ღია წონების მოდელებიდა AI კვლევა

AI ამბების ყველა სტატია, რომელიც ეხება თემებს ღია წონების მოდელები და AI კვლევა — ორივე მიმართულება ერთ გვერდზე, განახლებადი ახალი მასალის გამოქვეყნებისთანავე.

მონიშნული თეგები: ღია წონების მოდელები × AI კვლევა ×

16 სტატია

Thinking Machines-მა Inkling-Small გამოუშვა — დიდ მოდელსაც სჯობნის

Thinking Machines Lab-ის მეორე ღია წონების მოდელი წინამორბედის აქტიური პარამეტრების მხოლოდ მეოთხედს იყენებს, თუმცა მსჯელობისა და კოდირების ტესტებში სჯობნის მას.

ვრცლად →

Moonshot AI-მ Kimi K3 გამოუშვა — 2.8-ტრილიონპარამეტრიანი ღია მოდელი

ჩინურმა Moonshot AI-მ გამოუშვა Kimi K3 — 2.8-ტრილიონპარამეტრიანი ღია მოდელი 1 მილიონ ტოკენამდე საკონტექსტო ფანჯრით, რომელსაც კომპანია მსოფლიოში პირველ ღია 3-ტრილიონიან-კლასის AI მოდელად მოიხსენიებს.

ვრცლად →

PrismML-მა Bonsai 27B გამოუშვა — პირველი 27-მილიარდიანი AI მოდელი სმარტფონისთვის

PrismML-მა გამოუშვა Bonsai 27B — 27-მილიარდპარამეტრიანი ღია წონების მოდელი, შეკუმშული 4GB-მდე, რომელიც სმარტფონზეც მუშაობს და თითქმის მთლიან შესაძლებლობებს ინარჩუნებს.

ვრცლად →

Thinking Machines Lab-მა Inkling გამოუშვა — ღია წონების AI მოდელი

მირა მურატის სტარტაპმა გამოუშვა Inkling — 975 მილიარდპარამეტრიანი ღია წონების მოდელი, რომელიც შექმნილია არა რეიტინგებში გამარჯვებისთვის, არამედ დეველოპერების მიერ მორგებისთვის.

ვრცლად →
DeepSeek-ის ლოგოს ხატულა

რა არის DeepSeek? ჩინური AI ლაბორატორია, რომელმაც სილიკონის ველი შეაშფოთა

DeepSeek — ჩინური AI ლაბორატორიაა, რომლის იაფად გაწვრთნილმა, ღია წონების მოდელებმა Nvidia-ს აქციები ისტორიულად დასცა და ინდუსტრიის ხედვა AI-ხარჯებზე შეცვალა.

ვრცლად →

რა არის GLM — Zhipu AI-ის ღია წონების მოდელების ოჯახი

GLM არის ჩინური ლაბორატორია Zhipu AI-ის (Z.ai) ღია წონების AI მოდელების ოჯახი — უფასოდ გადმოსაწერი და თვითჰოსტინგისთვის ხელმისაწვდომი, რომელიც წამყვან ამერიკულ მოდელებს API-ის ფასის მეექვსედად ეჯიბრება.

ვრცლად →

ჩინეთის GLM-5.2 ამერიკის წამყვან AI-ს ექვსჯერ დაბალ ფასად ეჯიბრება

Z.ai-მ გამოუშვა GLM-5.2 — 744-მილიარდ-პარამეტრიანი ღია კოდის მოდელი, რომელიც GPT-5.5-ს ბევრ ტესტში ჯობნის და Claude Opus 4.8-ს მხოლოდ მცირე ზღვრით ჩამოუვარდება, ნვიდიას ჩიპების გარეშე.

ვრცლად →

Mistral-მა Leanstral 1.5 გამოუშვა — მათემატიკური თეორემებისა და კოდის ვერიფიკაციის ავტომატიზაცია

Mistral-ის ახალი ღია კოდის მოდელი Lean 4-ში ფორმალურ ვერიფიკაციას ავტომატიზებს: miniF2F-ზე 100%, კომპლექსური თეორემების 87% ამოხსნილი, 5 უცნობი შეცდომა კოდბაზებში — ამოცანაზე $4-ად.

ვრცლად →

Meituan-მა LongCat-2.0 გამოაქვეყნა — ფრონტიერ-კლასის AI მოდელი ჩინური ჩიპებით

ჩინურმა ტექნოლოგიურმა კომპანია Meituan-მა LongCat-2.0 MIT ლიცენზიით გამოაქვეყნა — 1,6 ტრილიონი პარამეტრის AI მოდელი, რომელიც მხოლოდ ჩინური ჩიპებით გავარჯიშდა და ფრონტიერ-კლასის ღია კოდის მოდელებს შეუერთდა.

ვრცლად →

რა არის ღია წონების AI მოდელი — და რით განსხვავდება დახურული AI-სგან?

ღია წონების AI მოდელები პარამეტრებს საჯაროდ ავრცელებენ, ასე რომ ნებისმიერს შეუძლია მათი გადმოწერა, გაშვება ან მორგება — განსხვავებით GPT-4 ან Gemini-სგანი, რომლებიც მხოლოდ ფასიანი API-ის გავლით ხელმისაწვდომია. აი, რას ნიშნავს ეს განსხვავება პრაქტიკაში.

ვრცლად →

ჩინური Z.ai-ს GLM-5.2 ამერიკული AI-ის ექვსჯერ იაფად ეჯიბრება

ბეიჯინგის სტარტაპ Z.ai-ს მოდელი GLM-5.2, 16 ივნისს გამოშვებული, კოდირების ტესტებში Claude Opus 4.8-სა და GPT-5.5-ის ტოლ-ღირსია, API-ის ფასი კი ექვსჯერ ნაკლებია.

ვრცლად →

Alibaba-მ Qwen-AgentWorld გამოაქვეყნა — AI აგენტების გარემოს სიმულაციის ახალი მოდელი

Alibaba-ს Qwen-ის გუნდმა გამოაქვეყნა ენობრივი მსოფლიო მოდელი, რომელიც AI აგენტებისთვის შვიდ სხვადასხვა გარემოს სიმულაციას ახდენს — გარეშე რეალური სისტემებისა.

ვრცლად →

Liquid AI-მ ონ-დივაის AI აგენტებისთვის 230M-პარამეტრიანი ღია მოდელი გამოუშვა

Liquid AI-მ გამოუშვა LFM2.5-230M — 230 მილიონ-პარამეტრიანი ღია წვდომის მოდელი, რომელიც სმარტფონის პროცესორზე 213 ტოკენს ამუშავებს წამში და Raspberry Pi-ზე — 42-ს. ღრუბლოვანი სერვისი არ სჭირდება.

ვრცლად →

Zhipu AI-ის GLM-5.2 კოდირებაში GPT-5.5-ს სჯობს — ფასი კი ექვსჯერ ნაკლებია

ჩინური AI ლაბორატორია Zhipu AI-მ MIT-ლიცენზიით გამოუშვა GLM-5.2 — 753 მილიარდი პარამეტრის ღია მოდელი, რომელიც OpenAI-ის GPT-5.5-ს პროგრამირების ტესტებში სჯობს და ფასადაც მნიშვნელოვნად იაფია.

ვრცლად →

Alibaba-ს ღია AI სამყაროს მოდელმა GPT-5.4 გადააჭარბა

Alibaba-ს Qwen-ის გუნდმა გამოაქვეყნა Qwen-AgentWorld — ღია კოდის ენობრივი სამყაროს მოდელების ოჯახი, რომელიც AI აგენტების ქმედებებზე ციფრული გარემოს რეაქციებს პროგნოზირებს. 397B-ის ვარიანტმა AgentWorldBench-ზე GPT-5.4 გადააჭარბა.

ვრცლად →

Reflection AI-მა SpaceX-თან $6.3 მილიარდიანი გარიგება გააფორმა ღია AI მოდელების შესაქმნელად

Google DeepMind-ის ყოფილი მკვლევრების მიერ დაფუძნებულმა სტარტაპმა SpaceX-ის Colossus მონაცემთა ცენტრთან სამწლიანი, $6.3 მილიარდიანი კომპიუტინგ-ხელშეკრულება გააფორმა — ეს მას ფრონტალური ღია AI მოდელების შექმნის შესაძლებლობას მისცემს.

ვრცლად →