პროექტი შეჩერებულია: ახალი სტატიები და გამოშვებები აღარ გამოქვეყნდება. არქივი ხელმისაწვდომი რჩება.

დიდი ენობრივი მოდელები (LLM)და სიახლეები

AI ამბების ყველა სტატია, რომელიც ეხება თემებს დიდი ენობრივი მოდელები (LLM) და სიახლეები — ორივე მიმართულება ერთ გვერდზე, განახლებადი ახალი მასალის გამოქვეყნებისთანავე.

მონიშნული თეგები: დიდი ენობრივი მოდელები (LLM) × სიახლეები ×

14 სტატია

Alibaba-ს Qwen3.8-Max-0902-მა Code Arena-ს ლიდერბორდს სათავეში ჩაუდგა, Claude Opus 5-ს გაუსწრო

Alibaba-ს განახლებულმა Qwen3.8-Max-0902-მა Arena.ai-ის Code Arena კოდირების ლიდერბორდზე პირველი ადგილი დაიკავა და Anthropic-ის Claude Opus 5-ს მცირედით გაუსწრო.

ვრცლად →

Anthropic-მა გამოუშვა Claude Fable 5.1 და Mythos 5.1

Anthropic-მა 1 სექტემბერს გამოუშვა Claude Fable 5.1 და Mythos 5.1 — ქეშ-წაკითხვის ფასი 75%-ით შემცირდა, ბენჩმარკებზე კი შედეგი Fable 5-თან შედარებით მკვეთრად გაუმჯობესდა.

ვრცლად →

Tencent-მა Hy4 Preview ღია კოდით გამოუშვა — 770-მილიარდპარამეტრიანი ფლაგმანი მოდელი

Tencent-ის Hunyuan გუნდმა ღია კოდით გამოუშვა Hy4 preview — 770 მილიარდი პარამეტრის მოდელი 1 მილიონ ტოკენამდე კონტექსტის ფანჯარით — რითაც ჩინეთის სწრაფად მზარდ ღია წონების AI რბოლას შეუერთდა.

ვრცლად →

Z.ai-მ იდუმალი მოდელი „Ox Alpha“ გაამხილა — ის GLM-5.3-Flash აღმოჩნდა

ჩინურმა კომპანია Z.ai-მ დაადასტურა, რომ მისი ანონიმური მოდელი „Ox Alpha“ სინამდვილეში მულტიმოდალური GLM-5.3-Flash იყო, და მისი ღია წონები MIT ლიცენზიით გამოაქვეყნა.

ვრცლად →

Thomson Reuters-მა გაუშვა თავისი იურიდიული AI მოდელი Thomson

Thomson Reuters-მა წარადგინა Thomson — საკუთარი AI მოდელი, გაწვრთნილი კომპანიის იურიდიულ და საინფორმაციო არქივებზე და აგებული Alibaba-ს ღია წონების Qwen მოდელზე; პირველად CoCounsel Legal-ის დოკუმენტების ანალიზში გამოიყენება.

ვრცლად →

ახალმა ტესტმა აჩვენა: AI მოდელები კვლევის იდეებს მხოლოდ 3–15%-ში აღადგენენ

ახალი საეტალონო ტესტი აჩვენებს, რომ შვიდმა წამყვანმა AI მოდელმა სამეცნიერო ნაშრომის ძირითადი იდეა მხოლოდ მისი ბიბლიოგრაფიის მიხედვით სულ რაღაც 3-15%-ში აღადგინა.

ვრცლად →

Nvidia-მ Nemotron 3.5 Lightning გამოუშვა — AI აგენტების ხარჯების შესამცირებლად

Nvidia-მ გამოუშვა ღია, 30-მილიარდპარამეტრიანი AI აგენტის მოდელი Nemotron 3.5 Lightning და როუთინგის სისტემა NeMo Switchyard, რომელიც ამოცანის ხარჯს Opus 4.8-ის მარტო გამოყენებასთან შედარებით სამჯერ ამცირებს.

ვრცლად →

DeepSeek-მა API-ის ფასები პიკის ტარიფით 12-ჯერამდე გაზარდა

DeepSeek 16 აგვისტოდან შემოიღებს API-ის პიკურ და არაპიკურ ტარიფებს — ზოგიერთი DeepSeek-V4-Pro-ს ფასი მზარდი მოთხოვნის გამო 12-ჯერამდე გაიზრდება.

ვრცლად →

DeepSeek-მა ჩუმად გამოუშვა V4 Pro 0813 — შედეგები არაერთგვაროვანია

DeepSeek-ის წამყვანი მოდელი 12 აგვისტოს პრევიუდან გამოვიდა — მკვეთრად გაუმჯობესდა კოდირებისა და აგენტული დავალებების შედეგები, თუმცა ზოგადი მსჯელობის ტესტებში შედეგი საშუალოა, და ეს ყველაფერი ოფიციალური განცხადების გარეშე მოხდა.

ვრცლად →

OpenAI-ის GPT-5.6-Cyber „მაღალ“ კიბერზღვარს მიაღწია

OpenAI-მ გამოუშვა GPT-5.6-Cyber — შეზღუდული წვდომის მოდელი შემოწმებული უსაფრთხოების მკვლევრებისთვის, რომელსაც კომპანია კიბერშესაძლებლობებში „მაღალ“ დონედ აფასებს — ეს „კრიტიკულ“ ზღვარს მხოლოდ ერთი საფეხურით ჩამორჩება.

ვრცლად →

Thinking Machines-მა Inkling-Small გამოუშვა — დიდ მოდელსაც სჯობნის

Thinking Machines Lab-ის მეორე ღია წონების მოდელი წინამორბედის აქტიური პარამეტრების მხოლოდ მეოთხედს იყენებს, თუმცა მსჯელობისა და კოდირების ტესტებში სჯობნის მას.

ვრცლად →

GPT-5.6 Sol-მა OpenAI-ის GPU ბირთვები თავად გადაწერა — ხარჯი 20%-ით შემცირდა

OpenAI-ის თქმით, მისმა GPT-5.6 Sol მოდელმა დამოუკიდებლად გადაწერა კომპანიის ინფერენსის ინფრასტრუქტურის GPU ბირთვები — მომსახურების ხარჯი 20%-ით შემცირდა და დაეხმარა Luna-ს დონის 80%-იან გაიაფებას.

ვრცლად →

Alibaba-მ Qwen3.8-Max გამოაცხადა — 2.4-ტრილიონპარამეტრიანი AI მოდელი

Alibaba-მ წარადგინა Qwen3.8-Max — 2.4-ტრილიონპარამეტრიანი მულტიმოდალური მოდელი, რომელსაც კომპანია Anthropic-ის Claude-ის შემდეგ ყველაზე ძლიერად მოიხსენიებს, თუმცა ბენჩმარკები ჯერ არ გამოქვეყნებულა.

ვრცლად →

Fireworks AI-მ $1.5 მილიარდიანი Series D რაუნდი მოიზიდა, შეფასებამ $17.5 მილიარდს მიაღწია

Fireworks AI-მ $1.5 მილიარდიანი Series D რაუნდი $17.5 მილიარდიან შეფასებაზე დახურა — კომპანიის თქმით, პლატფორმა დღეში 40 ტრილიონზე მეტ ტოკენს ამუშავებს სპეციალიზებული ხელოვნური ინტელექტის მოდელებისთვის.

ვრცლად →