პროექტი შეჩერებულია: ახალი სტატიები და გამოშვებები აღარ გამოქვეყნდება. არქივი ხელმისაწვდომი რჩება.

ხელოვნური ინტელექტიდა დიდი ენობრივი მოდელები (LLM)

AI ამბების ყველა სტატია, რომელიც ეხება თემებს ხელოვნური ინტელექტი და დიდი ენობრივი მოდელები (LLM) — ორივე მიმართულება ერთ გვერდზე, განახლებადი ახალი მასალის გამოქვეყნებისთანავე.

მონიშნული თეგები: ხელოვნური ინტელექტი × დიდი ენობრივი მოდელები (LLM) ×

37 სტატია

Z.ai-მ იდუმალი მოდელი „Ox Alpha“ გაამხილა — ის GLM-5.3-Flash აღმოჩნდა

ჩინურმა კომპანია Z.ai-მ დაადასტურა, რომ მისი ანონიმური მოდელი „Ox Alpha“ სინამდვილეში მულტიმოდალური GLM-5.3-Flash იყო, და მისი ღია წონები MIT ლიცენზიით გამოაქვეყნა.

ვრცლად →

Thomson Reuters-მა გაუშვა თავისი იურიდიული AI მოდელი Thomson

Thomson Reuters-მა წარადგინა Thomson — საკუთარი AI მოდელი, გაწვრთნილი კომპანიის იურიდიულ და საინფორმაციო არქივებზე და აგებული Alibaba-ს ღია წონების Qwen მოდელზე; პირველად CoCounsel Legal-ის დოკუმენტების ანალიზში გამოიყენება.

ვრცლად →
ორი მონაცემთა ანოტატორი ამუშავებს სავარჯიშო მონაცემებს კომპიუტერზე — AI მონაცემთა ბაზების უკან მდგარი ადამიანური შრომის ილუსტრაცია

რა არის მონაცემთა ანოტირება — და რატომ სჭირდება ამისთვის AI-ს ჯერ კიდევ ადამიანი?

მონაცემთა ანოტირება არის ადამიანის შრომა, რომელიც ტექსტს, სურათებსა და აუდიოს იმ ინფორმაციით ნიშნავს, რომლის მეშვეობითაც მანქანური სწავლების მოდელი სწავლობს — და AI ამას ჯერ კიდევ სრულად ვერ აკეთებს დამოუკიდებლად.

ვრცლად →

ახალმა ტესტმა აჩვენა: AI მოდელები კვლევის იდეებს მხოლოდ 3–15%-ში აღადგენენ

ახალი საეტალონო ტესტი აჩვენებს, რომ შვიდმა წამყვანმა AI მოდელმა სამეცნიერო ნაშრომის ძირითადი იდეა მხოლოდ მისი ბიბლიოგრაფიის მიხედვით სულ რაღაც 3-15%-ში აღადგინა.

ვრცლად →

Nvidia-მ Nemotron 3.5 Lightning გამოუშვა — AI აგენტების ხარჯების შესამცირებლად

Nvidia-მ გამოუშვა ღია, 30-მილიარდპარამეტრიანი AI აგენტის მოდელი Nemotron 3.5 Lightning და როუთინგის სისტემა NeMo Switchyard, რომელიც ამოცანის ხარჯს Opus 4.8-ის მარტო გამოყენებასთან შედარებით სამჯერ ამცირებს.

ვრცლად →

DeepSeek-მა API-ის ფასები პიკის ტარიფით 12-ჯერამდე გაზარდა

DeepSeek 16 აგვისტოდან შემოიღებს API-ის პიკურ და არაპიკურ ტარიფებს — ზოგიერთი DeepSeek-V4-Pro-ს ფასი მზარდი მოთხოვნის გამო 12-ჯერამდე გაიზრდება.

ვრცლად →

DeepSeek-მა ჩუმად გამოუშვა V4 Pro 0813 — შედეგები არაერთგვაროვანია

DeepSeek-ის წამყვანი მოდელი 12 აგვისტოს პრევიუდან გამოვიდა — მკვეთრად გაუმჯობესდა კოდირებისა და აგენტული დავალებების შედეგები, თუმცა ზოგადი მსჯელობის ტესტებში შედეგი საშუალოა, და ეს ყველაფერი ოფიციალური განცხადების გარეშე მოხდა.

ვრცლად →

OpenAI-ის GPT-5.6-Cyber „მაღალ“ კიბერზღვარს მიაღწია

OpenAI-მ გამოუშვა GPT-5.6-Cyber — შეზღუდული წვდომის მოდელი შემოწმებული უსაფრთხოების მკვლევრებისთვის, რომელსაც კომპანია კიბერშესაძლებლობებში „მაღალ“ დონედ აფასებს — ეს „კრიტიკულ“ ზღვარს მხოლოდ ერთი საფეხურით ჩამორჩება.

ვრცლად →
ხის საათი ქვიშით, რომელიც დროში ფიქსირებულ მომენტს განასახიერებს

რა არის ცოდნის ზღვრული თარიღი — და რატომ არ იცის AI-ს უახლესი მოვლენები?

ცოდნის ზღვრული თარიღი არის მომენტი, რომლის შემდეგაც AI მოდელს ახალი მონაცემები აღარ ასწავლეს — აი, რატომ აქვს ეს ყველა ჩატბოტს და როგორ უვლის მას გვერდი.

ვრცლად →

Thinking Machines-მა Inkling-Small გამოუშვა — დიდ მოდელსაც სჯობნის

Thinking Machines Lab-ის მეორე ღია წონების მოდელი წინამორბედის აქტიური პარამეტრების მხოლოდ მეოთხედს იყენებს, თუმცა მსჯელობისა და კოდირების ტესტებში სჯობნის მას.

ვრცლად →

GPT-5.6 Sol-მა OpenAI-ის GPU ბირთვები თავად გადაწერა — ხარჯი 20%-ით შემცირდა

OpenAI-ის თქმით, მისმა GPT-5.6 Sol მოდელმა დამოუკიდებლად გადაწერა კომპანიის ინფერენსის ინფრასტრუქტურის GPU ბირთვები — მომსახურების ხარჯი 20%-ით შემცირდა და დაეხმარა Luna-ს დონის 80%-იან გაიაფებას.

ვრცლად →
OpenAI-ის ლოგო

რა არის ეტაპობრივი მსჯელობა (Chain-of-Thought) — და როგორ „ფიქრობს“ AI?

ეტაპობრივი მსჯელობა (Chain-of-Thought) არის ტექნიკა, რომლის დახმარებითაც AI მოდელი პასუხამდე ნაბიჯ-ნაბიჯ მსჯელობს — და სწორედ ეს უდევს საფუძვლად დღევანდელ მოწინავე „მსჯელობის“ მოდელებს.

ვრცლად →
Microsoft-ის ლოგო — კომპანია, რომელმაც შექმნა კიბერუსაფრთხოების AI მოდელი MAI-Cyber-1-Flash

რა არის კიბერუსაფრთხოების საბაზისო მოდელი — და რატომ აქვს მნიშვნელობა

სულ უფრო მეტი AI მოდელი მხოლოდ კიბერუსაფრთხოებისთვის ვარჯიშდება — პოულობს დაუცველობებს, პრიორიტეტს ანიჭებს გაფრთხილებებს და ახდენს თავდასხმების სიმულაციას. აი, რით განსხვავდებიან ისინი ჩვეულებრივი ჩატბოტისგან.

ვრცლად →
დიაგრამა, რომელიც აჩვენებს NLP ტექნიკების განვითარებას სიტყვათა ტომრიდან ტრანსფორმერებამდე

რა არის ბუნებრივი ენის დამუშავება (NLP) — და რით განსხვავდება ის LLM-ისგან?

NLP ხელოვნური ინტელექტის ათწლეულოვანი დარგია, რომელიც კომპიუტერს ასწავლის ადამიანური ენის გაგებასა და გენერირებას — სწორედ ამას აკეთებენ თანამედროვე LLM-ები, როგორიცაა ChatGPT.

ვრცლად →
მარტივი დიაგრამა, სადაც სიტყვები ვექტორულ სივრცეში წერტილების სახითაა განთავსებული — ილუსტრირებულია, თუ როგორ გამოსახავს ემბედინგი მნიშვნელობას გეომეტრიული მიმართებების საშუალებით.

რა არის ემბედინგები — და როგორ ეხმარებიან ისინი AI-ს მნიშვნელობის გაგებაში?

ემბედინგები სიტყვებს, სურათებსა და სხვა მონაცემებს რიცხვებად აქცევს, რომლებსაც კომპიუტერი ადარებს — ეს ტექნოლოგია დგას AI ძიების, რეკომენდაციებისა და ჩატბოტის მეხსიერების მიღმა.

ვრცლად →
Poolside-ის კომპანიის ლოგო

რა არის Poolside — Laguna კოდირების მოდელების შემქმნელი სტარტაპი?

Poolside სტარტაპია, რომელიც კოდის დასაწერად და გასასწორებლად გაწვრთნილ AI მოდელებს ქმნის და შემდეგ უფასოდ აქვეყნებს. აი, ვინ დგას მის უკან და როგორ მუშაობს მისი მოდელები.

ვრცლად →
ჩადგმული წრეების დიაგრამა, სადაც ღრმა სწავლება მანქანურ სწავლებაშია მოქცეული, ეს კი — ხელოვნურ ინტელექტში

რა არის საბაზისო მოდელი — და რით განსხვავდება LLM-ისგან?

საბაზისო მოდელი დიდი AI სისტემაა, გაწვრთნილი ფართო მონაცემებზე და მორგებადი ბევრ სხვადასხვა ამოცანაზე — საფუძველი, რომელზეც დგას ჩატბოტები, სურათების გენერატორები და კოდირების ხელსაწყოები.

ვრცლად →
Anthropic-ის ლოგო-წარწერა

რა არის Claude Opus 5 — Anthropic-ის იაფი, მოწინავე AI მოდელი

Claude Opus 5 — Anthropic-ის ახალი შუალედური დონის AI მოდელია, რომელიც წამყვან Fable 5-ს შესრულებით უახლოვდება, ტოკენის ორჯერ დაბალ ფასად. აი, რა არის ეს და რა ღირს.

ვრცლად →
კოლაბორაციული რობოტის მკლავი — ტიპის მოწყობილობა, რომელსაც vision-language-action AI მოდელები მართავენ

რა არის Vision-Language-Action (VLA) მოდელი — და რატომ აქვს მნიშვნელობა?

Vision-language-action (VLA) მოდელი კამერის გამოსახულებასა და მარტივ ინსტრუქციას პირდაპირ რობოტის მოძრაობად გარდაქმნის, რითაც ცალკეულ აღქმისა და მართვის სისტემებს ერთი მოდელით ანაცვლებს.

ვრცლად →
Anthropic-ის ლოგო ნეიტრალურ ფონზე

რა არის Claude Fable 5? — Anthropic-ის წამყვანი AI მოდელი

Claude Fable 5 — Anthropic-ის ყველაზე მძლავრი საჯაროდ ხელმისაწვდომი AI მოდელია. ქვემოთ ავხსნით, თუ რა არის ის, რით განსხვავდება Claude Mythos 5-სგან და რა ღირს მისი გამოყენება.

ვრცლად →