პროექტი შეჩერებულია: ახალი სტატიები და გამოშვებები აღარ გამოქვეყნდება. არქივი ხელმისაწვდომი რჩება.

დიდი ენობრივი მოდელები (LLM)

დიდი ენობრივი მოდელი (LLM) ხელოვნური ინტელექტის სისტემაა, რომელიც ვარჯიშდება უზარმაზარ ტექსტურ მონაცემებზე ადამიანის ენის გასაგებად და გენერირებისთვის. LLM-ები ამოძრავებს ChatGPT-ს, Claude-ს, Gemini-ს და თანამედროვე AI ასისტენტების უმეტესობას. ეს გვერდი აგროვებს სიახლეებსა და განმარტებებს იმის შესახებ, თუ როგორ მუშაობს LLM-ები, როგორ ვარჯიშდებიან ისინი და როგორ ედრებიან ერთმანეთს წამყვანი მოდელები.

გააერთიანეთ:

რა არის Code Arena — და როგორ ადგენს AI კოდირების მოდელების რეიტინგს?

Code Arena ცოცხალი პლატფორმაა, სადაც AI მოდელები გვერდიგვერდ ქმნიან რეალურ აპლიკაციებს, ხოლო ადამიანები აფასებენ შედეგებს — ასე იქმნება რეიტინგი, რომელსაც დეველოპერები კოდირების მოდელის ასარჩევად იყენებენ.

ვრცლად →

Alibaba-ს Qwen3.8-Max-0902-მა Code Arena-ს ლიდერბორდს სათავეში ჩაუდგა, Claude Opus 5-ს გაუსწრო

Alibaba-ს განახლებულმა Qwen3.8-Max-0902-მა Arena.ai-ის Code Arena კოდირების ლიდერბორდზე პირველი ადგილი დაიკავა და Anthropic-ის Claude Opus 5-ს მცირედით გაუსწრო.

ვრცლად →

რა არის ფუნქციის გამოძახება — და როგორ იყენებენ AI მოდელები ხელსაწყოებს?

ფუნქციის გამოძახება საშუალებას აძლევს AI მოდელებს, როგორიცაა ChatGPT და Claude, გასცდნენ საკუთარ სასწავლო მონაცემებს — მოძებნონ ინტერნეტში, გაუშვან კოდი ან მიმართონ მონაცემთა ბაზას — აპლიკაციის მიერ განსაზღვრული ხელსაწყოების გამოძახებით.

ვრცლად →

Anthropic-მა გამოუშვა Claude Fable 5.1 და Mythos 5.1

Anthropic-მა 1 სექტემბერს გამოუშვა Claude Fable 5.1 და Mythos 5.1 — ქეშ-წაკითხვის ფასი 75%-ით შემცირდა, ბენჩმარკებზე კი შედეგი Fable 5-თან შედარებით მკვეთრად გაუმჯობესდა.

ვრცლად →

Tencent-მა Hy4 Preview ღია კოდით გამოუშვა — 770-მილიარდპარამეტრიანი ფლაგმანი მოდელი

Tencent-ის Hunyuan გუნდმა ღია კოდით გამოუშვა Hy4 preview — 770 მილიარდი პარამეტრის მოდელი 1 მილიონ ტოკენამდე კონტექსტის ფანჯარით — რითაც ჩინეთის სწრაფად მზარდ ღია წონების AI რბოლას შეუერთდა.

ვრცლად →

Z.ai-მ იდუმალი მოდელი „Ox Alpha“ გაამხილა — ის GLM-5.3-Flash აღმოჩნდა

ჩინურმა კომპანია Z.ai-მ დაადასტურა, რომ მისი ანონიმური მოდელი „Ox Alpha“ სინამდვილეში მულტიმოდალური GLM-5.3-Flash იყო, და მისი ღია წონები MIT ლიცენზიით გამოაქვეყნა.

ვრცლად →

Thomson Reuters-მა გაუშვა თავისი იურიდიული AI მოდელი Thomson

Thomson Reuters-მა წარადგინა Thomson — საკუთარი AI მოდელი, გაწვრთნილი კომპანიის იურიდიულ და საინფორმაციო არქივებზე და აგებული Alibaba-ს ღია წონების Qwen მოდელზე; პირველად CoCounsel Legal-ის დოკუმენტების ანალიზში გამოიყენება.

ვრცლად →
ორი მონაცემთა ანოტატორი ამუშავებს სავარჯიშო მონაცემებს კომპიუტერზე — AI მონაცემთა ბაზების უკან მდგარი ადამიანური შრომის ილუსტრაცია

რა არის მონაცემთა ანოტირება — და რატომ სჭირდება ამისთვის AI-ს ჯერ კიდევ ადამიანი?

მონაცემთა ანოტირება არის ადამიანის შრომა, რომელიც ტექსტს, სურათებსა და აუდიოს იმ ინფორმაციით ნიშნავს, რომლის მეშვეობითაც მანქანური სწავლების მოდელი სწავლობს — და AI ამას ჯერ კიდევ სრულად ვერ აკეთებს დამოუკიდებლად.

ვრცლად →

ახალმა ტესტმა აჩვენა: AI მოდელები კვლევის იდეებს მხოლოდ 3–15%-ში აღადგენენ

ახალი საეტალონო ტესტი აჩვენებს, რომ შვიდმა წამყვანმა AI მოდელმა სამეცნიერო ნაშრომის ძირითადი იდეა მხოლოდ მისი ბიბლიოგრაფიის მიხედვით სულ რაღაც 3-15%-ში აღადგინა.

ვრცლად →

Nvidia-მ Nemotron 3.5 Lightning გამოუშვა — AI აგენტების ხარჯების შესამცირებლად

Nvidia-მ გამოუშვა ღია, 30-მილიარდპარამეტრიანი AI აგენტის მოდელი Nemotron 3.5 Lightning და როუთინგის სისტემა NeMo Switchyard, რომელიც ამოცანის ხარჯს Opus 4.8-ის მარტო გამოყენებასთან შედარებით სამჯერ ამცირებს.

ვრცლად →

DeepSeek-მა API-ის ფასები პიკის ტარიფით 12-ჯერამდე გაზარდა

DeepSeek 16 აგვისტოდან შემოიღებს API-ის პიკურ და არაპიკურ ტარიფებს — ზოგიერთი DeepSeek-V4-Pro-ს ფასი მზარდი მოთხოვნის გამო 12-ჯერამდე გაიზრდება.

ვრცლად →

DeepSeek-მა ჩუმად გამოუშვა V4 Pro 0813 — შედეგები არაერთგვაროვანია

DeepSeek-ის წამყვანი მოდელი 12 აგვისტოს პრევიუდან გამოვიდა — მკვეთრად გაუმჯობესდა კოდირებისა და აგენტული დავალებების შედეგები, თუმცა ზოგადი მსჯელობის ტესტებში შედეგი საშუალოა, და ეს ყველაფერი ოფიციალური განცხადების გარეშე მოხდა.

ვრცლად →

OpenAI-ის GPT-5.6-Cyber „მაღალ“ კიბერზღვარს მიაღწია

OpenAI-მ გამოუშვა GPT-5.6-Cyber — შეზღუდული წვდომის მოდელი შემოწმებული უსაფრთხოების მკვლევრებისთვის, რომელსაც კომპანია კიბერშესაძლებლობებში „მაღალ“ დონედ აფასებს — ეს „კრიტიკულ“ ზღვარს მხოლოდ ერთი საფეხურით ჩამორჩება.

ვრცლად →
ხის საათი ქვიშით, რომელიც დროში ფიქსირებულ მომენტს განასახიერებს

რა არის ცოდნის ზღვრული თარიღი — და რატომ არ იცის AI-ს უახლესი მოვლენები?

ცოდნის ზღვრული თარიღი არის მომენტი, რომლის შემდეგაც AI მოდელს ახალი მონაცემები აღარ ასწავლეს — აი, რატომ აქვს ეს ყველა ჩატბოტს და როგორ უვლის მას გვერდი.

ვრცლად →

Thinking Machines-მა Inkling-Small გამოუშვა — დიდ მოდელსაც სჯობნის

Thinking Machines Lab-ის მეორე ღია წონების მოდელი წინამორბედის აქტიური პარამეტრების მხოლოდ მეოთხედს იყენებს, თუმცა მსჯელობისა და კოდირების ტესტებში სჯობნის მას.

ვრცლად →

GPT-5.6 Sol-მა OpenAI-ის GPU ბირთვები თავად გადაწერა — ხარჯი 20%-ით შემცირდა

OpenAI-ის თქმით, მისმა GPT-5.6 Sol მოდელმა დამოუკიდებლად გადაწერა კომპანიის ინფერენსის ინფრასტრუქტურის GPU ბირთვები — მომსახურების ხარჯი 20%-ით შემცირდა და დაეხმარა Luna-ს დონის 80%-იან გაიაფებას.

ვრცლად →
OpenAI-ის ლოგო

რა არის ეტაპობრივი მსჯელობა (Chain-of-Thought) — და როგორ „ფიქრობს“ AI?

ეტაპობრივი მსჯელობა (Chain-of-Thought) არის ტექნიკა, რომლის დახმარებითაც AI მოდელი პასუხამდე ნაბიჯ-ნაბიჯ მსჯელობს — და სწორედ ეს უდევს საფუძვლად დღევანდელ მოწინავე „მსჯელობის“ მოდელებს.

ვრცლად →
Microsoft-ის ლოგო — კომპანია, რომელმაც შექმნა კიბერუსაფრთხოების AI მოდელი MAI-Cyber-1-Flash

რა არის კიბერუსაფრთხოების საბაზისო მოდელი — და რატომ აქვს მნიშვნელობა

სულ უფრო მეტი AI მოდელი მხოლოდ კიბერუსაფრთხოებისთვის ვარჯიშდება — პოულობს დაუცველობებს, პრიორიტეტს ანიჭებს გაფრთხილებებს და ახდენს თავდასხმების სიმულაციას. აი, რით განსხვავდებიან ისინი ჩვეულებრივი ჩატბოტისგან.

ვრცლად →
დიაგრამა, რომელიც აჩვენებს NLP ტექნიკების განვითარებას სიტყვათა ტომრიდან ტრანსფორმერებამდე

რა არის ბუნებრივი ენის დამუშავება (NLP) — და რით განსხვავდება ის LLM-ისგან?

NLP ხელოვნური ინტელექტის ათწლეულოვანი დარგია, რომელიც კომპიუტერს ასწავლის ადამიანური ენის გაგებასა და გენერირებას — სწორედ ამას აკეთებენ თანამედროვე LLM-ები, როგორიცაა ChatGPT.

ვრცლად →
მარტივი დიაგრამა, სადაც სიტყვები ვექტორულ სივრცეში წერტილების სახითაა განთავსებული — ილუსტრირებულია, თუ როგორ გამოსახავს ემბედინგი მნიშვნელობას გეომეტრიული მიმართებების საშუალებით.

რა არის ემბედინგები — და როგორ ეხმარებიან ისინი AI-ს მნიშვნელობის გაგებაში?

ემბედინგები სიტყვებს, სურათებსა და სხვა მონაცემებს რიცხვებად აქცევს, რომლებსაც კომპიუტერი ადარებს — ეს ტექნოლოგია დგას AI ძიების, რეკომენდაციებისა და ჩატბოტის მეხსიერების მიღმა.

ვრცლად →