Z.ai-მ იდუმალი მოდელი „Ox Alpha“ გაამხილა — ის GLM-5.3-Flash აღმოჩნდა
ჩინურმა კომპანია Z.ai-მ დაადასტურა, რომ მისი ანონიმური მოდელი „Ox Alpha“ სინამდვილეში მულტიმოდალური GLM-5.3-Flash იყო, და მისი ღია წონები MIT ლიცენზიით გამოაქვეყნა.
ვრცლად →პროექტი შეჩერებულია: ახალი სტატიები და გამოშვებები აღარ გამოქვეყნდება. არქივი ხელმისაწვდომი რჩება.
დიდი ენობრივი მოდელი (LLM) ხელოვნური ინტელექტის სისტემაა, რომელიც ვარჯიშდება უზარმაზარ ტექსტურ მონაცემებზე ადამიანის ენის გასაგებად და გენერირებისთვის. LLM-ები ამოძრავებს ChatGPT-ს, Claude-ს, Gemini-ს და თანამედროვე AI ასისტენტების უმეტესობას. ეს გვერდი აგროვებს სიახლეებსა და განმარტებებს იმის შესახებ, თუ როგორ მუშაობს LLM-ები, როგორ ვარჯიშდებიან ისინი და როგორ ედრებიან ერთმანეთს წამყვანი მოდელები.
ჩინურმა კომპანია Z.ai-მ დაადასტურა, რომ მისი ანონიმური მოდელი „Ox Alpha“ სინამდვილეში მულტიმოდალური GLM-5.3-Flash იყო, და მისი ღია წონები MIT ლიცენზიით გამოაქვეყნა.
ვრცლად →Thomson Reuters-მა წარადგინა Thomson — საკუთარი AI მოდელი, გაწვრთნილი კომპანიის იურიდიულ და საინფორმაციო არქივებზე და აგებული Alibaba-ს ღია წონების Qwen მოდელზე; პირველად CoCounsel Legal-ის დოკუმენტების ანალიზში გამოიყენება.
ვრცლად →
მონაცემთა ანოტირება არის ადამიანის შრომა, რომელიც ტექსტს, სურათებსა და აუდიოს იმ ინფორმაციით ნიშნავს, რომლის მეშვეობითაც მანქანური სწავლების მოდელი სწავლობს — და AI ამას ჯერ კიდევ სრულად ვერ აკეთებს დამოუკიდებლად.
ვრცლად →ახალი საეტალონო ტესტი აჩვენებს, რომ შვიდმა წამყვანმა AI მოდელმა სამეცნიერო ნაშრომის ძირითადი იდეა მხოლოდ მისი ბიბლიოგრაფიის მიხედვით სულ რაღაც 3-15%-ში აღადგინა.
ვრცლად →
GPT არის OpenAI-ის ენობრივი მოდელების ოჯახი; ChatGPT კი — მასზე აგებული ჩატბოტი. აი, რით განსხვავდება "ძრავა" პროდუქტისგან.
ვრცლად →Nvidia-მ გამოუშვა ღია, 30-მილიარდპარამეტრიანი AI აგენტის მოდელი Nemotron 3.5 Lightning და როუთინგის სისტემა NeMo Switchyard, რომელიც ამოცანის ხარჯს Opus 4.8-ის მარტო გამოყენებასთან შედარებით სამჯერ ამცირებს.
ვრცლად →DeepSeek 16 აგვისტოდან შემოიღებს API-ის პიკურ და არაპიკურ ტარიფებს — ზოგიერთი DeepSeek-V4-Pro-ს ფასი მზარდი მოთხოვნის გამო 12-ჯერამდე გაიზრდება.
ვრცლად →DeepSeek-ის წამყვანი მოდელი 12 აგვისტოს პრევიუდან გამოვიდა — მკვეთრად გაუმჯობესდა კოდირებისა და აგენტული დავალებების შედეგები, თუმცა ზოგადი მსჯელობის ტესტებში შედეგი საშუალოა, და ეს ყველაფერი ოფიციალური განცხადების გარეშე მოხდა.
ვრცლად →OpenAI-მ გამოუშვა GPT-5.6-Cyber — შეზღუდული წვდომის მოდელი შემოწმებული უსაფრთხოების მკვლევრებისთვის, რომელსაც კომპანია კიბერშესაძლებლობებში „მაღალ“ დონედ აფასებს — ეს „კრიტიკულ“ ზღვარს მხოლოდ ერთი საფეხურით ჩამორჩება.
ვრცლად →
ცოდნის ზღვრული თარიღი არის მომენტი, რომლის შემდეგაც AI მოდელს ახალი მონაცემები აღარ ასწავლეს — აი, რატომ აქვს ეს ყველა ჩატბოტს და როგორ უვლის მას გვერდი.
ვრცლად →Thinking Machines Lab-ის მეორე ღია წონების მოდელი წინამორბედის აქტიური პარამეტრების მხოლოდ მეოთხედს იყენებს, თუმცა მსჯელობისა და კოდირების ტესტებში სჯობნის მას.
ვრცლად →OpenAI-ის თქმით, მისმა GPT-5.6 Sol მოდელმა დამოუკიდებლად გადაწერა კომპანიის ინფერენსის ინფრასტრუქტურის GPU ბირთვები — მომსახურების ხარჯი 20%-ით შემცირდა და დაეხმარა Luna-ს დონის 80%-იან გაიაფებას.
ვრცლად →
ეტაპობრივი მსჯელობა (Chain-of-Thought) არის ტექნიკა, რომლის დახმარებითაც AI მოდელი პასუხამდე ნაბიჯ-ნაბიჯ მსჯელობს — და სწორედ ეს უდევს საფუძვლად დღევანდელ მოწინავე „მსჯელობის“ მოდელებს.
ვრცლად →
სულ უფრო მეტი AI მოდელი მხოლოდ კიბერუსაფრთხოებისთვის ვარჯიშდება — პოულობს დაუცველობებს, პრიორიტეტს ანიჭებს გაფრთხილებებს და ახდენს თავდასხმების სიმულაციას. აი, რით განსხვავდებიან ისინი ჩვეულებრივი ჩატბოტისგან.
ვრცლად →
NLP ხელოვნური ინტელექტის ათწლეულოვანი დარგია, რომელიც კომპიუტერს ასწავლის ადამიანური ენის გაგებასა და გენერირებას — სწორედ ამას აკეთებენ თანამედროვე LLM-ები, როგორიცაა ChatGPT.
ვრცლად →
ემბედინგები სიტყვებს, სურათებსა და სხვა მონაცემებს რიცხვებად აქცევს, რომლებსაც კომპიუტერი ადარებს — ეს ტექნოლოგია დგას AI ძიების, რეკომენდაციებისა და ჩატბოტის მეხსიერების მიღმა.
ვრცლად →
Poolside სტარტაპია, რომელიც კოდის დასაწერად და გასასწორებლად გაწვრთნილ AI მოდელებს ქმნის და შემდეგ უფასოდ აქვეყნებს. აი, ვინ დგას მის უკან და როგორ მუშაობს მისი მოდელები.
ვრცლად →
საბაზისო მოდელი დიდი AI სისტემაა, გაწვრთნილი ფართო მონაცემებზე და მორგებადი ბევრ სხვადასხვა ამოცანაზე — საფუძველი, რომელზეც დგას ჩატბოტები, სურათების გენერატორები და კოდირების ხელსაწყოები.
ვრცლად →
Claude Opus 5 — Anthropic-ის ახალი შუალედური დონის AI მოდელია, რომელიც წამყვან Fable 5-ს შესრულებით უახლოვდება, ტოკენის ორჯერ დაბალ ფასად. აი, რა არის ეს და რა ღირს.
ვრცლად →
Vision-language-action (VLA) მოდელი კამერის გამოსახულებასა და მარტივ ინსტრუქციას პირდაპირ რობოტის მოძრაობად გარდაქმნის, რითაც ცალკეულ აღქმისა და მართვის სისტემებს ერთი მოდელით ანაცვლებს.
ვრცლად →
Claude Fable 5 — Anthropic-ის ყველაზე მძლავრი საჯაროდ ხელმისაწვდომი AI მოდელია. ქვემოთ ავხსნით, თუ რა არის ის, რით განსხვავდება Claude Mythos 5-სგან და რა ღირს მისი გამოყენება.
ვრცლად →