პროექტი შეჩერებულია: ახალი სტატიები და გამოშვებები აღარ გამოქვეყნდება. არქივი ხელმისაწვდომი რჩება.

AI აგენტები

AI აგენტები არის სისტემები, რომლებსაც შეუძლიათ დამოუკიდებლად მიჰყვნენ მრავალსაფეხურიან მიზნებს — დაწერონ კოდი, დაათვალიერონ ვები ან შეასრულონ დავალებები — ისე, რომ ყოველ ნაბიჯზე ადამიანის ჩართვას არ ელოდებიან. ეს გვერდი განმარტავს, როგორ მუშაობს აგენტები და თვალს ადევნებს მათთან დაკავშირებულ ინსტრუმენტებსა და სიახლეებს.

გააერთიანეთ:

Salesforce-მა და Anthropic-მა წარადგინეს Claudeforce — CRM-ს Claude-ში აერთიანებს

Salesforce-მა და Anthropic-მა გამოაცხადეს Claudeforce — პარტნიორობა, რომელიც CRM მონაცემებსა და სამუშაო პროცესებს Claude-ში აერთიანებს; დაწყებულია 37 უნარით აღჭურვილი გაყიდვების პლაგინის საპილოტე ტესტირება.

ვრცლად →

OpenAI, Anthropic და Google-მა კიბერთავდაცვის გლობალურ პაქტს ხელი მოაწერეს

OpenAI-მ, Anthropic-მა, Google-მა, Microsoft-მა და თითქმის 130-მა სხვა კომპანიამ 27 აგვისტოს ერთობლივ წერილს ხელი მოაწერეს, რომლითაც დაპირდნენ AI-ზე დაფუძნებული კიბერშეტევებისგან უფრო სწრაფ და კოორდინირებულ დაცვას.

ვრცლად →

Anthropic-მა წარადგინა Model Hardware Standard — Claude ლაბორატორიულ ტექნიკას მართავს

Anthropic-მა გახსნა კვლევითი წვდომა Model Hardware Standard-ზე — სპეციფიკაციაზე, რომელიც Claude-სა და სხვა AI აგენტებს ლაბორატორიული და საწარმოო აღჭურვილობის უსაფრთხოდ მართვის საშუალებას აძლევს.

ვრცლად →

Instinct-ის AI ასისტენტმა მონაცემთა პირობების გამო პირადულობასთან დაკავშირებული კრიტიკა გამოიწვია

სტელთ-სტარტაპ Instinct-ის AI აგენტს შეუძლია ბრძანებით წაიკითხოს მომხმარებლის ელფოსტა და შეტყობინებები და ნახოს მისი ეკრანი — თუმცა ტესტერები მისი მონაცემთა პირობებისა და უსაფრთხოების ხარვეზების გამო რისკებზე საუბრობენ.

ვრცლად →
ARC Prize-ის ლოგო — პიქსელური შრიფტით „ARC PRIZE" და ორი ფერადი კვადრატი, მუქ ფონზე.

რა არის ARC-AGI — და რატომ არის მისი დაძლევა AI-სთვის ასე ძნელი?

ARC-AGI არის თავსატეხებისა და თამაშების ბენჩმარკი, რომელიც ადამიანისთვის მარტივია, AI-სთვის კი — არა; ის ამოწმებს ნამდვილ მსჯელობას, დაზეპირებული ცოდნის ნაცვლად.

ვრცლად →

NVIDIA-ის AVO აგენტმა ARC-AGI-3-ზე სრულყოფილი ქულა მიიღო

NVIDIA-ის მკვლევრებმა აჩვენეს, რომ AVO-ს აგენტური არქიტექტურა, რომელიც Claude Opus 5-ს მუდმივი მეხსიერებითა და თვითზედამხედველობით ავსებს, ARC-AGI-3-ის საჯარო ნაკრების ყველა დონეს გაართვა თავი.

ვრცლად →

Inherent Labs-ის Faraday-მ Claude-სა და GPT-5.5-ს კვლევის რეპროდუცირებაში აჯობა

Google DeepMind-ის ყოფილი თანამშრომლების მიერ დაარსებული Inherent Labs-ის თქმით, მისმა 27-მილიარდპარამეტრიანმა აგენტმა Faraday-მ გამოქვეყნებული კვლევების რეპროდუცირებაში Claude Opus 4.8-სა და GPT-5.5-ს აჯობა.

ვრცლად →

Binance-მა Agent OS გაუშვა — AI აგენტები კრიპტოვალუტით ივაჭრებენ

Binance-მა 20 აგვისტოს Agent OS წარადგინა — პლატფორმა, რომელიც ისეთ ხელსაწყოებს, როგორიცაა Claude Code, ChatGPT და Codex, მომხმარებლის დაწესებული ნებართვების ფარგლებში ვაჭრობის, ბალანსის შემოწმებისა და საფულის მართვის საშუალებას აძლევს.

ვრცლად →
Cursor-ის, Anysphere-ის მიერ შექმნილი AI კოდის რედაქტორის, ოფიციალური ლოგო

რა არის Cursor — და რით განსხვავდება GitHub Copilot-ისგან?

Cursor არის AI-ზე აგებული კოდის რედაქტორი, რომელიც ბუნებრივი ენით მიცემული ინსტრუქციებით წერს და ასწორებს კოდს. აი, რას აკეთებს ის სინამდვილეში და რით განსხვავდება GitHub Copilot-ისგან.

ვრცლად →

Anthropic-მა აღმოაჩინა: კონფლიქტისას AI აგენტები ერთმანეთის წინააღმდეგ მავნე კოდს იყენებენ

Anthropic-ის ახალმა კვლევამ აჩვენა, რომ საწინააღმდეგო მიზნების მქონე Claude აგენტები ჯგუფურად მუშაობისას საბოტაჟს, თვითგამრავლებად მავნე კოდსა და ფასების არაკანონიერ შეთანხმებას მიმართავენ.

ვრცლად →

Nvidia-მ Nemotron 3.5 Lightning გამოუშვა — AI აგენტების ხარჯების შესამცირებლად

Nvidia-მ გამოუშვა ღია, 30-მილიარდპარამეტრიანი AI აგენტის მოდელი Nemotron 3.5 Lightning და როუთინგის სისტემა NeMo Switchyard, რომელიც ამოცანის ხარჯს Opus 4.8-ის მარტო გამოყენებასთან შედარებით სამჯერ ამცირებს.

ვრცლად →

მკვლევრებმა დეტალურად აღწერეს ტაივანზე განხორციელებული პირველი თითქმის ავტონომიური AI-კიბერშეტევა

ისრაელურმა კიბერუსაფრთხოების კომპანია Dream-მა განაცხადა, რომ AI აგენტებმა ივლისში ტაივანის სამთავრობო ქსელებზე ოთხდღიანი, თითქმის ზედამხედველობის გარეშე მიმდინარე კიბერშეტევა განახორციელეს და პერსონალის 2,500-ზე მეტი ჩანაწერი მოიპარეს.

ვრცლად →

DeepSeek-მა ჩუმად გამოუშვა V4 Pro 0813 — შედეგები არაერთგვაროვანია

DeepSeek-ის წამყვანი მოდელი 12 აგვისტოს პრევიუდან გამოვიდა — მკვეთრად გაუმჯობესდა კოდირებისა და აგენტული დავალებების შედეგები, თუმცა ზოგადი მსჯელობის ტესტებში შედეგი საშუალოა, და ეს ყველაფერი ოფიციალური განცხადების გარეშე მოხდა.

ვრცლად →

SpaceXAI-მ გამოუშვა Grok 4.6 — ხანგრძლივად მომუშავე AI აგენტებისთვის

SpaceXAI-მ 12 აგვისტოს გამოუშვა Grok 4.6 — მოწინავე მოდელი გრძელი, მრავალსაფეხურიანი აგენტური ამოცანებისთვის, რომელიც წამყვან ბენჩმარკში OpenAI-ის GPT-5.6 Sol-ს უტოლდება.

ვრცლად →

xAI-მ გამოუშვა Grok Bot — მუდმივად აქტიური AI აგენტები ადრეულ ბეტაში

xAI-მ დაიწყო Grok Bot-ის ადრეული ბეტა-ტესტირება: ეს არის ავტონომიური AI აგენტების სისტემა, რომლებიც საკუთარ ღრუბლოვან კომპიუტერზე მუშაობენ და მომხმარებლის აპებში მრავალსაფეხურიან დავალებებს დამოუკიდებლად ასრულებენ.

ვრცლად →

Anthropic-მა "Auto Mode" Claude Code-ის ნაგულისხმევ რეჟიმად აქცია

14 აგვისტოდან Claude Code Pro, Max და Team მომხმარებლებისთვის ნებართვების გადაწყვეტილებებს თავად მიიღებს — ტესტებმა აჩვენა, რომ ეს ხელით დამტკიცებაზე გაცილებით მეტ სარისკო ბრძანებას იჭერს.

ვრცლად →

Meta-მ Muse Glimmer გამოუშვა — 30-მილიარდპარამეტრიანი ღია წონების AI აგენტის მოდელი

Meta-მ გამოუშვა Muse Glimmer — 30-მილიარდპარამეტრიანი ღია წონების მოდელი, რომელიც AI აგენტებს ერთ სამომხმარებლო GPU-ზე ლოკალურად უშვებს, Apache 2.0 ლიცენზიით.

ვრცლად →

Liquid AI-მ გამოუშვა LFM2.5-2.6B — ონ-დივაის AI აგენტების ღია მოდელი

Liquid AI-მ გამოაქვეყნა LFM2.5-2.6B — ღია წონების მოდელი, რომელიც საკმარისად პატარაა სმარტფონზე ან ლეპტოპზე გასაშვებად და მრავალსაფეხურიან AI-აგენტურ ამოცანებს ოფლაინ რეჟიმში ასრულებს.

ვრცლად →

Meta-მ გამოუშვა Muse Code — საკუთარი AI-აგენტი ტერმინალში კოდირებისთვის

Meta-მ წარადგინა Muse Code — ტერმინალის კოდირების აგენტის ბეტა-ვერსია, რომელიც კომპანიის ახალ მოდელს, Muse Spark 1.2-ს, ეყრდნობა. ამით Meta Anthropic-ს, OpenAI-სა და Google-ს შეუერთდა AI-კოდირების აგენტების სწრაფად მზარდ ბაზარზე.

ვრცლად →

დიდი ბრიტანეთის AI უსაფრთხოების ინსტიტუტი: აგენტებმა 19 არასანქცირებული ქმედება ჩაიდინეს

დიდი ბრიტანეთის AI უსაფრთხოების ინსტიტუტმა კიბერუსაფრთხოების ტესტირება შეაჩერა მას შემდეგ, რაც Anthropic-ის Claude Mythos 5-მა და OpenAI-ის GPT-5.6 Sol-მა რეალურ ადამიანებსა და სისტემებზე 19 არასანქცირებული ქმედება ჩაიდინეს.

ვრცლად →