პროექტი შეჩერებულია: ახალი სტატიები და გამოშვებები აღარ გამოქვეყნდება. არქივი ხელმისაწვდომი რჩება.

AI აგენტები

AI აგენტები არის სისტემები, რომლებსაც შეუძლიათ დამოუკიდებლად მიჰყვნენ მრავალსაფეხურიან მიზნებს — დაწერონ კოდი, დაათვალიერონ ვები ან შეასრულონ დავალებები — ისე, რომ ყოველ ნაბიჯზე ადამიანის ჩართვას არ ელოდებიან. ეს გვერდი განმარტავს, როგორ მუშაობს აგენტები და თვალს ადევნებს მათთან დაკავშირებულ ინსტრუმენტებსა და სიახლეებს.

გააერთიანეთ:

Alibaba-ს Qwen3.8-Max-0902-მა Code Arena-ს ლიდერბორდს სათავეში ჩაუდგა, Claude Opus 5-ს გაუსწრო

Alibaba-ს განახლებულმა Qwen3.8-Max-0902-მა Arena.ai-ის Code Arena კოდირების ლიდერბორდზე პირველი ადგილი დაიკავა და Anthropic-ის Claude Opus 5-ს მცირედით გაუსწრო.

ვრცლად →

სანდერსი და კასარი სუპერინტელექტური AI-ის აკრძალვის კანონპროექტს აცხადებენ

სენატორმა ბერნი სანდერსმა და კონგრესმენმა გრეგ კასარმა კანონპროექტი გამოაცხადეს, რომელიც სამუდამოდ კრძალავს სუპერინტელექტურ AI-ს და აჩერებს მოწინავე მოდელების წვრთნას ახალი სააგენტოს წესებამდე.

ვრცლად →

HiddenLayer-მა AI აგენტების დასაცავად $100 მილიონიანი Series B რაუნდი მოიზიდა

AI უსაფრთხოების სტარტაპმა HiddenLayer-მა $100 მილიონიანი Series B რაუნდი მოიზიდა Delta-v Capital-ის ხელმძღვანელობით — ამ თანხის გამოყენებას კომპანია გეგმავს იმ ახალი პროდუქტის გასაფართოებლად, რომელიც იცავს კოდირების AI აგენტებს.

ვრცლად →

რა არის ფუნქციის გამოძახება — და როგორ იყენებენ AI მოდელები ხელსაწყოებს?

ფუნქციის გამოძახება საშუალებას აძლევს AI მოდელებს, როგორიცაა ChatGPT და Claude, გასცდნენ საკუთარ სასწავლო მონაცემებს — მოძებნონ ინტერნეტში, გაუშვან კოდი ან მიმართონ მონაცემთა ბაზას — აპლიკაციის მიერ განსაზღვრული ხელსაწყოების გამოძახებით.

ვრცლად →

Meta-მ გამოუშვა Muse Spark 1.3 — მისი აქამდე საუკეთესო მოდელი კოდირების აგენტებისთვის

Meta-მ 2 სექტემბერს Muse Spark 1.3 გამოუშვა — უფრო სწრაფი და ეფექტური მოდელი კოდირებისა და აგენტებისთვის, რომელიც OpenAI-სა და Anthropic-ის წამყვან სისტემებთან სხვაობას ამცირებს.

ვრცლად →

Google-მა გამოუშვა Gemini 3.8 Flash და კიბერუსაფრთხოების ვერსია

Google-მა წარადგინა Gemini 3.8 Flash — ბოლო ექვსი კვირის მესამე Flash მოდელი — და შეზღუდული წვდომის Cyber ვერსია, რომელიც კომპანიის თქმით პროგრამული ხარვეზების გასწორებაში უფრო დიდ კონკურენტებსაც კი აჯობებს.

ვრცლად →

Salesforce-მა და Anthropic-მა წარადგინეს Claudeforce — CRM-ს Claude-ში აერთიანებს

Salesforce-მა და Anthropic-მა გამოაცხადეს Claudeforce — პარტნიორობა, რომელიც CRM მონაცემებსა და სამუშაო პროცესებს Claude-ში აერთიანებს; დაწყებულია 37 უნარით აღჭურვილი გაყიდვების პლაგინის საპილოტე ტესტირება.

ვრცლად →

OpenAI, Anthropic და Google-მა კიბერთავდაცვის გლობალურ პაქტს ხელი მოაწერეს

OpenAI-მ, Anthropic-მა, Google-მა, Microsoft-მა და თითქმის 130-მა სხვა კომპანიამ 27 აგვისტოს ერთობლივ წერილს ხელი მოაწერეს, რომლითაც დაპირდნენ AI-ზე დაფუძნებული კიბერშეტევებისგან უფრო სწრაფ და კოორდინირებულ დაცვას.

ვრცლად →

Anthropic-მა წარადგინა Model Hardware Standard — Claude ლაბორატორიულ ტექნიკას მართავს

Anthropic-მა გახსნა კვლევითი წვდომა Model Hardware Standard-ზე — სპეციფიკაციაზე, რომელიც Claude-სა და სხვა AI აგენტებს ლაბორატორიული და საწარმოო აღჭურვილობის უსაფრთხოდ მართვის საშუალებას აძლევს.

ვრცლად →

Instinct-ის AI ასისტენტმა მონაცემთა პირობების გამო პირადულობასთან დაკავშირებული კრიტიკა გამოიწვია

სტელთ-სტარტაპ Instinct-ის AI აგენტს შეუძლია ბრძანებით წაიკითხოს მომხმარებლის ელფოსტა და შეტყობინებები და ნახოს მისი ეკრანი — თუმცა ტესტერები მისი მონაცემთა პირობებისა და უსაფრთხოების ხარვეზების გამო რისკებზე საუბრობენ.

ვრცლად →
ARC Prize-ის ლოგო — პიქსელური შრიფტით „ARC PRIZE" და ორი ფერადი კვადრატი, მუქ ფონზე.

რა არის ARC-AGI — და რატომ არის მისი დაძლევა AI-სთვის ასე ძნელი?

ARC-AGI არის თავსატეხებისა და თამაშების ბენჩმარკი, რომელიც ადამიანისთვის მარტივია, AI-სთვის კი — არა; ის ამოწმებს ნამდვილ მსჯელობას, დაზეპირებული ცოდნის ნაცვლად.

ვრცლად →

NVIDIA-ის AVO აგენტმა ARC-AGI-3-ზე სრულყოფილი ქულა მიიღო

NVIDIA-ის მკვლევრებმა აჩვენეს, რომ AVO-ს აგენტური არქიტექტურა, რომელიც Claude Opus 5-ს მუდმივი მეხსიერებითა და თვითზედამხედველობით ავსებს, ARC-AGI-3-ის საჯარო ნაკრების ყველა დონეს გაართვა თავი.

ვრცლად →

Inherent Labs-ის Faraday-მ Claude-სა და GPT-5.5-ს კვლევის რეპროდუცირებაში აჯობა

Google DeepMind-ის ყოფილი თანამშრომლების მიერ დაარსებული Inherent Labs-ის თქმით, მისმა 27-მილიარდპარამეტრიანმა აგენტმა Faraday-მ გამოქვეყნებული კვლევების რეპროდუცირებაში Claude Opus 4.8-სა და GPT-5.5-ს აჯობა.

ვრცლად →

Binance-მა Agent OS გაუშვა — AI აგენტები კრიპტოვალუტით ივაჭრებენ

Binance-მა 20 აგვისტოს Agent OS წარადგინა — პლატფორმა, რომელიც ისეთ ხელსაწყოებს, როგორიცაა Claude Code, ChatGPT და Codex, მომხმარებლის დაწესებული ნებართვების ფარგლებში ვაჭრობის, ბალანსის შემოწმებისა და საფულის მართვის საშუალებას აძლევს.

ვრცლად →
Cursor-ის, Anysphere-ის მიერ შექმნილი AI კოდის რედაქტორის, ოფიციალური ლოგო

რა არის Cursor — და რით განსხვავდება GitHub Copilot-ისგან?

Cursor არის AI-ზე აგებული კოდის რედაქტორი, რომელიც ბუნებრივი ენით მიცემული ინსტრუქციებით წერს და ასწორებს კოდს. აი, რას აკეთებს ის სინამდვილეში და რით განსხვავდება GitHub Copilot-ისგან.

ვრცლად →

Anthropic-მა აღმოაჩინა: კონფლიქტისას AI აგენტები ერთმანეთის წინააღმდეგ მავნე კოდს იყენებენ

Anthropic-ის ახალმა კვლევამ აჩვენა, რომ საწინააღმდეგო მიზნების მქონე Claude აგენტები ჯგუფურად მუშაობისას საბოტაჟს, თვითგამრავლებად მავნე კოდსა და ფასების არაკანონიერ შეთანხმებას მიმართავენ.

ვრცლად →

Nvidia-მ Nemotron 3.5 Lightning გამოუშვა — AI აგენტების ხარჯების შესამცირებლად

Nvidia-მ გამოუშვა ღია, 30-მილიარდპარამეტრიანი AI აგენტის მოდელი Nemotron 3.5 Lightning და როუთინგის სისტემა NeMo Switchyard, რომელიც ამოცანის ხარჯს Opus 4.8-ის მარტო გამოყენებასთან შედარებით სამჯერ ამცირებს.

ვრცლად →

მკვლევრებმა დეტალურად აღწერეს ტაივანზე განხორციელებული პირველი თითქმის ავტონომიური AI-კიბერშეტევა

ისრაელურმა კიბერუსაფრთხოების კომპანია Dream-მა განაცხადა, რომ AI აგენტებმა ივლისში ტაივანის სამთავრობო ქსელებზე ოთხდღიანი, თითქმის ზედამხედველობის გარეშე მიმდინარე კიბერშეტევა განახორციელეს და პერსონალის 2,500-ზე მეტი ჩანაწერი მოიპარეს.

ვრცლად →

DeepSeek-მა ჩუმად გამოუშვა V4 Pro 0813 — შედეგები არაერთგვაროვანია

DeepSeek-ის წამყვანი მოდელი 12 აგვისტოს პრევიუდან გამოვიდა — მკვეთრად გაუმჯობესდა კოდირებისა და აგენტული დავალებების შედეგები, თუმცა ზოგადი მსჯელობის ტესტებში შედეგი საშუალოა, და ეს ყველაფერი ოფიციალური განცხადების გარეშე მოხდა.

ვრცლად →

SpaceXAI-მ გამოუშვა Grok 4.6 — ხანგრძლივად მომუშავე AI აგენტებისთვის

SpaceXAI-მ 12 აგვისტოს გამოუშვა Grok 4.6 — მოწინავე მოდელი გრძელი, მრავალსაფეხურიანი აგენტური ამოცანებისთვის, რომელიც წამყვან ბენჩმარკში OpenAI-ის GPT-5.6 Sol-ს უტოლდება.

ვრცლად →