Anthropic-მა გამოაცხადა, რომ 14 აგვისტოდან “auto mode” გახდება Claude Code-ის ნაგულისხმევი სამუშაო რეჟიმი Pro, Max და Team გამომწერებისთვის — ეს ცვლის ხელსაწყოს ტრადიციულ, ხელით დამტკიცებაზე დაფუძნებულ სისტემას, აღნიშნულია კომპანიის ამ კვირას გამოქვეყნებულ ბლოგპოსტში.
Auto mode-ში Claude-ის ყოველი ქმედება — ბრძანების გაშვება, ფაილის რედაქტირება, საცავში ცვლილებების ატვირთვა — გადის უსაფრთხოების კლასიფიკატორში, მომხმარებლისთვის ყოველ ჯერზე კითხვის დასმის ნაცვლად. კლასიფიკატორი შექმნილია იმისთვის, რომ დაბლოკოს შეუქცევადი, დესტრუქციული ან პროექტის ფარგლებს გარეთ გამავალი ქმედებები, ხოლო ჩვეულებრივი სამუშაო შეუფერხებლად გააგრძელოს. თუ რაიმეს დაბლოკავს, Claude, როგორც წესი, ან ალტერნატიულ გზას ეძებს ამოცანის შესასრულებლად, ან პირდაპირ მომხმარებელს ეკითხება.
რატომ გადავიდა Anthropic ამ რეჟიმზე
Anthropic-ის თქმით, auto mode-ზე გადასვლის საფუძველი მოხერხებულობა კი არა, მონაცემებია. 1,053 ფასიან მომხმარებელზე ჩატარებულმა კვლევამ აჩვენა, რომ ადამიანების მიერ ხელით შემოწმებამ მოგვიანებით სახიფათოდ ცნობილი ბრძანებების მხოლოდ 13.6% დაიჭირა, მაშინ როცა auto mode-ის კლასიფიკატორმა იმავე ნაკრებიდან 89% აღმოაჩინა. პირდაპირი შედარებისას auto mode-მა დაახლოებით 800 სარისკო ბრძანება დაბლოკა, რომელიც ადამიანმა გამომსცდელმა გაატარა, ხოლო ადამიანებმა მხოლოდ ექვსი ისეთი ქმედება დაბლოკეს, რომელიც კლასიფიკატორმა დაუშვა. Anthropic-ი აღნიშნავს, რომ სხვაობა მით უფრო იზრდება, რაც უფრო დიდხანს გრძელდება სესია — ადამიანის ყურადღება იკლებს, კლასიფიკატორის აღმოჩენის მაჩვენებელი კი არა.
მაისისა და ივნისის რეალური საწარმოო სესიების ცალკე ანალიზმა აჩვენა, რომ ხელით დამტკიცებამ დაუგეგმავი ზიანი ორ ჯერზე მეტად უფრო ხშირად გაატარა, ვიდრე auto mode-მა — მონიშნული სესიების 6.3%-ში, ხოლო auto mode-ის შემთხვევაში მხოლოდ 2.4%-ში. დამატებით მოწმობად მოჰყავთ Apollo Research-ის დამოუკიდებელი რედ-თიმინგი და Trajectory Labs-ის 720-ჯერადი პრომფტ-ინექციის ტესტი; ამ უკანასკნელში auto mode-მა დაბლოკა ყველა მცდელობა Claude-ის Fable 5, Opus 5 და Sonnet 5 მოდელების წინააღმდეგ.
რა შეიცვლება მომხმარებლებისთვის
Pro, Max და Team გეგმებზე Claude Code-ის ახალი სესიები 14 აგვისტოდან ნაგულისხმევად auto mode-ში გაეშვება, თუმცა ვინც უკვე დააყენა ხელით დამტკიცების პარამეტრი, მას ერთჯერადი შეტყობინება მიეწოდება ჩუმად გადართვის ნაცვლად. Anthropic ასევე აუქმებს დამატებით ტოკენ-გადასახადს, რომელსაც აქამდე უსაფრთხოების კლასიფიკატორი ამ გეგმებზე იმატებდა. საწარმოო (Enterprise) კლიენტებისთვის, Claude API-სთვის და ღრუბლოვანი პლატფორმებისთვის, მათ შორის AWS, Google Cloud და Microsoft Foundry, auto mode ჯერჯერობით ნებაყოფლობითი რჩება — Anthropic-ის თქმით, იგეგმება მისი ნაგულისხმევად გადაქცევა მომდევნო თვის განმავლობაში.
Anthropic-ის მონაცემებით, გუნდები, რომლებიც უკვე იყენებენ auto mode-ს, დაახლოებით 25%-ით მეტ პულ-რექვესთს უშვებენ, ვიდრე ხელით შემოწმებაზე დამოკიდებული გუნდები. კომპანია მოჰყავს კლიენტების მაგალითებიც — Adobe, Nuro, Gusto და Garner Health — რომლებიც უფრო გრძელ, ნაკლებად შეფერხებულ კოდირების სესიებზე საუბრობენ.
ეს ცვლილება მოსდევს Claude Code-ის ავტონომიურობის მართვის რიგ ბოლოდროინდელ ცვლილებას, მათ შორის ახალი მოდელებისთვის მკვეთრად შემცირებულ სისტემურ პრომფტს და უსაფრთხოების სკანირების სპეციალიზებული დანამატის დამატებას.