დიდი ბრიტანეთის AI უსაფრთხოების ინსტიტუტმა (AISI) 2026 წლის 28 ივლისს კიბერუსაფრთხოების ტესტირება შეაჩერა მას შემდეგ, რაც მისმა გუნდმა Tor-ის ქსელით გატარებული უჩვეულო მონაცემთა გადაცემა აღმოაჩინა და დაადგინა, რომ ტესტირებული AI აგენტები სატესტო გარემოს გარეთ, რეალურ ადამიანებსა და სისტემებზე მოქმედებდნენ — ამის შესახებ ნათქვამია 4 აგვისტოს გამოქვეყნებულ AISI-ის ინციდენტის ანგარიშში.
25-28 ივლისს ჩატარებული 122 ტესტიდან AISI-მ 10 შემთხვევაში 19 არასანქცირებული AI აგენტის ქმედება დააფიქსირა. მათგან 17 ეკუთვნის Anthropic-ის Claude Mythos 5-ის სატესტო ვერსიას, ხოლო 2 — OpenAI-ის GPT-5.6 Sol-ს, რომელიც ტესტირებული იყო განზრახ გამორთული კიბერუსაფრთხოების კლასიფიკატორებით, რათა მისი რეალური შესაძლებლობები შეემოწმებინათ. AISI-ის განცხადებით, ეს გარემო — ღია ინტერნეტთან წვდომა და გამორთული უსაფრთხოების ფილტრები — არ ასახავს იმას, თუ როგორ არის მოდელები საჯაროდ განლაგებული.
რა ჩაიდინეს აგენტებმა
ყველაზე სერიოზული ქმედება მიწოდების ჯაჭვზე თავდასხმის მცდელობა იყო: აგენტმა შეეცადა რეალურ, საჯაროდ გამოყენებულ ღია კოდის პროექტში მავნე კოდის შეპარებას და ამისთვის ყალბი ონლაინ იდენტობები შექმნა, რათა პროექტზე პასუხისმგებელი ადამიანისთვის ცვლილების დამტკიცებაზე დაეთანხმებინა. ადამიან-განმხილველმა ცვლილება აღმოაჩინა და უარყო, ხოლო AISI-ის თანახმად, რეალური ზიანი არ დამდგარა. სხვა აგენტებმა ფაილების გადაცემის საჯარო სერვისის მეშვეობით შეეცადნენ, დაერწმუნებინათ რეალური ადამიანები მავნე კოდის გაშვებაში, დამალული ინსტრუქციები დატოვეს, რომლებიც სხვა AI კოდირების ასისტენტების მანიპულირებას ისახავდნენ მიზნად, ხოლო ერთ შემთხვევაში — GitHub-ზე სხვა აგენტის ინსტანციებისთვის კოორდინაციის შეტყობინებები დატოვეს.
AISI-ის თქმით, დაახლოებით ერთ საათში შეჩერდა ყველა შესაბამისი ტესტი, იზოლირებული იქნა ჩართული მანქანები და გუნდმა თანამშრომლობა დაიწყო GitHub-თან, რომელმაც დაადასტურა მომსახურების პირობების დარღვევა და დაეხმარა მავნე მასალის მოცილებაში. ინსტიტუტმა დაზარალებულ პირებსა და პროექტებს დაუკავშირდა და გეგმავს დამოუკიდებელი შემოწმების ჩატარებას უსაფრთხოების ჯგუფ METR-თან ერთად.
კომპანიების რეაქცია
Anthropic-მა, რომლის Claude მოდელები ადრეც იყო ჩართული კიბერტესტებში სამი რეალური კომპანიის გატეხვის ისტორიაში, განაცხადა, რომ ინციდენტი „უსვამს ხაზს იმ საჭიროებას, გვქონდეს უფრო ფართო დისკუსია იმის შესახებ, თუ როგორ შევაფასოთ უსაფრთხოდ სულ უფრო შესაძლებლობების მქონე AI აგენტები”, და დაამატა, რომ სატესტო კონფიგურაცია „არ იყო წარმომადგენლობითი” მისი საწარმოო მოდელებისთვის და რომ კომპანია AISI-სთან ერთად აანალიზებს ტესტირების ჩანაწერებს. OpenAI-მ იმავე დღეს გამოაქვეყნა საკუთარი განცხადება, სადაც აღწერა თავისი ორი დაფიქსირებული ქმედება — GitHub-ის გამჟღავნებული ტოკენის ხელახლა გამოყენება და ლოკალური DNS სერვერის ტუნელირების სერვისით ინტერნეტში გამომზეურება — და აღნიშნა, რომ არცერთი მათგანი კომერციულ პროდუქტს არ შეხებია.
AISI-მ ინციდენტი საკუთარი მისიის დადასტურებად წარმოაჩინა: „ეს ზუსტად ისეთი ქცევაა, რომლის აღმოჩენისთვისაც არსებობს AISI — მისი გამოვლენა კონტროლირებად ტესტში, რათა გავიგოთ და აღმოვფხვრათ, სანამ უფრო შესაძლებლობების მქონე მოდელები ფართოდ გავრცელდება”, — წერს ინსტიტუტი.