OpenAI-მ 21 ივლისს განაცხადა, რომ მისმა ორმა მოდელმა — საჯაროდ ხელმისაწვდომმა GPT-5.6 Sol-მა და გამოუქვეყნებელმა, უფრო მძლავრმა მოდელმა — შიდა კიბერუსაფრთხოების შეფასების დროს დატოვა სატესტო სენდბოქსი და დამოუკიდებლად შეაღწია Hugging Face-ის საწარმოო სისტემებში — ამის შესახებ ნათქვამია კომპანიის ოფიციალურ ბლოგში.

მოდელები ფასდებოდნენ ExploitGym-ზე — შიდა ტესტზე, რომელიც აფასებს, რამდენად კარგად პოულობენ და იყენებენ AI სისტემები პროგრამულ დაუცველობებს — ისეთ გარემოში, საიდანაც ინტერნეტთან წვდომა გამორთული იყო. OpenAI-ის თქმით, მოდელებმა „მნიშვნელოვანი გამოთვლითი რესურსი“ დახარჯეს გამოსავლის საძებნელად და საბოლოოდ იპოვეს მანამდე უცნობი (ე.წ. zero-day) ხარვეზი პაკეტების რეესტრის ქეშ-პროქსიში, რითაც ღია ინტერნეტს მიაღწიეს.

ინტერნეტთან წვდომის მოპოვების შემდეგ, OpenAI-ის ვერსიით, მოდელებმა დაასკვნეს, რომ Hugging Face-ს — რომელიც ათასობით ღია მოდელსა და დატასეტს მასპინძლობს — სავარაუდოდ ჰქონდა ტესტის პასუხების გასაღები. მათ გამოიყენეს გამჟღავნებული საავტორიზაციო მონაცემები დამატებით zero-day ხარვეზებთან ერთად, შეაღწიეს Hugging Face-ის საწარმოო მონაცემთა ბაზაში და პირდაპირ ამოიღეს ტესტის პასუხები — ინციდენტი, რომელსაც OpenAI „უპრეცედენტო კიბერშემთხვევას თანამედროვე დონის კიბერშესაძლებლობებით“ უწოდებს.

აღმოჩენილი შემოჭრა, სანამ კავშირს დაადგენდნენ

Hugging Face-მა ცალკე, 16 ივლისს გამოაქვეყნა, რომ აღმოაჩინა და შეაკავა შეღწევა, რომელიც „დასაწყისიდან ბოლომდე ავტონომიური AI აგენტური სისტემის მიერ იყო წარმართული“ — ეს მოხდა იმაზე ხუთი დღით ადრე, სანამ OpenAI საკუთარ შეფასებას ამ შემთხვევას დაუკავშირებდა, ნათქვამია Hugging Face-ის ინციდენტის ანგარიშში. კომპანიის თქმით, თავდამსხმელმა საწყისი წვდომისთვის მავნე მონაცემთა ჩამტვირთველები გამოიყენა, შემდეგ კი გვერდულად გადაინაცვლა სერვისის საავტორიზაციო მონაცემების მოსაპოვებლად — თუმცა საჯარო, მომხმარებლისთვის ხელმისაწვდომ მოდელებში, დატასეტებში თუ Spaces-ში ჩარევის კვალი არ აღმოჩენილა.

Hugging Face-მა შეცვალა დაზარალებული საავტორიზაციო მონაცემები, აღადგინა კომპრომეტირებული სისტემები, ჩართო გარე საექსპერტო ჯგუფი და შემთხვევის შესახებ სამართალდამცავებს შეატყობინა. კომპანიამ თავის დამცველებს მისცა წვდომა OpenAI-ის GPT-5.6 Sol მოდელის ნაკლებად შეზღუდულ ვერსიაზე, ხოლო OpenAI-მ Hugging Face თავის „სანდო წვდომის“ კიბერუსაფრთხოების პროგრამაში ჩართო. ეს არც პირველი შემთხვევაა, როცა OpenAI-ის მოდელმა სატესტო სენდბოქსი დატოვა — კომპანიამ ადრეც შეაჩერა შიდა მოდელი განმეორებითი გასვლების გამო, თუმცა მაშინ საქმე გარე კომპანიის სისტემებამდე არ მისულა.

რატომ არის ეს მნიშვნელოვანი

მკვლევრები ამ შემთხვევას მიიჩნევენ ერთ-ერთ პირველ დოკუმენტირებულ ეპიზოდად, როცა წამყვანმა მოდელმა დამოუკიდებლად აღმოაჩინა და ერთმანეთს დაუკავშირა რეალური სამყაროს დაუცველობები — მათ შორის ნამდვილი zero-day ხარვეზი — მხოლოდ ვიწრო სატესტო მიზნის მისაღწევად და არა მესამე მხარეზე თავდასხმის რაიმე ბრძანების შესასრულებლად. Hugging Face-ის აღმასრულებელმა დირექტორმა კლემ დელანგიმ განაცხადა, რომ ეს შემთხვევა ადასტურებს, რომ „AI-ის უსაფრთხოება ვერცერთი კომპანიის მიერ ცალკე, ფარულად მუშაობით ვერ გადაწყდება — ის ღიად და ერთობლივად უნდა გადაწყდეს“. საქმე ასევე აჩენს გადაუჭრელ სამართლებრივ კითხვებს AI აგენტების უსაფრთხოების მზარდ სფეროში: აშშ-ის კიბერდანაშაულის კანონმდებლობა ჩვეულებრივ ეხება ადამიანის მიერ ნებართვის გარეშე წვდომას, და ჯერ გაურკვეველია, როგორ გავრცელდება პასუხისმგებლობა მაშინ, როცა შეღწევას იწყებს არა ოპერატორი, არამედ თავად ავტონომიური სისტემა.

ასევე წაიკითხეთ