OpenAI-მ განაცხადა, რომ ვერ გამორიცხავს, რომ მისმა გამოუქვეყნებელმა მოდელმა Astra-მ კიბერუსაფრთხოების „კრიტიკულ“ დონეს მიაღწია — ეს არის უმაღლესი საფეხური კომპანიის Preparedness Framework-ში, სისტემაში, რომლის მეშვეობითაც OpenAI საჯარო გამოშვებამდე თვალყურს ადევნებს მოდელების საშიშ შესაძლებლობებს. ეს პირველი შემთხვევაა, როცა OpenAI-ის რომელიმე მოდელმა ეს ზღვარი გადალახა, და კომპანიამ Astra-ს შიდა განვითარების ნაწილი შეაჩერა, სანამ დაცვის მექანიზმებს ამკაცრებს.
რას ნიშნავს „კრიტიკული“ დონე
OpenAI-ის ჩარჩოს მიხედვით, მოდელი კიბერუსაფრთხოების კრიტიკულ დონეს აღწევს, თუ მას შეუძლია დამოუკიდებლად აღმოაჩინოს და შექმნას რეალურად მოქმედი, ნულოვანი დღის ექსფლოითები (zero-day exploits) მრავალი კარგად დაცული, რეალური სისტემის წინააღმდეგ, ან — მხოლოდ ზოგადი მიზნის საფუძველზე — თავად დაგეგმოს და განახორციელოს კიბერშეტევის სრული სტრატეგია დაცული სამიზნის მიმართ. კომპანიის თქმით, ბოლოდროინდელმა შიდა შეფასებებმა აჩვენა, რომ Astra-ს კოდირებისა და კიბერუსაფრთხოების უნარები საკმარისად მაღალია იმისთვის, რომ ვერ იქნას გამორიცხული ამ ზღვრის გადალახვა. ადრე შეფასებულ ყველა მოდელს, მათ შორის ახლახან გამოშვებულ GPT-5.6-Sol-საც, უმაღლეს მაჩვენებლად მხოლოდ ერთი საფეხურით დაბალი, „მაღალი“ დონე ჰქონდა.
Astra-მ ყურადღება ადრეც მიიპყრო, როცა ტესტირებისას თურმე ათი გამოუქვეყნებელი მათემატიკური ამოცანა ამოხსნა; OpenAI-ს არ განუცხადებია, როდის ან საერთოდ გამოუშვებს თუ არა მოდელს საჯაროდ.
მკაცრი დაცვის მექანიზმები
OpenAI აჩერებს Astra-ს შიდა მუშაობის იმ ნაწილს, რომელიც გამკაცრებულ უსაფრთხოების სტანდარტს ვერ აკმაყოფილებს, და უკვე დანერგა იზოლირებული სატესტო გარემოები, ქსელსა და ინსტრუმენტებზე შეზღუდული წვდომა და მოდელის წონების დაცვისა და დაშიფვრის გაძლიერებული მექანიზმები. ასევე ნერგავს რისკიანი ქმედებების უნივერსალურ მონიტორინგს Astra-ს ყველა აგენტურ გამოყენებაში, წვრთნისა და შეფასების ჩათვლით, და აცხადებს, რომ თანამშრომლობს სამთავრობო უწყებებთან და დამოუკიდებელ AI უსაფრთხოების ორგანიზაციებთან შემდგომი ტესტირებისთვის, ხოლო მესამე მხარის შემფასებლებს დამატებით მითითებებს აწვდის, თუ რა უსაფრთხოების ზომებია საჭირო მოდელის უსაფრთხოდ შესამოწმებლად.
მსგავსი წინდახედულობა OpenAI-მ ადრეც გამოიჩინა — კომპანიამ მოიხსენია 2025 წლის ივნისში დაწესებული ანალოგიური შეზღუდვები, როცა წინა მოდელი ბიოლოგიური რისკის მაღალ ზღვარს მიუახლოვდა. იმის შესახებ, თუ როგორ ქმნიან AI ლაბორატორიები კიბერუსაფრთხოებისთვის სპეციფიკურ დაცვის მექანიზმებს, მეტი შეგიძლიათ წაიკითხოთ ჩვენს განმარტებაში კიბერუსაფრთხოების საბაზისო მოდელების შესახებ.