OpenAI-მ 3 სექტემბერს გამოუშვა GPT-6 Astra, რომელსაც კომპანია საკუთარ „ყველაზე ინტელექტუალურ და გათანხმებულ მოდელად“ მოიხსენიებს. ამასთან, OpenAI-მ დაადასტურა, რომ ეს არის კომპანიის პირველი მოდელი, რომელმაც მისივე Preparedness Framework-ის („მზადყოფნის ჩარჩო“) ფარგლებში კიბერუსაფრთხოების „კრიტიკულ“ საფეხურს მიაღწია.

უფრო ძლიერი, მაგრამ უფრო სარისკო მოდელი

OpenAI-ის თქმით, Astra საუკეთესო შედეგებს აჩვენებს კოდირებაში, კომპიუტერთან მუშაობაში, ვებ-ბრაუზინგსა და სამეცნიერო მსჯელობაში — მოდელმა თითქმის მაქსიმალური ქულა აიღო ისეთ ტესტებზე, როგორიცაა FrontierMath Tier 4 (98%) და ARC-AGI-3 (99.9%). თუმცა უსაფრთხოების გუნდებისთვის მთავარი მაჩვენებელი ExploitBench-ია — OpenAI-ის შიდა წითელი გუნდის (red-teaming) ტესტი: Astra-მ 100% დააფიქსირა (წინა მოდელ GPT-5.6 Sol-ის 78.5%-თან შედარებით — მნიშვნელოვანი ზრდა) და, ცნობით, ტესტირებისას ორი აქამდე უცნობი ნულოვანი დღის მოწყვლადობა აღმოაჩინა.

OpenAI-ის ჩარჩოს მიხედვით, „კრიტიკული“ ნიშნავს, რომ მოდელს შეუძლია დამოუკიდებლად, ადამიანის ეტაპობრივი ხელმძღვანელობის გარეშე, აღმოაჩინოს და ერთმანეთთან დააკავშიროს (ჯაჭვად აქციოს) ახალი ექსფლოითები გამაგრებული, რეალურად მოქმედი სისტემების წინააღმდეგ. ამ საფეხურზე გადასვლა დამატებით დაცვის მექანიზმებს ავალდებულებს — და არა იმის ცვლილებას, თუ ვის შეუძლია მოდელის გამოყენება.

დამატებითი დაცვის მექანიზმები ფართო გაშვებამდე

ამ რისკის შესარბილებლად, OpenAI-ის განცხადებით, კომპანიამ დანერგა Astra-ს „მსჯელობის ჯაჭვის“ მონიტორინგი აგენტური გამოყენების ყველა შემთხვევაში — მაღალრისკიანი მოქმედება რეალურ დროში ფიქსირდება და წყდება. მომხმარებლისთვის ხელმისაწვდომი ვერსია უარს ამბობს პრინციპის დამადასტურებელი (proof-of-concept) საექსპლუატაციო კოდის შექმნაზე — ტესტების დროს ეს ყველა შემთხვევაში იმუშავა, მაშინ როცა GPT-5.6 Sol ამას მხოლოდ შემთხვევათა დაახლოებით ნახევარში ახერხებდა. გადამოწმებულ დამცველ გუნდებს Daybreak პროგრამის ფარგლებში, რომელიც განკუთვნილია უსაფრთხოების გუნდებისთვის და არა ფართო საზოგადოებისთვის, უფრო ღრმა წვდომის მოთხოვნა შეუძლიათ — ეს ნაბიჯი გამოძახილია იმ ერთობლივი კიბერთავდაცვის პაქტისა, რომელსაც OpenAI-მ Anthropic-თან და Google-თან ერთად ხელი მოაწერა ამ წლის დასაწყისში, და Astra-ს აქცევს Google-ის საკუთარ Gemini 3.8 Flash-ის კიბერუსაფრთხოების ვერსიის გვერდით — ორივე ლაბორატორიამ პროდუქტში ცალკე კიბერრისკის საფეხური ჩადო.

სპეციფიკაციები, ფასი და გაშვება

Astra-ს კონტექსტის ფანჯარა 1.05 მილიონ ტოკენს შეადგენს, გამონატანის ლიმიტი — 128,000 ტოკენს, ცოდნის ზღვარი კი 2026 წლის 30 აპრილს ჩერდება. ფასი შეადგენს $10-ს მილიონ შემავალ და $50-ს მილიონ გამომავალ ტოკენზე — წინა მოდელზე ძვირი. OpenAI მოდელს ჯერ შეზღუდული რაოდენობის ორგანიზაციისთვის უშვებს, ხოლო მომდევნო დღეებში წვდომა გაეხსნებათ ChatGPT-ის Plus, Pro, Business და Enterprise მომხმარებლებს, ასევე API-ს, Microsoft Azure-სა და AWS Bedrock-ის პლატფორმებს; საწარმოო მომხმარებლებისთვის მაღალრისკიანი შესაძლებლობები, ცნობით, ნაგულისხმევად გამორთულია.

ანალიტიკოსმა სანჩიტ ვირ გოგიამ CSO Online-სთან საუბრისას აღნიშნა, რომ „კრიტიკული“ იარლიყი, უფრო მეტად, გამჭვირვალობის ნაბიჯია, ვიდრე მოულოდნელი ნახტომი შესაძლებლობებში — თუმცა გააფრთხილა, რომ ამავე განახლებამ, რომელმაც Astra მავნე მოთხოვნებზე უფრო საიმედოდ ამბობინა უარი, მისი მსჯელობის გარე მკვლევრების მიერ მონიტორინგიც გაართულა.