OpenAI-მ 1 აგვისტოს განაცხადა, რომ მისმა შიდა, ჯერ გამოუქვეყნებელმა მოდელმა სახელად Astra ამოხსნა მათემატიკისა და თეორიული ინფორმატიკის ათი ამოცანა, რომლებზეც სულ მცირე ათი წელი, ზოგზე კი გაცილებით მეტი ხნის განმავლობაში პროგრესი არ ყოფილა — და პარალელურად გამოაქვეყნა თითოეული ამოხსნის მანქანურად გადამოწმებული დამტკიცება.
განცხადება მოვიდა რამდენიმე კვირის შემდეგ, რაც OpenAI-მ GPT-5.6 Luna-ის ფასი 80%-ით შეამცირა მთელი GPT-5.6 ხაზის ფასდაკლებასთან ერთად. კომპანიამ Astra დაახასიათა როგორც თავისი „შემდეგი ძირითადი მოდელების ოჯახი“ — შექმნილი გრძელვადიანი, მრავალსაფეხურიანი ამოცანების გადასაჭრელად და არა სწრაფი ჩატის პასუხებისთვის. Astra საჯაროდ ჯერ არ გამოსულა, და OpenAI-ს ჯერ არ განუცხადებია, გამოუშვებს თუ არა მას როგორც GPT-6-ს, GPT-5.7-ის განახლებას, თუ სულ სხვა სახელით.
ათი დიდი ხნის გადაუჭრელი ამოცანა
შედეგები მოიცავს ჯგუფთა თეორიას, მაღალგანზომილებიან გეომეტრიას, კოდირების თეორიას, კვანტურ სირთულეს, გისოსურ კრიპტოგრაფიასა და ექსტრემალურ კომბინატორიკას, OpenAI-ის თანახმად. ყველაზე გამორჩეული შედეგია პირველი კონკრეტული არასოფიკური ჯგუფის აგება — საკითხი ჯგუფთა თეორიაში, რომელიც გადაუჭრელი იყო მას შემდეგ, რაც მათემატიკოსმა მიხაილ გრომოვმა 1999 წელს სოფიკური ჯგუფის ცნება ჩამოაყალიბა. Astra-მ ასევე უარყო კონეს სიმტკიცის ჰიპოთეზა ფონ ნეიმანის ალგებრებზე, დაამტკიცა ერჰარტის მოცულობის ჰიპოთეზა, პირველად 1978 წლის შემდეგ გააუმჯობესა მაღალგანზომილებიანი სფეროების ჩალაგების ზოგადი ზღვარი და ამოხსნა სამი ამოცანა მათემატიკოს პოლ ერდიოშის დიდი ხნის გადაუჭრელ საკითხთა ნუსხიდან.
არცერთი შედეგი არ ეხება მილენიუმის შვიდ პრობლემას. OpenAI-ის შეფასებით, ყველა ათი ამოხსნის მისაღებად საჭირო გამოთვლების ჯამური ღირებულება Sol API-ის ტარიფებით დაახლოებით $2,000-ია — მაჩვენებელი, რომელსაც მკვლევრები ამგვარი მასშტაბის შედეგებისთვის უჩვეულოდ დაბლად მიიჩნევენ.
მანქანურად გადამოწმებული, მაგრამ ჯერ არა რეცენზირებული
იმის ნაცვლად, რომ მკითხველს არგუმენტების ბრმად დაჯერება მოსთხოვოს, OpenAI-მ თითოეული დამტკიცება Lean-ის სერტიფიკატის სახით ჩამოაყალიბა — ფორმატი, რომლის ლოგიკურ სისწორესაც ცალკე პროგრამა სტრიქონ-სტრიქონ ამოწმებს — და სერტიფიკატებთან ერთად 249-გვერდიანი ნაშრომი გამოაქვეყნა. ეს გადამოწმების უფრო მაღალი ზღვარია, ვიდრე OpenAI-ის ადრინდელი განცხადება, რომ GPT-5.6 Sol Ultra-მ 50 წლის გრაფთა თეორიის ჰიპოთეზა დაამტკიცა — მაშინ მათემატიკოსებმა თქვეს, რომ სრულ გადამოწმებას კვირები დასჭირდებოდა.
მანქანურად გადამოწმებული სერტიფიკატი ადასტურებს, რომ დამტკიცება ლოგიკურად გამართულია, მაგრამ თავისთავად არ განსაზღვრავს, რამდენად მნიშვნელოვნად ჩათვლის ამ შედეგებს ფართო მათემატიკური საზოგადოება — გამოქვეყნების მომენტისთვის OpenAI-ის საკუთარი ცნობის მიღმა დამოუკიდებელი შეფასება ჯერ არ გამოჩენილა. დამატებით იმის შესახებ, თუ როგორ მუშაობს ამგვარი გადამოწმება, იხილეთ ჩვენი განმარტება როგორ მოწმდება AI-ის მათემატიკური დამტკიცებები.
OpenAI-მ დაამატა, რომ Astra იქნება პირველი მოდელი, რომელსაც კომპანია საჯარო გამოშვებამდე აშშ მთავრობის ახალ უსაფრთხოების შემოწმებას წარუდგენს.
ასევე წაიკითხეთ
- openai/ten-proofs GitHub-ზე — ყველა ათი შედეგის გამოქვეყნებული Lean 4 სერტიფიკატი