OpenAI-მ 13 აგვისტოს წარადგინა Ultrafast — GPT-5.6 Sol-ის დამუშავების ახალი დონე, რომელიც კომპანიის თქმით წამში 750 ტოკენამდე გენერირებს — ეს სტანდარტულ რეჟიმთან შედარებით 14-ჯერ სწრაფია, ხარისხის დაკარგვის გარეშე.

Cerebras-ის ტექნოლოგიაზე აგებული

სისწრაფის საფუძველი Cerebras-ის ჩიპებია — კომპანია, რომელიც OpenAI-ის ახალი დონის აპარატურულ პარტნიორად გვევლინება. Cerebras-ის განცხადებით, მისი Wafer-Scale Engine მთელი მოდელის წონას 44 გბ მოცულობის ჩიპზევე არსებულ მეხსიერებაში ინახავს, რაც ტოკენებს მოდელის შრეებში დაბრკოლების გარეშე ატარებს — განსხვავებით რამდენიმე ცალკეულ GPU-ზე გაყოფილი მოდელისგან, სადაც მონაცემთა მუდმივი გადატანა ანელებს პროცესს. საიტის საკუთარი სტატია რა არის მთელი ფირფიტის ჩიპი უფრო დაწვრილებით აღწერს, რით განსხვავდება ეს არქიტექტურა ჩვეულებრივი GPU-სგან.

Humanity’s Last Exam ტესტში, OpenAI-ის თქმით, GPT-5.6 Sol Ultrafast-მა ყველა 2,500 კითხვას 11 საათსა და რამდენიმე წუთში უპასუხა, მაშინ როცა Anthropic-ის Claude Fable 5-ს ამისთვის სამ დღეზე მეტი უწყვეტი გამოთვლა დასჭირდა — ანუ დაახლოებით შვიდჯერ სწრაფად მიაღწია შესადარებელ სიზუსტეს, კომპანიის საკუთარი ტესტირების მიხედვით. OpenAI ასევე იტყობინება GDP-Val ტესტზე 5.6-ჯერად აჩქარებაზე, ხარისხის დაკარგვის გარეშე.

ჯერჯერობით შეზღუდული წვდომა

Ultrafast ჯერჯერობით მხოლოდ შეზღუდული რაოდენობის OpenAI-ის API მომხმარებლისთვისაა ხელმისაწვდომი — კომპანია მას კოდირების, ფინანსური ანალიზის, მომხმარებელთა მხარდაჭერის, კომერციის, კვლევისა და ინციდენტებზე რეაგირების ამოცანებზე ტესტავს. OpenAI-მ ფასი თუ ფართო წვდომის თარიღი ჯერ არ გამოაცხადა.

სწრაფი ინფერენსისკენ მიმართული ეს ნაბიჯი ინდუსტრიის საერთო ტენდენციას ასახავს: რაც უფრო ღრმად ინტეგრირდება AI რეალურ სამუშაო პროცესებში — კოდის გამართვიდან, მხარდაჭერის მოთხოვნებზე პასუხის გაცემიდან სავაჭრო ანალიზის ჩატარებამდე — მოდელის პასუხის სისწრაფე სულ უფრო მნიშვნელოვანი ხდება, სიზუსტის პარალელურად.