Alibaba-მ განაახლა თავისი წამყვანი მოდელი Qwen3.8-Max — და განახლებამ დაუყოვნებლივ გაუსწრო Anthropic-ის Claude Opus 5-ს კოდირების ერთ-ერთ ყველაზე ცნობილ ლიდერბორდზე.

Alibaba-მ Qwen3.8-Max-0902 2 სექტემბერს გამოუშვა, როგორც ეს Alibaba Cloud-ის Qwen მოდელების ცვლილებების ჟურნალშია მითითებული. აღნიშვნა „0902“ არა ახალ საბაზისო მოდელს, არამედ არსებულ მოდელზე დამატებით წვრთნას აღნიშნავს: არქიტექტურა უცვლელია — 2.4 ტრილიონი პარამეტრი და 1 მილიონი ტოკენის კონტექსტის ფანჯარა — ხოლო ფასიც იგივეა, რაც თავდაპირველ ვერსიას ჰქონდა: $2 ყოველ მილიონ შეყვანილ და $6 ყოველ მილიონ გამომავალ ტოკენზე.

რა გაუმჯობესდა სინამდვილეში

Alibaba-ს განცხადებით, განახლება სამ მიმართულებას შეეხო: კოდირებას დიდი და ხანგრძლივი საინჟინრო პროექტებისთვის, მრავალინსტრუმენტიან აგენტურ სამუშაო პროცესებს, სადაც მოდელი ერთი ამოცანისთვის რამდენიმე ხელსაწყოს კოორდინაციას უწევს, და ხედვის შესაძლებლობებს — მათ შორის დიაგრამების წაკითხვასა და დოკუმენტების დამუშავებას. კომპანიას ახალი შიდა ბენჩმარკის შედეგები არ გამოუქვეყნებია.

Arena.ai-მ, რომელიც ფართოდ ცნობილ Code Arena: WebDev ლიდერბორდს მართავს, გაუმჯობესებას კონკრეტული ციფრები დაუკავშირა: Qwen3.8-Max-0902-მა ლიდერბორდზე პირველი ადგილი 1,691 ქულით დაიკავა — წინა Qwen3.8-Max სნეპშოტის 1,669 ქულასთან შედარებით — და სამი ქულით უსწრებდა Claude Opus 5-ის საუკეთესო შედეგის მქონე რეჟიმს. მან ასევე 17 ქულით გაუსწრო Moonshot AI-ის Kimi K3-ს. Arena.ai-ის ინფორმაციით, ახალი სნეპშოტი ცალსახად ლიდერობს მონაცემთა ანალიტიკისა და სამომხმარებლო პროდუქტების კატეგორიებში, ხოლო გეიმინგის, მარკეტინგისა და დიზაინის ტესტებში მეორე-მესამე ადგილს იკავებს.

სწრაფი განახლებების ტენდენცია

განახლება ჩინური AI ლაბორატორიების ჩვეულ პრაქტიკას ერგება — ისინი ხშირად უშვებენ გახმაურების გარეშე „სნეპშოტ“ განახლებებს ფლაგმანური მოდელებისთვის, ვიდრე სრულ ვერსიის ცვლილებას ელოდებიან. Alibaba-მ ახალი სნეპშოტი თავის API-ში qwen3.8-max-0902-ად ჩამოთვალა, თარიღიანი ალიასით qwen3.8-max-2026-09-02, რაც დეველოპერებს ამჟამინდელი მოდელის პირდაპირ ჩანაცვლების საშუალებას აძლევს.

ასევე წაიკითხეთ