ჩინურმა ფინტექ გიგანტმა Ant Group-მა წარმოადგინა Ling-3.0-Flash — ახალი AI მოდელი, რომელიც კომპანიის განცხადებით, მსჯელობის, ინსტრუქციების შესრულებისა და გრძელი კონტექსტის დამუშავების ამოცანებში საკუთარ ზომაზე ორ-სამჯერ დიდ სისტემებს შეედრება ან სჯობნის კიდეც — ამასთან, თითოეულ მოთხოვნაზე პარამეტრების მხოლოდ მცირე ნაწილს აქტიურებს.
შედარებით მსუბუქი Mixture-of-Experts არქიტექტურა
Ling-3.0-Flash შექმნილია inclusionAI-ის მიერ — ეს არის Ant Group-ის AI კვლევითი ლაბორატორია — და სულ 124 მილიარდი პარამეტრი აქვს. სხვა Mixture-of-Experts მოდელების მსგავსად, ის თითოეული ტოკენისთვის მხოლოდ მცირე ნაწილს — ამ შემთხვევაში სულ 5.1 მილიარდ პარამეტრს — აქტიურებს, Ant Group-ის 27 ივლისის განცხადების მიხედვით. ეს კომპანიის წინა, Ling-2.6 სერიასთან შედარებით კიდევ უფრო მკვეთრი შეკუმშვაა — და Ant Group ამბობს, რომ ახალი მოდელი მაინც შეედრება ან სჯობნის საკუთარ, დაახლოებით 1-ტრილიონპარამეტრიან Ling-2.6 წამყვან მოდელს ტესტირებული ბენჩმარქების უმეტესობაში — თანაც აქტიური პარამეტრების თითქმის თორმეტჯერ ნაკლები რაოდენობით.
მოდელი იყენებს ჰიბრიდულ ყურადღების არქიტექტურას, რომელიც ორ ტექნიკას — Moonshot AI-ის კვლევაზე დაფუძნებულ Kimi Delta Attention-სა და მრავალთავიან ლატენტურ ყურადღებას (MLA) — 5:1 თანაფარდობით ენაცვლება; ეს, Ant Group-ის თქმით, გრძელი დოკუმენტების დამუშავებას აიაფებს. მოდელის საკონტექსტო ფანჯარა ბუნებრივად 256 000 ტოკენს მოიცავს, ხოლო კომპანიის გეგმის მიხედვით, საბოლოოდ 1 მილიონამდე გაიზრდება.
შექმნილია AI აგენტებისთვის, არა საუბრისთვის
Ant Group Ling-3.0-Flash-ს ჩვეულებრივი ჩატბოტის ნაცვლად, უფრო AI აგენტების სამუშაო ჯაჭვების სწრაფ ინფრასტრუქტურად წარმოაჩენს — მას კომპანია „მაღალსიჩქარიან შემსრულებელ კვანძს“ უწოდებს, რომელიც მრავალსაფეხურიან ამოცანებში დაგეგმვას, ხელსაწყოების გამოძახებასა და თვითკორექციას ახორციელებს. კომპანიის თქმით, მოდელი 10 000-ზე მეტ ინტერაქტიულ გარემოში გაწვრთნეს და დაამატეს ქეშირების სისტემა, რომელიც გრძელი შეყვანისას პირველ პასუხამდე დროს 60-დან 80 პროცენტამდე ამცირებს.
ჯერჯერობით უფასო, ღია წონები — მოგვიანებით
Ling-3.0-Flash ამჟამად უფასოდ ხელმისაწვდომია OpenRouter-სა და Vercel AI Gateway-ის საშუალებით, 2026 წლის 3 აგვისტომდე, რის შემდეგაც სტანდარტული ტარიფები ამოქმედდება. Ant Group-ის თქმით, ამ ვადის ამოწურვის შემდეგ მოდელის წონები ღიად გამოქვეყნდება, რითაც კომპანია იმეორებს ისეთი ჩინური ლაბორატორიების გზას, როგორიც არის Moonshot AI, რომლის Kimi K3 ახლახან ისტორიაში ყველაზე დიდი ღია წონების მოდელის გამოშვება გახდა. გამოქვეყნების მომენტისთვის Ant Group-ს დამოუკიდებელი ბენჩმარქების ცხრილები, ლიცენზიის პირობები თუ მოდელის ბარათი არ გამოუქვეყნებია.
ეს გამოშვება ემატება ჩინური AI ლაბორატორიების ტალღას, რომლებიც მასშტაბის ნაცვლად ეფექტურობაზე იჯიბრებიან — ტენდენცია, რომლის საჯაროდ მხარდაჭერისკენაც Nvidia-ს ჯენსენ ჰუანგმა ცოტა ხნის წინ ათობით კომპანია მოუწოდა, იმ არგუმენტით, რომ ღია მოდელები აშშ-ჩინეთის AI კონკურენციაში ტემპის შენარჩუნებისთვის აუცილებელია.