DeepSeek-მა თავისი წამყვანი ენობრივი მოდელი, DeepSeek V4 Pro, პრევიუდან სრულ ხელმისაწვდომობაზე გადაიყვანა — დაახლოებით ოთხთვიანი ტესტირების პერიოდი დასრულდა ვერსიით, რომელსაც ჩინურმა AI ლაბორატორიამ გამოშვების თარიღის მიხედვით 0813 უწოდა.

DeepSeek-ის წინა გამოშვებებისგან განსხვავებით, ამჯერად კომპანიამ განახლება თითქმის არ გაახმაურა. South China Morning Post-ის ცნობით, კომპანიამ საკუთარ საიტზე მოკლედ განაცხადა „აგენტული შესაძლებლობების მნიშვნელოვანი გაუმჯობესების“ შესახებ, თუმცა განცხადება მეორე დღეს ჩუმად მოხსნა. DeepSeek-ის მოდელის ბარათი Hugging Face-ზე ადასტურებს, რომ ახალი ვერსია ცვლის პრევიუს და მასში დამატებულია მსჯელობის ინტენსივობის სამი დონე — დაბალი, მაღალი და მაქსიმალური — რომლებიც განსაზღვრავს, რამდენად ღრმად „დაფიქრდეს“ მოდელი პასუხის გაცემამდე.

მკვეთრი ნახტომი კოდირებაში, საშუალო შედეგი მსჯელობაში

მოდელის ბარათის მიხედვით, ახალი ვერსიის აგენტულმა და კოდირების შედეგებმა პრევიუსთან შედარებით მკვეთრად მოიმატა: DeepSWE 12.8-დან 62.7-მდე გაიზარდა, CyberGym — 52.7-დან 83.3-მდე, ხოლო Terminal-Bench 2.1 — 72.1-დან 87.9-მდე.

უფრო ფართო მსჯელობის ტესტებში შედეგი ნაკლებად შთამბეჭდავი აღმოჩნდა. Artificial Analysis-ის Intelligence Index-მა V4 Pro 0813-ს 53 ქულა მისცა — ეს იმავე დონეზეა, რაც Zhipu AI-ის GLM-5.2, მაგრამ ოთხი ქულით ჩამორჩება OpenAI-ის GPT-5.6-ს და შვიდით — Moonshot AI-ის Kimi K3-ს. Vals Index-ში მოდელი მე-12 ადგილზეა, OpenAI-ის GPT-5.5-სა და Anthropic-ის Claude Opus 5-ის შემდეგ. გამოცემის ცნობით, მოდელს გაუჭირდა სენდბოქს-გარემოში ტერმინალის დავალებების შესრულება და რთული ფინანსური ცხრილების აწყობა, თუმცა მკვლევარების თქმით, კიბერუსაფრთხოების ვიწრო დავალებებში შედარებით კარგად გამოჩნდა.

ფასი ჯერჯერობით უცვლელია

V4 Pro 0813 პრევიუს ფასებს ინარჩუნებს — $0.435 მილიონ შემავალ ტოკენზე (ქეშის გამოტოვების შემთხვევაში) და $0.87 მილიონ გამომავალ ტოკენზე — მიუხედავად იმისა, რომ DeepSeek-მა უკვე მიანიშნა „მნიშვნელოვან“ ფასის ზრდაზე, თარიღის დაზუსტების გარეშე. მოდელი კვლავ ღია წონებით ვრცელდება MIT ლიცენზიით, რაც აგრძელებს იმ ტენდენციას, რომელიც DeepSeek-მა V4 Flash-ით დაამკვიდრა — ივლისში გამოშვებული მოდელი, რომელმაც პრევიუს დიდი Pro ვერსიას რამდენიმე აგენტულ ტესტში აჯობა.

ჩუმმა გამოშვებამ და არაერთგვაროვანმა შედეგებმა დეველოპერების თავშეკავებული რეაქცია გამოიწვია — ზოგი ადრეული ტესტერი აღნიშნავს, რომ ლაბორატორიისგან, რომელმაც ფასთან შედარებით მაღალი ღირებულებით მოიხვეჭა რეპუტაცია, მეტს ელოდა. გამოშვება DeepSeek-ს ისევ AI აგენტებზე ორიენტირებული მოდელების ხალხმრავალ ბაზარზე აყენებს, სადაც ამ თვეს ასევე გამოჩნდა SpaceXAI-ის Grok 4.6 და Meta-ს Muse Glimmer.

ასევე წაიკითხეთ