ექსპერტთა ნარევი (MoE)და ღია კოდის AI მოდელები

AI ამბების ყველა სტატია, რომელიც ეხება თემებს ექსპერტთა ნარევი (MoE) და ღია კოდის AI მოდელები — ორივე მიმართულება ერთ გვერდზე, განახლებადი ახალი მასალის გამოქვეყნებისთანავე.

მონიშნული თეგები: ექსპერტთა ნარევი (MoE) × ღია კოდის AI მოდელები ×

6 სტატია

Thinking Machines-მა Inkling-Small გამოუშვა — დიდ მოდელსაც სჯობნის

Thinking Machines Lab-ის მეორე ღია წონების მოდელი წინამორბედის აქტიური პარამეტრების მხოლოდ მეოთხედს იყენებს, თუმცა მსჯელობისა და კოდირების ტესტებში სჯობნის მას.

ვრცლად →

DeepSeek-მა გამოუშვა V4-Flash-0731 — საკუთარ დიდ მოდელსაც სჯობნის

DeepSeek-ის ოფიციალურმა V4-Flash-0731-მა კოდირებისა და აგენტულ ბენჩმარკებზე გადააჭარბა საკუთარ უფრო დიდ V4-Pro მოდელს, მიუხედავად იმისა, რომ თითოეულ ტოკენზე გაცილებით ნაკლები პარამეტრი აქვს აქტიური.

ვრცლად →

Ant Group-მა Ling-3.0-Flash გამოუშვა — ეფექტური AI მოდელი აგენტებისთვის

Ant Group-ის Ling-3.0-Flash მხოლოდ 5.1 მილიარდი აქტიური პარამეტრით მსჯელობისა და კოდირების ბენჩმარქებზე რამდენჯერმე დიდ მოდელებს შეედრება, კომპანიის თქმით.

ვრცლად →

Moonshot AI-მ Kimi K3 გამოუშვა — მისი ყველაზე დიდი ღია წონების მოდელი

პეკინში დაფუძნებულმა Moonshot AI-მ Kimi K3-ის სრული ღია წონები გამოაქვეყნა — 2.8-ტრილიონპარამეტრიანი მოდელი, რომელსაც კომპანია დღემდე გამოქვეყნებულ ყველაზე დიდ ღია მოდელად მოიხსენიებს.

ვრცლად →

Poolside-მა Laguna S 2.1 გამოუშვა — ღია წონების კოდირების მოდელი

Poolside-ის ახალი 118-მილიარდპარამეტრიანი Laguna S 2.1 აგენტური კოდირების ბენჩმარქებში გაცილებით დიდ მოდელებს ეჯიბრება და ღია ლიცენზიით ვრცელდება.

ვრცლად →

Moonshot AI-მ Kimi K3 გამოუშვა — 2.8-ტრილიონპარამეტრიანი ღია მოდელი

ჩინურმა Moonshot AI-მ გამოუშვა Kimi K3 — 2.8-ტრილიონპარამეტრიანი ღია მოდელი 1 მილიონ ტოკენამდე საკონტექსტო ფანჯრით, რომელსაც კომპანია მსოფლიოში პირველ ღია 3-ტრილიონიან-კლასის AI მოდელად მოიხსენიებს.

ვრცლად →