რა არის დანაწილებული ინფერენსი — და როგორ აჩქარებს ის AI-ს?
დანაწილებული ინფერენსი AI მოდელის მუშაობის ორ ეტაპს ცალ-ცალკე, თითოეულისთვის მორგებულ ჩიპებზე ანაწილებს — ტექნიკა, რომელიც Nvidia-დან AMD-სა და Cerebras-ის აპარატურამდე ვრცელდება.
ვრცლად →AI ამბების ყველა სტატია, რომელიც ეხება თემებს AI ჩიპები და AI დასკვნა (Inference) — ორივე მიმართულება ერთ გვერდზე, განახლებადი ახალი მასალის გამოქვეყნებისთანავე.
8 სტატია
დანაწილებული ინფერენსი AI მოდელის მუშაობის ორ ეტაპს ცალ-ცალკე, თითოეულისთვის მორგებულ ჩიპებზე ანაწილებს — ტექნიკა, რომელიც Nvidia-დან AMD-სა და Cerebras-ის აპარატურამდე ვრცელდება.
ვრცლად →AMD-მ და Cerebras-მა ერთობლივი AI ინფერენსის სისტემა წარადგინეს, რომელიც დატვირთვას AMD-ის Helios სერვერებსა და Cerebras-ის ფირფიტა-მასშტაბის ჩიპს შორის ანაწილებს — კომპანიების თქმით, ეფექტურობა ვატზე 5-ჯერამდე იზრდება.
ვრცლად →
AMD-მ 23 ივლისს წარადგინა Instinct MI400 სერიის AI ჩიპები და Helios თაროს მასშტაბის სისტემები — კომპანიის თქმით, დასკვნის სისწრაფე წინა თაობასთან შედარებით 34-ჯერ გაიზარდა, ღონისძიებას კი OpenAI-ის, Meta-ს და Anthropic-ის წარმომადგენლები დაესწრნენ.
ვრცლად →Etched-ი, ჩიპების მწარმოებელი კომპანია, 20 მილიარდ დოლარიან შეფასებაზე დაფინანსების რაუნდის მოლაპარაკებებს აწარმოებს, რაც მისი დეკემბრის შეფასების ოთხმაგ ზრდას ნიშნავს — ინვესტორები კი AI ინფერენსისთვის Nvidia-ს ალტერნატივებს ეძებენ, წერს Wall Street Journal-ი.
ვრცლად →SambaNova-მ Series F რაუნდის პირველი ტრანში $1 მილიარდის ოდენობით დახურა General Atlantic-ის ხელმძღვანელობით, ხოლო JPMorganChase-მა კომპანიის ჩიპები ადგილზე ინფერენსისთვის აირჩია.
ვრცლად →Qualcomm-მა 24 ივნისს Dragonfly-ს სახელით სერვერული CPU და ინფერენს ამაჩქარებელი წარადგინა. Meta 2028 წლიდან ჩიპებს საკუთარ სერვერ ინფრასტრუქტურაში გამოიყენებს.
ვრცლად →AI ინფერენს ჩიპი სპეციალიზებული პროცესორია, რომელიც მომზადებული AI მოდელების სწრაფ და ეკონომიურ გამოყენებას უზრუნველყოფს. ვხსნით, რატომ ქმნიან ტექნოლოგიური გიგანტები საკუთარ ჩიპებს Nvidia-ს ნაცვლად.
ვრცლად →OpenAI-მ და Broadcom-მა 24 ივნისს წარადგინეს Jalapeño — inference-ისთვის შექმნილი ჩიპი, რომელიც ცხრა თვეში AI-ის დახმარებით დაპროექტდა და 2026 წლის ბოლოსთვის გამოყენებაში შესვლა ეგეგმება.
ვრცლად →