ხედვა-ენა-მოქმედების მოდელები

ხედვა-ენა-მოქმედების (VLA) მოდელები არის AI სისტემები, რომლებიც ერთ მოდელში აერთიანებენ ვიზუალურ აღქმას, ენის გაგებასა და მოძრაობის კონტროლს — რაც რობოტს საშუალებას აძლევს, აღიქვას სცენა, გაიგოს ინსტრუქცია და პირდაპირ იმოქმედოს. აქ ვაშუქებთ VLA-კვლევას, გამოშვებებსა და ლაბორატორიებსა თუ რობოტებს, რომლებიც ამ მიდგომას ავითარებენ.

გააერთიანეთ:

Google DeepMind-მა წარადგინა Gemini Robotics 2 — ჰუმანოიდების მთელი სხეულის კონტროლი

Google DeepMind-ის ახალმა Gemini Robotics 2-ის მოდელებმა ჰუმანოიდურ რობოტებს მთელი სხეულის კოორდინაცია, მრავალსაფეხურიანი ამოცანების დაგეგმვა და ერთმანეთთან თანამშრომლობა ასწავლა — ეს Apptronik-ის Apollo 2-ზე დაადასტურეს.

ვრცლად →
კოლაბორაციული რობოტის მკლავი — ტიპის მოწყობილობა, რომელსაც vision-language-action AI მოდელები მართავენ

რა არის Vision-Language-Action (VLA) მოდელი — და რატომ აქვს მნიშვნელობა?

Vision-language-action (VLA) მოდელი კამერის გამოსახულებასა და მარტივ ინსტრუქციას პირდაპირ რობოტის მოძრაობად გარდაქმნის, რითაც ცალკეულ აღქმისა და მართვის სისტემებს ერთი მოდელით ანაცვლებს.

ვრცლად →