როცა ჩატბოტს კითხვას უსვამთ, ის ტექსტით პასუხობს. Computer Use სხვაგვარად მუშაობს: ის AI მოდელს აძლევს საშუალებას, ნახოს ეკრანი და პირდაპირ მართოს მაუსი და კლავიატურა — დააჭიროს ღილაკებს, შეავსოს ფორმები და გადავიდეს აპლიკაციებს შორის ისე, როგორც ადამიანი გააკეთებდა — ისე, რომ არავის სჭირდება თითოეული პროგრამისთვის ცალკე ინტეგრაციის შექმნა.
რა არის ეს
Computer Use არის AI-ის შესაძლებლობა და არა ერთი კონკრეტული პროდუქტი. Anthropic-მა ის 2024 წლის ოქტომბერში წარადგინა, როგორც Claude-ის ფუნქცია, ხოლო OpenAI-მ საკუთარი ვერსია გამოუშვა — მოდელი, რომელსაც Computer-Using Agent, ანუ CUA უწოდა — Operator-ში, 2025 წლის იანვარში გაშვებულ კვლევით ვერსიაში. ორივე ერთნაირად მუშაობს: მოდელი იღებს ეკრანის სქრინშოტს, წყვეტს, რა გააკეთოს შემდეგ, და შემდეგ ან ამოძრავებს კურსორს, აწკაპუნებს ან წერს იმავე გრაფიკულ ინტერფეისზე, რომელსაც ადამიანი იყენებს — და არა სპეციალურად AI-სთვის შექმნილ პროგრამულ ინტერფეისზე.
ეს განსხვავება მნიშვნელოვანია, რადგან პროგრამული უზრუნველყოფის უმეტესობას AI-სთვის ხელსაყრელი გზა არ გააჩნია. საავადმყოფოს ჩანიშვნის სისტემას, ათწლეულების წინანდელ ბუღალტრულ პროგრამას ან კომპანიის შიდა პანელს შესაძლოა ოფიციალური API არასდროს ჰქონდეს. Computer Use საშუალებას აძლევს მოდელს მაინც იმუშაოს ასეთ პროგრამასთან — ისე, როგორც ახალი თანამშრომელი იმუშავებდა: ეკრანს დაუყურებდა და დააწკაპუნებდა.
როგორ მუშაობს
მოდელი ციკლში მუშაობს. ის იღებს მიმდინარე ეკრანის სქრინშოტს, აანალიზებს, რა უნდა მოხდეს შემდეგ — დავალებისა და აქამდე გაკეთებული ყველაფრის გათვალისწინებით — და ირჩევს მოქმედებას: კურსორის გადატანა კონკრეტულ წერტილზე, დაწკაპუნება, ტექსტის აკრეფა, გადახვევა, ან ახალი სქრინშოტის გადაღება შედეგის შესამოწმებლად. ეს ციკლი — ერთი სქრინშოტი, ერთი მოქმედება — მეორდება, სანამ დავალება არ დასრულდება ან საჭირო არ გახდება ადამიანის ჩარევა.
ამის სწორად გაკეთება ტექნიკურად საკმაოდ რთული აღმოჩნდა. ადრეულმა ტესტირებამ აჩვენა, რომ მოდელებს უჭირდათ თუნდაც იმის განსაზღვრა, რამდენი პიქსელით უნდა გადაეტანათ კურსორი სწორ ღილაკზე მოსახვედრად — უნარი, რომელსაც ადამიანი ავტომატურად ფლობს. Anthropic-ის ვერსიამ რეალურ სამუშაო მაგიდის ამოცანების OSWorld ბენჩმარკზე 14.9% დააფიქსირა — იმჟამინდელ სხვა მოდელებზე წინ (7.7%), მაგრამ ადამიანის ჩვეულებრივ 70–75%-ზე გაცილებით დაბლა. OpenAI-ის CUA-მაც მსგავსი სურათი აჩვენა საკუთარ ტესტებში: დაახლოებით 38% საოპერაციო სისტემის დონის ამოცანებზე და 58% ვებ-ამოცანებზე. ეს რიცხვები აღწერს ტექნოლოგიის დღევანდელ მდგომარეობას და არა დასრულებულ პროდუქტს: Computer Use დღეს რეალურად სასარგებლოა, მაგრამ უფრო ნელი და ნაკლებად საიმედოა, ვიდრე API-ზე დაფუძნებული ავტომატიზაცია ან იგივე სამუშაოს შემსრულებელი ადამიანი.
რატომ აქვს მნიშვნელობა
Computer Use ხსნის ავტომატიზაციის განსხვავებულ ტიპს, ვიდრე კითხვებზე პასუხის გამცემი ჩატბოტი ან დოკუმენტირებულ API-ს გამომძახებელი AI აგენტი. ის მუშაობს პროგრამულ უზრუნველყოფასთან ზუსტად ისე, როგორც ის უკვე არსებობს, მომწოდებლისგან ინტეგრაციის შექმნის მოლოდინის გარეშე — სწორედ ამიტომ დგას ის იმ პროდუქტების უკან, რომლებიც საკუთარ თავს „სამუშაოს შემსრულებელ აგენტებად" პოზიციონირებენ: აპლიკაციის ტესტირება ისე, როგორც მომხმარებელი გააკეთებდა, ფორმების შევსება სისტემებში, რომლებიც ერთმანეთს არ ესაუბრებიან, ან მრავალსაფეხურიანი ამოცანის შესრულება ძველ შიდა ინსტრუმენტში.
ეს მოქნილობა ამავე დროს კომპრომისსაც ნიშნავს. რადგან მოდელი რეაგირებს იმაზე, რაც ეკრანზეა, მას შეცდომაში შეიძლება შეიყვანოს ის, რასაც ეკრანზე ხედავს. მავნე ამომხტარი ფანჯარა, ვებგვერდში დამალული ინსტრუქცია ან შეცვლილი ტექსტი ერთი შეხედვით ჩვეულებრივ ფორმაზე მოდელს დავალებიდან გადაახვევინებს — ეს არის პრომფტ ინექციის ეკრანზე დაფუძნებული ვარიანტი, რომელიც მიმართულია იმაზე, რაც გვერდზეა გამოსახული და არა იმაზე, რაც ჩატის ველშია აკრეფილი. Anthropic Computer Use-ს თავის მეორე ყველაზე დაბალ AI უსაფრთხოების დონეს მიაკუთვნებს და გვირჩევს, ის იზოლირებულ ვირტუალურ მანქანაში გავუშვათ, სენსიტიურ ანგარიშებზე წვდომის გარეშე, ასევე ადამიანის დადასტურებით ნებისმიერ მნიშვნელოვან ნაბიჯამდე — გადახდის დეტალების შეყვანამდე, ფულის გაგზავნამდე ან ხელშეკრულებაზე დათანხმებამდე.
OpenAI-ის ვერსიამ უკვე ერთხელ შეიცვალა ფორმა: Operator დამოუკიდებელ პროდუქტად 2025 წლის იანვარში გაეშვა, 2025 წლის ივლისში ChatGPT-ის ჩაშენებულ „agent mode"-ში გაერთიანდა, ხოლო მომდევნო თვეს ცალკე აპლიკაციის სახით შეწყდა. საბაზისო CUA მოდელი არ გამქრალა — ის ახლა ChatGPT-ისა და OpenAI-ის დეველოპერული ხელსაწყოების შიგნით მუშაობს — თუმცა ეს ცვლილება იმის შეხსენებაა, რომ ეს ჯერ კიდევ ადრეული, სწრაფად ცვალებადი შესაძლებლობაა და არა ჩამოყალიბებული პროდუქტის კატეგორია.
როგორ ვცადოთ
Computer Use დღეს დეველოპერებზე ორიენტირებული ფუნქციაა, რომელიც ხელმისაწვდომია Claude API-ს მეშვეობით და არა ცალკე სამომხმარებლო აპლიკაციის სახით. Anthropic აქვეყნებს საცნობარო იმპლემენტაციას მზა სენდბოქსით, ხოლო ChatGPT-ის მომხმარებლებს იმავე საბაზისო შესაძლებლობასთან წვდომა აქვთ ჩვეულებრივი ChatGPT ინტერფეისის „agent mode"-ის მეშვეობით. Computer Use-ს ცალკე გამოწერის საფასური არ აქვს — ის ნებისმიერი სხვა API გამოძახების მსგავსად, სტანდარტული ტოკენების ტარიფით ირიცხება (2026 წლის ივლისის მდგომარეობით, Claude Sonnet 5 ღირს $2 მილიონ შემავალ ტოკენზე და $10 მილიონ გამომავალ ტოკენზე, Anthropic-ის ფასების გვერდის მიხედვით), ასევე მცირე დანამატი ხელსაწყოს აღწერისთვის და თითოეული სქრინშოტისთვის, რომელსაც მოდელი განიხილავს.