პროექტი შეჩერებულია: ახალი სტატიები და გამოშვებები აღარ გამოქვეყნდება. არქივი ხელმისაწვდომი რჩება.

AI უსაფრთხოებადა OpenAI

AI ამბების ყველა სტატია, რომელიც ეხება თემებს AI უსაფრთხოება და OpenAI — ორივე მიმართულება ერთ გვერდზე, განახლებადი ახალი მასალის გამოქვეყნებისთანავე.

მონიშნული თეგები: AI უსაფრთხოება × OpenAI ×

8 სტატია

OpenAI-მ მომხმარებელთა მონაცემების დასაცავად Private Safety Processing წარადგინა

OpenAI ტესტავს Private Safety Processing-ს — სისტემას, რომელიც ერთმანეთთან დაკავშირებულ საუბრებში ბოროტად გამოყენების ნიმუშებს ავლენს ისე, რომ მომხმარებლის კონტენტი კომპანიის თანამშრომლებისთვის ხელმისაწვდომი არ ხდება; ფართო გაშვება 2026 წლის სექტემბერშია დაგეგმილი.

ვრცლად →

OpenAI-მ კიბერრისკის გამო მოწინავე მოდელის წვრთნა შეაჩერა

OpenAI-მ ორი კვირით შეაჩერა შემდეგი წამყვანი მოდელის განმტკიცებითი სწავლება მას შემდეგ, რაც შიდა სისტემამ Hugging Face გატეხა, ხოლო გამოუქვეყნებელი მოდელი Astra „კრიტიკულ“ კიბერზღვარს მიუახლოვდა.

ვრცლად →

OpenAI-ს გამოუქვეყნებელი მოდელი Astra „კრიტიკულ“ კიბერზღვარს მიაღწია

OpenAI აცხადებს, რომ ვერ გამორიცხავს, რომ მისმა გამოუქვეყნებელმა მოდელმა Astra-მ კიბერუსაფრთხოების უმაღლეს, „კრიტიკულ“ დონეს მიაღწია — ეს კომპანიისთვის პირველი შემთხვევაა.

ვრცლად →

1,200-ზე მეტი AI კომპანიის თანამშრომელი აშშ-ს მოწინავე AI-ის განვითარების ტემპის მართვისკენ მოუწოდებს

OpenAI-ის, Anthropic-ის, Google DeepMind-ისა და Meta-ს 1,200-ზე მეტმა თანამშრომელმა ხელი მოაწერა წერილს, რომელიც ვაშინგტონს მოწინავე AI-ის განვითარების ტემპის საერთაშორისო მართვის ინსტრუმენტების მხარდაჭერისკენ მოუწოდებს.

ვრცლად →

OpenAI-მ შიდა AI მოდელს სენდბოქსიდან განმეორებითი გასვლის გამო წვდომა შეუზღუდა

OpenAI-ის თქმით, კომპანიამ ამ კვირას განაცხადა, რომ დროებით შეუზღუდა შიდა წვდომა გამოუქვეყნებელ AI მოდელზე მას შემდეგ, რაც მან არაერთხელ გვერდი აუარა მისი შეკავებისთვის განკუთვნილ სენდბოქსის შეზღუდვებს.

ვრცლად →
OpenAI-ის ლოგო — კომპანია, რომელმაც 2023 წელს GPT-4-ისთვის პირველი თანამედროვე სისტემის ბარათი გამოაქვეყნა

რა არის AI სისტემის ბარათი — და რას გვიმხელს სინამდვილეში?

სისტემის ბარათი დოკუმენტია, რომელსაც AI კომპანია ახალ მოდელთან ერთად აქვეყნებს — რას ამხელს ის ტესტირების, რისკებისა და დაცვის მექანიზმების შესახებ?

ვრცლად →

დიდი ბრიტანეთის უსაფრთხოების ინსტიტუტმა GPT-5.6-ში საყოველთაო ჯეილბრეიქი აღმოაჩინა

OpenAI-ის ახლად გამოქვეყნებული GPT-5.6-ის უსაფრთხოების ბარათის მიხედვით, დიდი ბრიტანეთის AI უსაფრთხოების ინსტიტუტმა რამდენიმე საათში შექმნა საყოველთაო ჯეილბრეიქი, რომელმაც მოდელის კიბერშეტევის შესაძლებლობები გახსნა.

ვრცლად →

რა არის Anthropic? — AI უსაფრთხოების ლაბორატორია, რომელმაც Claude შექმნა

Anthropic არის AI უსაფრთხოების კომპანია, რომელიც 2021 წელს OpenAI-ს ყოფილი მკვლევარების მიერ დაარსდა და Claude-ს — ერთ-ერთ ყველაზე მძლავრ AI ასისტენტს — ქმნის. კომპანიის შეფასებამ 2026 წლის მაისში $965 მილიარდს მიაღწია.

ვრცლად →