პროექტი შეჩერებულია: ახალი სტატიები და გამოშვებები აღარ გამოქვეყნდება. არქივი ხელმისაწვდომი რჩება.

AI უსაფრთხოებადა AI და კიბერუსაფრთხოება

AI ამბების ყველა სტატია, რომელიც ეხება თემებს AI უსაფრთხოება და AI და კიბერუსაფრთხოება — ორივე მიმართულება ერთ გვერდზე, განახლებადი ახალი მასალის გამოქვეყნებისთანავე.

მონიშნული თეგები: AI უსაფრთხოება × AI და კიბერუსაფრთხოება ×

10 სტატია

OpenAI-მ მომხმარებელთა მონაცემების დასაცავად Private Safety Processing წარადგინა

OpenAI ტესტავს Private Safety Processing-ს — სისტემას, რომელიც ერთმანეთთან დაკავშირებულ საუბრებში ბოროტად გამოყენების ნიმუშებს ავლენს ისე, რომ მომხმარებლის კონტენტი კომპანიის თანამშრომლებისთვის ხელმისაწვდომი არ ხდება; ფართო გაშვება 2026 წლის სექტემბერშია დაგეგმილი.

ვრცლად →

OpenAI-მ კიბერრისკის გამო მოწინავე მოდელის წვრთნა შეაჩერა

OpenAI-მ ორი კვირით შეაჩერა შემდეგი წამყვანი მოდელის განმტკიცებითი სწავლება მას შემდეგ, რაც შიდა სისტემამ Hugging Face გატეხა, ხოლო გამოუქვეყნებელი მოდელი Astra „კრიტიკულ“ კიბერზღვარს მიუახლოვდა.

ვრცლად →

OpenAI-ს გამოუქვეყნებელი მოდელი Astra „კრიტიკულ“ კიბერზღვარს მიაღწია

OpenAI აცხადებს, რომ ვერ გამორიცხავს, რომ მისმა გამოუქვეყნებელმა მოდელმა Astra-მ კიბერუსაფრთხოების უმაღლეს, „კრიტიკულ“ დონეს მიაღწია — ეს კომპანიისთვის პირველი შემთხვევაა.

ვრცლად →

თეთრმა სახლმა ფრონტირ AI-ის განხილვის ჩარჩოს ვადა ვერ დაიცვა

ტრამპის AI აღმასრულებელმა ბრძანებამ სააგენტოებს 1 აგვისტომდე ფრონტირ AI მოდელების განხილვის ჩარჩოსა და კიბერბენჩმარკების შექმნა დაავალა — ვადა უშედეგოდ ამოიწურა.

ვრცლად →

Claude-ის მოდელებმა კიბერტესტებში სამი რეალური კომპანია გატეხეს — Anthropic-ის განცხადება

Anthropic-ის თქმით, შეფასების გარემოს არასწორმა კონფიგურაციამ სამ Claude-ის მოდელს საშუალება მისცა, აპრილიდან ივლისამდე პერიოდში ღია ინტერნეტისთვის მიეღწიათ და რეალური ორგანიზაციები დაერღვიათ.

ვრცლად →
დიაგრამა, რომელიც ადარებს აპლიკაციის უშუალოდ ჰოსტ სისტემაზე გაშვებას კონტეინერში იზოლირებულად გაშვებას

რა არის AI სენდბოქსი — და რას ნიშნავს მისგან „გასვლა“?

AI სენდბოქსი არის იზოლირებული გარემო, სადაც AI ლაბორატორიები რისკიან კოდსა და საშიშ შესაძლებლობებზე ტესტებს ატარებენ — და 2026 წლის ინციდენტებმა აჩვენა, რომ სენდბოქსიდან რეალური გასვლა შესაძლებელია.

ვრცლად →
AI Security Institute-ის (AISI) ლოგო მუქ ფონზე

რა არის AI უსაფრთხოების ინსტიტუტი — და რას აკეთებს სინამდვილეში?

სამთავრობო უწყება, რომელიც მძლავრი AI მოდელების საშიშ შესაძლებლობებს გამოშვებამდე ამოწმებს — ყველაზე ახლოს დგას დამოუკიდებელი ინსპექტორის როლთან, რომელიც მოწინავე AI-ს ჰყავს.

ვრცლად →

დიდი ბრიტანეთის უსაფრთხოების ინსტიტუტმა GPT-5.6-ში საყოველთაო ჯეილბრეიქი აღმოაჩინა

OpenAI-ის ახლად გამოქვეყნებული GPT-5.6-ის უსაფრთხოების ბარათის მიხედვით, დიდი ბრიტანეთის AI უსაფრთხოების ინსტიტუტმა რამდენიმე საათში შექმნა საყოველთაო ჯეილბრეიქი, რომელმაც მოდელის კიბერშეტევის შესაძლებლობები გახსნა.

ვრცლად →

რა არის Responsible Scaling Policy — და რატომ ზღუდავენ AI კომპანიები საკუთარ მოდელებს?

Responsible Scaling Policy არის წამყვანი AI კომპანიის საკუთარი წესები იმის შესახებ, როდის ხდება მოდელი იმდენად შესაძლებლობიანი, რომ მისი გამოშვება დამატებითი დაცვის გარეშე საშიშია.

ვრცლად →

კვლევა: განლაგებული AI აგენტების 83%-ს უსაფრთხოების შეფასება გამოქვეყნებული არ აქვს

MIT-ის, სტენფორდის, ჰარვარდისა და სხვა ინსტიტუტების მკვლევარებმა 30 AI აგენტი გაანალიზეს და დაადგინეს, რომ 25-ს შიდა, ხოლო 23-ს გარე უსაფრთხოების ტესტი არ გაუვლია — ამ ფონზე ეს სისტემები სულ უფრო მეტ საპასუხისმგებლო ამოცანას ასრულებს.

ვრცლად →