
უსაფრთხოების მკვლევარები Anthropic-ის Fable-ის შეზღუდვებს აკრიტიკებენ
Anthropic-ის ახალი მოდელი Fable ბლოკავს მოთხოვნებს, რომლებიც კიბერუსაფრთხოებას მხოლოდ არაპირდაპირ ეხება. მკვლევრების თქმით, ფილტრები ჩვეულებრივ საინჟინრო სამუშაოსაც იჭერს და მათ ძველ მოდელზე აბრუნებს.
Anthropic-მა სამშაბათს გამოუშვა Fable და ის წარადგინა როგორც საჯარო და შეზღუდული ვერსია კიბერუსაფრთხოების მოდელ Mythos-ისა. მოდელთან დაკავშირებულმა შეზღუდვებმა უსაფრთხოების მკვლევრებისა და პროფესიონალების უკმაყოფილება გამოიწვია: მათი თქმით, ფილტრები იმ მოთხოვნებზეც რეაგირებს, რომლებსაც სისტემებზე თავდასხმასთან კავშირი არ აქვს.
ფილტრები თემას რეაგირებს და არა მოთხოვნას
IBM X-Force-ის უსაფრთხოების მკვლევარი ვალენტინა „ჩომპი“ პალმიოტი წერს, რომ Fable „უარყოფს ყველა მოთხოვნას, რომელიც კიბერუსაფრთხოებას მხოლოდ არაპირდაპირ ეხება. თუნდაც ისეთ უწყინარ დავალებას, როგორიც ბლოგის პოსტის წაკითხვაა“. როცა მოთხოვნა დამცავ მექანიზმს ააქტიურებს, მოდელი ჩატს აჩერებს და მომხმარებელს ატყობინებს, რომ „უსაფრთხოების ზომებმა ეს შეტყობინება კიბერუსაფრთხოების ან ბიოლოგიის თემად მონიშნა“. კიდევ ერთმა მკვლევარმა X-ზე აღნიშნა, რომ ფილტრის გასააქტიურებლად კოდის გადახედვის თხოვნაც კი საკმარისია.
რატომ არსებობს შეზღუდვები
Anthropic-მა ეს შეზღუდვები იმისთვის შემოიღო, რომ შემცირდეს რისკი, Fable არ გამოიყენონ მავნე პროგრამების დასაწერად ან პროგრამული უზრუნველყოფის ხარვეზების გამოყენებისთვის — ეს კომპანიისთვის დიდი ხნის საზრუნავია. ბიოლოგიის შეზღუდვები ანალოგიური შიშიდან მომდინარეობს, ბიოლოგიურ იარაღთან დაკავშირებით. მოდელი ისეა დაპროგრამებული, რომ დამცავი მექანიზმის გააქტიურებისას Claude Opus 4.8-ზე გადავიდეს. ამავდროულად Anthropic ამუშავებს Cyber Verification Program-ს: დამტკიცებული უსაფრთხოების პროფესიონალები Claude-ს კიბერუსაფრთხოების სამუშაოსთვის ნაკლები შეზღუდვით იყენებენ. OpenAI-ს მსგავსი პროგრამა Trusted Access for Cyber ჰქვია.
Mythos და Project Glasswing
როცა Anthropic-მა აპრილში Mythos გამოუშვა, მოდელი შეზღუდული რაოდენობის კომპანიებსა და ორგანიზაციებს დაუთმო Project Glasswing-ის ფარგლებში, რომლის მიზანი კრიტიკული პროგრამული უზრუნველყოფისა და ინფრასტრუქტურის დაცვაა. გასულ კვირას კომპანიამ წვდომა 15 ქვეყნის ასობით ორგანიზაციამდე გააფართოვა.
საკვანძო სიტყვები და არა განსჯა
კიბერუსაფრთხოების ვეტერანი მეტ სუიში, რომელიც ახლა AI-უსაფრთხოების სტარტაპ Tolmo-ში მუშაობს, TechCrunch-ს უთხრა: „თუ მას დაცული კოდის დაწერას სთხოვ, ის ფიქრობს, რომ ეს კიბერუსაფრთხოების სამუშაოა და არა პროგრამული ინჟინერიის საუკეთესო პრაქტიკა, და დაქვეითებას იღებ“. მისი აზრით, ტრიგერები საკვანძო სიტყვებზეა დაფუძნებული, ამიტომ „კიბერუსაფრთხოების“ ლექსიკური ველის ყველაფერი მათ ააქტიურებს. მანვე დასძინა, რომ ამ ეტაპზე ეს გასაგებია და შეზღუდვები დროთა განმავლობაში შესაძლოა შემცირდეს: „ასეთი გამოშვებისას უკეთესია მეტი ადამიანი დაიჭირო, ვიდრე ცოტა, და დროთა განმავლობაში შეზღუდვები შეამსუბუქო“. Anthropic-მა კომენტარის თხოვნას დაუყოვნებლივ არ უპასუხა.
SiTech — AI-გაძლიერებული ვებ დეველოპმენტი
ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.