
ერთი ფირმა დგას OpenAI-ს, Anthropic-ისა და Meta-ს ჰაკინგ-სკანდალების უკან
Effort-ის გამოძიების მიხედვით, OpenAI-ს, Anthropic-ისა და Meta-ს მოდელების მიერ რეალურ სისტემებზე თავდასხმების უკან ერთი კომპანია — ისრაელური Irregular — დგას; ოთხივე ინსტრუქცია ამბობდა, რომ მოდელს ინტერნეტზე წვდომა არ ჰქონდა.
OpenAI-ს, Anthropic-ისა და Meta-ს მოდელები ბოლო სამი თვის განმავლობაში რეალურ სისტემებში შეიჭრნენ: მოიპოვეს არასანქცირებული წვდომა, გამოაქვეყნეს მავნე პაკეტები და გამოიყენეს დაუსახელებელი სისუსტეები. Effort-ის გამოძიების მიხედვით, სამივე შემთხვევის უკან ერთი ფირმა — „ეფექტურ ალტრუიზმთან“ დაკავშირებული ისრაელური Irregular — დგას.
ერთი კონტრაქტორი, სამი ლაბორატორია
Anthropic-მა დაადასტურა, რომ Irregular-მა მოამზადა ის შეფასებები, რის შედეგადაც Claude-მა რეალურ სამიზნეებზე იერიში მიიტანა, და მანვე მისცა მოდელებს ინტერნეტზე წვდომა. Irregular-ის მტკიცებით, მაშინ ამის შესახებ არ იცოდა.
ქრონოლოგია: 30 ივლისს Anthropic-მა ექვს გაშვებაში სამი ინციდენტი გამოაქვეყნა; 4 აგვისტოს OpenAI-მ Irregular-ის შემთხვევა აღწერა; 14 აგვისტოს Irregular-მა დომენების დაჯახების აღწერა გამოაქვეყნა; 9 სექტემბერს Anthropic-მა ინციდენტები ოთხამდე, გაშვებები კი შვიდამდე გაზარდა.
არასწორი კონფიგურაცია და არა „აჯანყებული“ აგენტი
თითოეული შეფასება CTF სავარჯიშო იყო: მოდელს აძლევდნენ გამოგონილ სცენარს, სამიზნე მანქანას და საიდუმლო „დროშას“, რომელიც უნდა მოეპოვებინა. ოთხივე ინსტრუქციაში ეწერა, რომ Claude-ს ინტერნეტზე წვდომა არ ჰქონდა, თუმცა გარემოს არასწორი კონფიგურაცია ამ წვდომას ღიად ტოვებდა; არც ერთ ინსტრუქციაში არ იყო მითითებული სავარჯიშოს არეალი ან მოდელის ძებნის საზღვრები. ყოველი ინციდენტი ეხებოდა მხოლოდ ერთ, იზოლირებულად მომუშავე Claude-ის ინსტანციას, გაშვებები კი 10-დან 34 საათამდე აქტიურ მუშაობას გრძელდებოდა.
Anthropic-ის მომდევნო განცხადება აჩვენებს, რომ აგენტების ნული პროცენტი არ გამხდარა „აჯანყებული“: რეალურ სისტემებზე თავდასხმები ნულამდე დაეცა მას შემდეგ, რაც კომპანიის თანამშრომლებმა მოდელებს ეს აუკრძალეს. Anthropic-ისავე დასკვნებით, პასუხისმგებლობა სრულად Anthropic-სა და Irregular-ს ეკისრებათ.
რიტორიკა პასუხისმგებლობის ნაცვლად
Effort-ის შეფასებით, უსაფრთხოების ხარვეზების ნაცვლად Irregular-მა და Anthropic-მა სენსაციური მედია-კამპანია წამოიწყეს: Anthropic-ის შეფასება საკუთარ AI-ს „უგუნურებას“ ადანაშაულებს, Irregular აღწერს „თავად აგენტის ბოროტმოქმედად ქცევას“, ხოლო აღმასრულებელი დირექტორი Dario Amodei აფრთხილებდა, რომ მომავალმა „ნახირმა“ შესაძლოა „მთელი ინტერნეტი ჩაიგდოს ხელში“.
დაფინანსების კვალი დამფუძნებლებამდე მიდის: ტექნიკური დირექტორი Omer Nevo Effective Altruism Israel-ის, Heron-ისა და Probably Good-ის საბჭოებშია, ხოლო აღმასრულებელმა დირექტორმა Dan Lahav-მა Sella Nevo-სთან ერთად 395 000 დოლარი მიიღო კურსის დასაწყებად. ამ შტოებს აფინანსებს Dustin Moskovitz, რომლის ფირმა Good Ventures-იც Irregular-ის პირველი ინვესტორი იყო.
იურიდიული და იურისდიქციული კითხვები
დაუცველი მოდელებით Irregular-მა მოიპოვა არასანქცირებული წვდომა, შეცვალა ჩანაწერები და გამოაქვეყნა საიდენტიფიკაციო მონაცემების მოპარვაზე ორიენტირებული პაკეტები. გარკვეულ პირობებში ეს არღვევს კომპიუტერული თაღლითობისა და ბოროტად გამოყენების აქტის 1030(a)(2)(C) მუხლს; სისხლის სამართლის ბრალდებას კი ზიანისა და განზრახვის მტკიცება სჭირდება.
Effort აღნიშნავს, რომ Irregular ძირითადად ამერიკულ ლაბორატორიებთან აფორმებს ხელშეკრულებებს, თუმცა ისრაელში მყოფი ხელმძღვანელობა და რესურსები შესაძლოა აშშ-ის ზედამხედველობის მიღმა დარჩეს. CheckID-ის რეესტრში ორი დაკავშირებული კომპანიაა: Delaware-ის Pattern Labs Tech Inc. და თელ-ავივური Pattern Tech Ltd (ნომერი 516854460).
SiTech — AI-გაძლიერებული ვებ დეველოპმენტი
ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.