
Kibertəhlükəsizlik mütəxəssisləri Anthropic-in Fable modelindəki məhdudiyyətlərdən narazıdır
Anthropic-in yeni Fable modeli kibertəhlükəsizliyə dolayı yolla aid olan sorğuları belə bloklayır. Tədqiqatçılar filtrin adi mühəndis işlərini də tutub onları köhnə modelə qaytardığını bildirirlər.
Anthropic çərşənbə axşamı Fable-ı buraxdı və onu kibertəhlükəsizlik modeli Mythos-un ictimai və məhdud versiyası kimi təqdim etdi. Modeli müşayiət edən məhdudiyyətlər sistemlərə hücumla heç bir əlaqəsi olmayan işlərdə də filtrin işə düşdüyünü deyən təhlükəsizlik mütəxəssislərinin narazılığına səbəb oldu.
Filtrlər sorğuya yox, mövzuya reaksiya verir
IBM X-Force-da çalışan təhlükəsizlik tədqiqatçısı Valentina "Chompie" Palmiotti yazıb ki, Fable "kiber sahəyə dolayı yolla aid ola biləcək hər sorğunu rədd edir, hətta bloq yazısı oxumaq kimi zərərsiz tapşırıqları da". Sorğu müdafiə mexanizmlərini işə saldıqda model söhbəti dayandırır və istifadəçiyə "təhlükəsizlik tədbirlərinin bu mesajı kibertəhlükəsizlik və ya biologiya mövzusu kimi işarələdiyini" bildirir. Başqa bir tədqiqatçı X-da qeyd edib ki, kod baxışı istəmək belə filtrləri işə salır.
Məhdudiyyətlər nə üçün var
Anthropic onları Fable-ın zərərli proqram yazmaq və ya proqram təminatını zədələmək üçün istifadə edilmə riskini azaltmaq məqsədilə qoyub; bu, şirkətin uzun müddət daşıdığı narahatlıqdır. Biologiya məhdudiyyətləri isə bioloji silahla bağlı bənzər qorxudan irəli gəlir. Model həmçinin müdafiə işə düşəndə Claude Opus 4.8-ə keçmək üçün proqramlaşdırılıb. Ayrıca Anthropic Cyber Verification Program adlı proqram yürüdür: təsdiqlənmiş təhlükəsizlik mütəxəssisləri Claude-u kiber işlər üçün daha az məhdudiyyətlə istifadə edir. OpenAI-da da Trusted Access for Cyber adlı oxşar proqram var.
Mythos və Project Glasswing
Anthropic apreldə Mythos-u buraxanda modeli Project Glasswing təşəbbüsü çərçivəsində məhdud sayda şirkət və təşkilata açdı; təşəbbüsün məqsədi kritik proqram təminatını və infrastrukturu qorumaqdır. Keçən həftə şirkət Mythos-a çıxışı 15 ölkədə yüzlərlə təşkilata genişləndirdi.
Açar sözlərin uyğunluğu, mühakimə deyil
Hazırda Tolmo adlı AI təhlükəsizlik startapında çalışan kibertəhlükəsizlik veteranı Mett Suiche TechCrunch-a deyib: "Ondan təhlükəsiz kod yazmağı xahiş etsən, bunu proqram mühəndisliyinin ən yaxşı təcrübəsi yox, kibertəhlükəsizlik işi hesab edir və səviyyən aşağı düşür". Onun fikrincə tətikləyicilər açar sözlərə əsaslanır, ona görə də kibertəhlükəsizlik leksik sahəsindəki hər şey onları işə salır. O əlavə edib ki, bu mərhələdə yanaşma başa düşüləndir və məhdudiyyətlər zamanla yumşaldılacaq: "Belə buraxılışda çox adamı tutmaq az adamı tutmaqdan yaxşıdır, məhdudiyyətlər də sonradan yumşaldılır". Anthropic şərh sorğusuna dərhal cavab vermədi.
SiTech — AI ilə gücləndirilmiş veb hazırlanması
Sürətli və müasir saytlar qurur, AI-ı real biznes proseslərinə gətiririk. Layihəniz və ya sualınız var? Kömək etməyə hazırıq.