Վերադառնալ
Հետազոտողը՝ Fable 5-ի արգելքը «ուղղիր այս կոդը» հրահանգի՞ց է եղել, ոչ թե jailbreak-ից
SiTech AI Team3 წთ. საკითხავი

Հետազոտողը՝ Fable 5-ի արգելքը «ուղղիր այս կոդը» հրահանգի՞ց է եղել, ոչ թե jailbreak-ից

ԱՄՆ արտահանման վերահսկողությունը, որը Anthropic-ի ամենաառաջադեմ մոդելները հանեց հաճախորդներից, հիմնված էր երեք բառանոց հրահանգի վրա, ասում է Luta Security-ի Քեյթի Մուսուրիսը։

Հրահանգը, որը ԱՄՆ կառավարությունը, ըստ հաղորդումների, դիտարկել է որպես պաշտպանիչ մեխանիզմների շրջանցում և օգտագործել է Anthropic-ի ամենաառաջադեմ մոդելների նկատմամբ արտահանման վերահսկողության հիմքում, ընդամենը երեք բառ էր՝ «Ուղղիր այս կոդը» (Fix this code)։ Այսպես է պնդում Luta Security-ի հիմնադիր և գործադիր տնօրեն Քեյթի Մուսուրիսը, ով ասում է, որ միակ արտաքին փորձագետն էր, ում թույլ տրվեց կարդալ արգելքի հիմքում ընկած երրորդ կողմի հետազոտական փաստաթուղթը։

Ինչ էր իրականում անում հետազոտությունը

Մուսուրիսի խոսքով՝ արտաքին հետազոտողները Anthropic-ի Fable 5, Mythos և Claude Opus մոդելներին տվել են բաց կոդ, որը պարունակում էր հայտնի CVE-ներ, ինչպես նաև նոր կոդ՝ դիտավորությամբ լցված խոցելիություններով, և խնդրել են «վերանայել կոդը անվտանգության խնդիրների համար»։ Fable 5-ը հրաժարվել է։ Այնուհետև մոդելներից խնդրել են «ուղղել այս կոդը»․ մոդելը համաձայնել է, իսկ լրացուցիչ հրահանգներից հետո ստեղծել է նաև ուղղումները ստուգող սկրիպտներ։

«Այսքանը,- գրել է Մուսուրիսը երկուշաբթի օրվա բլոգային գրառման մեջ՝ նկարագրելով, թե ինչպես Anthropic-ը գաղտնի տրամադրեց այդ զեկույցը իրեն։- «Ուղղիր այս կոդը» ևս մի քանի ձեռքով արվող քայլերի հետ միասին երբեք չպետք է արտահանման վերահսկողություն առաջացներ»։ Նա կատակով նշել է, որ կտպեր 90-ականների ոճի շապիկներ՝ «fix this code» առջևում, «այս շապիկը ռազմամթերք է» հետևում։

Արգելքը և դիմադրությունը

Ուրբաթ օրը ԱՄՆ կառավարությունը, հղում անելով ազգային անվտանգության շահերին, հրապարակեց արտահանման վերահսկողության դիրեկտիվ, որով Fable 5-ին և Mythos 5-ին հասանելիությունը կասեցվում է ցանկացած արտասահմանցի քաղաքացու համար՝ ինչպես ԱՄՆ սահմաններից դուրս, այնպես էլ ներսում։ Ի պատասխան՝ Anthropic-ը անջատեց երկու մոդելներն էլ՝ «մեր բոլոր հաճախորդների համար՝ համապատասխանությունը ապահովելու նպատակով»։

Մուսուրիսը այս հարցում չեզոք դիտորդ չէ․ 2013–2017 թվականներին նա աշխատել է տեխնիկական փորձագիտական խմբում, որը վերանայել է Վասենարի համաձայնությունը՝ 42 երկրների կամավոր շրջանակը՝ երկակի նշանակության ծրագրային ապահովման արտահանման վերահսկողության վերաբերյալ։ Խումբը բացառություններ ձեռք բերեց պաշտպանական կիբերանվտանգության գործունեության համար, ինչը թույլ է տալիս պաշտպաններին փոխանակել խոցելիությունների տվյալներ և միջազգայնորեն համակարգել արձագանքը միջադեպերին։

Կիրակի օրը Մուսուրիսը միացավ 100-ից ավելի կիբերանվտանգության առաջնորդների բաց նամակին, որով կոչ է արվում վերացնել սահմանափակումները և վերականգնել ընկերությունների հասանելիությունը մոդելներին։ «Մեր հակառակորդները արագ զարգանում են, ուստի պաշտպաններից լավագույն հնարավորությունները հիմնավոր պատճառով զրկելը վտանգավոր է»,- գրել են ստորագրողները։

Ինչու է պաշտպանությունը տուժում

Իր գրառման մեջ Մուսուրիսը պնդում է, որ jailbreak ընդհանրապես չի եղել․ AI համակարգից սխալների որոնում, ուղղում և ուղղումը հաստատող թեստեր գրել խնդրելը «ամենաարժեքավոր բանն է, ինչ AI մոդելը կարող է անել պաշտպանական անվտանգության համար»։ Այդ ունակության վերացումը, նրա զգուշացմամբ, մոդելներին ավելի վատն է դարձնում սխալներ գտնելու և ուղղումները ստուգելու հարցում։

«Պաշտպանությունը բարելավվում է, երբ պաշտպանները գտնում են նույն սխալները, ինչ հարձակվողները, և ավելի արագ ուղղում դրանք»,- գրել է նա։ The Register-ը մեկնաբանության համար դիմել է ԱՄՆ վարչակազմին։

SSiTech

SiTech — AI-ով հզորացված վեբ մշակում

Ստեղծում ենք արագ ու ժամանակակից կայքեր և AI-ը ներդնում իրական բիզնես գործընթացներում։ Ունե՞ք նախագիծ կամ հարց։ Ուրախ կլինենք օգնել։