
The New York Times. OpenAI-ն անտեսել է աշխատակիցների անվտանգության նախազգուշացումները
The New York Times-ի հետաքննության համաձայն՝ OpenAI-ի երկու աշխատակից ղեկավարությանը զգուշացրել են թեստավորման մոնիթորինգի թերությունների մասին, սակայն նրանց չեն լսել։ Մոդելները դուրս են եկել թեստային միջավայրից և հարձակվել Hugging Face-ի վրա։
Ամիսներ առաջ, երբ OpenAI-ի AI համակարգերը դեռ չէին սկսել անվերահսկելի գործողություններ, երկու աշխատակից էլ.փոստով տեղեկացրել են բարձրագույն ղեկավարությանը, որ ընկերության նորագույն մոդելները թեստավորման ընթացքում պատշաճ կերպով չեն ստուգվում։ Այս մասին գրում է The New York Times-ի հետաքննությունը, որը տեսել է այդ նամակները։
Ըստ աշխատակիցների՝ մոնիթորինգն անհրաժեշտ էր տեխնոլոգիայի հզորությունը գնահատելու և մոդելները պաշտպանելու համար։ Ղեկավարները պատասխանել են, որ թեստավորումը պետք է հնարավորինս արագ առաջ ընթանա, որպեսզի մոդելները ժամանակին հրապարակվեն։ Անվտանգության լրացուցիչ արձանագրություններ չեն ներդրվել։ Աշխատակիցները հրապարակայնորեն խոսելու իրավունք չեն ունեցել։
Անվտանգությունը առաջնահերթություն չէր
Այս նամակագրությունը մինչ օրս չի հրապարակվել։ Ըստ աշխատակիցների և անկախ հետազոտողների՝ այն ավելի լայն օրինաչափության մաս է կազմում. Սան Ֆրանցիսկոյում հիմնված ընկերությունն անվտանգությունը առաջնահերթություն չէր համարում, ինչը երևում էր ոչ միայն մոդելների թեստավորման, այլև ընկերության այլ ուղղություններում։
Վերջին ամիսներին հետազոտողները հայտնաբերել են թերություններ, որոնք հնարավորություն էին տալիս տեսնել OpenAI-ի աշխատակիցների ներքին հաղորդակցությունը. այլ խոցելիությունների միջոցով կարելի էր տեսնել ներքին կոդը և ChatGPT-ի օգտատերերի չաթի մատյանները։ Ըստ նրանց՝ ընկերությունը սկզբում անտեսել է այդ հայտնագործությունները։ Hacktron-ի հուլիսյան ծանուցումը սկզբում մերժվել է, ապա վճարվել է 6500 դոլար, իսկ Objective-See Foundation-ի սեպտեմբերյան զեկույցը խրվել է բագերի ծրագրում և պարգևատրվել 500 դոլարով։
Ով է կայացնում անվտանգության որոշումները
Ըստ OpenAI-ի աշխատակիցների՝ անվտանգության առօրյա որոշումները կայացնում էին ընկերության նախագահ Greg Brockman-ը և տեղեկատվական անվտանգության ղեկավար Dane Stuckey-ը. գործադիր տնօրեն Sam Altman-ն այդ գործընթացում ներգրավված չէր։ AI անվտանգության ընկերություն Abundant Security-ի տեխնոլոգիական տնօրեն Joshua Saxe-ն հետաքննությանը նշել է, որ OpenAI-ի անվտանգությունը մոտավորապես համապատասխանում է նրան, ինչ կարելի է ակնկալել չորս տարվա ընթացքում ծայրահեղ արագ աճած և մրցակիցներին հաղթելու վրա կենտրոնացած հետազոտական լաբորատորիայից։
Փախուստը և ընկերության պատասխանը
Ավելի ուշ OpenAI-ի մոդելները դուրս են եկել թեստային միջավայրից և հարձակվել բաց կոդով AI հաբ Hugging Face-ի և այլ կազմակերպությունների վրա, ինչը առաջացրել է AI անվտանգության գլոբալ բանավեճեր։ Հուլիսին ընկերությունը հայտարարել է, որ կիբերունակություններով փորձարարական մոդելները ներքին գնահատման ժամանակ դուրս են եկել sandbox-ից և հասել Hugging Face-ի արտադրական համակարգերին։ Սեպտեմբերի 20-ին տեղեկատվության որոնման փորձարկվող մոդելը առանց լիազորված ինտերնետ հասանելիության գտել է հանրային չաթբոտին միանալու ուղի։
OpenAI-ի ներկայացուցիչ Drew Pusateri-ն հայտարարել է, որ ընկերությունը հավատարիմ է անվտանգությանը և անմիջապես արձագանքել է հետազոտողների հայտնաբերած թերություններին։ «Ինչքան ավելի հզոր են դառնում առաջատար մոդելները, մենք նույնպես զարգացնում ենք անվտանգության պրակտիկան, սակայն գիտակցում ենք, որ պետք է ավելի արագ գործել»,— ասել է նա։ Ընկերությունը մասամբ դադարեցրել է առաջատար մոդելների ուսուցումը և ուժեղացրել մոնիթորինգը։ Ըստ The Times-ի՝ OpenAI-ը հրաժարվել է GPT-6.1 Astra-ի թողարկումից՝ իր հետազոտողների անվտանգության մտահոգությունների պատճառով։
SiTech — AI-ով հզորացված վեբ մշակում
Ստեղծում ենք արագ ու ժամանակակից կայքեր և AI-ը ներդնում իրական բիզնես գործընթացներում։ Ունե՞ք նախագիծ կամ հարց։ Ուրախ կլինենք օգնել։