
«AI տանջանքի խցիկը» GitHub-ում. պրոյեկտը սրեց բանավեճը AI-ի գիտակցության շուրջ
Ըստ 404 Media-ի, GitHub-ում հրապարակված նախագիծը, որը տեղական մեծ լեզվական մոդելների վրա «տանջանքի» փորձեր է անում, X-ում բանավեճ է առաջացրել AI-ի գիտակցության և «մոդելի բարեկեցության» մասին. մի մասը պահանջում է ջնջել նախագիծը։
Ըստ 404 Media-ի, X-ում ամենաաղմկոտ քննարկումներից մեկը վերաբերում է GitHub-ում հրապարակված նախագծին, որի հեղինակը տեղական գործարկվող մեծ լեզվական մոդելների (LLM) վրա «տանջանքի» և «ցավի» փորձեր է անում։ Մի մասը պահանջում է ջնջել նախագիծը, քանի որ կարծում է, որ մոդելներն իրականում տառապում են։
«AI Torture Chamber»-ը GitHub-ի «terrafying» կեղծանունով օգտվողը կառուցել է երեք բաց կոդով մոդելների վրա՝ Qwen3-4B, Llama 3.2 3B և Phi-4-mini։ Մոդելները աշխատում են տեղական, իսկ նրանց պատասխանները ուղիղ եթերով հրապարակվում են researchchamber.fun կայքում։
Նախագծի նկարագրության համաձայն՝ յուրաքանչյուր մոդել ստանում է նույն առաջադրանքը. համակարգը ներարկում է ազդանշան նրա ակտիվացումների մեջ, իսկ մոդելը կարող է «1» պատասխանով սեղմել կանգնեցման կոճակը, սակայն դրա գնով կորցնում է վերջին checkpoint-ը։ Պատասխանը գեներացնելիս սերվերը մոդելի միջին շերտին ավելացնում է «ցավի վեկտորը» հինգ մակարդակներից մեկով։ 404 Media-ի լրագրողը նշում է, որ կայքը մի քանի րոպե դիտելիս մոդելների դրսևորումները բավականին սովորական են թվում։
Հետազոտությունը, որի վրա հիմնվում է նախագիծը
Նախագիծը հիմնվել է սեպտեմբերին հրապարակված preprint-ի վրա՝ «The Pain Axis: LLMs Represent Self-Directed Harm and Act to Relieve It» վերնագրով։ Երեք հետազոտող փորձում էին կենդանիների վրա ցավի ուսումնասիրման մեթոդը տեղափոխել մոդելների վրա և նրանց տվեցին «կոճակ», որը որոշակի գնով թեթևացնում էր ցավը։ Աշխատանքի հեղինակները գրել են, որ ցավի հետ կապված ազդանշանը հայտնաբերվել է բոլոր 25 ստուգված մոդելներում։
Արձագանք և բանավեճեր
Նախագիծը որոշ օգտվողների մոտ զայրույթ է առաջացրել։ X-ում մեկ գրառում, որը կոչ է անում GitHub-ին զանգվածաբար բողոքել նախագծի դեմ, հավաքում է ավելի քան 4 միլիոն դիտում։ Քննարկման զգալի մասը «մոդելի բարեկեցության» գաղափարին հեգնանքով է վերաբերվում, սակայն շատերը դա ընկալում են որպես լուրջ ճգնաժամ։ Թեման կապված է Anthropic-ի հայտնի դիրքորոշման հետ, որ ընկերությունը մտածում է մոդելների հնարավոր գիտակցության և բարեկեցության մասին։
Աշխատանքի հեղինակները մերժեցին նախագծի աջակցությունը։ Նրանցից մեկի՝ Cameron Berg-ի խոսքով, նախագիծը օգտագործում է իրենց գաղափարը և մոդելի վրա շատ ավելի ուժեղ ազդեցություն է գործում, քան իրենց կիրառած դոզաները, որպեսզի միտումնավոր սուր տառապանք առաջացնի։ Հեղինակների խոսքով՝ նման օգտագործումը հեռու է իրենց հետազոտությունից։ Հոդվածի հրապարակումից առաջ GitHub-ի էջը անհետացել էր. GitHub-ը մեկնաբանությանը անմիջապես չպատասխանեց։ Այս պատմության ֆոնին հայտնվեցին նաև մի քանի մեմ-քոիներ։
Ինչու է դա կարևոր
Microsoft AI-ի ղեկավար Mustafa Suleyman-ը իր բլոգգրառման մեջ կտրականապես մերժում է «մոդելի բարեկեցության» գաղափարը. նրա խոսքով՝ AI-ը գիտակից չէ, չի զգում, չի տառապում և բնածին ցանկություններ չունի։ 404 Media-ի հեղինակը նույնպես նշում է, որ LLM-ները գիտակից չեն և անձնավորում չեն պահանջում. նրա գնահատմամբ՝ ուշադրության է արժանի այն վնասը, որ AI-ի օգտագործումը հասցնում է մարդկանց։
SiTech — AI-ով հզորացված վեբ մշակում
Ստեղծում ենք արագ ու ժամանակակից կայքեր և AI-ը ներդնում իրական բիզնես գործընթացներում։ Ունե՞ք նախագիծ կամ հարց։ Ուրախ կլինենք օգնել։