
Anthropic-ը Claude-ի նկատմամբ վիրավորական վարքագիծն արգելել է օգտագործման կանոնների առաջին թարմացմամբ՝ մեկ տարուց ավելի անց
Anthropic-ը մեկ տարուց ավելի անց առաջին անգամ թարմացրել է օգտագործման կանոնները՝ արգելելով Claude-ի նկատմամբ կրկնվող վիրավորական կամ դաժան վարքագիծը և ավելացրել նոր կանոններ քարոզչական արշավների, հետևելու և զենքի մշակման վերաբերյալ։
Anthropic-ը մեկ տարուց ավելի անց առաջին անգամ թարմացրել է օգտագործման քաղաքականությունը և ավելացրել սահմանափակումներ ընտրական միջամտության, զենքի մշակման, հսկման և առողջապահական ու ֆինանսական կիրառությունների վերաբերյալ Claude AI մոդելների համար։ Հիմնական փոփոխությունն արգելում է «կրկնվող և անհիմն վիրավորական կամ դաժան վարքագիծը» Claude-ի նկատմամբ։
Մոդելի բարեկեցություն
Թարմացումը հիմնված է անցյալ օգոստոսի քայլի վրա, երբ Anthropic-ը հայտարարեց, որ Claude-ը կարող է դադարեցնել զրույցը «մշտապես վնասակար կամ վիրավորական» օգտատերերի հետ։ Ընկերության խոսքով՝ զրույցի դադարեցումը մնում է «հիմնական կատարման մեխանիզմը»։ Անհայտ է՝ կհետևի՞ արդյոք օգտատերերի արգելափակումը։
Նոր կանոնը «կիրառվում է միայն ծայրահեղ դեպքերում, երբ օգտատերերը կրկնվող դաժանությամբ են վարվում մեր մոդելների հետ առանց որևէ նկատելի նպատակի»։ Այն չի վերաբերում սովորական դժգոհությանը, առարկությանը, մութ ստեղծագործական թեմաներին կամ թեստավորմանն ու հետազոտությանը։
Փոփոխությունը գալիս է մոդելի բարեկեցության շուրջ արդյունաբերական բանավեճերի ֆոնին։ Anthropic-ի գործադիր տնօրեն Դարիո Ամոդեին փետրվարին ասաց՝ «Մենք չգիտենք՝ արդյոք մոդելները գիտակից են»։ Microsoft AI-ի Մուստաֆա Սուլեյմանի օրենսգրքի նախագիծը սկզբում մերժում էր մոդելների իրավունքները, ապա դիրքորոշումը մեղմացավ։
Քարոզչություն և ընտրություններ
Anthropic-ը նախկինում «ցրված» սահմանափակումները միավորել է նոր արգելքի մեջ՝ խաբուսիկ առևտրային կամ քաղաքական արշավների դեմ, ինչն արձագանքում է AI-ով գեներացված քարոզչության աճին։ Քաղաքականությունը սահմանափակում է «փորձերը թաքցնել, թե ով է կանգնած հաղորդագրության հետևում, կամ ուժեղացնել բովանդակությունը կեղծ հաշիվներով ու գրառումներով»։
Ընտրությունների մասը արգելում է ընտրողներին խաբելը և ընտրական գործընթացին խոչընդոտելը, ներառյալ ապատեղեկատվությունը «թեկնածուների կամ քվեարկության կանոնների մասին, թեկնածուների կամ ընտրական պաշտոնյաների անվան տակ հանդես գալը, կամ ընտրողների ակտիվության ճնշումը»։
Զենք և հետևում
Օգտագործման քաղաքականությունը միշտ արգելում էր Claude-ով զենքի մշակումը, սակայն Anthropic-ը հայտարարեց, որ հաճախ տեսել է Claude-ի օգտագործման փորձեր՝ զենքի հրահանգներ և կառավարման ծրագրային ապահովում ստեղծելու համար։ Ընդլայնված արգելքը ներառում է «ծրագրային ապահովում և բաղադրիչներ, որոնք աշխատեցնում են զենքը, ինչպես նաև դրոնների և այլ ինքնավար տրանսպորտային միջոցների զինումը»։
Վերջին սպառնալիքների հետախուզության զեկույցից հետո, որը ցույց էր տալիս Claude-ով կառավարվող հսկման աճ «քաղաքական դիսիդենտների» դեմ, ընկերությունը ճշգրտեց արգելքները։ Anthropic-ի խոսքով՝ մարդկանց հետևելն առանց նրանց համաձայնության արգելված է՝ լինի դա իրական ժամանակում, թե նախկինում հավաքված տվյալներով։ Claude-ով անթույլատրելի է որոշումներ կայացնելը կամ առաջարկելը, թե ում պետք է հետաքննեն, ձերբակալեն կամ մեղադրեն, կամ հետևելու գործիքներ ստեղծելն ու բարելավելը։
Anthropic-ը նշել է, որ այս կանոնները կարող են փոխվել «որոշակի պետական օգտատերերի հետ պայմանագրերի համար», եթե պայմանագրով նախատեսված սահմանափակումները և պաշտպանական միջոցները բավարար համարվեն հնարավոր վնասը նվազեցնելու համար։ Ընկերությունը նախկինում համագործակցել է նաև ԱՄՆ զինված ուժերի հետ։
Սարքավորումներ և ռոբոտիկա
Նոր կանոնի համաձայն՝ երբ Anthropic-ի մոդելները միանում են ինքնավար սարքավորումներին և կարող են վնասվածք պատճառել, որակավորում ունեցող օպերատորը պետք է կարողանա դիտարկել և անհրաժեշտության դեպքում կանգնեցնել։ Անհայտ է՝ այդ օպերատորը պետք է մարդ լինի, թե ոչ։ Սա արտացոլում է AI լաբորատորիաների հետաքրքրությունը ռոբոտիկայի և սարքավորումների նկատմամբ՝ AI համակարգերին ֆիզիկական մարմնավորում տալու համար, և կարող է մատնանշել Anthropic-ի ապագա գործընկերությունները։
Աղբյուրներ: The Verge Ai
SiTech — AI-ով հզորացված վեբ մշակում
Ստեղծում ենք արագ ու ժամանակակից կայքեր և AI-ը ներդնում իրական բիզնես գործընթացներում։ Ունե՞ք նախագիծ կամ հարց։ Ուրախ կլինենք օգնել։