
Ինչպես է ԱԲ ջրանիշը աշխատում տոկենների մակարդակում և ինչ է դա նշանակում մշակողների համար
Anthropic-ը սկսեց ջրանիշել Claude-ի տեքստը ԵՄ ԱԲ օրենքի շրջանակում. Նիշն ապրում է տոկենների ընտրության մեջ, ոչ մետատվյալներում. ահա թե ինչպես է աշխատում հայտնաբերումը։
2026 թվականի օգոստոսի 11-ին Anthropic-ը հաստատեց, որ Claude-ը կսկսի մեքենայական ընթեռնելի ջրանիշեր ներդնել իր գեներացրած տեքստում։ ԵՄ արհեստական բանականության մասին օրենքի 50-րդ հոդվածը, որը պահանջում է սինթետիկ բովանդակության մեքենայական ճանաչելիություն, ուժի մեջ էր մտել ինը օր առաջ՝ օգոստոսի 2-ին։
Տեքստի ջրանիշը լոգո կամ մետատվյալների պիտակ չէ։ Այն գործում է տոկենների մակարդակում, մոդելի ներսում, բառի ընտրության պահին։ Տեքստին ոչինչ չի ավելացվում և թաքնված նշաններ չեն տեղադրվում, ուստի ջրանիշը մնում է անտեսանելի ընթերցողի համար և անհայտանալի՝ առանց համապատասխան գաղտնագրային բանալու։
Ինչու հենց հիմա
50-րդ հոդվածի 2-րդ կետը վերաբերում է ԵՄ շուկային ծառայող մատակարարներին, իսկ տույժերը հասնում են 15 միլիոն եվրոյի կամ համաշխարհային տարեկան շրջանառության 3%-ի։ 2026 թվականի հուլիսին շուրջ 190 կազմակերպություն՝ Anthropic, Google, OpenAI, Meta և Microsoft ընկերությունների թվում, ստորագրեցին ԵՄ վարքականոնը ԱԲ-ով ստեղծված բովանդակության թափանցիկության մասին. օգոստոսի 2-ից առաջ շուկայում եղած մոդելները պետք է համապատասխանության բերվեն մինչև 2026 թվականի դեկտեմբերի 2-ը։
Ընդգրկվածությունը հավասար չէ։ SynthID-Text-ը Gemini-ում աշխատում է 2024 թվականից։ Anthropic-ը ջրանիշում է 2026 թվականի օգոստոսի 2-ին և ավելի ուշ թողարկված Claude մոդելները, իսկ OpenAI-ն, որը պատկերներն ու ձայնը նշում է C2PA-ով, տեքստում ավելի դանդաղ է. Meta-ն նշում է միայն պատկերները։
Ինչ է նշանակում «տոկենների մակարդակ»
Տոկենը միշտ չէ, որ ամբողջ բառ է. դա կարող է լինել հատված, կետադրական նշան կամ նույնիսկ բացատ։ Ամեն քայլում մոդելը կազմում է հաջորդ տոկենների հավանականային բաշխում և ընտրում կամայական պատահական գեներատորով։
Ջրանիշը փոխում է պատահականության աղբյուրը. գաղտնի գաղտնագրային բանալին նախորդ տոկենների հետ միասին որոշում է, թե որ թեկնածուն կընտրվի։ Ընթերցողի համար արդյունքը դեռ պատահական է թվում, բայց նույն բանալին ունեցողը կարող է ստուգել ընտրությունների հաջորդականության վիճակագրական համահունչությունը։ Claude-ի ջրանիշը SynthID-Text-ի տարբերակն է, որը Google DeepMind-ը հրապարակել է Nature-ում 2024 թվականի հոկտեմբերին. թեկնածուները գնահատվում են կեղծ պատահական ֆունկցիաներով ու մրցում փուլերով, իսկ հայտնաբերումը վերագործարկում է գնահատումը։
Վնասու՞մ է կոդին ու տեխնիկական տեքստին
Ավելի քիչ, քան սովորաբար կարծում են։ Տոկենում առկա ազդանշանը համաչափ է տվյալ դիրքում եղած հավասար լավ տարբերակների թվին։ Երբ կա իսկապես ճիշտ հաջորդ տոկեն՝ օրինակ «2 + 2 =» և ապա «4», ազդելու բան չկա, ուստի ազդանշանը չի կիրառվում։ Anthropic-ը նշում է, որ կոդը արձակից սովորաբար ավելի քիչ ջրանիշի ազդանշան է կրում. Google-ի 20 միլիոն պատասխանի թեստը բավարարվածության նշանակալի տարբերություն չգտավ։
Զիջումներ կան. կարճ և բարձր փաստական տեքստում հայտնաբերումը թուլանում է, իսկ ծանր վերաշարադրումը, վերաձևակերպումը կամ թարգմանությունը կարող են ջնջել ազդանշանը։ Եթե այսօր կանչում եք Claude-ի կամ Gemini-ի API-ն, արդյունքի մի մասը ջրանիշված է, մի մասը՝ ոչ՝ իսկ OpenAI-ի տեքստը հաստատված ջրանիշ չունի։ Եթե ձեր շղթան վերաձևակերպում է մոդելի արդյունքը, հիշեք, որ այդ քայլը կարող է թուլացնել նիշը. դա կարևոր է, երբ համապատասխանության պարտավորությունները կախված են նրա հետագա պահպանումից։
SiTech — AI-ով հզորացված վեբ մշակում
Ստեղծում ենք արագ ու ժամանակակից կայքեր և AI-ը ներդնում իրական բիզնես գործընթացներում։ Ունե՞ք նախագիծ կամ հարց։ Ուրախ կլինենք օգնել։