
Як водяний знак ШІ працює на рівні токенів і що це означає для розробників
Anthropic почала додавати водяні знаки до тексту Claude відповідно до Закону ЄС про ШІ, і знак живе у виборі токенів, а не в метаданих. Ось як працює виявлення.
11 серпня 2026 року Anthropic підтвердила, що Claude почне вбудовувати машинозчитувані водяні знаки в текст, який генерує. Стаття 50 Закону ЄС про ШІ, яка вимагає машинної виявності ШІ-контенту, набула чинності дев'ятьма днями раніше — 2 серпня.
Водяний знак у тексті — не логотип і не тег у метаданих. Він працює на рівні токенів, усередині моделі, під час вибору слів. До тексту нічого не додають і прихованих символів не вставляють, тож знак залишається невидимим для читача й невиявним без відповідного криптографічного ключа.
Чому це сталося саме тепер
Стаття 50(2) поширюється на постачальників, що працюють на ринку ЄС, а штрафи сягають 15 млн євро або 3% світового річного обороту. У липні 2026 року близько 190 організацій — серед них Anthropic, Google, OpenAI, Meta і Microsoft — підписали Кодекс практики ЄС щодо прозорості контенту, створеного ШІ; моделі, які вже були на ринку до 2 серпня, мусять відповідати вимогам до 2 грудня 2026 року.
Покриття нерівномірне. SynthID-Text працює всередині Gemini з 2024 року. Anthropic застосовує водяні знаки до моделей Claude, випущених 2 серпня 2026 року або пізніше, а OpenAI, яка додає до зображень і аудіо сигнали походження, як-от метадані C2PA, просувається з текстом повільніше; Meta маркує лише зображення.
Що означає «на рівні токенів»
Токен — не завжди ціле слово: це може бути фрагмент, розділовий знак або навіть пробіл. На кожному кроці модель формує розподіл імовірностей для наступних токенів і вибирає з нього за допомогою довільного генератора випадкових чисел.
Водяний знак змінює джерело випадковості: секретний криптографічний ключ разом із попередніми токенами визначає, який кандидат буде обраний. Для читача вибір усе ще виглядає випадковим, але той, хто має той самий ключ, може перевірити, чи послідовність виборів статистично узгоджується з тим, що дав би ключ. Водяний знак Claude — це версія SynthID-Text, яку Google DeepMind опублікувала в Nature у жовтні 2024 року; кандидатів оцінюють псевдовипадкові функції, і вони змагаються в раундах, а виявлення повторює це оцінювання.
Чи страждає код і технічний текст
Менше, ніж зазвичай думають. Обсяг сигналу в конкретному токені пропорційний кількості приблизно однаково добрих варіантів. Там, де є очевидно правильний наступний токен, впливати нема на що, тож сигнал не застосовується. Anthropic зазначає, що код, який часто вимагає точного токена, зазвичай несе менше водяного сигналу, ніж проза; тест Google на 20 млн відповідей не виявив значущої різниці в задоволеності користувачів.
Компроміси залишаються: на коротких і дуже фактологічних текстах виявлення слабше, а важке переписування, перефразування чи переклад можуть знищити сигнал. Якщо ви викликаєте API Claude або Gemini, частина результату має водяний знак, а частина — ні, тоді як текст з API OpenAI поки не має підтвердженого знака. Якщо ваш конвеєр перефразовує вихід моделі, пам'ятайте: цей крок може послабити знак, і це важливо, коли власні зобов'язання щодо відповідності залежать від того, чи збережеться він далі.
SiTech — веброзробка з підтримкою AI
Створюємо швидкі та сучасні сайти й інтегруємо AI у бізнес-процеси. Маєте проєкт чи запитання? Із задоволенням допоможемо.