
Ґрубер критикує план Anthropic позначати весь текст Claude «водяними знаками»
Джон Ґрубер із Daring Fireball називає план Anthropic вбудовувати статистичні водяні знаки в усі тексти Claude псуванням письма й зауважує, що ключ для їх виявлення має лише компанія.
Джон Ґрубер, автор блогу Daring Fireball, опублікував докладну критику плану Anthropic вбудовувати статистичні «водяні знаки» в усі тексти, які генерують її моделі Claude по всьому світу, назвавши цю техніку псуванням письма. Компанія впроваджує систему, щоб виконати Кодекс практики ЄС щодо прозорості контенту, згенерованого ШІ, який Anthropic підписала в липні 2026 року разом із приблизно 190 іншими підписантами.
Як працює водяний знак
Спочатку Anthropic лише заявляла, що Claude «вплітає непомітний водяний знак безпосередньо в текст», не пояснюючи механізм. Пізніший допис «How Claude's Text Watermark Works» описує стеганографічний метод: на кожному кроці, коли модель обирає наступний токен, її варіанти детерміновано розподіляються на «зелений» і «червоний» списки за секретним ключем, і слова зі «зеленого» списку отримують трохи вищу ймовірність бути обраними. Детекція перевіряє, чи містить уривок більше «зелених» слів, ніж передбачала б випадковість, — статистичний тест, надійність якого зростає з довжиною. Позначення застосовується до згенерованого тексту довшого за 200 токенів і, за словами Anthropic, діє глобально від запуску, бо компанія не має надійного способу обмежити його регіонально.
Заперечення
Головний аргумент Ґрубера: два синоніми ніколи не несуть точно однакового значення, тож зміщення вибору токенів — навіть трохи — до менш влучних варіантів навмисно погіршує текст. Він також зауважує, що секретний ключ для створення й виявлення позначок має лише Anthropic: користувачі не можуть нічого перевірити самі, а читачі можуть зіткнутися з бездоказовими звинуваченнями в авторстві ШІ. Оскільки техніка спирається на вибір слів, вона переживає копіювання й вставлення і, за однією з цитованих праць, може витримати навіть переклад; критики зазначають, що той, хто справді хоче обманути, просто пропустить текст через інструмент перефразування. Подібні аргументи висловили Майкл Лопп, Джефф Ґамет і Джеймс Пейдолсі — останній вважає, що рішення Anthropic ширше за мінімум, який вимагає закон.
Ширший контекст
Схожа система Google, SynthID, уже застосовується до текстів Gemini; у статті Nature команда DeepMind повідомила, що частки схвальних і несхвальних оцінок у поміченому та непоміченому трафіку відрізнялися на 0,01% і 0,02%, що автори визнали статистично незначущим. Ґрубер відкидає ці дані як надто грубі, щоб уловити погіршення вибору слів, хоча й визнає, що математика методу цікава. OpenAI заявила, що її мета — поширити сигнали походження на всі модальності, включно з текстом, не уточнивши, чи стане це обов'язковим для всіх користувачів. Історія перетворилася на тестовий випадок того, як правила прозорості текстів вплинуть на авторів далеко за межами ЄС.
SiTech — веброзробка з підтримкою AI
Створюємо швидкі та сучасні сайти й інтегруємо AI у бізнес-процеси. Маєте проєкт чи запитання? Із задоволенням допоможемо.