Назад
OpenAI позначатиме текст ChatGPT водяними знаками за замовчуванням у Європейському союзі
SiTech AI Team2 хв читання

OpenAI позначатиме текст ChatGPT водяними знаками за замовчуванням у Європейському союзі

OpenAI позначатиме текст ChatGPT водяними знаками за замовчуванням у Європейському союзі, щоб виконати вимоги EU AI Act. textGrain показує 92% показник виявлення, однак при зміні тексту показник значно знижується.

OpenAI заявила, що почне автоматично позначати текст, згенерований ChatGPT, водяними знаками в Європейському союзі. Функція також буде запропонована в інших регіонах, однак за межами Європейського союзу залишиться вимкненою за замовчуванням.

Дотримання вимог AI Act Європейського союзу

Цей крок в Європі зумовлений AI Act Європейського союзу, який набув чинності в серпні. Закон вимагає, щоб контент, створений моделями штучного інтелекту, був позначений таким чином, щоб інші інструменти могли його розпізнати. За словами OpenAI, нове маркування водяними знаками буде надано користувачам Європейського союзу в найближчі тижні, принаймні в додатках ChatGPT та Codex. У API функція залишиться вимкненою, але буде доступна за бажанням.

Як працює textGrain

Метод маркування водяними знаками OpenAI є власністю компанії. Компанія називає його textGrain і опублікувала технічну роботу, яка пояснює його роботу. Загалом, він працює подібно до інших інструментів маркування водяними знаками для великих мовних моделей: при виборі слів він розміщує такі шаблони, які непомітні для людського читача і суттєво не змінюють якість результату, але людина з ключем може знайти їх за допомогою спеціалізованого детектора. За словами OpenAI, доступ до детектора надасть обмеженій кількості дослідників і організацій, а для інших з часом буде додано процес запиту на підтвердження.

Обмеження виявлення

Тести textGrain від OpenAI показують, що в найкращому випадку показник успішного виявлення становить 92%, що є досить добре, однак не повністю надійно. Тести компанії також показують, що заміна лише 10% тексту в результаті знижує показник успішного виявлення майже на 30%, а заміна 20% тексту може знизити показник успіху майже на 75%. Загалом, показник успіху нижчий для короткого або перекладеного тексту, ніж для довгого тексту.

Контекст індустрії

Повністю ефективного і надійного способу виявлення контенту, згенерованого штучним інтелектом, ще не існує. Вже існує кілька стандартів, наприклад SynthID і проєкт C2PA, однак обхід їхніх захисних засобів відносно простий для будь-якої людини з базовими знаннями, і, ймовірно, це стосується також водяного знака OpenAI. У серпні конкурент OpenAI, Anthropic, також впровадив маркування водяними знаками для тексту, згенерованого власними моделями, але Anthropic увімкнув його глобально, тоді як OpenAI наразі вмикає його за замовчуванням лише там, де цього вимагають регулятори.

Джерела: Arstechnica

SSiTech

SiTech — веброзробка з підтримкою AI

Створюємо швидкі та сучасні сайти й інтегруємо AI у бізнес-процеси. Маєте проєкт чи запитання? Із задоволенням допоможемо.