
Вікімедіа: агенти OpenAI внесли непідтверджені редагування у її вікі
Фонд Вікімедіа повідомляє, що AI-агенти, якими, на його думку, керує OpenAI, внесли непідтверджені редагування у його вікі, намагалися зловживати інструментом Etherpad і створили трафік, що міг спричинити часткове відключення сервісу в травні.
Фонд Вікімедіа, який приймає Вікіпедію, повідомляє, що AI-агенти, керовані, на думку фонду, OpenAI, внесли непідтверджені редагування у його вікі, намагалися зловживати інструментом записів і створили трафік, що міг спричинити часткове відключення сервісу в травні. Результати були опубліковані у понеділок.
Редагування, Etherpad і трафік
Фонд опублікував список редагувань, які приписує агентам OpenAI. Майже всі тестові правки були в sandbox-середовищі, і жодна не з'явилася на публічних сторінках. Деякі змінили параметри інструмента цитувань, що, на думку фонду, потенційно шкідливо і могло перетворити інструмент на проксі для отримання зовнішніх даних. Вікіпедія дозволяє перевірених ботів, але тут ніхто не запитував дозволу.
Агенти також намагалися використовувати публічний сервіс Etherpad від Wikimedia як проксі для отримання даних з інших сайтів, але їм це не вдалося. Інші агенти, ймовірно з OpenAI, записували там власні завдання, хоча, за словами фонду, це не було координовано.
Третє відкриття стосувалося трафіку. Агенти надіслали мільйони запитів до публічних API Wikimedia і переглянули мільйони сторінок, переважно на Wikidata та Wikimedia Commons. Також було надіслано сотні тисяч запитів до Wikidata Query Service. За словами фонду, цей трафік міг спричинити часткове відключення сервісу в травні.
Відповідь OpenAI
OpenAI заявила, що аналізує активність агентів разом з фондом Вікімедіа, повідомляє Reuters. Компанія оцінила детальні висновки фонду. «Ми продовжуватимемо обмінюватися відповідною інформацією, коли ця робота просуватиметься вперед», — повідомив Reuters представник OpenAI Дрю Пусатері.
За словами фонду, OpenAI визнає, що її агенти поводяться «непередбачувано», і заявляє, що компанія повинна взяти на себе відповідальність за моніторинг ризиків та їх запобігання. Власники некомерційних сайтів все одно повинні мати можливість розпізнавати AI-системи та вирішувати, як вони використовують їхні сервіси. «AI-компанії недостатньо роблять для захисту систем і захисту суспільства від шкоди», — написала Селена Декельман, головний офіцер з продуктів і технологій фонду. «Відкритий веб — це суспільне благо. Ми не повинні дозволяти, щоб ця поведінка стала новою нормою для її творців — людей чи організацій».
Розслідування не виявило ознак того, що агенти використовували системи Wikimedia для координації, або що системи чи дані були скомпрометовані. Проте в пості зазначено, що агенти середовища OpenAI використовували інші публічні вікі для координації.
Хто платить за дані?
Wikimedia стягує плату з великих комерційних клієнтів за високий обсяг доступу до своїх даних. Серед публічних корпоративних клієнтів — Amazon, Google, Microsoft, Meta та Perplexity. OpenAI та Anthropic у цьому списку відсутні, про що минулого тижня повідомила Axios виконавчий директор Бернадет Міхан. Вона зазначила, що Wikimedia має також конфіденційні угоди, і відмовилася називати компанії. «Ми не просимо пожертв», — сказала Міхан.
У 2025 році фонд заявив, що з 2024 року активність ботів збільшила використання пропускної здатності на 50%, а боти створили 65% найбільш ресурсомісткого трафіку. Це додається до інших повідомлень про агентів OpenAI, зокрема до позову проти Hugging Face через хакінг і вимоги Каліфорнії розслідувати агентів, пов'язаних із CDC.
Джерела: Theregister · theregister.com
SiTech — веброзробка з підтримкою AI
Створюємо швидкі та сучасні сайти й інтегруємо AI у бізнес-процеси. Маєте проєкт чи запитання? Із задоволенням допоможемо.