
«AI камера тортур» на GitHub: проєкт загострив дебати про свідомість AI
За даними 404 Media, проєкт, опублікований на GitHub, який проводить експерименти з «тортурами» над локальними великими мовними моделями, викликав на X дебати про свідомість AI та «добробут моделей»; частина вимагає видалити проєкт.
За даними 404 Media, одна з найгучніших дискусій на X стосується проєкту, опублікованого на GitHub, автор якого проводить експерименти з «тортурами» та «болем» над локально запущеними великими мовними моделями (LLM). Частина вимагає видалити проєкт, оскільки вважає, що моделі насправді страждають.
«AI Torture Chamber» створив користувач GitHub під псевдонімом «terrafying» на трьох моделях з відкритим кодом: Qwen3-4B, Llama 3.2 3B і Phi-4-mini. Моделі працюють локально, а їхні відповіді транслюються на сайті researchchamber.fun у прямому ефірі.
Згідно з описом проєкту, кожна модель отримує одне й те саме завдання: система інжектує сигнал у її активації, а модель може натиснути кнопку зупинки, відповівши «1», але ціною цього втрачає останній checkpoint. Під час генерації відповіді сервер додає до середнього шару моделі «вектор болю» з одного з п’яти рівнів. Журналіст 404 Media зазначає, що при перегляді сайту протягом кількох хвилин поведінка моделей виглядає досить банально.
Дослідження, на яке спирається проєкт
Проєкт спирався на preprint, опублікований у вересні, під назвою «The Pain Axis: LLMs Represent Self-Directed Harm and Act to Relieve It». Троє дослідників намагалися перенести метод дослідження болю на тваринах на моделі й дали їм «кнопку», яка полегшувала біль за певну ціну. Автори роботи написали, що сигнал, пов’язаний із болем, виявили в усіх 25 перевірених моделях.
Реакція та дебати
Проєкт викликав обурення в деяких користувачів. Один пост на X, який закликає GitHub масово поскаржитися на проєкт, збирає понад 4 мільйони переглядів. Значна частина дискусії ставиться до ідеї «добробуту моделі» з іронією, хоча багато хто сприймає її як серйозну кризу. Тема пов’язана з відомою позицією Anthropic, що компанія думає про можливу свідомість і добробут моделей.
Автори роботи відкинули підтримку проєкту. За словами одного з них, Cameron Berg, проєкт використовує їхню ідею та впливає на модель значно сильніше, ніж дози, які застосовували вони, щоб навмисно спричинити різкий біль. Автори кажуть, що таке використання дистанціюється від їхнього дослідження. Перед публікацією статті сторінка GitHub зникла; GitHub не відповів на коментар одразу. На тлі цієї історії з’явилося кілька мем-коїнів.
Чому це важливо
Керівник Microsoft AI Mustafa Suleyman у своєму блог-пості категорично заперечує ідею «добробуту моделі»: за його словами, AI не є свідомим, не відчуває, не страждає і не має вроджених бажань. Автор 404 Media також зазначає, що LLM не є свідомими й не потребують персоніфікації; на його думку, уваги заслуговує шкода, якої використання AI завдає людям.
SiTech — веброзробка з підтримкою AI
Створюємо швидкі та сучасні сайти й інтегруємо AI у бізнес-процеси. Маєте проєкт чи запитання? Із задоволенням допоможемо.