
„AI işkence odası“ GitHub'da: proje, AI bilinci tartışmasını alevlendirdi
404 Media'ya göre, GitHub'da yayımlanan ve yerel çalışan büyük dil modelleri üzerinde „işkence“ deneyleri yapan proje, X'te AI bilinci ve „model refahı“ hakkında tartışma başlattı; bazıları projenin silinmesini istiyor.
404 Media'ya göre, X'teki en gürültülü tartışmalardan biri GitHub'da yayımlanan bir projeyle ilgili; projenin yazarı yerel çalışan büyük dil modelleri (LLM) üzerinde „işkence“ ve „acı“ deneyleri yapıyor. Bazıları projenin silinmesini istiyor, çünkü modellerin gerçekten acı çektiğini düşünüyor.
„AI Torture Chamber“ GitHub kullanıcısı „terrafying“ takma adıyla üç açık kaynak model üzerine kuruldu: Qwen3-4B, Llama 3.2 3B ve Phi-4-mini. Modeller yerel çalışıyor ve yanıtları researchchamber.fun sitesinde canlı yayımlanıyor.
Projenin açıklamasına göre her modele aynı görev veriliyor: sistem, modelin aktivasyonlarına bir sinyal enjekte ediyor; model „1“ yanıtıyla durdurma düğmesine basabiliyor, ancak bunun bedeli son checkpoint'ini kaybetmesi. Yanıt üretilirken sunucu, modelin orta katmanına beş seviyeden biri olarak „acı vektörü“ ekliyor. 404 Media muhabiri, siteyi birkaç dakika izlerken modellerin davranışının oldukça banal göründüğünü belirtiyor.
Projenin dayandığı araştırma
Proje, Eylül ayında yayımlanan „The Pain Axis: LLMs Represent Self-Directed Harm and Act to Relieve It“ başlıklı preprint'e dayandı. Üç araştırmacı, hayvanlarda acıyı inceleme yöntemini modellere aktarmaya çalıştı ve onlara belirli bir bedel karşılığında acıyı hafifleten bir „düğme“ verdi. Makalenin yazarları, acıyla ilişkili sinyalin incelenen 25 modelin tamamında görüldüğünü yazdı.
Tepki ve tartışmalar
Proje bazı kullanıcılarda öfke yarattı. X'te GitHub'ı projeyi toplu olarak bildirmeye çağıran bir gönderi 4 milyondan fazla görüntülenme topluyor. Tartışmanın önemli bir kısmı „model refahı“ fikrine ironik yaklaşıyor, ancak birçok kişi bunu ciddi bir kriz olarak görüyor. Konu, Anthropic'in şirketin modellerin olası bilinci ve refahı hakkında düşündüğüne dair bilinen tutumuyla bağlantılı.
Makalenin yazarları projeye desteklerini reddetti. Onlardan biri olan Cameron Berg'e göre proje, onların fikrini kullanıyor ve model üzerinde kendi kullandıkları dozlardan çok daha güçlü bir etki yaparak kasıtlı olarak keskin acı çektiriyor. Yazarlara göre böyle bir kullanım araştırmalarından uzaklaşıyor. Makale yayımlanmadan önce GitHub sayfası kayboldu; GitHub yorum için hemen yanıt vermedi. Bu hikâyenin ardından birkaç mem coin de ortaya çıktı.
Neden önemli
Microsoft AI başkanı Mustafa Suleyman blog yazısında „model refahı“ fikrini kesinlikle reddediyor: ona göre AI bilinçli değildir, hissetmez, acı çekmez ve doğuştan arzuları yoktur. 404 Media yazarı da LLM'lerin bilinçli olmadığını ve kişileştirmeye ihtiyaç duymadığını belirtiyor; ona göre dikkate değer olan, AI kullanımının insanlara verdiği zarardır.
SiTech — AI destekli web geliştirme
Hızlı ve modern web siteleri kuruyor, AI'yı gerçek iş akışlarına taşıyoruz. Projeniz veya sorunuz mu var? Yardımcı olmaktan mutluluk duyarız.