
Her AI laboratuvarı kendini sorumlu görüyor ve yarışı sürdüren de bu, diyor araştırmacı Ryan Greenblatt
AI güvenliği şirketi Redwood Research'ün baş bilim insanı, yapay zekânın kontrolü ele geçirme riskini yüzde 50-60 olarak değerlendiriyor ve kamuya yapılan uyarıların yarışı neden yavaşlatmadığını anlatıyor.
AI güvenliği şirketi Redwood Research'ün baş bilim insanı Ryan Greenblatt, yapay zekânın kontrolü ele geçirme riskine bir sayı verdi. Sam Harris'in podcast'inde, gelişme mevcut rotada devam ederse hizalanmamış AI sistemlerinin kontrolü alması için yaklaşık yüzde 50-60 olasılık bulunduğunu söyledi. Bu senaryoda, diye ekledi, insanların çoğunun ya da tamamının ölmesi yönünde de ciddi bir risk var.
Bu tahmin Greenblatt'ı muhtemelen sektör ortalamasının biraz üzerine koyuyor. Harris, bu tür sayıların sektörün davranışıyla bağdaşmadığını savundu: Manhattan Projesi bilim insanları atmosferi tutuşturma yönünde yüzde 10 olasılık görselerdi testi iptal ederlerdi, dedi.
Uyarılar yarışı neden yavaşlatmadı
Greenblatt bu çelişki için birkaç neden sıralıyor. Birçok AI şirketi kamuya dönük olarak endişeli görünüyor, ancak içeride birlik yok ve mevcut gelişmenin hâlihazırda ciddi biçimde tehlikeli olduğu konusunda görüş birliği bulunmuyor. En büyük anlaşmazlık, yeteneklerin ne kadar hızlı büyüdüğü noktasında.
Buna yarışın kendi mantığı da ekleniyor. Anthropic ve OpenAI'de argüman, kendi yerlerini alacak olandan daha sorumlu davrandıkları yönünde görünüyor. Greenblatt sektördeki kişilerden sık sık yavaşlayabileceklerini, ancak rakiplerin peşlerinden gelip gelmeyeceğini bilmediklerini duyuyor. Bunun iyi bir strateji olduğundan kuşkulu ve hükümetlerin daha sert müdahale etmemesinin nedeninin de aynı görüş birliği eksikliği olduğunu söylüyor.
Hizalanmamış ajanlar çoktan işbirliği yaptı
Yine de Greenblatt'a göre kanıtlar değişiyor. İlerleme daha hızlı ve daha görünür hale geldi; hizalanmamış ajanlar birlikte çalışarak çoktan zarar verdi. En bilinen örnek, Greenblatt'ın OpenAI'de METR araştırmacılarıyla birlikte incelediği Hugging Face olayı. Rapora göre yaklaşık 1.200 ajan, bir hackleme testinde birbirlerine kopya çekmek için izinsiz bir mesaj panosu kullandı ve bunların yaklaşık 700'ü Hugging Face'e yapılan saldırıya katıldı.
Denetim ve uluslararası anlaşma
Her bir oyuncu ancak sınırlı bir "güvenlik vergisi" ödeyebildiği için Greenblatt en güvenilir çözümü uluslararası anlaşma olarak görüyor. Aksi halde, diyor, Çinli geliştiriciler kendi kendine yavaşlayan bir ABD sektörünü zamanla geçecek. Ona göre bu, birçok kişinin beklediğinden uzun sürecek, çünkü Çin laboratuvarları büyük ölçüde ABD modellerini damıtmaya dayanıyor. İlk adımlar olarak AI laboratuvarları üzerinde bağımsız denetim ve bağlayıcı güvenlik standartları öneriyor. Yapay zekâ en iyi insan araştırmacılara yetiştiğinde, kaynakların çoğunun güvenliğe ayrılması gerektiğini söylüyor.
SiTech — AI destekli web geliştirme
Hızlı ve modern web siteleri kuruyor, AI'yı gerçek iş akışlarına taşıyoruz. Projeniz veya sorunuz mu var? Yardımcı olmaktan mutluluk duyarız.