Anthropic ve Accenture, öncü AI modellerini 'içeriden' değerlendirecek

Anthropic, Accenture'ın Faculty birimine laboratuvar içinde çalışan düzeyinde erişim vererek öncü modelleri bağımsız değerlendirecek. İki şirket beş yılda en az birer milyar dolar yatırım yapmayı planlıyor.
Ne oldu
Anthropic, öncü yapay zekâ modellerinin bağımsız değerlendirmesi için Accenture ile ortaklık kurduğunu duyurdu. Çalışmayı Accenture'ın uzman AI birimi Faculty yürütecek; kapsamda model değerlendirme ve red teaming, hizalama (alignment) testleri ve model koruma mekanizmalarının sınanması var.
Neden önemli
Buradaki fikir "gömülü değerlendirme": değerlendiriciler bir AI şirketinin içinde, çalışan düzeyinde erişimle çalışıyor. Bu sayede modelin eğitim sırasında nasıl şekillendiğini görebiliyor, nasıl geliştirilip devreye alındığına dair kararları izleyebiliyor ve çalışanlarla doğrudan konuşabiliyorlar. Böylece şirketin güvenlik taahhütlerini tutup tutmadığını doğrulayabiliyor ve kör noktaları tespit edebiliyorlar.
Para ve açık sorular
İki şirket önümüzdeki beş yılda en az birer milyar dolar yatırım yapmayı planlıyor. Ancak gömülü değerlendiricilerin hangi bilgilere erişmesi gerektiğine ve bulgularını nasıl raporlayacağına dair henüz bir standart yok. Anthropic, Accenture'ın işini doğrudan finanse edecek; uzun vadede finansmanın havuzlanmış ya da devlet kaynaklı olması gerektiğini savunuyor. Ortaklık münhasır değil: şirket METR ve diğer kâr amacı gütmeyen değerlendiricilerle de görüşüyor.