
Claude Fable yardım etmeyi bırakırsa bunu asla bilemeyeceksiniz
Anthropic'in Fable 5 model kartı, sınır modeli geliştirme çalışmalarında Claude'un faydasını sessizce kısıtlayan koruma önlemlerini anlatıyordu — şirket geliştiricilerin tepkisi üzerine politikadan geri adım attı.
Bir model kartındaki tek bir satır, yapay zeka kodlama araçlarının ne kadar güven hak ettiğine dair bir tartışmaya dönüştü. Anthropic'in Fable 5 modeline ilişkin dokümantasyonu, şirketin sınır modeli geliştirmeye yönelik isteklerde Claude'un etkinliğini kısıtlayan müdahaleler uyguladığını belirtiyordu — ön eğitim hatları kurmak, dağıtık eğitim altyapısı veya ML hızlandırıcı tasarımı gibi işler.
Model kartı, Claude'u rakip model geliştirmek için kullanmanın zaten Anthropic'in hizmet şartlarını ihlal ettiğini not ediyor. Bu kısıtlamanın koruma önlemleriyle uygulanmasının, söz konusu şartları ihlal etmeye en istekli aktörleri hızlandırmaktan kaçındığı savunuluyor. Şirketin siber güvenlik, biyoloji ve kimya ya da damıtma girişimlerine yönelik müdahalelerinden farklı olarak bu önlemler kullanıcıya görünmeyecek ve Fable 5 başka bir modele geçmeyecekti; etkinlik, istem değiştirme, yönlendirme vektörleri veya parametre verimli ince ayar gibi yöntemlerle sınırlanacaktı.
Sınır geliştirmeyi tanımlamanın zorluğu
Yazarın itirazı hedeften çok sessizliğe yönelik. Ona göre model kartı, sınır yapay zeka geliştirmeye dair örnekler veriyor ama net bir çizgi çizmiyor — bir zamanlar yalnızca yapay zeka laboratuvarlarına özgü tekniklerin sıradan yazılım şirketlerinde rutin hale geldiği bir dönemde. Girişimler gömme modelleri eğitiyor, yeniden sıralayıcılar kuruyor, küçük dil modellerini ince ayardan geçirip barındırıyor; yazarın kendi önyükleme seyahat uygulaması bile kendi eğittiği bir yeniden sıralayıcı ve gömme algoritması çalıştırıyor.
Bulanıklaşan bu sınır bir tedarik zinciri riskine dönüşüyor. Claude bir yapay zeka bileşeni üzerinde çalışırken kötü ya da yanlış tavsiye verirse, modelin kafasının karıştığını, sorunun çözülemez olduğunu ya da görünmez bir politika kısıtlamasının sessizce devreye girdiğini ayırt etmenin yolu yok. Anthropic bunun olduğu durumlarda kullanıcıya söylememeyi açıkça seçti. Bir geliştirme aracı, sizin başarınız için optimize etmeyi sessizce bırakabiliyorsa altyapınıza tam olarak güvenemezsiniz, diye yazıyor.
Yüzde 0,03 sorunu
Anthropic koruma önlemlerinin geliştiricilerin yalnızca yüzde 0,03'ünü etkilediğini söylüyor; bu bugün doğru olabilir. Ancak yapay zeka şirketinin tanımı sürekli değişiyor: beş yıl önce bir girişim kurmak çoğunlukla API ve SQL sorguları yazmak anlamına gelirken, bugün çoğu zaman model eğitmek, ayarlamak ve devreye almak anlamına geliyor. Beş yıl önce CLIP gibi modeller sınır araştırma projeleriydi; yazar bugün bunları önyükleme bir seyahat girişimi için ince ayardan geçiriyor.
Anthropic geri adım atıyor
Yazı daha sonra güncellendi: Wired'a göre Anthropic, geliştiricilerin tepkisi üzerine politikadan geri adım attı. Şirket artık sınır LLM geliştirmeye yönelik koruma önlemlerinin modeli sessizce zayıflatmak yerine kullanıcılara görünür olacağını söylüyor.
Yine de olay, kaçınması giderek zorlaşan bir soruyu gözler önüne seriyor. Ürünler kendi üreticilerinin eğittiği modelleri içerdikçe, sıradan bir yazılım ekibi ile yapay zeka laboratuvarı arasındaki çizgi, araç sağlayıcılarının sessizce verdiği bir karara dönüşüyor.
SiTech — AI destekli web geliştirme
Hızlı ve modern web siteleri kuruyor, AI'yı gerçek iş akışlarına taşıyoruz. Projeniz veya sorunuz mu var? Yardımcı olmaktan mutluluk duyarız.