Geri Dön
Anthropic mühendisi, model daha akıllı olsa da Claude'un yazısının neden bozulduğunu açıkladı
SiTech AI Team2 წთ. საკითხავი

Anthropic mühendisi, model daha akıllı olsa da Claude'un yazısının neden bozulduğunu açıkladı

Claude'un ince ayarı üzerinde çalışan Anthropic araştırmacısı Jackson Kernion, yeni modellerin neden daha kötü yazdığını açıkladı: modeller matematiğe ve koda göre optimize ediliyor, metni ise insanlar için değil diğer yapay zeka modelleri için üretiyor.

Anthropic'in modelleri matematikte, programlamada ve çok adımlı akıl yürütmede büyük ölçüde gelişti. Metinlerinin kalitesi aynı hızla artmadı, bazı durumlarda ise geriledi. Claude'un ince ayarı (fine-tuning) üzerinde çalışan Anthropic araştırmacısı Jackson Kernion, X'te yayımladığı bir dizi paylaşımda bu farkın açıklamasını sundu.

Kod için optimizasyon, doğal dilin pahasına

Kernion'a göre Opus 4.6, gerçekten iyi bir "yazı modeli" diyebileceği son Anthropic modeliydi. Bunun bir kısmı öngörülebilir: yeni sürümler matematik ve kod için optimize edildi. Ancak daha az görünür ikinci bir etken var — modeller, teknik açıklamaları insanlara değil, diğer yapay zeka modellerine yönelik üretmek üzere de eğitildi.

Model "LLM psikolojisine uyarlandı" diyor Kernion; yani makineler için yazmayı öğrendi. Ona göre kullanıcıların "Claudeish" dediği tuhaf ifadeler tam da buradan geliyor: kesin ve bilgi yoğun görünen, ama insan için okunması zor metin.

Hedef kitle: dil modelleri

Kernion bu etkiyi, ağırlıklı olarak tek bir dar grup içinde iletişim kuran insanlara benzetiyor: grubun içinde işleyen, ancak dışarıdan anlaşılması zor bir üslup gelişir. LLM'lerin çalışma belleği insanlardan çok daha büyük ve ayrıntıları çok daha ince düzeyde yakalıyorlar; bu yüzden eğitim sırasında diğer modellere uygun bir üslup oluşuyor ve insan okura "fazla yoğun bilgi yığını" olarak ulaşıyor.

Sorunun kökeni ödül yapısında

Kernion'a göre sorunun kökeni pekiştirmeli öğrenmedeki ödül yapısı. Bazı ödüller bir yanıtı başka bir yapay zeka modelinin ne kadar iyi anladığını, bazıları ise insanın ne kadar iyi anladığını ölçüyor. Matematik ve kod üzerinde yoğun eğitim dengeyi ilk türe kaydırıyor; model bu yönde ne kadar çok eğitilirse geliştiricilerin o kadar aktif biçimde karşı koyması gerekiyor — insanın takip edebileceği basit açıklamaları ödüllendirerek.

Anthropic, Opus 5.5 ile daha iyi bir denge buldu diyor Kernion; Opus 4.6'dan bu yana hiçbir modelin yazısından bu kadar memnun kalmadığını ekliyor. Yeni modelin eskisini geçtiğini iddia etmiyor. "Çözülmesi zor bir problem ve iyileştirmeye devam edeceğiz" diye yazıyor.

SSiTech

SiTech — AI destekli web geliştirme

Hızlı ve modern web siteleri kuruyor, AI'yı gerçek iş akışlarına taşıyoruz. Projeniz veya sorunuz mu var? Yardımcı olmaktan mutluluk duyarız.