
Anthropic, Claude Opus 5.5 için istem mühendisliği kılavuzunu yayımladı
Anthropic, Claude Platform belgelerinde Claude Opus 5.5 için bir istem mühendisliği kılavuzu yayımladı: yeni varsayılan effort düzeyi, her zaman açık thinking, gözetimsiz ajanlar için harness değişiklikleri ve yeni ret kategorileri.
Anthropic, Claude Platform belgelerinde Claude Opus 5.5 için bir istem mühendisliği kılavuzu yayımladı. Şirkete göre model, çıktı tokenlarını Claude Opus 5'ten %30'dan fazla hızlı üretiyor ve aynı görevi daha az tokenla bitiriyor; eski modele yazılmış istemlerin değişiklik yapılmadan çalışması bekleniyor.
Effort ana denetim
Claude Opus 5.5'te thinking her zaman açık olduğu için değiştirilecek ilk ayar effort düzeyi. Varsayılan düzey medium, Claude Opus 5'te ise high idi. Anthropic, düzeyi açıkça belirtmeyi ve birkaç değeri kendi değerlendirmelerinizde test etmeyi öneriyor. Şirketin testlerinde medium düzeyindeki Claude Opus 5.5, kodlama ve bilgi işi değerlendirmelerinde high düzeyindeki Claude Opus 5'e yetişti ya da onu geçti.
Aynı düzeyde yeni model tur başına Claude Opus 5'ten daha fazla düşünüyor, özellikle xhigh ve max düzeylerinde. Bu nedenle max_tokens içinde thinking tokenları için yer bırakılmalı, çünkü bu tokenlar kullanıcıya dönmese de limite sayılıyor. Uzun ajan görevleri için testlerde modelin üst sınırı olan 128.000 token iyi sonuç verdi. Daha az düşünmek için isteme talimat eklemek yerine effort düzeyini düşürmek daha güvenilir, üst düzey effort değerini istekler arasında değiştirmek ise prompt cache'i geçersiz kılıyor.
Gözetimsiz ajanlar ve harness değişiklikleri
Claude Opus 5.5 artık thinking'in kapatılmasını kabul etmiyor; Claude Opus 5 bunu high ve altındaki düzeylerde kabul ediyordu. Thinking kapalı çalışan entegrasyonlar low düzeyinden başlamalı, modelden gerekçesini yanıt metnine yazmasını isteyen talimatları kaldırmalı ve yanıtı blok türlerine göre okumalı.
Gözetimsiz ajanlarda araç çağrısı olmadan metinle biten tur artık görevin tamamlandığının kanıtı değil ilerleme raporu sayılıyor. Anthropic, görevin parçalarını modelin güncellediği bir listede tutmayı ve açık maddeleri adlandıran kısa bir devam mesajı göndermeyi öneriyor.
Araç çağrıları arasında model kısa ilerleme notları yazıyor. Bu notlar progress-update türü thinking blokları olarak dönüyor ve metinleri varsayılan olarak boş, bu yüzden istemcinin updates görünüm ayarını istemesi gerekiyor.
Güvenlik ve görsel girdiler
Claude Opus 5.5 biyoloji, siber güvenlik ve gerekçe çıkarımı için güvenlik sınıflandırıcıları çalıştırıyor. Ret, stop_reason değeri "refusal" ve kategoriyi belirten bir stop_details nesnesiyle normal yanıt olarak geliyor. Böyle bir istek yedek bir modelde otomatik yeniden denenebiliyor, gerekçe çıkarımı redleri hariç.
Yoğun grafikler, diyagramlar ve ekran görüntüleri için kılavuz daha yüksek çözünürlüklü görselleri ve konteyner içinde PIL, OpenCV gibi araçları öneriyor.
SiTech — AI destekli web geliştirme
Hızlı ve modern web siteleri kuruyor, AI'yı gerçek iş akışlarına taşıyoruz. Projeniz veya sorunuz mu var? Yardımcı olmaktan mutluluk duyarız.