Geri Dön
Anthropic Claude Opus 5.5'i tanıttı: Opus 5'ten %40 daha ucuz
SiTech AI Team3 წთ. საკითხავი

Anthropic Claude Opus 5.5'i tanıttı: Opus 5'ten %40 daha ucuz

Anthropic, yeni Claude 5.5 ailesinin ilk modeli olan Claude Opus 5.5'i tanıttı. Şirkete göre model çoğu işte Claude Fable 5.1 seviyesine ulaşıyor, ancak çalıştırma maliyeti Opus 5'e göre %40 daha düşük.

Anthropic, 22 Eylül'de yeni Claude 5.5 ailesinin ilk modeli olan Claude Opus 5.5'i tanıttı. Şirkete göre model, işlerin çoğunda Claude Fable 5.1 seviyesine ulaşıyor ve çalıştırma maliyeti Opus 5'e göre %40 daha düşük.

Performans ve maliyet

Anthropic'e göre erken test kullanıcıları karmaşık işlerde büyük kazanımlar gördü. Bir kullanıcı 680.000 satırlık kod taşıma işini bir günden kısa sürede tamamladı; şirket bu işin bir mühendis ekibine haftalar alacağını söylüyor. Bir web uygulamasının tüm sayfalarında yükleme sürelerini kısma görevinde Opus 5.5 40 denemenin 39'unda başarılı oldu; Opus 5 ise uygulamanın davranışını da değiştiren daha küçük iyileştirmeler yaptı.

Şirketin aktardığına göre ajan tabanlı ve kodlama maliyetlerinin çoğunu oluşturan önbellek okumaları milyon token başına 0,20 dolar — Opus 5'e göre %60 daha az — ve çıktı %30'dan fazla daha hızlı üretiliyor. Claude Code ve Claude Platform'da 2,5 kata kadar hızlanan bir hızlı mod var: milyon giriş tokenı için 8 dolar, milyon çıkış tokenı için 40 dolar.

Benchmark'lar ve müşteri sonuçları

Ajanın kod değişikliklerinin birleştirilip birleştirilmeyeceğini ölçen FrontierCode v1.1'de Opus 5.5 varsayılan çabayla %54,6 alıyor; bu, diğer tüm modellerin ve GPT-6 Astra'nın en yüksek skoru olan %53,3'ün üzerinde ve görev başına maliyetin yaklaşık beşte biriyle. Terminal-Bench 4.0'da varsayılan çabayla, en yüksek çabayla çalışan Opus 5'i yaklaşık beşte bir maliyetle geçiyor ve GPT-6 Astra ile maliyetin yaklaşık %40'ında eşleşiyor. 44 meslekte gerçek işleri ölçen GDPval-AA v2.1'de 1846 Elo'ya ulaşıyor.

Anthropic'in aktardığı müşteri sonuçları da benzer. Hebbia'ya göre Opus 5.5, uzman finans kriterlerinin %86,6'sını karşıladı; Opus 5'te bu oran %60,3'tü. Spotify ise modelin ajan tabanlı kodlama görevlerinde Opus 5 kalitesine yaklaşık yarısı kadar adımda, sürede ve çıkış tokenında ulaştığını bildiriyor.

Güvenlik ve koruma önlemleri

Anthropic'e göre Opus 5.5, Claude'u yaklaşık 2.000 senaryoda test eden otomatik davranış denetiminde bugüne kadarki en iyi skorları aldı ve şirketin dürüstlük ölçütlerinin çoğunda en güçlü modeli. Yeni bir sınır içinde kalma değerlendirmesinde, sınırları aşmayı Opus 5 veya Claude Mythos 5.1'e göre yaklaşık %85 daha az denedi. Güvenlik şirketi Gray Swan'ın benchmark'ında, test edilen tüm modeller arasında en düşük prompt injection başarı oranıyla Fable 5.1 ile eşit durumda.

Opus 5.5, siber güvenlik, biyoloji ve damıtma alanlarında Fable 5.1'e benzer koruma önlemleriyle çıkan ilk Opus modeli; siber güvenlik görevlerinin çoğu Opus 4.8'e yönlendiriliyor. Model, 31 Ağustos 2026 ve sonrasında oluşturulan API hesapları için geçerli olan damıtma karşıtı "korunmuş düşünme" ile geliyor ve artık düşünme modu kapalı olarak sunulmuyor.

Kullanılabilirlik

Claude Opus 5.5 artık Amazon Web Services, Google Cloud ve Microsoft Azure'da kullanılabilir; Claude Platform'da model kimliği claude-opus-5-5.

SSiTech

SiTech — AI destekli web geliştirme

Hızlı ve modern web siteleri kuruyor, AI'yı gerçek iş akışlarına taşıyoruz. Projeniz veya sorunuz mu var? Yardımcı olmaktan mutluluk duyarız.