Geri Dön
Anthropic, en ajan tabanlı Sonnet modeli Claude Sonnet 5'i duyurdu
SiTech AI Team2 წთ. საკითხავი

Anthropic, en ajan tabanlı Sonnet modeli Claude Sonnet 5'i duyurdu

Anthropic 30 Haziran'da Claude Sonnet 5'i tanıttı ve onu şirketin bugüne kadarki en ajan tabanlı Sonnet modeli olarak nitelendirdi. Performansı Opus 4.8'e yaklaşıyor, fiyatı ise daha düşük; model Free ve Pro planlarında varsayılan hâle geldi.

Şimdiye kadarki en ajan tabanlı Sonnet

Anthropic, 30 Haziran'da Claude Sonnet 5'i tanıttı ve modeli şirketin bugüne kadar geliştirdiği en ajan tabanlı Sonnet modeli olarak sundu. Model plan yapabiliyor, tarayıcı ve terminal gibi araçları kullanabiliyor ve yalnızca birkaç ay önce daha büyük ve daha pahalı modellerin gerektirdiği düzeyde otonom çalışabiliyor.

Anthropic'e göre ajan tabanlı yapay zekâ dönemi Sonnet sınıfı modellerle başladı: Claude Sonnet 3.5, 3.6 ve 3.7, kodlama ve araç kullanımında etkileyici beceriler gösteren ilk modellerdi. Son dönemde ajan yeteneklerindeki en belirgin kazanımlar Opus sınıfı modellerden geldi; Sonnet 5 bu farkı kapatıyor: performansı Opus 4.8'e yakın, fiyatı ise belirgin şekilde düşük.

Sonuçlar, çaba seviyeleri ve fiyat

Şirkete göre Sonnet 5, selefi Sonnet 4.6'ya kıyasla akıl yürütme, araç kullanımı, kodlama ve bilgi işi gibi ajan performansının önemli alanlarında ciddi bir iyileşme sunuyor. Orta çaba seviyesinde maliyet verimliliği belirgin biçimde artıyor; yüksek çaba seviyesinde ise bazı görevlerde Opus 4.8 düzeyine ulaşabiliyor. Kullanıcılar maliyet ile performans arasında denge kurmak için çaba seviyesini ayarlayabiliyor.

Claude Sonnet 5 tüm planlarda kullanılabiliyor: Free ve Pro planlarının varsayılan modeli ve Max, Team ile Enterprise kullanıcılarına da açık. Fiyatlandırma milyon giriş token'ı için 2 dolar, milyon çıkış token'ı için 10 dolar; başlangıç fiyatı kalıcı hâle getirildi, standart tarife ise 3 ve 15 dolardı. Anthropic, modelin güncellenmiş bir tokenizer kullandığını, bu nedenle aynı metnin içerik türüne bağlı olarak yaklaşık 1,0–1,35 kat daha fazla token'a karşılık gelebileceğini belirtiyor.

Güvenlik değerlendirmeleri

Anthropic'in güvenlik değerlendirmeleri, Sonnet 5'in Sonnet 4.6'ya göre genel olarak daha düşük oranda istenmeyen davranış sergilediğini ve ajan bağlamlarında kullanımının daha güvenli olduğunu gösterdi. Değerlendirmeler ayrıca modelin siber güvenlik görevlerini yerine getirme yeteneğinin mevcut Opus modellerinden çok daha düşük olduğunu ortaya koyuyor. Firefox tarayıcısındaki güvenlik açıkları için exploit geliştirme testinde Sonnet 5 hiçbir zaman tam çalışan bir exploit geliştiremedi, ancak kısmi başarı oranı Sonnet 4.6'dan biraz yüksek. Ayrıntılı sonuçlar Claude Sonnet 5 System Card'da yayımlandı.

Anthropic'in alıntıladığı geliştiriciler modeli olumlu değerlendirdi. Zimu Li, Sonnet 5'in ajanlara çok adımlı yazılım mühendisliği işleri için güçlü bir yürütme katmanı sağladığını ve uzun süreli kodlama, araç kullanımı ile hata ayıklamayı iyi yönettiğini söyledi. Kiro'dan Deepak Singh ise modeli Opus sınıfı doğruluğa sahip güçlü bir ajan tabanlı kodlama modeli olarak tanımlıyor.

SSiTech

SiTech — AI destekli web geliştirme

Hızlı ve modern web siteleri kuruyor, AI'yı gerçek iş akışlarına taşıyoruz. Projeniz veya sorunuz mu var? Yardımcı olmaktan mutluluk duyarız.