Anthropic, foundation model şirketleri arasında ajan (agentic) yeteneklerin temel haline gelmesiyle, Claude Sonnet 5'i piyasaya sürdü. Bu model, daha güçlü ve daha ucuz bir versiyon olarak tanımlanıyor. Anthropic, bir blog yazısında, 'Sonnet 5, planlar yapabilir, tarayıcılar ve terminaller gibi araçları kullanabilir ve otonom olarak çalışabilir. Bu, sadece birkaç ay önce daha büyük ve daha pahalı modellerin gerektirdiği bir seviyedir.' dedi.
Sonnet 5, Salı günü kullanıma sunuldu ve serideki 'en ajan odaklı Sonnet modeli' olarak nitelendiriliyor. Free ve Pro kullanıcılar için varsayılan model olan Sonnet 5, Max, Team ve Enterprise planlarında, Claude Code aracılığıyla ve API üzerinden kullanılabiliyor. Ayrıca, geliştiriciler bir çaba çarkı (effort dial) ile Sonnet 5 ile Opus 4.8 arasında seçim yapabiliyor ya da web uygulamasında aynı görev için maliyet-doğruluk dengesini ayarlayabiliyor.
Sonnet 5, Opus 4.8'e benzer bir performans sunuyor ancak daha düşük maliyetlerle. 31 Ağustos'a kadar, Sonnet 5'in fiyatı girişte 2 dolar ve çıktıda 10 dolar olarak belirlendi; bu süre sonunda fiyat girişte 3 dolar, çıktıda 15 dolara yükseliyor. Bu fiyat, Opus 4.8'in 5/25 dolar olan tarifesinin oldukça altında. Ayrıca OpenAI'nin GPT-5.5 ve Google'ın Gemini 3.1 Pro'sundan da daha ucuz.
Yeni model, önceki versiyonu Sonnet 4.6'ya göre önemli iyileştirmeler gösteriyor. Anthropic'e göre Sonnet 5, akıl yürütme, araç kullanımı, yazılım kodlama ve bilgi işlerinde önemli gelişmeler kaydetti. SWE-bench Pro (çok dosyalı değişiklikler içeren aktif depolardan alınan kodlama sorunları) benchmark'ında Sonnet 5 %63,2 skor elde etti. Bu oran Opus 4.8'in %69,2'sine ve Sonnet 4.6'nın %58,1'ine karşılık geliyor. GDPval-AA v2 benchmark'ında (kör çiftli Elo derecelendirmeleriyle 44 meslekte gerçek dünya profesyonel görevleri puanlayan bir test) Sonnet 5, 1.618 puan alarak Opus 4.8'in 1.616 puanıyla neredeyse eşitlendi. Humanity's Last Exam'de ise fark ihmal edilebilir düzeyde: %57,4'e karşı %57,9.
Anthropic, 'Opus 4.8 hala bu görevlerde daha yüksek doğruluk için tercih edilen modeldir, ancak Sonnet 5, geliştiricilere daha düşük fiyatlı ve daha yüksek kaliteli seçenekler sunuyor' dedi. Testçiler, Sonnet 5'in karmaşık görevleri tamamlama konusunda başarılı olduğunu ve 'açıkça istenmeden bile kendi çıktısını kontrol edebildiğini' belirtti.
Daniel Shepard, Zapier'dan senior mühendis, 'Sonnet 5'i iki parçalı bir işe verdik - Salesforce hesap seviyelerini güncelle, kurumsal temaslara lansman açıklaması gönder - ve o, işi baştan sona tamamladı. Bu, daha önce yarı yolda kalıyordu. Günlük otomasyon için bu bir seçim değil.' dedi.
Sonnet 5, ayrıca güvenlik konusunda da önemli gelişmeler gösteriyor. Kötüye kullanım ve aldatma ile işbirliği gibi 'istenmeyen davranışlar'ın oranını düşürdü ve daha güvenli bir şekilde kullanılıyor. Lovable'ın kurucu ortağı Fabian Hedin, 'Sonnet 5, güvensiz istekleri temiz ve tutarlı bir şekilde reddediyor. Lovable'da, milyonlarca yapımcının eline güçlü araçlar koyuyoruz. Bir modelin ne zaman hayır demesini bilmesi, nasıl inşa edeceğini bilmesi kadar önemlidir.' dedi.