· kaynak dev.to (home feed)
Claude Sonnet 5.5, agentic coding testlerinde Opus 5.5'e yaklaşıyor, yarı fiyatına
Anthropic'in yeni Claude Sonnet 5.5'i Terminal-Bench 4.0'da Opus 5.5'i geçerken Sonnet 5 fiyatını koruyor; daha hızlı çıktı ve Sonnet 4.5 için Kasım'da emeklilik tarihi de cabası.

Anthropic ne yayınladı
Anthropic, 28 Eylül 2026'da Claude Sonnet 5.5'i yayınladı; token başına yarısı maliyetle amiral gemisi Opus 5.5'e agentic coding değerlendirmelerinde yakın performans gösteren orta segment bir model. Anthropic'in duyurusuna göre yeni model, Sonnet 5'ten %30'dan fazla daha hızlı çıktı üretiyor ve aynı iş için daha az token gerektiriyor; şirket bu sayede bir görevin maliyetinin %30'a kadar düşebileceğini söylüyor.
Fiyatlandırma Sonnet 5'ten değişmedi: milyon giriş token başına 2 dolar ve milyon çıktı token başına 10 dolar; cache okuma 0,20 dolar, cache yazma milyon başına 2,50 dolar. Bir hafta önce 22 Eylül'de yayımlanan Opus 5.5, tam olarak iki katı: 4 ve 20 dolar. Geliştiriciler modeli claude-sonnet-5-5 kimliğiyle çağırıyor; model Claude Platform, Amazon Web Services, Google Cloud, Microsoft Azure ve Claude uygulamalarında mevcut. MarkTechPost'a göre 1 milyon token context window, 128.000 maksimum çıktı token ve Haziran 2026 bilgi kesim tarihine sahip.
Benchmark sonuçları
Anthropic, Sonnet 5.5'i hem Sonnet 5 hem de Opus 5.5 ile karşılaştıran sonuçlar yayınladı. Öne çıkan sayı, komut satırında çalışan agent'ları ölçen Terminal-Bench 4.0: Sonnet 5.5 %70,6 puan alarak %66,4'teki Opus 5.5'i az bir farkla geçiyor.
Diğer benchmarkların çoğunda Opus 5.5 dar bir liderliği koruyor: CursorBench 4.0 (%55,5'e karşı %57,8), FrontierCode 1.1 Main (%46,2'ye karşı %54,4), OSWorld 2.1 (%80,1'e karşı %81,8), Humanity's Last Exam (%64,5'e karşı %67,7), Chartography (%61,6'ya karşı %64,4) ve GDPval-AA v2.1 (1844'e karşı 1846).
Sonnet 5'e göre kuşak atlaması en çok agent görevlerinde belirgin. Sonnet 5, Terminal-Bench 4.0'da yalnızca %10,3 ve Chartography'de %15,6 başarım gösterdi; bu da komut satırı agent çalışmasını Anthropic'in tablosundaki en büyük iyileşme yapıyor.
Müşteriler nasıl kullanıyor
Anthropic iki modeli birbirini tamamlayan şekilde konumlandırıyor: iyi tanımlanmış günlük işler — hata düzeltme, belge üretimi ve hızlı yineleme — için Sonnet 5.5, sürekli akıl yürütme gerektiren açık uçlu sorunlar için Opus 5.5.
Erken benimseyenler ölçülebilir kazançlar bildiriyor. Slack başmühendisi Curtis Allen, promptları değiştirmeden Sonnet 5.5'in şirketin eval'lerinin neredeyse tamamında daha iyi performans gösterdiğini ve yaklaşık %14 daha az çıktı token kullandığını söyledi. Unite.AI'ya göre uygulama geliştirici Base44, Sonnet 5.5 ile derleme başına 3,6 yineleme ölçtü; Opus 5 için bu sayı 7,7 idi. Atlassian, Rovo Agents'ının Sonnet 5'e kıyasla %30'a kadar daha hızlı çalışabileceğini belirtiyor.
Güvenlik önlemleri ve bir fallback
Anthropic, Sonnet 5.5'in akıl yürütmesini çıkarmaya yönelik girişimleri engelleyen safety classifier'lara sahip ilk Sonnet model olduğunu söylüyor. Daha yüksek riskli siber güvenlik görevlerinde istekler görünür biçimde Sonnet 5'e fallback yapacak; güvenlik araştırmacıları Anthropic'in Cyber Verification Programı üzerinden daha geniş erişim için başvurabilir.
Sonnet 4.5 için geri sayım
Yayın, eski modeller için de bir geri sayım başlatıyor. Anthropic'in deprecation sayfasına göre Claude Sonnet 4.5 (claude-sonnet-4-5-20250929) 30 Eylül 2026'da deprecate edildi ve 30 Kasım 2026'da emekliye ayrılıyor; yerine claude-sonnet-5-5 geçiyor. Amazon Bedrock ve Google Cloud kendi emeklilik tarihlerini belirliyor.
Neden önemli
Yarı token fiyatına amiral gemisine yakın performans gösteren bir orta segment model, yapay zeka destekli kodlamanın ekonomisini yeniden şekillendiriyor. Agent iş yüklerinde varsayılan olarak Opus'u kullanan ekiplerin artık güvenilir bir ucuz alternatifi var: Anthropic'in kendi konumlandırması, iyi tanımlanmış kodlama, hata düzeltme ve belge görevlerinin Sonnet 5.5'e yönlendirilmesini, derin muhakeme gerektiren sorunlarınsa Opus 5.5 için ayrılmasını öneriyor. %30 daha hızlı çıktı ve azalan token kullanımı, yüksek hacimli pipeline'larda fiyat farkını katlayarak büyütüyor.
İki operasyonel pürüz var. Birincisi, hâlâ Sonnet 4.5 çağıranların Anthropic platformunda 30 Kasım'a kadar süresi var; Bedrock ve Google Cloud'da ayrı son tarihler geçerli. İkincisi, daha yüksek riskli güvenlik isteklerinde Sonnet 5'e görünür fallback, yanıtların sessizce farklı bir modelden gelebileceği anlamına geliyor; bu yüzden her isteğe hangi modelin yanıt verdiğini kaydetmek mantıklı bir adım. Benchmark odaklı yayınlarda her zaman olduğu gibi, geçmeden önce kendi gerçek promptlarınızla eval'lerinizi çalıştırmak akıllıca varsayılan olmaya devam ediyor.
- #anthropic
- #claude
- #ai-models
- #agentic-coding
- #llm-pricing