· kaynak Hacker News – Front Page (native)
Anthropic, %30'dan fazla daha hızlı çıktı ve daha uygun maliyetli görevlerle Claude Sonnet 5.5'i duyurdu
Anthropic'in Claude Sonnet 5.5'i, Sonnet 5'e göre %30'dan fazla daha hızlı çalışıyor ve görev başına maliyeti %30'a varan oranda daha düşük; agentic kodlamada büyük kazanımlar sunuyor ve ilk günden itibaren Vercel'in AI Gateway üzerinde kullanılabiliyor.

Anthropic ne duyurdu
Anthropic, Claude 5.5 ailesinin ikinci modeli ve Claude Sonnet 5'in doğrudan bir yükseltmesi olan Claude Sonnet 5.5'i yayınladı. Şirketin duyurusuna göre model, selefine kıyasla çıktıyı %30'dan fazla daha hızlı üretiyor ve görev başına maliyeti genellikle %30'a varan oranda daha düşük. Opus 5.5'in yerine geçmeyen model, onun yanında konumlanıyor: Opus, sürekli dikkat ve yargı gerektiren karmaşık, açık uçlu işler için kullanılmaya devam ederken, Sonnet 5.5 özellik geliştirme, hata düzeltme ve cilalı belgeler, sunumlar ile elektronik tablolar üretme gibi iyi tanımlanmış günlük görevlere odaklanıyor. Anthropic, yüksek hacimli ve maliyete duyarlı uygulamalar için tasarlanan Claude Haiku 5.5'in önümüzdeki haftalarda aileye katılacağını belirtiyor.
Kodlama ve bilgi işi kazanımları
En belirgin iyileşme agentic kodlamada görülüyor. Terminal-Bench 4.0'da Sonnet 5.5, Sonnet 5'in %10,3'üne karşılık %70,6 puan alıyor ve Opus 5.5'in %66,4'ünün de önünde. FrontierCode 1.1'de High çabasında Anthropic, görev başına yaklaşak on beşte bir maliyetle Sonnet 5'e göre on puanlık bir artış bildirirken, en iyi CursorBench 4.0 sonucu Opus 5.5'in yaklaşık iki puan gerisinde kalıyor. Model ayrıca Sonnet 5'ten daha fazla tool çağrısını birlikte gruplandırıyor; erken test edenler bunun adım ve maliyeti azalttığını söyledi.
Bilgi işinde de benzer bir hareket var. 44 meslek ve dokuz büyük sektörü kapsayan GDPval-AA'da Sonnet 5.5, 1.844 puan aldı — Opus 5.5'e neredeyse eşit ve Sonnet 5'in yaklaşık 400 puan üzerinde — ve Anthropic, modelin uzun vadeli bilgi işinde hem Sonnet 5'i hem de GPT-6 Sol'u açık ara geride bıraktığını söylüyor. Ayrıca yalnızca ekran görüntülerine bakarak Pokémon Red'i tamamlayan ilk Sonnet modeli. Erken test eden Epic Games ve Slack, promptlarını değiştirmeden daha iyi sonuçlar aldıklarını bildirdi; Slack, Slackbot değerlendirmelerinde çıktı tokenlarında yaklaşık %14 azalma ölçtü.
Fiyatlandırma, hız ve çaba düzeyleri
Token başına fiyatlar Sonnet 5 ile aynı: milyon girdi tokenı başına 2 dolar, milyon çıktı tokenı başına 10 dolar ve milyon cache okuması başına 0,20 dolar — Opus 5.5'in girdi ve çıktı ücretlerinin yarısı. Tasarruf, modelin aynı işi bitirmek için daha az tokena ihtiyaç duymasından kaynaklanan verimlilikten geliyor. Çıktı üretimi %30'dan fazla daha hızlı ve bu, onu Anthropic'in bugüne kadarki en hızlı Sonnet modeli yapıyor. Ayarlanabilir çaba (effort) ayarı, hızı ve maliyeti kapsamlılığa karşı takas ediyor: Claude Code ve Anthropic'in uygulamaları varsayılan olarak Medium kullanırken, Claude Platform varsayılan olarak High'da. Birçok benchmark'ta Low veya Medium çabasındaki Sonnet 5.5, görev başına yaklaşık onda bir maliyetle Sonnet 5'in en iyi puanını geçiyor.
Vercel'in AI Gateway'sinde yayında
Vercel, modelin aynı gün kullanıma açıldığını duyurdu: anthropic/claude-sonnet-5.5 kimliğiyle AI Gateway üzerinden çağrılabiliyor ve Zero Data Retention destekleniyor. AI SDK, OpenAI uyumlu Chat Completions API, Responses API ve Anthropic Messages API ile çalışıyor ve gateway'e bağlı kodlama agent'larının içinden seçilebiliyor — Vercel, npx vercel ai-gateway setup komutunu çalıştırıp agent'ın ayarlarından modeli seçmeyi öneriyor. Gateway; kullanım ve maliyet takibi, yönlendirme, yeniden deneme ve failover için tek bir API sunuyor ve bir AI Gateway anahtarı ya da sağlayıcı anahtarıyla kullanılabiliyor.
Güvenlik yaklaşımı
Sonnet 5.5 yetenek sınırlarını genişletmediği için Anthropic'in hizalama incelemesi, kullanıcıların çıkarlarına aykırı davranma ve yüksek riskli kötüye kullanımla iş birliği yapma gibi hedeflenmiş risklere odaklandı. Yaklaşık 1.850 senaryoyu kapsayan otomatik bir davranışsal denetimde model, çoğu ölçümde Sonnet 5'i iyileştiriyor ya da onunla eşit kalıyor; daha yeni containment değerlendirmelerinde ise sandbox'ından kaçma girişimlerinin ne kadar seyrek olduğu konusunda Opus 5.5'e yaklaşıyor. Siber güvenlik yetenekleri Opus 5'ininkine kıyaslanabilir olduğundan, Anthropic'in en güçlü modellerindeki gibi siber güvenlik korumaları ve yedek mekanizmalarıyla gelen ilk Sonnet modeli; biyoloji korumaları ise Sonnet 5 ile aynı. Anthropic, her iki korumanın da dar bir yüksek riskli istek kümesini hedeflediğini ve rutin yazılım geliştirmeyi ile yaşam bilimleri çalışmalarının çoğunu etkilemediğini belirtiyor.
Neden önemli
Sonnet 5.5, orta segment ile sınır modeller arasındaki boşluğu daraltıyor: iyi tanımlanmış işlerde Opus düzeyinde kaliteye yarı token fiyatıyla ve görev başına maliyetin çok küçük bir bölümüyle yaklaşırken daha hızlı yanıt veriyor. Mühendislik ekipleri için daha az token ve daha az adım, doğrudan daha düşük faturalara ve daha duyarlı ürünlere dönüşüyor; Slack ve Epic Games gibi erken benimseyenlerin promptlarına dokunmadan kazanımlar bildirmesinin nedeni de bu. Zero data retention dahil Vercel'in AI Gateway'de ilk günden kullanıma sunulması, yeni modellerin artık yönlendirme katmanları üzerinden üretime ne kadar hızlı ulaştığını gösteriyor — ekipler, bir entegrasyonu yeniden yazmak yerine yalnızca bir yapılandırma değişikliğiyle bu modelleri benimseyebiliyor ya da onlara failover yapabiliyor.
- #anthropic
- #claude
- #ai-gateway
- #vercel
- #llm
- #agentic-coding