· kaynak Hacker News – Front Page (native)
Claude Opus 5.5, Fable düzeyinde performansla %40 daha düşük maliyetle geldi ve Vercel AI Gateway'de yerini aldı
Anthropic, Claude Opus 5.5'in çoğu işte daha büyük Fable 5.1 modeli düzeyinde performans gösterdiğini ve görev başına Opus 5'ten yaklaşık %40 daha düşük maliyetli olduğunu söylüyor; Vercel ise modeli ilk gün AI Gateway'e ekledi.

Anthropic, yeni Claude 5.5 ailesinin ilk modeli olan Claude Opus 5.5'i yayınladı. Şirket, modelin çoğu işte daha büyük Fable 5.1 modeli düzeyinde performans gösterdiğini ve görev başına Opus 5'ten kabaca %40 daha düşük maliyetli olduğunu iddia ediyor. Model hemen kullanıma sunuldu ve Vercel, çıkış gününde modeli AI Gateway'e ekledi.
Daha ucuz ve daha hızlı
Anthropic'in duyurusuna göre input ve output token fiyatları milyonda sırasıyla 4 ve 20 dolar; bu, Opus 5'in %20 altında. Cache okumaları ise %60 düşüşle milyonda 0,20 dolara iniyor — cache'lenen tokenların agent tabanlı ve kodlama iş yüklerinde maliyetlerin büyük bölümünü oluşturması nedeniyle bu önemli bir ayrıntı. Model ayrıca bir öncekinden %30'dan fazla hızlı output üretiyor; Claude Code'da ve Claude platformunda milyonda 8 ve 40 dolar input ve output token fiyatıyla 2,5 kata varan hız sunan bir fast mode mevcut.
Anthropic bunlara ek olarak Pro, Max ve Team planlarındaki beş saatlik kullanım limitlerini yükseltiyor ve abonelere istedikleri zaman saklayıp kullanabilecekleri bir rate-limit sıfırlama hakkı veriyor. TechCrunch, lansmanın Opus 5'in 24 Temmuz'da gelmesinden yalnızca iki ay sonra gerçekleştiğine dikkat çekiyor.
Performans ve verimlilik iddiaları
Anthropic, Opus 5.5'i yeni öncü modeli olarak nitelendiriyor ve en büyük kazanımların agent tabanlı kodlama, uzun süren agent görevleri ve bilgi işinde olduğunu belirtiyor. Şirketin kendi benchmark tablolarında model, Terminal-Bench 4.0'da %66,4 ve FrontierCode v1.1'de %54,4 puan alıyor — Anthropic'in bildirdiğine göre Fable 5.1, Opus 5 ve OpenAI'nin GPT-6 Astra'sının önünde — ayrıca OSWorld 2.0 bilgisayar kullanımı paketinde %81,8 puana ulaşıyor. Anthropic'in kendisi de bu yetkinlik düzeyinde benchmark farklarının gerçek dünyadaki farkları ölçmede daha az güvenilir bir gösterge olduğu konusunda uyarıyor ve kendi kullanımında Fable 5.1 ile arasındaki farkın puanların ima ettiğinden daha dar olduğunu söylüyor. TechCrunch ise Opus 5.5'in birçok benchmark'ta Fable'ı geride bıraktığını ve Fable'ın tamamlayamadıgayri resmi görevlerde başarı gösterdiğini bildiriyor.
Anthropic'in aktardığı erken testçiler arasında bir günde 680.000 satırlık bir kod göçünü tamamlayan ve üç saatten kısa sürede 200.000 satırlık bir kod tabanını denetleyip düzelten kullanıcılar var — Opus 5 bu işler için 20 saatten fazla süre ve 2,5 kat fazla token harcamıştı. HAProxy load balancer'ı C'den Rust'a çeviren dahili bir testte Opus 5.5 işi 9,5 saatte, %51 daha düşük maliyetle tamamlarken Fable 5.1 12 saatte tamamladı. Anthropic ayrıca modelin daha sade yazdığını ve kilit bilgileri başa koyduğunu söylüyor; bunu, output'un doğrulanması kolaylaştığı için hem kullanılabilirlik hem de güvenlik açısından bir avantaj olarak sunuyor.
Güvenlik ve hız ayarı bağlamı
TechCrunch, bunun CEO Dario Amodei'nin risk önleme çalışmalarının yetişebilmesi için yetenek ilerlemesini bilinçli olarak yavaşlatmayı desteklemesinden sonraki ilk Anthropic sürümü olduğuna dikkat çekiyor. Anthropic, Opus 5.5'in yayınlanmadan önce METR ve Frontier Design dahil dış kuruluşlar tarafından değerlendirildiğini ve binlerce simüle senaryoyu kapsayan bir hizalama paketi olan otomatik davranışsal denetimde bugüne kadar test ettiği tüm modellerden daha yüksek puan aldığını söylüyor. Şirket, modelin son modellere kıyasla geri alınması zor eylemler gerçekleştirmeye daha az yatkın olduğunu ve Opus 5'ten daha yüksek prompt injection direncine sahip olduğunu, ancak yine de sınırları bulunduğunu kabul ediyor.
Opus 5.5, biyoloji ve siber güvenlik alanında Claude Mythos 5.1 ile karşılaştırılabilir olduğundan Fable 5.1 ile aynı koruma önlemleriyle geliyor. Onaylanmış kuruluşlar Life Sciences Verification Program'a şimdiden başvurabiliyor; Anthropic, Cyber Verification Program'ın önümüzdeki haftalarda doğrulanmış güvenlik uzmanlarına açılacağını söylüyor. TechCrunch, temel güvenlik eğitiminin önceki modellerle büyük ölçüde benzer olduğunu, gelecek sürümler için daha güçlü değerlendirme ve izleme sistemlerinin hazırlandığını bildiriyor.
Vercel AI Gateway'de, breaking change'lerle birlikte
Vercel, modelin AI Gateway'de aynı gün anthropic/claude-opus-5.5 model kimliğiyle kullanıma sunulduğunu duyurdu; fast mode ise anthropic/claude-opus-5.5-fast olarak sunuluyor. Model; AI SDK, OpenAI uyumlu Chat Completions API, Anthropic Messages API ve bağlı kodlama agent'ları üzerinden erişilebilir; 1M token'lık context window, 128K'a varan output token kapasitesi ve Haziran 2026 bilgi kesim tarihi sunuyor. Vercel, sağlayıcı fiyatlandırmasını ek fiyat veya platform ücreti olmadan aynen geçiriyor ve opsiyonel bölgesel çıkarım — örneğin istekleri ABD'ye sabitleme — ile Zero Data Retention sunuyor.
Vercel, daha önce geçerli olan istekleri HTTP 400 hatalarına dönüştürebilen iki API değişikliği konusunda uyarıyor: thinking artık her zaman adaptif, dolayısıyla thinking'i devre dışı bırakan veya sabit bir thinking bütçesi belirleyen istekler reddediliyor; zorunlu araç kullanımı (forced tool use) ise emekliye ayrılıyor. Geliştiricilere modeli prompt'lar ve effort ayarlarıyla yönlendirmeleri, kaçırılan araç çağrılarını kendi harness'lerinde yeniden denemeleri ve daha önce JSON üretmek için zorunlu araç çağrılarının kullanıldığı yerlerde structured outputs'a geçmeleri tavsiye ediliyor.
Anthropic, Sonnet 5.5 ve Haiku 5.5'in önümüzdeki haftalarda performans, verimlilik ve güvenlikte benzer iyileştirmelerle geleceğini söylüyor.
Neden önemli
Agent tabanlı kodlama faturaları token hacmiyle ölçekleniyor ve Opus 5.5 maliyeti aynı anda iki eksende düşürüyor — token başına daha düşük fiyat ve görev başına daha az token — dolayısıyla iddia edilen %40 net tasarruf, tek bir benchmark puanından daha önemli. Bu sürüm ayrıca Amodei'nin frontier'in hızını ayarlama sözünün somut ilk sınavı: yetenek artışının yanına değil, dış değerlendirmeyi yetenekle eşleşen koruma önlemleriyle birleştiriyor. Mühendislik ekipleri için emekliye ayrılan zorunlu araç kullanımı ve sabit thinking bütçesi seçenekleri gerçek göç çalışması anlamına geliyor ve Vercel'in gateway'i üzerinden ek ücret olmadan ilk gün erişim, frontier modellerinin artık üçüncü taraf dağıtıma ne kadar hızlı ulaştığını gözler önüne seriyor.
- #anthropic
- #claude
- #llm
- #vercel
- #ai-gateway
İlgili yazılar
- OpenAI'nin GPT-6 Sol ve Luna modelleri Vercel AI Gateway'de GPT-6 Astra'nın altındaki fiyatlarla kullanıma sunuldu
- Anthropic, başıboş yapay zeka olaylarının ardından daha sıkı siber güvenlik korumalarıyla Claude Opus 5.5'i yayınladı
- OpenAI, GPT-5.6 Luna API fiyatlarını yüzde 80, Terra'yı yüzde 20 düşürdü