deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak Hacker News – Front Page (hnrss.org)

Anthropic, Claude Haiku 5.5'i piyasaya sürdü: Haiku 4.5'ten yaklaşık %75 daha ucuz küçük model

Anthropic'in Claude Haiku 5.5'i yüksek hacimli, maliyet duyarlı iş yüklerini hedefliyor; Haiku 4.5'ten yaklaşık %75 daha ucuz çalışıyor ve yanında Sonnet 5.5 cache-read fiyat indirimi ile abonelere yeni API kredisi geliyor.

Anthropic, Claude Haiku 5.5'i piyasaya sürdü: Haiku 4.5'ten yaklaşık %75 daha ucuz küçük model

Anthropic, şirketin şimdiye kadarki en ucuz, en hızlı ve en yetenekli küçük modeli olarak nitelendirdiği Claude Haiku 5.5'i yayınladı. Halihazırda Hacker News ana sayfasında yer alan, Anthropic'in sitesindeki duyuru, token başına fiyatın ve gecikme süresinin zirve akıl yürütme yeteneğinden daha önemli olduğu yüksek hacimli, maliyet duyarlı iş yükleri çalıştıran geliştiricilere yönelik.

Dar kapsamlı işler için işçi at modeli

Haiku 5.5, bir frontier modelden çok bir işçi at olarak konumlandırılıyor. Anthropic'e göre model; özetleme, bağlam sıkıştırma, veritabanı sorguları ve sınıflandırma gibi hızlı, tekrarlayan işleri güvenilir biçimde gerçekleştiriyor ve kodlama kurulumlarında daha büyük Opus 5.5 ile Sonnet 5.5'in yanında bir subagent olarak görev alarak, daha büyük bir modelin fiyatını hak etmeyen dar adımları üstlenebiliyor. Anthropic'in şimdiye kadarki en hızlı modeli olduğundan şirket, canlı müşteri desteği ve tarayıcı otomasyonu gibi gecikmeye duyarlı kullanımlara da işaret ediyor.

Çalıştırması yaklaşık %75 daha ucuz

Anthropic, Haiku 5.5'in çalıştırma maliyetinin Haiku 4.5'ten ortalama yaklaşık %75 daha düşük olduğunu söylüyor. Fiyatlandırma prompt uzunluğuna göre kademeli. Anthropic'in önceki Haiku modeline gelen isteklerin yaklaşık %90'ını oluşturduğunu söylediği, 100.000 token'a kadar promptlarda girdi milyonda 0,10 dolar, çıktı milyonda 0,50 dolar; cache read 0,01 dolar, cache write ise 0,125 dolar. 100k token'ı aşan promptlar ise milyonda 0,50 dolar girdi, milyonda 2,50 dolar çıktı, 0,05 dolar cache read ve 0,625 dolar cache write üzerinden faturalanıyor. Karşılaştırma gerekirse, Haiku 4.5 milyonda 1,00 dolar girdi token'ı ve milyonda 5,00 dolar çıktı token'ı ücreti alıyordu.

Benchmark kazanımları ve uyarılar

Anthropic'in yayınladığı benchmark'ler Haiku 4.5'e kıyasla büyük bir sıçrama gösteriyor. Bilgisayar kullanımını test eden OSWorld 2.1'de (çevrimdışı alt küme) Haiku 5.5, Haiku 4.5'in yüzde 15,7'sine karşılık yüzde 72,4 alıyor; Sonnet 5.5 yüzde 83,9'a ulaşıyor ve Anthropic'in tablosunda GPT-6 Luna olarak listelenen bir model yüzde 48,9 alıyor. Agentic coding benchmark'i olan Terminal-Bench 4.0'da Haiku 5.5 yüzde 39,2'ye ulaşırken Haiku 4.5 yüzde 0,0 almıştı ve Sonnet 5.5 yüzde 70,6'ya ulaşıyor. Araç kullanılmadan yapılan Humanity's Last Exam'de Haiku 5.5, Haiku 4.5'in yüzde 10,2'sine karşılık yüzde 45,9 alıyor. Anthropic'in kendisi de daha büyük modelleriyle arasındaki farka dikkat çekiyor: Karmaşık agentic coding için Sonnet 5.5 ve Opus 5.5 hâlâ daha iyi seçenekler; Haiku 5.5 ise daha önce bir Claude modeline devredilmesi maliyet açısından mantıklı olmayacak dar kapsamlı işlere uygun.

Duyuruda yer alan erken müşteri geri bildirimleri de hız iddialarıyla tutarlı. Asana'da staff software engineer olarak çalışan Aaron Vinh, Asana'nın bugün kullandığı modele kıyasla görev tamamlama gecikmesinde yüzde 30'dan fazla düşüş ve agent başına tur başına en fazla 2,5 kat daha hızlı çıkarım bildirdi.

Ayarlanabilir effort özelliğine sahip ilk Haiku

Haiku 5.5, ayarlanabilir effort ayarına sahip ilk Haiku sınıfı model; böylece geliştiriciler, Anthropic'in daha büyük modellerinde zaten yapabildikleri gibi, maliyet ile zekâ arasındaki dengeyi görev bazında ayarlayabiliyor.

Tüm ürün gamında daha geniş fiyatlandırma hamleleri

Lansmanın yanı sıra Anthropic, Claude Sonnet 5.5'in cache-read fiyatını milyonda token başına 0,20 dolardan 0,10 dolara yarıya indirdi. Cache read'ler agent döngülerindeki token tüketiminin büyük bölümünü oluşturduğundan Anthropic, bunun Sonnet 5.5'i agentic işlerin çoğunda yaklaşık %20 daha ucuz hale getirdiğini tahmin ediyor.

Şirket ayrıca Claude Max ve Team aboneleri için aylık API kredisi sunuyor: Max 5x kullanıcılarına ayda 100 dolar, Max 20x kullanıcılarına 200 dolar ve Team planlarındaki kullanıcılar arasında havuzlanmış şekilde 500 dolara kadar; bu kredi herhangi bir modelde harcanabiliyor. Buna ek olarak Claude Python ve TypeScript SDK'lerine bilgisayar kullanımı ve tarayıcı kullanımı için beta desteği geliyor; Anthropic bu görevleri Haiku 5.5'in hızı ve fiyatı sayesinde özellikle iyi yerine getirdiğini söylüyor.

Güvenlik duruşu

Güvenlik konusunda Anthropic, Haiku 4.5 ile karşılaştırıldığında hizalanmamış davranış örneklerinin ve kötüye kullanıma işbirliği yapma isteğinin azaldığını bildiriyor. Haiku 5.5'in siber güvenlik korumaları Haiku 4.5'ten daha kısıtlayıcı ama diğer yeni modellerdekilerden biraz gevşek: Sonnet 5.5'in korumalarından daha geniş bir yelpazedeki savunma amaçlı güvenlik görevlerine izin verirken sızma testi ve benzeri saldırı tekniklerini hâlâ engelliyor. Biyoloji korumaları ise Sonnet 5, Sonnet 5.5 ve Opus 5'e uygulananlarla aynı: araştırma sorularına izin verirken zarar verme olasılığı yüksek olduğu değerlendirilen istekleri kısıtlıyor.

Erişilebilirlik

Claude Haiku 5.5 şu anda Claude Platform'da claude-haiku-5-5 model tanımlayıcısıyla ve Amazon Web Services, Google Cloud ile Microsoft Azure üzerinden erişilebilir. Anthropic, geçiş yapan geliştiriciler için bir migration guide yayınladı.

Neden önemli

Küçük modeller, uygulamalı yapay zekânın ekonomisinin belirlendiği yer. Gerçek dünyadaki agent iş akışlarının çoğu token'larının büyük bölümünü rutin adımlara — yönlendirme, özetleme, bağlam sıkıştırma — harcıyor ve bu adımlardaki yaklaşık %75'lik fiyat indirimi, hangi otomatik sistemlerin finansal olarak uygulanabilir olduğunu değiştiriyor. Kademeli, prompt uzunluğuna dayalı fiyatlandırma da dikkat çekici: Hacmin gerçekte nerede olduğunu kabul ederek kısa istekleri uzunlardan çok daha düşük fiyata sunuyor. Rakip küçük modeller geliştirenler için Anthropic agresif bir referans noktası belirledi ve abone API kredileri müşterileri yalnızca uygulamalarını kullanmak yerine Claude platformu üzerine inşa etmeye yönlendiriyor.

  • #anthropic
  • #claude
  • #llm
  • #api-pricing
  • #ai-agents

İlgili yazılar