deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak dev.to (home feed)

Claude Fable 5.1 tool çağrılarını, thinking bloklarını ve caching'i değiştiriyor — kod değişikliği gerekmeden

Anthropic'un Claude Fable 5.1 modeli, hiçbir kod değişikliği olmadan tool çağrısı, thinking bloğu ve ilerleme güncellemesi davranışlarını değiştiriyor; bir dev.to yazısı neyin devredileceğini, neyin elde tutulacağını haritalıyor.

Claude Fable 5.1 tool çağrılarını, thinking bloklarını ve caching'i değiştiriyor — kod değişikliği gerekmeden

Kod değişikliği gerektirmeyen davranış değişiklikleri

Anthropic, Claude Fable 5.1'i 1 Eylül'de yayınladı ve SharpHaw tarafından yazılan bir dev.to yazısı, sürümün en faydalı kısmının benchmark tablolarının altında olduğunu savunuyor: geliştiriciler kodlarına dokunmadığı halde değişen davranışların bir listesi.

O yazıya göre Fable 5'ten belgelenen farklar arasında daha değişken paralel tool çağrıları var. Kodlama ve bilgisayar kullanım döngülerinde model, birkaç okuma ima edilse bile tur başına tek bir tool çağrısı yapabiliyor; bu, yanıt kalitesini koruyor ama tur sayısını artırıyor. Daha yüksek efordaki uzun tool çalışmaları daha az ilerleme güncellemesi gönderiyor, yani bir arayüz dakikalarca sessiz kalabiliyor. Düşük eforda model daha sık hafızasından yanıt veriyor ve arama ile erişim tool'larını daha az çağırıyor. Daha az sohbet formatlamasıyla daha yoğun düzyazı üretiliyor, belge özetleri pasajları alıntı olarak işaretlemeden yeniden üretmeye daha yatkın ve küçük düzenlemeler tüm dosyayı yeniden yazma olarak gelmeye daha yatkın.

Fable 5 çağıranlar için kırıcı değişiklikler

Yazıya göre iki değişiklik mevcut entegrasyonları doğrudan kırıyor. Zorunlu tool kullanımı kaldırıldı: tool_choice değerinin "any" veya belirli bir tool olarak ayarlanması artık 400 hatası döndürüyor. Thinking blokları ayrıca onları üreten sohbete bağlı hale geldi. 31 Ağustos 2026 veya sonrasında oluşturulan hesaplar için, isteğin önceki herhangi bir kısmı düzenlendikten sonra (system prompt, tool listesi veya önceki bir mesaj gibi) bir thinking bloğunu yeniden oynatmak, çağıran bloğu düşürmeyi seçmediği sürece 400 hatasıyla başarısız oluyor. Yazıda aktarıldığı üzere notlar, gelecekteki modellerin bunu herkese uygulaymasını bekliyor; bu da sadece-eklemeli sohbet geçmişini güvenli varsayılan yapıyor.

Cache okumaları çok daha ucuzladı

Girdi ve çıktı fiyatlandırması değişmedi ama cache okumaları önceki oranın çeyreğine düştü. Anthropic bunu tipik işlerde kabaca %25, aynı bağlamı tekrar tekrar okuyan agentic döngülerde %45'e varan oranda ucuzlama olarak çerçeveliyor.

Bir triyaj listesi: neyi devretmek, neyi geri tutmak

Yazar işleri tek bir soruya göre sıralıyor: yanlış bir yanıt neye mal olur ve bunu ilk kim yakalar. Devredilecek tarafta: yıllardır süren hata (yayın materyalleri, Millennium adlı bir müşterinin milyonda bir görülen bir çöküşü bir tedarikçi kütüphanesine kadar izlemesini alıntılıyor ve notlar, modelin artık kök nedenleri düzelttiğini iddia ediyor — önce başarısız bir testle doğrulanıyor, sonra bir insan diff'i okuyor); saatlerce tek kullanımlık bir dalda çalışan çok dosyalı refactor'lar; yüksek eforla çalışan, arama açık, her iddianın yanında atıf ve üç rastgele nokta kontrolü içeren kaynaklı araştırma notları; bağlayıcı maddelere ve sahipliğe karar vermeye odaklı belge okumaları; ve tek kullanıcılı iç tool'lar.

Geri tutulanlar: kendi başına bir şey gönderen, paylaşan veya ödeme yapan her şey. Yazı, Anthropic'un küçük işletme paketleme sloganını — "herhangi bir şey gönderilmeden, paylaşlmadan veya ödemeden önce siz onaylarsınız" — alıntılıyor ve model akıllandı diye bu çizginin kaymayacağını savunuyor. Ayrıca geri tutulan: düşük eforla dönmüş ve üzerine hareket edilecek gerçekler; çünkü toplantılar arasındaki hızlı bir yanıt, kendinden emin bir şekilde güncelliğini yitirmiş olabilir (varsayılan efor Claude Code'da yüksek, Cowork ve claude.ai'de ise orta). Ve müşteri verileri, saklama koşulları yazıya dökülmeden dışarıda kalıyor; çünkü zero-retention Enterprise Frontier Safeguards düzeni, kurumsal müşteriler için ancak bu sonbahardan itibaren aşamalı olarak geliyor ve safeguard sınıflandırıcıları, modelin okuduğu her şeyi — dosyalar ve bağlı tool'lar dahil — okuyor.

Şimdi yapılacak iki harness düzeltmesi

Birincisi, mesaj dizisini sadece-eklemeli tutun ve metin ekleyip silmek yerine, mid-conversation-system-clear-at-2026-08-21 beta'sı altında clear_at değerini next_user_message olarak ayarlayarak tur kapsamlı sistem mesajları kullanın. Anthropic bu yönlendirmeyi, tur başına tek çağrı davranışına bir hafifletme olarak konumlandırıyor; temizlenmiş kopyalar girdi token'ı maliyeti getirmiyor ve cache'i geçersiz kılmıyor.

İkincisi, görünür ilerlemeye opt-in olun. Varsayılan thinking.display değeri "omitted" iken ilerleme blokları boş dönüyor; thinking-display-updates-2026-08-18 beta'sı üzerinden "updates" istemek, boş olmayan her thinking bloğunu kullanıcıya gösterebileceğiniz bir durum satırına dönüştürüyor.

Yazı plan mekanikleriyle kapanıyor: Max ve premium Team koltuklarında Fable modelleri haftalık kullanım limitinin yarısına kadar çekiyor ve onu daha hızlı tüketiyor; Pro ve standart koltuklar ise ilk mesajdan itibaren kredi ile çalışıyor. Anthropic, 5.1'de orta eforun kabaca tam efordaki Fable 5'e denk olduğunu söylüyor; yani efor kadranı, model seçiciden daha önemli.

Yerinde bir biçimde, yazı kendisinin de yazarın yayınlama hattındaki Fable 5.1 tarafından taslaklandığını açıklıyor: inceleme turu, modelin "dört ila beş yıl" ifadesini "dört yıl"a sıkıştırmasını ve kendi stil rehberinin yasakladığı bir cümle yazmasını yakaladı — ikisi de dikkat listesindeki davranışlar, tam da o liste hakkında yazılan bir yazının içinde ortaya çıkıyor.

Neden önemli

Model yükseltmeleri artık sistemleri kod seviyesinde değil, prompt ve sohbet seviyesinde kıran davranışsal kaymayla geliyor. Prompt'ları ve mesaj geçmişini kararlı sözleşmeler olarak gören ekipler, inceleyecek bir kod diff'i olmadan sert 400 hataları veya sessiz gerilemeler alıyor. dev.to yazısındaki triyaj kalıbı — görevleri etki yarıçapına göre sıralamak ve yetenekten bağımsız olarak otonom eylemleri insan onayının arkasında tutmak — sürümler harness yeniden yazımlarını geçtikçe uygulanabilir bir yönetişim şablonu. Ve cache okumaları eski fiyatın çeyreğine indiği için, uzun agentic döngüler maddi ölçüde ucuzladı; bu da tam da dikkat listesinin bahsettiği gözetimsiz iş yüklerini teşvik edecek.

  • #anthropic
  • #claude
  • #llm
  • #ai-agents
  • #api

İlgili yazılar