deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak dev.to (home feed)

Claude Fable 5 düşünmeyi her zaman açık tutuyor ve anahtarları beş kademeli bir efor kadranıyla değiştiriyor

Anthropic'in Claude Fable 5'i her istekte iç akıl yürütmeyi çalıştırıyor ve düşünme anahtarlarının yerine beş kademeli bir efor ayarı getiriyor; gecikme ve maliyet kontrolünü tek bir kadran'a taşıyor.

Claude Fable 5 düşünmeyi her zaman açık tutuyor ve anahtarları beş kademeli bir efor kadranıyla değiştiriyor

Anthropic'in Claude Fable 5'i, geliştiricilerin model akıl yürütmesini açıp kapatmak için kullandığı anahtarı kaldırıyor. dev.to'da yayınlanan bir öğreticiye göre yeni akıl yürütme motoru her istekte bir iç düşünme aşamasını aktif tutarken, derinlik low, medium, high, xhigh ve max olmak üzere beş düzey kabul eden tek bir efor ayarıyla ölçekleniyor.

Gönderi, bu değişikliği büyük dil modellerinin tarihsel davranışıyla karşılaştırarak çerçeveliyor: sabit hesaplama parametreleriyle, sıradan bir selamlama ile zorlu bir matematik kanıtı kabaca aynı işleme gücünü tüketiyordu. Fable 5'in hibrit yaklaşımı akıl yürütme geçişini her zaman döngüde tutuyor, ancak ne kadar satın alacağına çağırıcıyı karar veriyor; gecikme ve token harcamasını istek bazında yanıt kalitesiyle takas etmeyi sağlıyor.

Efor ayarı nasıl çalışıyor

Akıl yürütme derinliği, bir effort alanı içeren output_config bloğuyla ayarlanıyor. Düşük efor kısa düşünme ve sohbet trafiğine uygun hızlı yanıtlar üretiyor; yüksek ve max efor, modeli çok adımlı mantık, kod üretimi ve zor matematik için daha derin akıl yürütmeye itiyor. Öğreticiye göre bu tek değer, eski token bütçesi mekanizmasının yerini alıyor ve ayrı bir hızlı mod ya da etkinleştirme bayrağı yok. Basit durumda hiçbir thinking bloğu geçirilmiyor, çünkü uyarlanabilir düşünme her çağrıda otomatik olarak çalışıyor.

Mevcut entegrasyonlar için kırıcı değişiklikler

Geçiş yolu sessiz değil. Öğretici, thinking: {type: "enabled"}, thinking: {type: "disabled"} veya herhangi bir budget_tokens değeri geçirmenin artık Fable 5'te HTTP 400 hatası döndürdüğü uyarısında bulunuyor; çünkü bu parametreler kaldırılmış — reportedly bu modelde ve Opus 4.7 ile 4.8'de de öyle. budget_tokens'ı hâlâ seri hale getiren eski SDK sürümleri güncellenmiş şemaya karşı başarısız oluyor, dolayısıyla paketleri güncellemek bir ön koşul.

Bir de kapasite konusu var: daha yüksek efor düzeylerinde geliştiricilerin max_tokens içinde nihai yanıt için yeterli pay bırakması gerekiyor, çünkü düşünme çıktı bütçesinin bir kısmını tüketiyor.

Streaming davranışı

Gerçek zamanlı arayüzler için Fable 5, düşünme adımlarını ve nihai içeriği Server-Sent Events üzerinden iletiyor. Düşünme, delta.type "thinking_delta" olan content_block_delta olayları içindeki thinking content block'ları olarak geliyor, metin delta.thinking'den okunuyor; yanıtın kendisi ise her zamanki text_delta olaylarıyla geliyor.

Ham akıl yürütme zinciri hiçbir zaman açığa çıkmıyor. Varsayılan olarak display seçeneği "omitted"; bu, boş düşünme metni stream ediyor. thinking: {type: "adaptive", display: "summarized"} ile tercih etmek, katlanabilir bir UI paneline aktarılabilen ya da frontend tarafından atılabilen okunabilir bir özet döndürüyor.

Maliyet ve üretim konuları

Düşünme token'ları çıktı olarak faturalandırılıyor ve bu, yüksek hacimli API'lerin ekonomisini değiştiriyor: artık her istek en azından bir miktar akıl yürütme yükü taşıyor. Öğretici, aynı girdilerde akıl yürütme döngülerini yeniden çalıştırmamak için agresif prompt caching öneriyor; cache isabet oranlarını denetlemeyi ve tüketimin beklentileri aştığı yerleri tespit etmek için thinking-token kullanımını telemetri üzerinden izlemeyi öneriyor.

Gönderide önerilen iş akışı: önce SDK paketlerini güncelle, kullanım senaryosuna göre gecikme eşikleri tanımla — selamlamalar ve basit akışlar için düşük efor, kod ve matematik için high ya da max — ve düşünme adımlarının görüntülenmesi amaçlanmıyorsa frontend işleyicilerinde thinking_delta paketlerini filtrele.

Neden önemli

İkili bir anahtardan kademeli bir efor kadranına geçiş, ekiplerin LLM hesaplamasını bütçelemelerini yeniden çerçeveliyor. Bir isteğin hiç düşünmesi gerekip gerekmediğine karar vermek yerine, her isteğe ne kadar düşünmenin değdiğini kararlaştırıyorlar — ve düşünme devre dışı bırakılamadığı için hafif uç noktalar bile akıl yürütme maliyetini üstleniyor; bu da prompt caching ve efor yönlendirmesini sonradan akla gelen detaylar değil, birinci sınıf tasarım konuları haline getiriyor.

Bu aynı zamanda bir API yönüne işaret ediyor: budget_tokens Fable 5'ten ve öğreticiye göre Opus 4.7 ile 4.8'den kaldırıldığına göre, efor tabanlı kontrol Anthropic'in modelleri için ileriye dönük desen gibi görünüyor ve açık düşünme anahtarları üzerine kurulu pipeline'lar yeniden işlenmek zorunda kalacak. Bir uyarı: bu ayrıntılar Anthropic'in resmi dokümantasyonundan değil, dev.to'daki tek bir geliştirici öğreticisinden geliyor, dolayısıyla ekipler geçiş yapmadan önce ayrıntıları API referansına karşı doğrulamalı.

  • #anthropic
  • #claude
  • #llm
  • #reasoning
  • #api

İlgili yazılar