deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak dev.to (home feed)

Anthropic'ın Opus 5.5 rehberi: 'adım adım düşün' demeyi bırakın ve sessiz düşürmelere dikkat edin

Anthropic'ın Opus 5.5 prompting rehberine göre 'dikkatlice düşün' promptları artık yalnızca gecikme ekliyor, uzun çalışmalar için bitiş çizgisi tanımlamak gerekiyor ve işaretlenen mesajlar sessizce daha eski bir modele geri düşebiliyor.

Anthropic'ın Opus 5.5 rehberi: 'adım adım düşün' demeyi bırakın ve sessiz düşürmelere dikkat edin

Model artık kendi akıl yürütmesini yönetiyor

Anthropic'ın mühendislik blogunda yakın zamanda Addy Osmani tarafından yazılan, Claude ve Claude Code'da Opus 5.5'ten en iyi şekilde yararlanmayı anlatan bir rehber yayımlandı; rehberi özetleyen bir dev.to yazısı, metnin Hacker News ana sayfasına çıktığını belirtiyor. Merkezî argümanı, yıllarını prompt hileleri toplamakla geçiren herkesi rahatsız edecek cinsten: Opus 5.5 her yanıttan önce düşünüyor ve bir görevin ne kadar dikkati hak ettiğini kendisi karar veriyor; dolayısıyla onu akıl yürütmeye teşvik etmek gereksiz. dev.to'nun aktardığına göre Anthropic'ın kendi chat ürün testlerinde, "dikkatlice düşün" satırını kaldırmak yanıtların daha erken başlamasını sağladı ve kalitede belirgin bir düşüş yaşanmadı. Bu talimat artık yalnızca gecikme ekliyor ve kayıtlı talimatlarda bu gecikme gönderdiğiniz her mesaja ekleniyor.

Tek mesaj, bir bitiş çizgisi, bir durdurma koşulu

Osmani'nin önerdiği yapı, görevi baştan itibaren üç parça halinde teslim ediyor: görevin kendisi, örneğin payment endpoint'lerinin yeni bir client'a taşınması; tamamlanma tanımı, örneğin her endpoint'in taşınmış olması, eski client'ın silinmiş olması ve test paketinin geçiyor olması; ve çalışmayı kesmesi gereken tek koşul, örneğin bir testin modelin açıklayamadığı nedenlerle başarısız olması. Bunların dışındaki her şey bir durum notu olmalı, soru değil. dev.to'ya göre gerekçe, ilk test edenlerin Opus 5.5'i az gözetimle saatlerce büyük repository'lerde çalıştırması ve Opus 5'e göre en güçlü kazanımlarının tam da orada ortaya çıkması.

Tasarım işlerinde rehber, belirsiz pozitifler yerine somut negatifleri tercih ediyor. Modele genel bir görünümü kaçınmasını söylemek çoğunlukla genel bir sonucu bir başkasıyla takas ediyor; buna karşılık somut bir yasak listesi — kırık beyaz arka plan yok, italik vurgu kelimeleri yok, hap şeklinde butonlar yok — daha iyi sonuç veriyor; hoşunuza gitmeyen her şey listeye eklenip çalışma yeniden başlatılıyor.

CLAUDE.md çalışma kontrolüne dönüşüyor

Rehber, CLAUDE.md dosyasını stil referansı olmaktan çıkarıp agent oturumları için bir yönlendirme mekanizmasına dönüştürüyor. Önerilen kurallar, modele bir adım insan girdisi gerektirmiyorsa devam etmesini, durum notlarını bir sonraki eylemine katmasını; yalnızca gerçekten ilerleyemediğinde veya yıkıcı bir şeyden önce — veri silme, force-push veya repository dışındaki herhangi bir şeyi değiştirme — durmasını söylüyor. Yıkıcı kompaya dair ayrıcalık önemli: daha az duraklama, riskli işlemler için izin promptlarının açık tutulmasının güvenlik ağınız olarak kalması anlamına geliyor.

Rehberin altını çizdiği bir davranış da modelin görev ortasında durup rapor vermesi, bir sonraki adımı atmadan yalnızca adlandırması. Devam et kuralı bunun sistematik çözümü; tek seferlik durumlarda ise "devam et" diye yanıtlamak yeterli.

Bir codebase'e yayılan denetim ve göç işleri için Osmani, servis başına bir subagent öneriyor, ama bir farkla: model, her subagent'ın kanıtını kabul etmeden önce kendisi doğrulamalı ve çalışmayı servis, etkilenme durumu ve kanıt içeren tek bir tabloyla kapatmalı. Claude Code uzun çalışmalarda bağlam penceresi dolduğunda eski turları özetlediğinden, rehber ayrıca görev kontrol listesini TASKS.md gibi, bu özetlemeden etkilenmeyen bir dosyada tutmayı öneriyor.

Çıktıyı bilinçli olarak inceleyin

Bir çalışma bittiğinde önce sizin engellediğinizi okuyun — açık bir karar veya onay bekleyen bir değişiklik — sonra özetin geri kalanını; ve bitişi standartlaştırın: üç kapanış başlığı isteyin: beni engelliyor, değiştirdi, buldu. Diğer alışkanlıklar arasında, insan incelemesinden önce bir model incelemesi çalıştırmak var — ilk test edicilerden biri, Opus 5.5'in en düşük efor ayarının Opus 5'in yüksek eforundan daha fazla bug yakaladığını, daha az yanlış alarmla bildiriyor; araştırma görevlerinden doğrulanmamış iddiaları işaretlemesini ve nereye baktığını belirtmesini istemek; ve sayıları yeniden yazmak yerine grafik ve ekran görüntüleri eklemek — çünkü Opus 5.5'in bildirildiğine göre görselleri, bir okun hangi kutuları bağladığı gibi uzamsal ilişkiler dahil, öncülünden daha doğru okuyor.

Sessiz düşürmeler gözden kaçan risk

dev.to'nun yeterince tartışılmadığını söylediği bölüm model routing ile ilgili. Opus 5.5, Fable düzeyinde bio ve cyber korumalarıyla birlikte piyasaya çıkan ilk Opus modeli ve Claude uygulamaları ile Claude Code'da işaretlenen mesajların çoğu reddedilmiyor — oturum devam ederken sessizce daha eski bir modele yönlendiriliyor. Denetim tüm konuşmayı, dosyalar ve arama sonuçları dahil, kapsıyor; dolayısıyla önceki içerik de bunu tetikleyebilir. Claude Code'da /model komutu geri geçiş yapıyor veya Escape'e iki kez basmak mesajı düzenleyip yeniden denemenizi sağlıyor; bir /config ayarı modelin geçiş yapmadan önce sormaya zorluyor; uygulamalarda modeli yeniden seçin veya yeni bir sohbet başlatın, aynı anahtar Ayarlar altında. Özellikle, modelden kendi iç akıl yürütmesini yeniden üretmesini istemek başlı başına bir işaret kategorisi ve doğrudan reddedilebiliyor; bunun yerine kısa bir gerekçe isteyin.

Fast mode

Etkileşimli ileri geri görüşmeler için Claude Code /fast sunuyor: aynı model, metin daha erken geliyor. Rehbere göre bu bir araştırma önizlemesi, etkinleştirilmesi ek kullanım gerektiriyor ve token başına daha pahalı; bu da kimsenin her yanıtı okumadığı uzun otonom çalışmalar için uygun olmadığı anlamına geliyor.

Neden önemli

Sağlayıcıların prompting rehberleri, binlerce geliştiricinin system prompt ve kayıtlı talimatları nasıl yazdığını doğrudan şekillendiriyor. Anthropic'ın testleri tutuyorsa, eski tarz akıl yürütme promptları artık yalnızca gecikme satın alıyor ve zanaat, düşünce ortaya çıkarmaktan tamamlanma ölçütleri, durdurma koşulları ve koruma bariyerleri tanımlamaya kayıyor. Sessiz düşürme mekanizması da aynı dikkati hak ediyor: güvenlik incelemesi veya buna yakın iş yapan biri, fark etmeden saatlerce eski model çıktısı alıyor olabilir ve önce-sor anahtarı tam bu başarısızlığa karşı ucuz bir sigorta.

  • #anthropic
  • #claude
  • #prompting
  • #ai-agents
  • #llm

İlgili yazılar