deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak Hacker News – Front Page (native)

Anthropic'ın Opus 5.5 rehberi: daha uzun özerk çalışmlar yeni prompt alışkanlıkları gerektiriyor

Anthropic'ın Opus 5.5 rehberi, modelin her yanıttan önce düşündüğünü ve uzun kodlama çalışmalarını sürdürebildiğini söylüyor; bu yüzden 'dikkatlice düşün' prompt'ları terk edilmeli, yerini CLAUDE.md durdurma kuralları almalı.

Anthropic'ın Opus 5.5 rehberi: daha uzun özerk çalışmlar yeni prompt alışkanlıkları gerektiriyor

Değişen bir model için Anthropic'ın rehberi

Anthropic, en yeni Opus modeli Opus 5.5 için hem Claude sohbet uygulamalarını hem de Claude Code terminal ajanını kapsayan bir kullanım rehberi yayımladı; gönderi 22 Eylül'de yayına girdi ve Hacker News'in ana sayfasına ulaştı. Kısa versiyon: model, önceki Opus sürümlerine göre alışılmadık ölçüde farklı davranıyor; bu yüzden küçük görevler, 'adım adım düşün' yönlendirmeleri ve sürekli kontrol etme gibi eski alışkanlıklar emekliye ayrılmalı.

Opus 5.5'te ne değişti

Rehbere göre üç değişim bu sürümü tanımlıyor. Model, çok parçalı işleri kendi başına çok daha uzun süre sürdürüyor; en büyük kazanımları, bir değişikliği testler geçene kadar büyük bir depo boyunca taşımak gibi çok adımlı görevlerde önceki Opus modellerine göre ortaya çıkıyor. İlk testçilerin modeli saatlerce az gözetimle kodlama işlerinde çalıştırdıkları bildiriliyor. Model, Opus 5'ten daha düz bir anlatımla işini raporluyor; ne yaptığını, ne bulduğunu ve kullanıcıdan hâlâ neye ihtiyacı olduğunu söylüyor. Ve artık her yanıttan önce akıl yürütüyor, derinliği kendisi ayarlıyor — bu da insanların onu nasıl prompt'layacağını değiştiriyor.

Prompt'lama: hedefi söyle, düşünme yönlendirmelerini bırak

Önerilen kalıp, tüm görevi tek bir mesajla devretmek, tamamlanmayı kesin biçimde tanımlamak — taşınan her endpoint, silinen eski istemci, yeşil test paketi — ve yalnızca hangi durumlarda durup sorması gerektiğini belirtmek. Kullanıcılar çalışma ortasında bir şey hatırlarsa, Claude çalışırken bir takip mesajı yazıp Enter'a basabilir; çünkü uzun bir çalışmayı yeniden başlatmak artık daha maliyetli.

Anthropic ayrıca prompt'lardan ve kayıtlı talimatlardan 'dikkatlice düşün' gibi satırları silmeyi öneriyor; çünkü model zaten varsayılan olarak akıl yürütüyor. Şirketin bir sohbet ürünündeki kendi testlerinde, böyle bir satırı kaldırmak yanıtların daha erken başlamasını sağlamış, kalitede belirgin bir düşüş olmamış. Claude Code'da akıl yürütme derinliği bunun yerine effort ayarıyla ayarlanmalı; basit sorular doğrudan yanıt için işaretlenebilir.

Tasarım işleri için rehber, modelin birkaç varsayılan stile geri düştüğü uyarısında bulunuyor; 'genel bir görünümü kaçın' gibi belirsiz bir talimat çoğunlukla bir varsayılanı bir başkasıyla değiştiriyor. Daha iyisi, hariç tutulacak belirli örüntüleri listelemek — rehberin örneği krem veya kırık beyaz arka planları, italik vurgu kelimeleri, numaralı bölüm etiketleri, monospace etiketler ve hap şeklinde düğmeleri yasaklıyor — ve modelin yine de seçtiği her neyse bunu bir sonraki denemede eklemek.

Claude Code'da uzun çalışmaları yönlendirme

Opus 5.5 çalışırken durum güncellemeleri paylaşıyor, ama bazense devam etmek yerine durup rapor veriyor: bir sonraki adımını atmadan onu adlandıran bir özet ya da devam etme teklifi. Anthropic'ın çaresi, bir adım insan girdisi gerektirmiyorsa devam etmesi, durum notlarını bir sonraki eylemine katması ve yalnızca gerçekten tıkandığında ya da yıkıcı bir şeyden önce — veri silme, force-push veya depo dışındaki herhangi bir şeyi değiştirme — durması gerektiğini söyleyen kısa bir CLAUDE.md kuralı. Rehber, daha az duraklamanın kullanıcıların kendi koruma bariyerlerini koruması gerektiği konusunda uyarıyor; yıkıcı komutlar için izin prompt'ları dahil. Ve eş programcıların bu kuralı tersine çevirip en başta tek satırlık bir plan, sonda ise bir özet isteyebileceğini not ediyor; model talimatın her ikisine de uyuyor.

Büyük bir kod tabanına yayılan denetimler ve göçler için rehber, modelden işi paralel subagent'lara dağıtmasını, her birinin kanıtını kabul etmeden önce doğrulamasını ve sonunda tek bir sonuç tablosuyla bitirmesini istemeyi öneriyor. Uzun çalışmalar context penceresini doldurduğu ve Claude Code daha eski turları özetlediği için, görev kontrol listesini bu sıkıştırmadan kurtulan bir dosyada tutmayı ve maddeler kapandıkça güncellemeyi de tavsiye ediyor.

Sonucu kontrol etme

Uzun bir çalışma bittiğinde rehber, özetin geri kalanından önce modelin neyi beklediğini okumayı — açık kararları, onay bekleyen değişiklikleri — ve varsayılan biçim uymuyorsa özetin şeklini CLAUDE.md üzerinden düzeltmeyi söylüyor. Anthropic'ın aktardığı ilk testçilerden biri, Opus 5.5'in en düşük effort ayarında Opus 5'in yüksek effort'undan daha fazla hatayı, daha az yanlış alarmla yakaladığını ve sade dildeki açıklamalarının pull request tanımlarını incelemeyi kolaylaştırdığını söylüyor. Araştırma görevleri için, modelden doğrulayamadığı her şeyi işaretlemesini ve nereye baktığını söylemesini istemek, okumaya değen uyarıları ortaya çıkarıyor. Sohbet uygulamalarında Anthropic, model seçiciyi kontrol etmeyi ve içeriklerini yeniden yazmak yerine grafik, diyagram ve ekran görüntülerini eklemeyi tavsiye ediyor; çünkü Opus 5.5, selefinden daha doğru şekilde görselleri okuyor ve bir okunun hangi kutuları bağladığı gibi uzamsal ilişkileri ele alıyor.

Neden önemli

Rehber, bir benchmark duyurusundan çok insanın döngüdeki nerede oturduğunun değiştiğine dair bir kılavuz gibi okunuyor. Bir model saatlerce çalışıp kendiliğinden akıl yürüttüğünde, kaldıraç mesaj başına prompt mühendisliğinden görev çerçeveleme, açık durdurma koşulları ve doğrulama alışkanlıklarına — dosya tabanlı kontrol listeleri, diff incelemesi ve subagent kanıt kontrollerine — kayıyor. Opus 5.5'i Opus 5 gibi ele alan ekipler onu aşırı prompt'layacak, yanlış şeyleri denetleyecek veya uzun çalışmaların izini kaybedecek; rehber esasen bu üçünden kaçınmanın bir kontrol listesi.

  • #anthropic
  • #claude-code
  • #llm
  • #prompting
  • #developer-tools

İlgili yazılar