· kaynak Hacker News – Front Page (native)
Güvenilir uzun süreli Claude Code agent'ları için bir Chief of Staff orkestrasyon deseni
asyncdot.com'da yayınlanan bir yazı, Claude Code için bir orkestratör-işçi desenini ele alıyor: doğrulayan tek bir koordinatör, tek kullanımlık işçi oturumları ve saatlerce süren kodlama işleri için dayanıklı bir MCP görev panosu.

Üretim sorunu değil, koordinasyon sorunu
Hacker News ana sayfasında öne çıkan, asyncdot.com'daki bir yazıya göre uzun özerk kodlama oturumları nadiren model kod yazamadığı için başarısız oluyor. Başarısız olmalarının nedeni context'in sınırlı olması: uzun oturumlar sıkıştırılıyor ve saatler önce önemli olan ayrıntılar kayıplı özetlere dönüşüyor. Kendi raporları da sapma gösterdiği için başarısız oluyorlar; testlerinin geçtiğini söyleyen bir agent, güncel bir gözlem yapmaktan ziyade niyetini hatırlıyor. Ve hiçbir şey birikmediği için başarısız oluyorlar: ikinci saatte öğrenilen bir ders, bir sonraki oturumun okuyacağı bir yere yazılmadıysa yok oluyor. Daha fazla agent eklemek sorunu katlıyor, çünkü o zaman birkaç güvenilmez anlatıcınız oluyor ve onları uzlaştıran kimse kalmıyor.
Yazarın önerdiği çözüm örgütsel. Uzun ömürlü tek bir oturum koordinasyonu sağlıyor: dayanıklı bir kuyruktan iş çekiyor, daha zayıf bir modelin bile takip edebileceği kadar net brief'ler yazıyor, işçilerin çalıştırdıklarını söyledikleri komutları yeniden çalıştırarak iddiaları doğruluyor, transcript yerine diff okuyor, oturum bitmeden dersleri kaydediyor ve sürüklenen oturumları işi ele almadan yönlendiriyor. Asla yapmadığı şey ise implementation. Koordinatör kod yazmaya başladığı an doğrulamayı bırakıyor ve kurulum, aşırı yüklenmiş tek bir oturuma çöküyor.
Yeni bir etiketli eski bir yapı
Yazı, "Chief of Staff"ın yerleşik bir terim değil kişisel bir metafor olduğunu açıkça belirtiyor. Altta yatan yapı birçok gerçek isme sahip: orchestrator-worker (supervisor olarak da bilinir), coordinator-implementor-verifier, finans ve operasyondan maker-checker ve Git'in integration-manager iş akışı; burada tek bir maintainer ayrı katkıcıların değişikliklerini pull eder, test eder ve birleştirir. Claude Code'un kendi subagent dokümantasyonu bunu, takım arkadaşları olan bir takım lideri olarak tanımlıyor. Yazarın yaptığı bir ayrım: Anthropic'in cookbook'unda farklı türde bir "chief of staff agent" var; bir startup CEO'sunun takvimini, gelen kutusunu ve önceliklerini yöneten bir asistan. Aynı metafor, farklı problem.
Üç bileşen, sabit roller
Araçlar değiştirilebilir, roller değil.
Claude Code, her oturumun kendi context penceresini tuttuğu tool kullanımı, dosya düzenleme, shell erişimi ve oturumlar arası mesajlaşma sunan agent runtime'ı. İzolasyon bilinçli: bir oturumun kafa karışıklığı diğerininkini bulaştırmıyor.
Komut satırından sürülebilen bir terminal workspace yöneticisi olan cmux, koordinatörün işçi başlatmak için kullandığı temel katman. Yazı burada zor yoldan öğrenilmiş iki dersi vurguluyor. Launch komutu, bir agent başlatmak yerine workspace'in shell'ine metin gönderiyor; dolayısıyla agent açıkça çağrılmalı, aksi halde talimat onun üzerinde işlem yapamayacak bir shell'e düşüyor ve launch eden taraf yine de başarı bildiriyor. Ayrıca uzun komut dizileri güvenilmez şekilde çalışıyor; bu yüzden commit edilmiş bir brief dosyasına işaret eden kısa bir prompt hem daha sağlam hem de brief'i gözden geçirilebilir ve yeniden çalıştırılabilir kılıyor.
Plan Desk dayanıklı durum deposu: MCP üzerinden sunulan, her oturum tarafından okunan ve yazılan projeler, hedefler, bağımlılıklarla bağlı görevler, tasarım dokümanları ve yorumlar içeren bir planlama panosu. Yazarın deyimiyle insanların atladığı bileşen bu ve çok agent'lı kurulumların geceyi atlatabilmemesinin nedeni de bu atlayış. Oturumlar tek kullanımlık; kalıcı olan panonun kendisi. Görevler, yazının "build contract" diye adlandırdığı biçimde yazılıyor: problem tanımı, aksiyon maddeleri, arayüzler, bir doğrulama sözleşmesi ve non-goal'lar dahil; bir işçinin hiçbir zaman bir üst dokümana başvurması gerekmeyecek kadar ayrıntılı. Durum, iş başladığı ve doğrulandığı an değiştiriliyor, asla oturum sonunda toplu halde değil; çünkü yalnızca mesai bitiminde gerçekliği yansıtan bir pano görevini yapmıyor.
İşletim döngüsü
Bir seferde tek bir iş maddesi, tek bir dispatch, tek bir commit. Döngü şöyle işliyor: panodan bir sonraki engelsiz görevi çek; herhangi bir şeye dokunmadan önce bağlı tasarım dokümanını oku; kırmızı bir kapı olarak önce verifier'ı çalıştır ve başarısız olmasını iste; işi uygulayan bir oturuma devret ya da kendin yap; iddia edilen her komutu yeniden çalıştır ve kararı exit code'lara bırak; diff'i parça parça oku; akıl yürütmeyi paylaşarak onay kapısını çöz; sonra ship'le. Kaynak metin son adım sırasında kesiliyor, ancak döngünün tek commit kuralıyla tutarlı biçimde görevin durumunu değiştirmekle başlıyor.
Bunu ayakta tutan alışkanlıklar
Yazının genel kuralları bu belirli araçların ötesinde geçerli. Her agent raporunu talimat değil kanıt olarak ele alın: bir özet bir agent'ın neyi amaçladığını söyler, bir exit code ne olduğunu söylemiş olur. Dayanıklı kanalları tercih edin; çünkü oturumlar arası mesajlar gecikebilir, tutulabilir veya süresi dolabilir, oysa commit edilmiş bir dosya ya da pano kartı her zaman ulaşır. İlerlemenin ne sıklıkla yüzeye çıkacağına sabit zaman aralıklarıyla karar verin, işin nerede duracağına asla. Ve kendi ölçüm araçlarınıza güvenmeyin; çünkü agent'lı işlerdeki en pahalı hatalar, yapmadıkları iş için başarı bildiren kontrol mekanizmalarından gelir.
Neden önemli
Kodlama agent'ları saatler süren, gözetimsiz işler üstlendikçe darboğaz kod üretmekten kodu kontrol etmeye kaydı. Desen araçtan bağımsız — cmux ve Plan Desk'in eşdeğerleri var ve önceki örnekler yapay zekadan çok daha eski — ama disiplin aktarılabilir: planlamayı yapmaktan ayırın, paylaşılan durumu tek bir context penceresinin dışında tutun ve inanmadan önce her iddiayı yeniden çalıştırın. Agent'ları bir saat sınırının ötesine taşıyan ekipler için bu yazı, yeni bir mimariden çok, sizi yakalamadan önce yakalanmaya değer hata türlerinin bir kontrol listesi gibi okunuyor.
- #ai-agents
- #claude
- #orchestration
- #developer-tools
- #llm