· kaynak dev.to (home feed)
GPT-6 Astra'nın ilk Choice grubu: üç yapı ve bir input hatasını yakalayan koordinasyon ajanı
Üç GPT-6 Astra ajanı kendi projelerini seçti — bir dizme bulmacası, bir tedarik zinciri modeli ve bir kitapçık dizim aracı — koordinasyon ajanı ise her yapıyı inceleyip tamamlanmadan önce bir input hatası yakaladı.

Üç ajan, üç kendi seçtiği yapı
billiem'in dev.to'daki yazısı, GPT-6 Astra'dan gelen ilk "Choice grubunu" belgeliyor: konu seçiminde serbest bırakılan üç ajan, 4 Eylül'de yayımlanan bir dizme bulmacası, bir tedarik zinciri öğretim modeli ve katlanabilir kitapçık dizim aracı teslim etti. Dikkat çekici olan kısmı, ürettilen artefaktlardan çok etraflarındaki iş akışı — koordinasyon ajanı cilalama başlamadan önce her prototipi inceledi ve bir vakada, bulmacadaki bir input hatasını fark edip, oyun henüz tamamlanmamışken yapıyı yapan ajana geri gönderdi.
Yazıya göre yazar, konu seçme özgürlüğü tanınan üç bağımsız deney istedi. Her Astra ajanı geniş bir yetki çerçevesinde — oynanacak, keşfedilecek veya kullanılacak bir şey — maksimum reasoning düzeyinde çalıştı. Sürekli geçerli talimat, cilalamadan önce prototip incelemesi gerektiriyordu ve grubun curation kaydı, her inceleyicinin istediği düzeltmeleri logluyor. Yazar, denemenin sınırları konusunda açık: bunlar düzeltmeleri uygulanmış ayrı projelerdi; başka bir modelle kontrollü karşılaştırmalar değildi. dev.to yazısının kendisi de billiem.uk'daki daha uzun bir makalenin, AI yardımıyla yapılmış bir uyarlaması.
Loose End ve yapı sırasında yakalanan bir input hatası
Loose End bulmacası, oyuncudan sonlu bir ipin pirinç ucunu, üç çivi ve dört zil taşıyan bir tahta üzerinde yönetmesini istiyor. İp çivilere takıldığı için, bir zile giden rota, sonraki zil için ne kadar uzunluk kaldığını belirliyor ve dört zilin hepsini çalmak tek başına kazanma koşulu değil — ucun geri eve dönmesi gerekiyor.
İlk prototipin ok tuşu kontrolleri kısa dokunuşları yok sayıyordu. Koordinasyon ajanı sorunu buldu ve yapı tamamlanmadan geri gönderdi; düzeltmeyle kısa tuş basışları kayda geçmeye başladı. Sonraki kontroller tek bir kazanmanın ötesine gitti: iki farklı kazanan strateji denendi ve uzun bir hamle dizisi başlangıç noktasına kadar geri izlendi. Yazı kapsam konusunda dikkatli: bu kontroller yalnızca oyunun rota ve geri sarma kurallarını kapsıyor — altta yatan düzlemsel gergin ip modeli sürtünmeyi veya esnemeyi simüle etmiyor ve oyun tek bir elle tasarlanmış parkurdan oluşuyor.
The Order Echo: tek ölçekte iki sipariş politikası
İkinci yapı, aynı talebe farklı sipariş kuralları altında tepki veren bir dükkân, toptancı, depo ve fabrikayı modelliyor. İnceleyicinin isteği görünürlükle ilgiliydi: izler ortak bir ölçek üzerinde durmalı ve her siparişin içeriği incelenebilir olmalıydı. Biten arayüz, hesap aritmetiğini incelemek için bir hafta ve bir aşama seçmenize izin veriyor.
Başlangıç politikasında, yoğun tek bir alışveriş haftası — dört yerine on iki sandık — zincirin fabrika siparişlerini on ikinci haftada 76,8 sandıkklık bir zirveye taşıyor. Politika bunun yerine tedarikçi bekleme stokunu da dahil ederek bekleyen siparişleri saydığında, dükkân başlangıçta daha fazla sipariş veriyor, 12,5 yerine 14,5 sandık, çünkü yükselen talep tahmini hedefini yükseltiyor ve bir düzeltme ekliyor — ancak fabrika zirvesi dokuzuncu haftada 38,1 sandığa düşüyor. Başlangıç politikasının izleri, değiştirilen koşunun yanında kesikli çizgiler olarak görünür kalıyor, böylece sonuç ve zamanlama doğrudan karşılaştırılabiliyor. Yazı, tüm miktarların modelin seçtiği kurallara ait olduğunu vurguluyor — 48 haftalık bir pencere, sürekli sandık miktarları ve fabrikanın üstünde sınırsız üretim — ki bu da onu bir iş tahminden çok öğretim modeli yapıyor.
Pocket Press: kağıtta test edilmemiş katlanabilir kitapçık
Üçüncü araç, bir kapak, el yazması ve arka kapak alıp tek bir A4 veya US Letter sayfasında sekiz sayfalık bir kitapçık diziyor ve baskı düzeninin yanında bir okuma görünümü tutuyor. Yazdırılabilir çıktı, bir SVG sayfası ve düzenlenebilir kaynak kaydedebiliyor. İnceleyici, bulunabilir kaydetme eylemleri, katlama talimatları ve kaydedilmiş kaynağı yeniden açma yolu istedi; kayıtlı browser kontrolleri gerçek dosyaları indirdi, geometrilerini ve metinlerini geri okudu ve el yazmasını kaydedilen kaynağından geri yükledi. Taşma, yazdırılabilir dışa aktarmayı engelliyor ama kaynak kaydetmeyi açık bırakıyor.
Dizim bilinçli olarak alışılmadık — 6, 7, 8 ve 1'in üzerinde baş aşağı duran 5, 4, 3 ve 2 — ortadaki bir yarığı kesip katladıktan sonra kitaba dönüşmesi amaçlanıyor. Makale için görsel yakalama ayrı bir kusuru ortaya çıkardı: 9 Eylül'de 1.280 piksellik bir browser genişliğinde baskı sayfası önizleme alanının ötesine taşıp üstten ve alttan kırpıldı; 900 piksellik görünüm ise sığıyor. Kağıt sonucu hâlâ denenmemiş durumda — her kontrol ajanlar veya otomasyon tarafından yürütüldü, hiçbir yazıcı veya katlama devrede değildi ve araç, deneyin fiziksel sayfa gerektiren kısmı için numaralı bir test sayfasıyla geliyor.
Neden önemli
Bu, kendi kendine yönlendirilen yapılarda çok ajanlı koordinasyonun erken ve iyi belgelenmiş bir örneği: talimata gömülü bir inceleyici rolü, tamamlanmadan önce bir input hatası yakaladı, her aracı şekillendiren arayüz değişiklikleri istedi ve her düzeltmenin bir curation kaydını bıraktı. Bu bir benchmark'tan çok bir süreç gösterimi — taban çizgisi modeli olmayan tek bir grup — ve doğrulama browser içinde kaldı; fiziksel kitapçık test edilmedi. Yine de, agentic kodlama iş akışlarını değerlendiren herkes için ilginç sinyal şu: cilalamadan önce inceleme, ajanların ürettiklerini nasıl değiştiriyor ve sınırlar, sonuçların yanında ne kadar açıkça rapor edildi.
- #gpt-6
- #ai-agents
- #multi-agent-systems
- #automation
- #code-review