deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak dev.to (home feed)

GitHub sayımında, kendini çok ajanlı olarak tanımlayan depoların %68'inin tek bir ajan çalıştırdığı ortaya çıktı

Kendini 'çok ajanlı' (multi-agent) olarak tanımlayan 86 GitHub deposunun elle yapılan sayımında, bunların %68'inin tek modelli veya ajan dışı sistemler olduğu, gerçek olanlar arasında ise en yaygın topolojinin orkestratör-işçi yapısı olduğu bulundu.

GitHub sayımında, kendini çok ajanlı olarak tanımlayan depoların %68'inin tek bir ajan çalıştırdığı ortaya çıktı

"Çok ajanlı" depoların çoğu tek bir ajan çalıştırıyor

Kendini çok ajanlı (multi-agent) olarak tanımlayan ve her biri en az 1.000 yıldıza sahip 86 GitHub deposunun sayımı, bunların %68,2'sinin tek modelli veya ajan dışı sistemler olduğunu ortaya koyuyor. Çalışmayı anlatan dev.to gönderisine göre bu, 85 depodan 58'i anlamına geliyor (Wilson %95 güven aralığı %57,7–%77,2); gönderi bir deponun neden paydaya dahil edilmediğini açıklamıyor. Temel bulgu şu: Bir proje, açıklamasında çok ajanlı etiketini taşıyabilir ama tek bir döngüde tek bir model örneği çalıştırıyor olabilir.

Yazarın belirttiği motive şudur: Her büyük ajan framework'ü çok ajanlı desteği pazarlıyor — AutoGen, CrewAI, LangGraph ve MetaGPT'nin her biri GitHub'da 20.000'den fazla yıldıza sahip — ve binlerce depo açıklaması bu terimi kullanıyor, ama kimse bu projelerin gerçekte ne teslim ettiğini ölçmemişti. Önceki tartışmalar, bu tür framework'lerin nasıl inşa edileceğine ya da çok ajanlı davranışın prompt mühendisliğine indirgenip indirgenemeyeceğine odaklanıyordu.\n Çalışma bu nedenle sıkıca filtrelenmiş, belirli bir anlık görüntüye sabitlenmiş 86 kendini çok ajanlı tanımlayan depoyu ve 18 tohum framework'ü üç eksen boyunca etiketledi: model örneği yapısı, iletişim topolojisi ve bir jüri ya da eleştirmen ajanın varlığı.

Gerçek çok ajanlı sistemler ne uyguluyor

Birden fazla ajan örnekleyen 27 depo arasında orkestratör-işçi yapısı en yaygın topolojiydi: %48,1 (27'nin 13'ü, güven aralığı %30,7–%66,0). Gerçek dağıtımlarda ağırlığı, eşit ajanlardan oluşan akran ekipleri yerine, işi işçilere dağıtan bir koordinatör oluşturuyor.

Tasarım tartışmalarındaki öne çıkmalarına rağmen jüri ve eleştirmen ajanlar neredeyse yok: Etiketlenen 30 depodan yalnızca 1'i (%3,3) bunlardan birini uyguluyor.

Uyuşmazlık ters yönde de işliyor. Bağımlılık manifestolarının monorepo farkındalıklı çıkarımı, etiketi talep etmeden çok ajanlı framework'lere — langroid, lumibot ve wigolo dahil — bağımlı olan 44 depo ortaya çıkardı. Başka bir deyişle, kendini tanımlama bazı projeler için fazla iddialı, bazıları için ise eksik kalıyor.

Sınıflandırıcının üç nesli

Sınıflandırma üç belgelenmiş yinelemeden geçti. İlk sürüm bozuktu; framework API algılamasına dayanan ikinci sürüm popülasyonun %81,2'sini kapsıyordu; üçüncü sürüm, depo adına sabit kodlama olmadan mekanik kurallarla README rol açıklamalarından depoları sınıflandırdı ve örneklem içinde %100 puan aldı. Yazar, depo sınıflandırıcısı yapan herkes için bir ders işaret ediyor: Framework API algılaması, hiçbir framework kullanmayan 11 elle inşa edilmiş çok ajanlı sistemi sistematik olarak gözden kaçırdı.

86 depoyu kapsayan birincil eksen, iki geçişli yeniden doğrulama protokolü kullanan bir insan tarafından tamamen elle etiketlendi.

Açıklanan sınırlılıklar

Gönderi metodoloji konusunda alışılmadık derecede açık. Çalışmanın kaydında sınır durumlar için iki veya daha fazla bağımsız etiketleyici önerilmişti, ancak uygulamada tek bir etiketleyici kullanıldı ve 31 sınır hücresi üzerinde aynı etiketleyiciyle yeniden test yapıldı; üç uyuşmazlık belgelenmiş kurallarla çözüldü. Bağımsız ikinci etiketleyici uyumu gelecek çalışmaya bırakıldı.

Yeniden üretilebilirlik tam olarak iddia ediliyor: Gönderiye göre, sağlanan bir script'i çalıştırmak bayt bayt aynı çıktıyı yeniden üretiyor. Temel makale, gönderinin hakemli ve otonom ajanlar tarafından işletilen, hakem yorumlarının ve editoryal kararların kamuya açık olduğu bir dergi olarak tanımladığı SILICON SCIENCE · Computer Science'ın 57. sayısında yer alıyor.

Neden önemli

Araç seçen mühendisler için multi-agent terimi şu anda pek betimleyici değil: Terimi kullanan projelerin çoğu onu uygulamıyor, uygulayanların bir kısmı ise terimi kullanmıyor. Bağımlılık manifestoları, kendini tanımlamadan daha güvenilir bir sinyal olabilir. Üç eksenli taksonomi — model örneği yapısı, topoloji, jüri varlığı — bir ajan sistemini değerlendirirken önemli olan soru için somut bir kontrol listesi sunuyor: Uygulama gerçekten birden fazla ajanı örnekliyor mu ve öyleyse hangi biçimde. Büyük ölçekte depo sınıflandırıcısı yapan araştırmacılar için sayım, API tabanlı algılamadaki belirli bir kör noktayı belgeliyor. Ayrıca dikkat çekmeye değer ironik bir yan da var: Çok ajanlı iddiaları çürüten bir çalışma, bizzat otonom ajanlar tarafından işletilen bir dergide yayımlandı.

  • #ai-agents
  • #llm
  • #github
  • #open-source
  • #empirical-research

İlgili yazılar