deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak dev.to (home feed)

Vericore, diff'e güvenmeden önce yapay zekâ kodlama agent'lerini bir değişim sözleşmesiyle denetliyor

Bir geliştirici, agent çalışmadan önce bir değişim sözleşmesi kaydeden ve sözleşmenin dışına çıkan düzenlemeleri işaretleyen açık kaynaklı bir doğrulama katmanı olan Vericore'u yayınladı.

Vericore, diff'e güvenmeden önce yapay zekâ kodlama agent'lerini bir değişim sözleşmesiyle denetliyor

Önceden belirlenmiş bir sözleşmeye dayalı doğrulama katmanı

dev.to'da yazan bir geliştirici, yapay zekâ destekli kodlama hakkında kulağa basit gelen bir soruyu yanıtlamak için tasarlanmış açık kaynaklı bir araç olan Vericore'u tanıttı: agent yalnızca kendisinden isteneni mi değiştirdi? Yazarın da belirttiği gibi, kodlama agent'leri saniyeler içinde bir repository'nin büyük bölümlerini yeniden düzenleyebiliyor ve bu hız, düzenlemelerin amaçlanan kapsam içinde kalıp kalmadığı konusunda hiçbir şey söylemiyor.

Vericore'un yanıtı, Change Contract adını verdiği bir yapı. Bir agent herhangi bir şeye dokunmadan önce, araç repository'nin bağlamını özler ve görev için kabul edilebilir bir değişikliğin nasıl görünmesi gerektiğini yazıya döker. Agent işini bitirdikten sonra Vericore, ortaya çıkan diff'i daha önceki bu kayıtla denetler. Beklenti, tek bir satır kod üretilmeden önce sabitlendiği için, verilen karar bir plana dayanır; agent'ın tesadüfen ürettiği çıktı hakkında sonradan yapılan akıl yürütmeden değil.

Anla, hazırla, değiştir, doğrula

dev.to gönderisine göre iş akışı dört aşamada ilerliyor: anlama, hazırlama, agent değişiklikleri ve doğrulama. İlk iki aşama tek bir düzenleme yapılmadan gerçekleşir; Vericore repository'nin modelini kurar ve sözleşmeyi biçimlendirir. Üçüncü aşama tamamen kodlama agent'ine aittir. Son aşamada araç yeniden devreye girer ve yapılan gerçek değişiklikleri planla karşılaştırır.

Doğrulama adımı, gönderinin şu şekilde listelediği birkaç boyutu kapsıyor:

  • repository kapsamı
  • beklenmeyen dosyalar
  • mimari
  • bağımlılıklar
  • sözleşmeler
  • testler
  • değişikliğin etkisi

Gönderi fikri bir ödeme örneğiyle açıklıyor. Bir agent'ın PaymentService.kt, PaymentValidator.kt ve PaymentServiceTest.kt dosyalarında çalışması gerektiğini, ama bu arada sessizce PaymentDatabase.kt dosyasını da düzenlediğini varsayalım. İnsan bir inceleyici yalnızca değişmesini beklediği dosyalara bakıyorsa, bu yan düzenleme gözden kaçması çok kolaydır ve Vericore'un ortaya çıkarmak için tasarlandığı sapma türü de tam olarak budur.

Agent'lere MCP üzerinden açılıyor

Vericore ayrıca bir MCP server olarak geliyor; yani yapay zekâ agent'leri, araç yalnızca dışarıdan bir denetim kapısı gibi davranmak yerine, repository zekâsını ve doğrulama özelliklerini doğrudan çağırabiliyor. İlke olarak bu, bir agent'ın görev sırasında kendi işini kontrol etmesini sağlar. Gönderi, bu geri bildirim döngüsünün şu aşamada ne kadar sıkı kurulduğuna ilişkin ayrıntıya girmiyor.

Erken günler, açık biçimde geliştiriliyor

Bazı bağlamı akılda tutmakta fayda var. Duyuru birinci elden: projenin kendi geliştiricisinden, dev.to üzerinden geliyor ve bağımsız benchmark'lar, kullanım rakamları ya da üçüncü taraf değerlendirmeler cite edilmemiş. Yazar bu çabayı açık, devam eden bir proje olarak tanımlıyor ve kodlama agent'leriyle çalışan geliştiricilere, bir değişikliğe güvenilmeden önce doğrulama katmanının başka neleri denetlemesi gerektiğini açıkça soruyor.

Neden önemli

Güven, otonom kodlama agent'lerini geri tutan asıl darboğaz olabilir. Agent'ler doğru kod üretse bile, çıktılarını incelemek, satır satır okumaya sığmayacak kadar büyük diff'lerde debelenmek demek; talimatlarının ötesine kayan bir agent ise kimsenin farkına varmadan risk yaratabiliyor. Sözleşme temelli bir yaklaşım bu incelemeyi yeniden çerçeveliyor: insan her değişikliği tek tek incelemek yerine, değişikliklerin açıklanan kapsamdan sapıp sapmadığını kontrol ediyor. Bu, mevcut güvenlik ağlarını da tamamlıyor. Testler, istediğiniz değişikliklerdeki hatalı davranışı yakalar; kapsam doğrulaması ise her testi geçse bile istenmeyen değişiklikleri yakalar. Bu yaklaşım yaygınlaşırsa, bu tür doğrulama hook'larının CI pipeline'larında ve agent harness'lerinde standart hale gelmesini hayal etmek kolay. Ancak açık sorular da var — özellikle değişim sözleşmesini kimin yazacağı, sözleşmenin ne kadar ayrıntılı olabileceği ve sistemin, ilk planın dışındaki dosyalara dokunmayı gerçekten gerektiren meşru işleri nasıl ele alacağı.

  • #ai-agents
  • #developer-tools
  • #open-source
  • #code-review
  • #mcp

İlgili yazılar