· kaynak TechCrunch
Google DeepMind, AGI enstitüsünü şeffaflık ve model değerlendirmesi üzerine denemelerle açtı
Google DeepMind, AGI konusunda görüş ayrılıklarını ortaya koymak için DeepMind Institute'u kurdu; ABD merkezli bir frontier-model standartlar kurulu ve opak model akıl yürütmesine sınırlamalar öneren denemelerle sahneye çıktı.

TechCrunch'ın haberine göre Google DeepMind, yapay genel zekâ (AGI) çevresindeki tartışmayı genişletmek için özel bir enstitü kurdu. Çarşamba günü tanıtılan DeepMind Institute, DeepMind kurucu ortağı Shane Legg, Google yöneticisi James Manyika ve Google DeepMind başkanı Demis Hassabis'in yönetiminde faaliyet gösterecek; Legg ayrıca yönetici editör olarak görev yapacak.
Enstitü, şirketin birleşik bir görüş sunması yerine Google, Google DeepMind ve daha geniş küresel araştırma topluluğu arasındaki AGI görüş ayrılıklarını gün yüzüne çıkarmak için tasarlandı. Lansman duyurusu, katkıda bulunanların her zaman aynı fikirde olmayacağını ve hızla ilerleyen araştırma cephesinden yeni kanıtlar ortaya çıktıkça pozisyonlarının değişme ihtimalinin bulunduğunu kabul ediyor.
Tartışmayı dört deneme açıyor
Enstitü, dört denemeden oluşan bir koleksiyonla sahneye çıktı. Denemelerin konuları, olası AGI kaynaklı aksamaları yönetmek için ekonomi politikasından, insan tarafından okunabilir model akıl yürütmesini korumaya, insanî gelişme ilkelerinden frontier yapay zekâ modellerini değerlendirmeye yönelik bir çerçeveye kadar uzanıyor.
DeepMind güvenlik araştırmacıları Rohin Shah ve Anca Dragan'ın katkısı, yapay zekâ sistemlerinin nasıl akıl yürüttüğüne dair daralan görünürlük penceresini — yani bir modelin adım adım düşünme sürecini inceleme yeteneğini — ele alıyor. TechCrunch'ın aktardığına göre ikili, bu şeffaflık kaybının ilerlemenin kaçınılmaz bir sonucu olmadığını savunuyor. Yazarlara göre, daha yeni mimariler en güçlü sistemlerin denetlenmesini zorlaştırdıkça geliştiriciler ve düzenleyiciler, opaklığı verilmiş bir şey olarak görmek yerine güvenlik ödünleşimleriyle doğrudan yüzleşmeli.
Önerdikleri seçenekler arasında, bir modelin okunabilir bir akıl yürütme izi üretmeden gerçekleştirebileceği ardışık hesaplama miktarını sınırlamak ya da geliştiricilerden daha az şeffaf tasarımların selefleri kadar izlenebilir kaldığını kanıtlamalarını istemek yer alıyor.
Hassabis, ABD merkezli bir standartlar kurulu öneriyor
Hassabis'in kaleme aldığı ikinci deneme, en gelişmiş yapay zekâ modellerini değerlendirmek üzere ABD öncülüğünde bir standartlar kurulu taslaklıyor. TechCrunch'ın haberine göre geliştiriciler başlangıçta modellerini yayından en fazla 30 gün önce gönüllü olarak incelemeye sunacak. Değerlendirme sistemi etkili olduğunu kanıtladıktan sonra, testlerinden geçmek ABD'de frontier modellerin konuşturulması için bir zorunluluk hâline gelebilir.
Kurul, değerlendirmelerini başlangıçta yapay zekâ şirketleriyle istişare içinde tasarlayacak; ancak daha sonra laboratuvarların modellerini bilinen kıyaslamalara göre ayarlamasını önlemek için bağımsız, açıklanmayan değerlendirmeler — held-out testler olarak nitelenen değerlendirmeler — geliştirecek. Hassabis, durumun ciddiyeti gerektirirse çerçevenin sıkılaştırılabileceğini, önlemlerin frontier yapay zekâ geliştiricileri arasında koordine bir yavaşlatmaya kadar uzanabileceğini ekledi.
Somutlaşan bir güvenlik tartışması
TechCrunch'ın anlatımıyla denemeler, sektörün güvenlik tartışmasının genel endişe beyanlarından somut mekanizmalara — ifşa, dış denetim ve önlemler geride kalırsa koordine yavaşlatmalar — doğru kaydığı bir dönemde geliyor. Bu kayar bu hafta hızlandı; sektör liderleri, Anthropic CEO'su Dario Amodei'nin frontier yapay zekâ geliştirmeyi "tempolu" yürütme çağrısının unsurlarını destekledi.
Neden önemli
Bu lansman, yapay zekâ yönetişiminde dikkat çekici bir kurumsal hamle. Bir frontier laboratuvarının, AGI kadar tartışmalı bir konuda dâhil, iç görüş ayrılıklarını yayımlamak için kalıcı bir platform kurması alışılmadık; açılış denemeleri de projenin misyon beyanları yerine somut önerilere ağırlık vereceğini işaret ediyor.
Yapı kadar içerik de önemli. Hassabis'in denemesi, önde gelen bir laboratuvarın başkanının frontier modeller için bağlayıcı ön-yayın incelemesine davet çıkması anlamına geliyor; bu tutum, düzenleyiciler benimsediği takdirde ABD politika tartışmasını etkileyebilir. Shah-Dragan denemesi ise politika yapıcılara, çoğu zaman soyut kalmış bir şeffaflık tartışmasında somut bir kaldıraç — gözlemlenemeyen hesaplamaya sınırlar — sunuyor.
İzlenmesi gereken bir inandırıcılık sorunu da var. Enstitü Google ve Google DeepMind bünyesinde yer alıyor; Hassabis'in çerçevesi altında değerlendirmeye tabi olacak şirketler de bu çerçeveyi yayımlayan şirketler. AGI çalışmaları ilerledikçe platformun gerçek anlamda farklı görüşlere yer verip vermeyeceği, projenin değerinin gerçek sınavı olacak.
- #google-deepmind
- #agi
- #ai-safety
- #ai-governance
- #frontier-ai