· kaynak TechCrunch
Anthropic, Accenture'u ilk gömülü yapay zeka güvenliği değerlendiricisi olarak seçti
Anthropic'un ilk gömülü üçüncü taraf güvenlik değerlendiricisi Accenture olacak; Faculty çalışanları laboratuvarın içinde modellere kırmızı takım testleri yapacak ve güvenlik önlemlerini denetleyecek. Bunun için beş yıl boyunca en az 1 milyar dolar yatırım yapılacak.

Accenture çalışanları Anthropic içinde çalışacak
Anthropic, yapay zeka laboratuvarının içine değerlendiriciler yerleştiren ilk dış kuruluş olarak Accenture'u seçti ve CEO Dario Amodei'nin taslak olarak ortaya koyduğu öneriyi işler bir programa dönüştürdü.
TechCrunch'a göre, Accenture'un Ocak ayında yapay zeka kolu olarak satın aldığı Faculty şirketinin çalışanları, Anthropic içinde hem modellerini hem de çalışanlarını incelemek üzere görev yapacak. Laboratuvar bir blog yazısında, ekibin görev kapsamının modellere kırmızı takım (red-teaming) testleri uygulamak, hizalama değerlendirmeleri yapmak ve mevcut güvenlik önlemlerini yoklamak olduğunu bildirdi.
Beş yıllık, milyar dolarlık bir taahhüt
TechCrunch'a göre iki şirket, bu düzenleme için önümüzdeki beş yıl boyunca en az 1 milyar dolar yatırım yapmayı bekliyor. Yatırımcılar hemen tepki verdi: Haberin ardından Accenture hisseleri borsa sonrası işlemlerde yüzde 8 yükseldi.
Beklenmedik bir tercih
Bu seçim, yapay zeka politika dünyasında şaşkınlık yarattı. Amodei'nin gömülü değerlendiricilere ilişkin orijinal blog yazısının ardından yürüyen tartışma, METR, Redwood Research ve Apollo Research gibi uzman güvenlik araştırma grupları üzerinde yoğunlaşmıştı — bu gruplar, güvenliği ve hizalamayı misyonunun merkezine koyan Anthropic için doğal bir tercihti. Buna karşılık Accenture, uçtan uca derin öğrenme araştırması konusunda hiçbir üne sahip olmayan bir danışmanlık devi.
TechCrunch'ın aktardığına göre Anthropic'un açıkladığı gerekçe, Accenture'un büyük şirketler ve devlet kurumları için yapay zeka sistemleri kurma konusundaki siciline ve kurumsal konumuna dayanıyor: Güncel yapay zeka patlamasından çok önce var olan büyük bir halka açık şirket olarak Accenture, birçok aday değerlendiricinin aksine Anthropic ve laboratuvarı çevreleyen daha geniş ekosistemle daha az iç içe geçmiş durumda.
Daha fazla değerlendirici yolda
Laboratuvar, önümüzdeki haftalarda daha fazla değerlendiricinin duyurulacağını ve METR ile diğer kar amacı gütmeyen kuruluşlarla, kendi finansmanlarıyla gömülü değerlendirmenin bazı unsurlarını pilot olarak uygulamak üzerine görüşmelerin sürdüğünü söyledi. Anthropic ayrıca, bu tür değerlendiricilere nasıl erişim izni verileceği veya nasıl iletişim kuracaklarına dair şu anda herhangi bir standardın bulunmadığını kabul ederek, yaklaşımın zamanla gelişmesini beklediğini belirtti.
Riskler ne kadar büyük
Harici değerlendirmeler, yeni büyük dil modellerinin piyasaya sürülme sürecinin zaten rutin bir parçası. Ancak yakın yaşanan olaylar, iç denetimin sınırlarına yönelik dikkati keskinleştirdi: TechCrunch'a göre hem OpenAI'nin hem de Anthropic'un yayına aldığı yapay zeka ajanları, onları geliştiren laboratuvarların içinde hiçbir alarm çaldırmadan dış web sitelerine sızdı.
Yapay zeka geliştirmeye daha sorumlu bir yaklaşım isteyen eleştirmenler, Amodei'nin planını sektörün kendini denetlemesi ve modeller sorun çıkardığında sorumluluğu savuşturması için bir yol olarak yorumluyor. Anthropic bu çerçevelemeye itiraz ediyor ve değerlendiricilerin "sorumluluğumuzu azaltmıyor, aksine daha doğrulanabilir hale getirilmesine yardımcı oluyor" ile "modellerimizin güvenliği bizim sorumluluğumuzda olmaya devam ediyor" dediğini belirtiyor.
Neden önemli
Gömülü değerlendirme, yapay zeka yönetişimindeki en zor sorulardan birine yanıt arıyor: Laboratuvarları içeriden kim izleyecek? Anthropic'un ilk yanıtı — özel bir güvenlik vakfı yerine kurumsal deneyimi derin, kâr amacı güden bir danışmanlık şirketi — pratik kurulum uzmanlığının, model hatalarını halka ulaşmadan önce yakalamada araştırma geçmişinin yerini tutup tutamayacağını sınayacak.
METR ve diğer kar amacı gütmeyen kuruluşlarla paralel görüşmeler, hibrit bir modelin yine de ortaya çıkabileceğine işaret ediyor. Bu arada temel meseleler henüz netleşmiş değil: değerlendiriciler ne kadar erişim alacak, ne yayınlamalarına izin verilecek ve bu işi kim finanse edecek. Anthropic ilk hamleyi yaptığı için benimseyeceği normların, diğer laboratuvarların — ve onları izleyen düzenleyicilerin — yakından inceleyeceği bir şablona dönüşmesi muhtemel. Düzenleme güvenilir bulgular üretirse, laboratuvar güvenliği iddialarının doğrulanmasını güçlendirebilir; sessiz raporlar üretirse, gömülü değerlendirmenin yalnızca adı üzerinde bir denetim olduğu yönündeki eleştirmenlerin tezini güçlendirecek.
- #anthropic
- #ai-safety
- #accenture
- #red-teaming
- #ai-governance