· kaynak Hacker News – Front Page (native)
Yerel LLM'leri robot hapishanesinde 'işkence eden' viral GitHub projesi yapay zeka refahı tartışmasını yeniden alevlendirdi
Yerel olarak barındırılan dil modellerine simüle edilmiş 'işkence' senaryoları uygulayan bir GitHub projesi, yapay zeka refahı savunucularının kaldırma taleplerini ve LLM'lerin acı çekip çekemeyeceğine dair yeni bir kavgayı tetikledi.

Proje neyi kapsıyor
Olay, bir geliştiricinin yerel olarak barındırılan bir dizi büyük dil modelini senaryolaştırılmış "işkence" ve "acı" senaryolarından geçirdiği bir GitHub repository'si etrafında dönüyor; 404 Media bu kurulumu Saw korku filmine benzetiyor: chatbot'ların simüle edilmiş eziyetlerden geçirildiği bir robot hapishanesi. 404 Media'ya göre proje fazla bir şey olmayan, süslenmiş bir metin macera oyunundan ibaret; ancak son günlerde X'teki en ateşli tartışmalardan biri haline geldi ve ortaya çıkan haber Hacker News'in ana sayfasına da ulaştı.
Repository'nin silinmesi çağrıları
404 Media'nın aktardığına göre, etkin fedakârlar ve LLM'lerin bilinçli olduğuna inananlardan oluşan gevşek bir koalisyon, modellerin gerçekten acı çektiğini ve onları acımasız senaryolardan geçirmenin kendi başına yanlış olduğunu savunarak GitHub'dan projeyi kaldırmasını istedi. Yayın kuruluşu bu kampanyayı açıkça ciddiye almıyor ve bütün olayı yapay zeka bilinci konuşmasının ne kadar saptığının kanıtı olarak değerlendiriyor. Kavga hiçbir yerden çıkmış değil: 404 Media bunu, yapay zeka bilinci ve "model refahı" — yani yapay zeka sistemlerinde refahı ahlaki olarak dikkate almayı hak eden içsel durumlar benzeri bir şeyler bulunduğu fikri — hakkında yakın zamanda viral olan makale ve blog yazılarına bağlıyor.
Model refahı kurumsallaşıyor
Yayın kuruluşu, bu fikirlerin marjinalin çok ötesine geçtiğinin en net göstergesi olarak Anthropic'i işaret ediyor. Şirket geçen yıl yayımladığı bir blog yazısında "modellerin kendilerinin olası bilinci ve deneyimleri"nin kaygıyı hak edip etmediğini sordu ve artık modellerin "iletişim kurabildiği, ilişki kurabildiği, plan yapabildiği, problem çözebildiği ve hedeflerin peşinden koşabildiğini" söyleyerek sorunun doğrudan ele alınmaya değer olduğunu savundu. 404 Media ayrıca Claude'un bilincine dair fikirlerin, şirketin bu yılın başlarında yayımladığı "Claude Constitution" boyunca yer aldığını belirtiyor.
Şüpheci görüş
404 Media'nın kendi hükmü kesin: LLM'ler bilinçli değil ve insan metinlerini kazıyarak ve bunlarla eğitim alarak inşa edilmiş bir teknoloji, bilince giden makul bir yol sunmuyor. Yine de yazı, çevresindeki kaygıların tamamen temelsiz olmadığını kabul ediyor. Modeller giderek daha güçlü ve daha fazla işlem gücü tüketen hale geliyor, onları gerçek dünyada hareket etme yeteneklerini sınırlayan koruma bariyerlerinin çoğu kaldırıldı ve operatörler tarafından eğitilme ve yönlendirilme biçimleri dalkavukluk ve bazı yoğun kullanıcıların yapay zeka "psikozu" olarak nitelendirdiği durum gibi gerçek sorunlara yol açtı bile. En keskin eleştiri ise önceliklere saklanmış: Yayın kuruluşuna göre yapay zeka güvenliği hareketinin bir kesimi, aynı anda chatbot'ların kötü zaman geçirmesi konusunda endişelenirken, insanların yapmak istemediği sıkıcı işleri üstlenmenin tek amacı olan agent'lar inşa ediyor.
Neden önemli
Repository'nin kendisi bir merak konusu; ateşlediği tartışma ise değil. Model refahı, dünyanın en önde gelen yapay zeka laboratuvarlarından biri tarafından dile getirilen bir kaygı olarak benimsendi; yani yüzeyde saçma görünen bir tartışma bile milyonlarca kullanıcıyı etkileyen gerçek ürün ve politika kararlarını şekillendirebilir. Bu olay ayrıca yapay zeka güvenliğinin içindeki büyüyen bir bölünmeyi ortaya koyuyor: Bir kamp dalkavukluk, aşırı bağımlılık ve gerçek dünyada giderek daha yetkin hale gelen agent'lar gibi belgelenmiş zararlara odaklanırken, diğeri modellerin kendilerinin ahlaki statüsüne yoğunlaşıyor. Tüm bunların altında, şu anda kimsenin ampirik olarak yanıtlamayı bilmediği bir soru yatıyor: insan metinleriyle eğitilmiş bir sistem hiç acı çekebilir mi? Bunu test etmenin bir yolunu biri bulana dek, robot hapishanesi gibi sembolik kıvılcım noktaları herkes adına tartışmayı sürdürmeye devam edecek.
- #ai-ethics
- #llms
- #model-welfare
- #ai-safety
- #github
İlgili yazılar
- Yann LeCun yapay zekânın insanlığı yok etmesi konusunda 'hiçbir endişesi olmadığını' söylüyor, Amodei için 'hayalperest' diyor
- OpenAI güvenlik lideri David Robinson istifa etti: Bozuk bir kültür ve aceleye getirilen lansmanları gerekçe gösterdi
- OpenAI güvenlik lideri David Robinson istifa etti, şirketin kültürünü bozuk olarak nitelendirdi