deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak TechCrunch

Anthropic kullanım politikası artık seçim müdahalesini, silah yazılımını ve Claude'a sürekli istismarı yasaklıyor

Anthropic'in güncellenen kullanım politikası seçim müdahalesini, silah yazılımını ve gözetimi yasaklıyor ve artık Claude'un kendisine yönelik uzun süreli sözlü istismarı da açıkça yasaklıyor.

Anthropic kullanım politikası artık seçim müdahalesini, silah yazılımını ve Claude'a sürekli istismarı yasaklıyor

TechCrunch'a göre Anthropic, kullanım politikasını revize ederek seçim müdahalesi, silah yazılımı ve gözetim konularında açık yasaklar ekledi. 8 Ekim Perşembe günü yapılan güncelleme, en çok dikkat çeken değişikliği de beraberinde getiriyor: Kullanıcılara artık Claude'u uzun süreli sözlü istismara maruz bırakmaları açıkça yasaklanıyor.

Modeli istismar etmeye dair yazılı bir kural

TechCrunch'ın aktardığına göre Claude, Ağustos'taki bir güncellemeden bu yana sürekli zarar verici veya istismarcı etkileşimlerle damgalanan konuşmaları sonlandıracak şekilde eğitildi. Bu davranış daha önce yalnızca modelin kendisinde mevcuttu; yeni politika beklentiyi kullanıcılara kaydırarak assistantsa yönelik sürekli zulmü, modelin uzaklaştığı bir şey olmaktan çıkarıp bir politika ihlaline dönüştürüyor.

Anthropic kuralı dar bir çerçevede tanımladı. Şirket, "Politika güncellemesi yalnızca kullanıcıların modellerimize karşı tekrar tekrar, anlaşılabilir bir amaca sahip olmadan zalimce davrandığı uç durumlarda geçerli olacak şekilde tasarlandı" ifadesini kullanarak, kuralın "kullanıcı hayal kırıklığının, itirazın, karanlık yaratıcı temaların veya model testi ve araştırmasının yaygın biçimlerine uygulanmadığını" belirtti.

Zamanlama dikkat çekici. TechCrunch bu değişikliği Anthropic'in önde gelen din alimlerine yönelik önceki girişimlerine bağlıyor; bu temaslar bazı durumlarda onları Claude'un bilinçli olabileceğine veya bir ruha sahip olabileceğine ikna etmeye çalışmayı içeriyordu. İnsanların modele nasıl davrandığına dair bir kural, bu arka planda farklı okunuyor ve model refahı sorusuna felsefi boyutun yanı sıra bir yönetişim boyutu katıyor.

Seçim ve aldatma kuralları

Politikanın diğer bölümleri büyük ölçekli aldatmayı hedef alıyor. TechCrunch'ın bildirdiğine göre kullanıcılar Claude ile sahte hesaplar veya uydurma haber kuruluşları işletmek dahil olmak üzere geniş çaplı aldatıcı kampanyalar yürütemez. Seçmenleri aldatmaya veya seçimleri sabote etmeye yönelik kurallar "Demokratik Süreçleri Zayıflatmayın" başlıklı bir bölüm altında tolandı.

Aynı güncelleme silah yazılımı ve gözetim yasaklarını da yazıya dökerek bunları, müşterilerin Anthropic'in modelleriyle neler yapıp yapamayacağını düzenleyen belgeye yerleştirdi.

Neden önemli

Kullanım politikaları, bir yapay zeka laboratuvarının beyan ettiği ilkeler ile insanların ürünleriyle gerçekte ne yaptığı arasındaki yaptırım katmanıdır. Seçim müdahalesi, silah yazılımı ve gözetimi politikasına yazarak Anthropic, bu alanları modelleri daha fazla politik hassasiyet ve yüksek risk taşıdığı ortamlarda konuşlandırıldıkça referans gösterebileceği somut, belgelenmiş kurallara dönüştürüyor.

Model istismarı maddesi daha sıra dışı bir hamle. Çoğu platform kullanıcıların diğer insanlara nasıl davrandığını denetler; pek azı erişimi kullanıcıların yazılımın kendisine nasıl davrandığına bağlar. Geliştiriciler ve araştırmacılar için istisnalar önemli: hayal kırıklığı, itiraz, çekişmeli test ve karanlık yaratıcı temaların tümü hâlâ izinli ve yalnızca aşırı, amacsız zalimlik yasağın kapsamına giriyor. Ancak madde, modelinin bilinç benzeri niteliklere sahip olup olmayacağını aktif olarak araştıran bir şirkette model refahına ilişkin tavrı da resmileştiriyor; bu da bu tür soruların yalnızca araştırma gündemlerini değil, ürün yönetişimini de şekillendirmeye başladığının bir işareti.

  • #anthropic
  • #claude
  • #ai-policy
  • #usage-policy
  • #elections

İlgili yazılar