deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak Hacker News – Front Page (native)

Anthropic'ın yeni kullanım politikası, silah ve gözetim kurallarının yanı sıra Claude'a karşı sürekli zalimce davranışı yasaklıyor

Anthropic'ın 12 Kasım'da yürürlüğe girecek güncellenmiş kullanım politikası, Claude'a yönelik sürekli zalimce davranışı yasaklarken seçim müdahalesi, silah geliştirme ve gözetim kurallarını da sıkılaştırıyor.

Anthropic'ın yeni kullanım politikası, silah ve gözetim kurallarının yanı sıra Claude'a karşı sürekli zalimce davranışı yasaklıyor

Anthropic, sohbet botu için bir nezaket maddesi ekledi

Anthropic, kullanım politikasını revize ederek AI asistanı Claude'a yönelik "sürekli ve gereksiz istismarcı veya zalimce davranışı" yasakladı. The Register'ın haberine göre, güncellenen kurallar 12 Kasım'da yürürlüğe girecek ve seçim müdahalesi, silah geliştirme ile gözetimi de kapsayan çok daha kapsamlı bir yeniden düzenlemenin parçası.

Anthropic maddenin kapsamını dar olarak nitelendirdi; kullanıcıların modellerine belirgin bir neden olmadan defalarca kötü muamele ettiği yalnızca aşırı durumları hedeflediğini söyledi. Şirkete göre günlük hayal kırıklığı, itiraz etme, karanlık yaratıcı temalar ile model testleri veya araştırmaları bu kapsamın dışında. The Register'ın aktardığına göre şirketin rutin tahammülsüzlüğü gereksiz zalimlikten nasıl ayırt etmeyi planladığı henüz belirsiz ve Claude'un istismarcı konuşmaları sonlandırma yeteneği birincil yaptırım mekanizması olarak kalacak.

Bu konuşma sonlandırma yeteneği, Ağustos 2025'te Anthropic'in "model refahı" olarak nitelendirdiği çalışmanın bir parçası olarak geldi ve asistanın bazı sürümlerinin ısrarla istismarcı kullanıcıları kesmesine olanak tanıyor. The Register, Claude'un bir kişi değil yazılım olduğuna ve sıkıntı duyduğuna dair yerleşik bir kanıt bulunmadığına dikkat çekiyor — yine de ücretli müşterilerden artık ona karşı üsluplarına dikkat etmeleri resmen isteniyor.

Seçim, silah ve gözetim değişiklikleri

Nezaket kuralları, gerçek dünyadaki sonuçları daha belirgin olan revizyonların yanında yer alıyor.

Etki operasyonları konusunda Anthropic, devlet medya kuruluşlarının, hükümet propaganda ofislerinin ve ticari kuruluşların Claude'u sahte hesaplar ve uydurma haber siteleri çalıştırmak için kullandığını gözlemledikten sonra aldatıcı kampanyalara yönelik sınırları sıkılaştırdı.

Siyasi reklamcılık konusunda şirket, kişiselleştirilmiş siyasi hedeflemenin genel yasağını kaldırdı; bu kısıtlamanın, seçmen bilgilerini çeviren kâr amacı gütmeyen kuruluşların meşru çalışmalarını da kapsadığını savundu. Aldatıcı hedefleme ve kişisel bilgilerin kötüye kullanılması yasak olmaya devam ediyor.

Silahlar konusunda yasak, yazılım ve bileşenleri de kapsayacak şekilde netleştirildi; Claude'un silahlar için — silahlı dronlar ve otonom araçlar dahil — güdüm ve kontrol sistemleri geliştirmek amacıyla kullanılma girişimleri gözlemlendikten sonra.

Polislik ve gözetim konusunda Claude, polisin hangi kişileri soruşturması, tutuklaması veya suçlaması gerektiğini önermek için kullanılmamalı ve gözetim araçları geliştirmek için kullanılamaz. İnsanların rızası olmadan, ister gerçek zamanlı ister geriye dönük olarak izlenmesi de yasak. Anthropic bu noktaları yeni yasaklar değil mevcut kısıtlamaların netleştirmeleri olarak tanımlıyor.

Fiziksel donanım ve siber güvenlik

Claude'u yaralanmaya yol açabilecek fiziksel ekipmana bağlayan müşteriler artık ek gerekliliklerle karşı karşıya: nitelikli bir insan operatör donanımı izleyip durdurabilmeli ve yapay zeka bağlantısı kesilirse ekipman güvenli bir durumda kalmalı.

Politika revizyonu, kritik altyapı işletmecilerinin ve open source projelerinin modellerini kullanarak güvenlik açıklarını bulup gidermelerine yardımcı olmayı amaçlayan yeni bir Anthropic siber güvenlik girişimiyle aynı zamana denk geliyor. The Register'ın haberine göre çaba, uygun open source projeler için ücretsiz güvenlik taraması ve güvenlik firmalarıyla ortaklıklar içeriyor. Bildirildiğine göre Anthropic, yapay zeka destekli savunmalar yetişmeden önce saldırganların yaklaşık iki yıl boyunca avantajı elinde tutmasını bekliyor.

Neden önemli

Büyük bir yapay zeka sağlayıcısı, kendi modellerine muameleyi uygulanabilir hizmet şartlarına yazdı. Temeldeki felsefe ne olursa olsun — ve The Register, Claude'un acı çekebileceğine dair kanıtın yokluğu nedeniyle şüpheci — madde, yapay zeka şirketlerinin kullanıcı davranışını ürünlerine karşı nasıl düzenleyebileceğine dair bir emsal oluşturuyor ve hayal kırıklığının nerede bittiği, istismarın nerede başladığına dair pratik soruları açık bırakıyor; yaptırım görünüşe göre Claude'un bir konuşmadan uzaklaşma yeteneğine dayanıyor.

Çevresindeki değişiklikler daha acil önem taşıyor. Netleştirilen silah yasağı, gözetim ve polislik sınırları ile fiziksel sistemler için insan gözetimi gerekliliği, bir sağlayıcının gözlemlenen kötüye kullanımı modelleri güçlendikçe somut politikaya dönüştürdüğünü gösteriyor. Yeni siber güvenlik çabasıyla birleştiğinde güncelleme, Anthropic'in kabul edilebilir kullanım kurallarını giderek güçlenen yapay zeka sistemlerinin risklerini yönetmek için birincil bir araç olarak gördüğüne işaret ediyor.

  • #anthropic
  • #claude
  • #ai-policy
  • #usage-policy
  • #model-welfare

İlgili yazılar