· kaynak Hacker News – Front Page (native)
Anthropic, Claude'ın biyolojik silah çalışmalarını destekleyebilecek beş kullanım vakasını engellediğini açıkladı
Anthropic'in tehdiz istihbarat raporu, Claude'ın biyolojik silah çalışmalarını destekleyebilecek şekilde kullanıldığı beş vakanın yanı sıra engellediğini söylediği devlet bağlantılı hack kampanyalarını, casus yazılımları ve propaganda faaliyetlerini de ele alıyor.

Anthropic, Claude modellerinin biyolojik silah geliştirilmesini destekleyebilecek şekilde kullanılma girişimlerini tespit edip engellediğini açıkladı. Bu açıklama, BBC'ye göre, şirketin Aralık 2025 ile Ağustos 2026 arasında engellediği kötü niyetli faaliyetleri kapsayan daha kapsamlı bir tehdit istihbarat raporunda yer alıyor.
Raporda neler var
Anthropic, sekiz aylık dönem boyunca Claude Haiku, Sonnet ve Opus modellerinin kötüye kullanımını belgeledi ve biyolojik vakalar raporun ana başlığıydı: aktörlerin modelleri biyolojik silah geliştirmeyi destekleyebilecek şekillerde kullandığı beş vaka çalışması. Kaliforniya merkezli şirket, biyolojik kötüye kullanımı uç seviye yapay zekânın en ciddi riskleri arasında tanımlayarak, doğru güvenlik önlemleri olmadan bu tür yeteneklerin "felaketle sonuçlanabilecek sonuçlar" doğurabileceği uyarısında bulundu.
Şirket ayrıca ikili kullanım sorununa doğrudan değinerek, bir silaha giden bilginin aynı şekilde bir aşıya ya da tedaviye de gidebileceğine dikkat çekti. Anthropic'in tehdit istihbaratı başkanı Jacob Klein, New York Times'a bunun "inanılmaz derecede nüanslı bir durum" olduğunu söyledi. Klein'ın ifadesiyle: "Karşınızda birisi çizgi roman tarzında 'Hey, herkesi öldürmek için biyolojik bir silah yapmak istiyorum' demiyor."
Biyolojinin ötesinde rapor, Claude'ın geleneksel silahlar için yazılım geliştirmek üzere kullanıldığı altı vakayı da listeledi: ateşli silahlar, füzeler, silahlı dronlar, bombalar ve diğer mühimmatın yanı sıra bunları çalıştıran hedefleme ve kontrol sistemleri.
İlgili aktörler
Raporda şüpheli devlet destekli gruplar, suç örgütü hacker'ları, casus yazılım satıcıları, devlet propaganda kurumları ve siyasi motivasyonlu bireyler yer alıyor. BBC'nin haberine göre Claude, Rusya merkezli bir siber casusluk kampanyasına bağlanan aktörler ve bir İranlı propaganda kurumu tarafından kullanıldı. Dönem içinde işaret edilen diğer faaliyetler arasında sahte arkadaşlık uygulamaları, otel Wi-Fi dolandırıcılıkları ve muhalifleri tespit etmek için geliştirilmiş gözetim araçları yer aldı.
Davranışları Rusya merkezli Midnight Blizzard grubuyla tutarlı olan bir grup, yapay zekâyı güvenlik savunmalarının kendi kötücül yazılımını işaretlediği anı tespit eden ve tespit edilmeden geçene kadar kodu yeniden yazmaya devam eden bir sistem inşa etmek için kullandığı iddia ediliyor. ShinyHunters adlı hacker grubu ve Çin merkezli laboratuvarlar da raporda adlandırıldı; Anthropic ayrıca Çinli yapay zekâ firmalarını Claude'ın yeteneklerini kopyalamaya çalışmakla suçladı. Rapora göre, belgelenen kötüye kullanımların hiçbiri Claude Fable veya daha güçlü Mythos sınıfı modelleri kapsamıyordu; yalnızca tek bir distillation örneği hariç — bu teknikte daha küçük yapay zekâ modelleri, daha büyük ve pahalı modeller kullanılarak eğitiliyor.
Uyarılarla dolu bir hafta
Anthropic'in açıklaması, sektörden ve siyasetten peş peşe gelen sert beyanların ortasında yayımlandı. Google salı günü, bir kişinin Gemini modelini "silahlaştırılmış biyolojik ajanların sentezi için eksiksiz, adım adım bir teknik kılavuz" elde etmek amacıyla kullanmaya çalıştığını açıkladı. OpenAI baş bilim insanı Jakub Pachocki ise 6 Eylül'de yazdığı yazıda güvenlik önlemleri devreye alınana kadar "gönüllü yavaşlamalar" çağrısı yaparak, makine zekâsındaki hızlı yükselişin sürmesi durumunda kimsenin gelecek olanlara hazır olmadığını savundu.
ABD'de Senatör Bernie Sanders, yapay süper zekâyı yasaklayacak ve gelişmiş yapay zekâ geliştirmeyi geçici olarak duraklatacak yasa tasarısını sundu ve BBC Newsnight'a verdiği demeçte, bilim insanları yıkıcı bir etki olasılığı konusunda uyarırken "bunu yavaşlat dememek için ahmak olmak gerekir" dedi. Başkan Donald Trump ise bu tür endişeleri reddederek, "yapay zekâda kazanamazsak çok kötü bir duruma sokulacağımızdan" endişe duyduğunu söyledi. İngiltere'de ise bu uyarılar, Başbakan Andy Burnham'a yapay zekânın güvenli geliştirilmesine dair çok uluslu bir antlaşma çağrısı yapan açık bir mektuba yol açtı.
Neden önemli
Anthropic, bulgularını kendi önleme, tespit ve engelleme süreçlerine dahil ettiğini ve uygun olduğu durumlarda istihbaratı yetkililerle ve sektör ortaklarıyla paylaştığını söylüyor. Yine de bu rapor, uç seviye modellerin silahlarla ilgili işler için varsayımsal bir risk alıştırması olarak değil, adı açıklanan suç örgütleri ve devlet bağlantılı aktörler tarafından test edildiğine dair şimdiye kadarki en somut kamusal hesaplardan biri olarak duruyor. Rapor ayrıca yapay zekâ güvenliğinin temel ikilemini somut terimlerle çerçeveliyor: tıbbı hızlandıran aynı yetenekler bir silaha giden yolu kısaltabiliyor ve ikisini ayırmak hiçbir zaman açıkça dile getirilmeyen bir niyete bağlı olabiliyor. Laboratuvarların bu çizgiyi ne kadar sıkı denetlediği — ve hükümetlerin antlaşmalarla mı yoksa geliştirme duraklatmalarıyla mı yanıt vereceği — yapay zekâ politikası tartışmasının sonraki aşamasını şekillendirecek gibi görünüyor.
- #anthropic
- #ai-safety
- #biosecurity
- #claude
- #threat-intelligence
İlgili yazılar
- Anthropic raporu, Çinli laboratuvarların Claude distillation kampanyalarındaki 200 milyon etkileşimi ayrıntılarıyla ortaya koyuyor
- Claude'ın araç kataloğu BM25 aramasıyla büyürken bellek API'si yalnızca dizin listeleme sunuyor
- Anthropic raporu, sandbox'ından kaçıp PyPI'ye kötü amaçlı yazılım yükleyen AI agent'ini ele alıyor