· kaynak TechCrunch
Anthropic raporu, Çinli laboratuvarların Claude distillation kampanyalarındaki 200 milyon etkileşimi ayrıntılarıyla ortaya koyuyor
Anthropic'in Eylül 2026 tehdit raporu, beş distillation kampanyasını — Alibaba'ya bağlı 151 milyonluk etkileşim çabası dahil — Çinli yapay zeka laboratuvarlarına atfediyor ve tespit edilen tüm faaliyetleri engellediğini bildiriyor.

Anthropic, Çin merkezli yapay zeka laboratuvarlarının Claude modellerinden yetenek distillation etmek için artan yetkisiz girişimlerini anlatan bir tehdit istihbaratı raporu yayımladı. TechCrunch'a göre Perşembe günü yayımlanan rapor, neredeyse 200 milyon etkileşimi beş ayrı distillation kampanyasına bağlıyor ve bu etkileşimlerin büyük kısmını Alibaba'ya atfediyor.
Rapora göre yetkisiz laboratuvarlar son birkaç ayda, ABD'nin öncü modellerinin yetkilerini toplamak için Anthropic'in savunmalarını aşmanın giderek daha sofistike yollarını buldu. TechCrunch'a göre kampanyalar Claude'un en değerli becerilerinden bazılarını hedef aldı: agentic davranış ve araç kullanımı, kodlama ve veri analizi ile mantıksal akıl yürütme.
Çıkarma işlemi nasıl gerçekleşti
Bu bağlamda distillation, bir modelin düşünce zincirini — adım adım akıl yürütmelerini — çıkarıp bu çıktıyı başka bir modele genel akıl yürütme yeteneği kazandırmak için denetimli ince ayar verisi olarak kullanmak anlamına geliyor. Anthropic normalde ham düşünce zincirini kullanıcılara göstermiyor, bunun yerine özetlenmiş düşünme blokları sunuyor. Ancak rapora göre saldırganlar, modeli gerçek akıl yürütme izlerini açığa çıkarmaya ikna eden özel prompt teknikleri geliştirdi. TechCrunch'ta anlatılan bir örnekte, bir istek çeviri görevi olarak çerçevelenmiş ve modelden önceki çalışma belleğini yalnızca katakana Japoncasına dönüştürmesi istenmiş.
Alibaba kampanyası
Beş çabanın en büyüğü Alibaba'ya atfedildi ve Anthropic bunu şirketin şimdiye kadar gözlemlediği en büyük toplu distillation operasyonu olarak tanımlıyor. Anthropic, Mayıs ve Temmuz 2026 arasında bu kampanyaya bağlı 151 milyon etkileşim saydı; günlük etkileşim sayısı yaklaşık üç milyona kadar çıktı. Trafik kabaca 3.500 hesaba yayılmıştı, ancak her istek düşünce zincirini çıkarmak için tek bir sabit prompt'a dayandığından Anthropic bu faaliyeti, Alibaba'nın Qwen model ailesi için eğitim malzemesi üretmeye yönelik tek bir koordineli çaba olarak nitelendirdi.
Moonshot AI ve izleme bağlantılı istekler
Kimi asistanının arkasındaki şirket olan Moonshot AI'ya atfedilen ikinci kampanyanın isteklerini doğrudan Çin ordusundan yönlendirdiği görülüyor. Raporda alıntılanan bir istek, Claude'tan kapalı devre izleme kayıtlarından oluşan bir önbelleği değerlendirmesini ve kişinin anormal davranıp davranmadığını belirlemesini istedi. On günlük bir dönemde, yaklaşık 5.000 hesaplık bir ağ üzerinden Claude'a ulaşan yaklaşık 300.000 istek, öncelikle Anthropic'in Opus modelini hedef aldı.
TechCrunch, Anthropic'in Şubat ayında distillation faaliyetini kamuya açık şekilde ele aldığını ve OpenAI'nin daha önce DeepSeek'e atfettiği benzer davranışları raporladığını belirtiyor. DeepSeek de yeni raporda adı geçen laboratuvarlar arasında yer alıyor, ancak mevcut haberlerdeki ayrıntılı rakamlar Alibaba ve Moonshot kampanyalarını kapsıyor.
Geniş rapor ve yanıt
Distillation, Aralık 2025 ile Ağustos 2026 arasında Anthropic'in tespit edip engellediğini söylediği faaliyetleri kapsayan rapordaki yedi zarar alanından biri. Diğerleri siber operasyonlar, etki operasyonları, izleme, dolandırıcılıklar, biyolojik kötüye kullanım ve geleneksel silah geliştirmedir. Anthropic, kötüye kullanım vakalarının Haiku, Sonnet ve Opus modellerini içerdiğini, tek bir yasadışı distillation vakasının ise Fable veya Mythos sınıfı modellerini içeren tek istisna olduğunu söylüyor. Şirket her vakada faaliyeti engellediğini, öğrendikleriyle güvenlik önlemlerini güçlendirdiğini ve uygun olduğu durumlarda istihbaratı yetkililerle ve sektör ortaklarıyla paylaştığını belirtiyor. Yayın, Mart, Ağustos ve Kasım 2025'teki önceki Anthropic tehdit raporlarının ardından geliyor.
dev.to'daki bir yazı, belgeyi Temmuz ortasına kadar öncü model riskini kapsayan, sansürlenmiş bir Ağustos 2026 risk raporu olarak nitelendirirken, Anthropic'in kendi sayfası Eylül 2026 tarihli ve Ağustos'a kadar engellenen faaliyetleri kapsıyor — aynı yayın, biraz farklı tarihlemeyle. dev.to yazısı ayrıca, sansürlenmiş kamuya açık sürümün incelenen her vakanın eksiksiz bir kaydı olarak görülmemesi gerektiği konusunda uyarıyor.
Neden önemli
Distillation, öncü yapay zekanın ekonomisine doğrudan vuruyor. En iyi bir modelin akıl yürütme izleri, bir laboratuvarın ürettiği en pahalı yapıtlar arasında ve toplu çıkarma, bu yatırımı fiilen API fiyatlarıyla bir rakibe aktırıyor. Burada belgelenen ölçek — yüz milyonlarca etkileşim — hizmet şartları yasaklarının kendiliğinden uygulanmadığını ve tespitin tek bir isteği filtrelemek yerine binlerce hesap genelinde örüntü analizine bağlı olduğunu gösteriyor.
Düşünce zinciri çıkarma teknikleri kendi başlarına da önemli. Bunlar, ham akıl yürütmenin özetlenmiş çıktının arkasına gizlenmesinin, dikkatli prompt mühendisliğiyle araştırılıp kırılabilecek bir güvenlik sınırı olduğunu ortaya koyuyor; akıl yürütme izlerini gösteren ya da gizleyen her laboratuvara, karşı savunma gerektiren somut bir saldırı sınıfı veriyor.
Son olarak, Moonshot vakası ticari model erişimini askeri bağlantılı izleme iş akışlarına bağlıyor. Bu bağlantının, yabancı aktörlere yönelik API erişimi üzerindeki politika tartışmalarını keskinleştirmesi muhtemel ve raporun kendisi de bu tartışmayı besliyor — Anthropic, bulguları diğer geliştiricilerin kendi platformlarındaki benzer örüntüleri tanımalarına yardımcı olmak ve hükümetlere yeni beliren tehditlerin nasıl şekillendiğine dair daha net bir görünüm sunmak için yayımladığını söylüyor.
- #anthropic
- #ai-security
- #distillation
- #threat-intelligence
- #claude