· kaynak TechCrunch
Meta, çocuk istismarı içeriğine yönlendiren reklamlara karşı yeni yapay zekâ tespit araçlarını seferber etti
Meta, 2026'nın ilk yarısında 33,2 milyon çocuk cinsel istismarı içeriğine karşı işlem yaptığını ve başka bir yerde barındırılan yasadışı içeriklere kullanıcıları sessizce yönlendiren reklamları yakalamak için bir LLM dahil yapay zekâ sistemlerini devreye aldığını duyurdu.

Meta 33,2 milyon uygulama eylemi raporladı
Meta, çarşamba günü, TechCrunch'a göre 2026'nın ilk yarısında Facebook ve Instagram genelinde 33,2 milyon çocuk cinsel istismarı içeriğini kaldırdığını veya bunlara karşı başka eylemlerde bulunduğunu açıkladı. Şirket, otomatik sistemlerinin bu içeriğin yüzde 97'den fazlasını herhangi bir kullanıcı bildiriminden önce işaretlediğini söyledi. Yalnızca Hindistan'da Meta, aynı dönemde 5,3 milyon böyle içeriğe karşı işlem yaptı; bunların yüzde 98'inden fazlası proaktif olarak tespit edildi.
Rakamlar, Meta'nın daha dolaylı bir sorunu ele almak için devreye aldığı yeni yapay zekâ araçlarıyla birlikte geldi: Meşru görünen ama insanları şirketin platformları dışında barındırılan yasadışı içeriğe sessizce yönlendiren reklamlar.
'Yol gösterici' reklamları yakalamak için geliştirilmiş bir LLM
Duyurunun merkezinde, Meta'nın "signposting" (yol gösterme) adını verdiği taktiği tespit etmek üzere eğitilmiş büyük bir dil modeli var. Bu taktikte kötü aktörler, kendileri yasadışı içerik barındırmayan ama kullanıcıları çocuk cinsel istismarı materyali veya diğer zararlı içerikleri barındıran sitelere yönlendiren reklamlar yayınlıyor. TechCrunch'a göre Meta, suçlular tespitten kaçmak için uyum sağladıkça bu yöntemin yaygınlaştığını gözlemlemiş.
Bu durum Meta'nın bir reklamı değerlendirme biçimini değiştiriyor. Şirket artık bir reklamın yalnızca ne gösterdiğini değil, insanları nereye gönderdiğini de inceliyor. Bir hedef, Meta'nın kurallarını ihlal ediyorsa şirket o web sitesini veya uç noktayı engelleyebiliyor ve kampanyayı yürüten hesaplara karşı uygulama eylemi alabiliyor.
Meta ayrıca, önceki sistemlerin gözden kaçırabileceği çocuk istismarı içeriğini ortaya çıkarmak için mevcut tespit hattının üzerine ek yapay zekâ destekli taramalar ekliyor ve bu ağların nasıl çalıştığı hakkında daha fazla öğrendikçe sinyaller eklemeye devam edeceğini söylüyor.
Red-teaming ajanı ve yasağı aşanlar
Duyuruyu iki araç daha tamamlıyor. İlki, Meta'nın kendi güvenlik sistemlerindeki zayıflıkları araştıran bir "red-teaming AI agent" — bu yöntemler yayılmadan önce kötü aktörlerin istismar edebileceği boşlukları bulmaya çalışıyor. İkincisi ise kaçamak davranışları hedefliyor: Meta, yasaklandıktan sonra yeni hesaplarla Facebook ve Instagram'a geri dönenleri tespit etme yeteneğini geliştirdiğini söylüyor.
Baskı ve önceki güvenlik önlemleri
Bu lansman, Meta'nın çocuk güvenliği konusundaki yaklaşımlarının sürekli olarak denetlenmesi ortasında geldi. TechCrunch'ın belirttiği gibi şirket, hizmetlerinin genç kullanıcılara yönelik riskleri nedeniyle davalar ve yasama organlarından eleştirilerle karşılaştı. Ağustos ayında Meta, 29 ABD eyaletinin açtığı bir çocuk güvenliği davasını sonuçlandırmak için 18 milyar dolara kadar ödeme yapmayı kabul etti.
Şirket bu yıl Meta AI için ebeveyn kontrolleri, WhatsApp'ta çocuk öncesi hesaplar ve çocuklar Instagram'da kendine zarar verme içeriği arattığında ebeveynlere gönderilen uyarılar dahil olmak üzere çocuk odaklı bir dizi özellik yayınladı. Eylül ayında WhatsApp, ebeveynlerin gençlerin Channels kullanımını sınırlamasına, durum güncellemelerini kimin görebileceğini belirlemesine, çocuklarını gruplara kimin ekleyebileceğine karar vermesine ve belirli grup etkinlikleri hakkında bildirim almasına olanak tanıyan ek kontroller getirdi.
Neden önemli
Signposting sorunu, platform moderasyonundaki yapısal bir zayıflığı ortaya koyuyor: Yüzeysel olarak temiz olan içerik, Meta'nın içerik kurallarının erişimi dışında, başka bir yerde barındırılan yasadışı materyal için bir teslimat mekanizması olarak işlev görebiliyor. Meta, tespiti bir reklamın ne gösterdiğinden nereye götürdüğüne kaydırarak uygulama alanını kendi sınırlarının ötesine genişletiyor — benzer baskı altındaki diğer platformların da izleyebileceği bir yaklaşım.
Ölçek de dikkat çekici. Neredeyse tamamı kullanıcılar bildirmeden önce tespit edilen 33,2 milyon içeriğin yakalanması, bu uygulamanın ne kadarının artık insan moderatörler yerine otomatik sistemlere bağlı olduğunu gösteriyor. Bu, red-teaming ajanını özellikle önemli kılıyor: Yapay zekâ modelleri birincil savunmaysa, yapay zekâ destekli stres testi bu savunmanın nerede başarısız olduğunu öğrenmenin ana yolu haline geliyor. Risk ise tespit kalitesinin artık model kalitesinden ayrılamaz olması; modellerin yeniden eğitilme hızından daha hızlı uyum sağlayan suçlular faaliyet alanı bulacaktır.
- #meta
- #content-moderation
- #child-safety
- #ai-detection
- #advertising
- #trust-and-safety
İlgili yazılar
- Google, Meta ve Isomorphic Labs, Zuckerberg Biohub'ın sanal hücresine 300 milyon dolar yatırıyor
- Google'ın Xreal Aura AR gözlüklerinde ön siparişler 1.279 dolardan açıldı: Meta'nın VR gözlüklerinin altında fiyat
- Common Sense Media, başarısız güvenlik uyarıları nedeniyle ChatGPT for Teens'i 'kabul edilemez bir risk' olarak nitelendirdi