deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak dev.to (home feed)

Microsoft yöneticisi yapay zekâ ile veri kazımanın tarihin en büyük emek hırsızlığı olduğunu söylediği iddia ediliyor

İki dev.to yazısı, bir Microsoft yöneticisinin yapay zekâ ile veri kazımanın 'insanlık tarihinin en büyük emek hırsızlığı' haline gelme riski taşıdığı konusunda uyardığını bildiriyor; ancak yazılar bunu kimin söylediği konusunda ayrışıyor.

Microsoft yöneticisi yapay zekâ ile veri kazımanın tarihin en büyük emek hırsızlığı olduğunu söylediği iddia ediliyor

Ne söylendi

Aynı yazar tarafından 19 Eylül'de yayımlanan, birbirine neredeyse eş iki dev.to yazısı çarpıcı bir uyarı içeriyor: kıdemli bir Microsoft yöneticisinin, yapay zekâ destekli veri kazımanın "insanlık tarihinin en büyük emek hırsızlığı" haline gelme riski taşıdığını söylediği iddia ediliyor. Yazılara göre bu sözler yakın zamanda verilen bir röportajda sarf edilmiş; ancak iki versiyon da özgün söyleşiye atıfta bulunmuyor.

Kaynaklandırma, okurların en baştan bilmesi gereken şekilde sarsıntılı. Yazılardan biri konuşmacı olarak Microsoft'un baş bilim insanı Kate Crawford'ı gösteriyor. Diğeri ise yalnızca adı açıklanmayan bir Microsoft yöneticisinden bahsediyor. Her iki yazı da aynı yazar tarafından aynı topluluk platformunda yayımlandığından, bu çelişki mevcut bilgilerle çözülemiyor ve alıntının doğrulanmış değil, aktarılmış bir iddia olarak değerlendirilmesi gerekiyor.

Yazılar yapay zekâ ile veri kazımadan ne anlıyor

dev.to yazıları, "yapay zekâ ile veri kazıma" terimini eski usul tarayıcıların çok ötesine geçen otomatik veri çıkarma sürecini tanımlamak için kullanıyor. Yazılara göre makine öğrenmesi modelleri bir sitenin yapısını öğrenebiliyor, tıklama ve form doldurma gibi insan etkileşimlerini taklit edebiliyor, düzen değiştiğinde uyum sağlayabiliyor, CAPTCHA'ları çözebiliyor ve API hız sınırlarını aşmanın yolunu bulabiliyor. Örnek verilen kullanım alanları rakip fiyat izleme ve içerik toplamadan sosyal medya duyarlılık analizine kadar uzanıyor; sahte yorum üretimi ve hassas verilerin toplanması gibi daha zararlı örnekler de sayılıyor.

Aynı yazılar kazıma konusunu emek sorunlarıyla daha doğrudan da ilişkilendiriyor. Birçok yapay zekâ sisteminin ardındaki düşük ücretli veri etiketleme işine ve daha geniş otomasyon rakamlarına dikkat çekiyorlar: Yazılardan biri, McKinsey araştırmasına dayanarak, mevcut teknolojiyle işlerin yaklaşık yüzde 60'ındaki görevlerin kabaca yüzde 30'unun otomatikleştirilebileceğini söylüyor; alıntı yapılan bir Dünya Ekonomik Forumu raporu ise yapay zekânın 97 milyon yeni iş yaratırken 2025'e kadar 85 milyon işi ortadan kaldırabileceğini öne sürüyor.

İddia edilen ölçek, ama uyarılarla

Yazılardaki bazı rakamlar şüpheyi hak ediyor. Versiyonlardan biri, Microsoft'un 2021'de iddiaya göre "Prometheus" adı verilen gelişmiş bir yapay zekâ destekli bot ağı tespit ettiğini ileri sürüyor ve bu iddiayı Microsoft'un Digital Defense Report'una dayandırıyor; diğer versiyonda bundan hiç söz edilmiyor. Aynı yazı, ortalama bir web sitesine günde kabaca 300 bot saldırısı ve yapay zekâ destekli bot etkinliğinde yüzde 24'lük yıllık artış gibi rakamlar için Imperva'nın 2021 Bad Bot Report'una yaslanıyor. Bu iddiaların hiçbirine bağlantı eşlik etmiyor ve tümü yalnızca dev.to yazılarının kendi kaynaklarına dayanıyor.

Geliştirici cephesi

Kazınmaktan endişe eden ekipler için yazılar tanıdık savunma önerileri sunuyor. Örneğin Node.js'teki express-rate-limit paketiyle uygulanabilen hız sınırlama, istek selini yavaşlatıyor. CAPTCHA'lar zorluk ekliyor; ancak yazılar modern yapay zekâ botlarının bunları giderek daha fazla çözdüğünü kabul ediyor. Cloudflare gibi yapay zekâ destekli çözümler de dahil web uygulaması firewall'ları düşmanca trafiği filtreleyebiliyor ve kod gizleme (obfuscation) bir uygulamanın tersine mühendisliğini zorlaştırıyor. Kazıma yapanlar içinse yazılar, robots.txt kurallarına ve hizmet şartlarına saygı gösteren uyumlu scraping API'lerini yasal alternatif olarak öneriyor.

Uyum, sorunun daha keskin tarafı olarak sunuluyor. GDPR ve CCPA kapsamında işletmeler kişisel veri toplamak için genellikle onay almak zorunda ve yazılar, toplama işlemi şeffaf olmayan otomatik sistemler aracılığıyla yapıldığında onayın elde edilmesinin, hatta tanımlanmasının bile zor olduğunu belirtiyor.

Bölünmüş bir topluluk

dev.to yazılarına göre Hacker News'teki tartışmalar geliştiriciler arasındaki gerçek bir bölünmeyi yansıtıyor: bazıları kazımayı yenilik ve veri odaklı ürünler için meşru bir araç olarak görürken, diğerleri sektör aksaklığı, haksız rekabet avantajı ve mahremiyet ihlalinden endişe ediyor.

Neden önemli

Alıntı gerçekse, bu durum yapay zekâya devasa yatırımlar yapmış bir şirket olan Microsoft'u, kendi sektörünün veri iştahına komşu bir uygulamayı tarihi bir emek hırsızlığı olarak tanımlayan bir beyanla kayıt altına almış oluyor. Gerçek hikâye aslında bu gerilim: modellerin web'den öğrenmesini sağlayan yetenekler, botların da web'den değer sökmesini sağlıyor ve meşru veri kullanımı ile tazmin edilmemiş emek arasındaki çizgi, düzenleyicilerin, mahkemelerin ve geliştirici topluluklarının şu an tam da mücadele ettiği şey.

Burada ikinci, daha sessiz bir ders de var. Manşetlik bir iddia, temel atıf konusunda anlaşamayan ve raporları bağlantısızca kaynak gösteren, birbirine neredeyse eş topluluk yazıları aracılığıyla dolaşımda. Alıntının doğruluğu ne olursa olsun, bu olay tartışmalı yapay zekâ anlatılarının nasıl yayıldığını ve teknik okurların bunları yaymadan önce kaynağını kontrol etmesinin neden önemli olduğunu gösteriyor.

  • #ai
  • #web-scraping
  • #data-privacy
  • #bots
  • #microsoft

İlgili yazılar