· kaynak The Verge
İkinci matematikçi, OpenAI'ı eğitim verisinin kaynağı konusunda dürüst olmamakla suçladı
Matematikçi Andreas Thom, OpenAI'ın ChatGPT görüşmelerinin eğitim verisinin dışında tutulduğunu hiçbir zaman kanıtlamadığını söylüyor; bu da matematikteki atılımlarının kaynaklarına ilişkin tartışmayı derinleştiriyor.

İkinci bir matematikçi, OpenAI'ı eğitim verisinin nereden geldiği konusunda etik dışı ve dürüst olmayan davranışlarla kamuoyu önünde suçladı. The Verge'un haberine göre Andreas Thom, bir dizi Mastodon gönderisinde, OpenAI'ın yakın tarihli matematik duyurularından önce kendisinin ve meslektaşlarının ChatGPT ile yaptığı etkileşimlerin şirketin sonuçlarına katkı sağlamış olabileceğini ve OpenAI'ın bunun aksini kanıtlamayı reddettiğini yazdı.
Thom'un iddiası ne
OpenAI'ın geçen ay duyurduğu on sonuçtan biri Thom'un kendi uzmanlık alanına denk geliyor: sofic olmayan gruplar — kabaca, sonlu yapılarla yaklaşılamayan sonsuz matematiksel yapılar olarak tanımlanabilir. The Verge'un bildirdiğine göre OpenAI, sonucunun Thom ve Gábor Kun'un önceki çalışmalarına büyük ölçüde dayandığını kabul etti ve şirket, bu katkıları anmamak nedeniyle matematik çevrelerinde eleştirilmesinin ardından yazımını sessizce düzeltti.
Thom, New York Üniversitesi matematik profesörü Tristan Buckmaster'ın OpenAI'ın modellerinin Codex aracını kullanımından avantaj elde edip etmediğini kamuoyu önünde sorgulamasının ardından şirketle kendi etkileşimlerini incelemeye başladığını söyledi. Thom'u ayrıca, dediğine göre, OpenAI'ın kendisi ve Kun'un geliştirdiği tekniklere dair ayrıntılı hâkimiyeti etkiledi — o zamanlar en bariz ne de en umut vaat eden yol olmayan çözüm yolları.
Soruyu geçiştiren bir yanıt
Thom, chatbot ile yaptığı görüşmelerin eğitim verisinin parçası olup olmadığını ya da sonucun arkasındaki akıl yürütme sürecine erişilebilir olup olmadığını sormak için OpenAI araştırmacıları Sébastien Bubeck'e ve aynı zamanda Harvard'da istatistikçi olan Mark Sellke'ye e-posta gönderdiğini söyledi. Thom'a göre gelen yanıt, sohbetlerine doğrudan erişilip erişilemediğini ele aldı; ancak OpenAI'ın modellerini geliştirmek için kullandığı dev veri havuzlarına girip girmediğini değil. "Böyle bir niteleme, açıklama ya da kanıt verilmedi" yazan Thom, bunun en hafif tabirle dürüstsüzlük olduğunu söyledi ve Sellke'nin özgün yanıtını da sonradan haklı görülemeyecek kadar geniş ve öz olarak yanıltıcı olarak niteledi.
Ana noktası asimetriyle ilgili: araştırmacıların, materyallerinin emilip edilmediğini kontrol etmek için OpenAI'ın eğitim hattını tersine mühendislikle çözecek pratik bir yolu yok. İlgili verileri yalnızca OpenAI elinde tutuyor; bu yüzden, diye savunuyor Thom, gerekli veri kümelerini açıklama ve kullanıcı verisinin nasıl ele alındığını düzenleyen ayarları ve koşulları netleştirme yükümlülüğü şirkete düşüyor.
Milenyum Ödülü tartışmasıyla aynı örüntü
Thom'un tarif ettiği ince ayrım — doğrudan erişim yok ama dolaylı etkinin dışlanması da yok — OpenAI'ın duyurduğu Navier-Stokes çözümünü (akışkan hareketiyle ilgili bir Milenyum Ödülü problemi) hem kamuya açık hem de Buckmaster ile yazışmalarında nasıl savunduğunun aynısı. Buckmaster, bu problem üzerine Anthropic araştırmacısı Levent Alpöge ile kişisel kapasitede çalışıyordu. Duyurusunda OpenAI, araştırmacılarının ya da agent'larının bu ikilinin çalışmasını kamuya açıklanmadan önce görmediğini ve hiçbir spesifik kullanıcı verisine erişilmediğini kesin bir dille yalanladı. Ancak aynı zamanda, olasılık düşük olsa da, ürün kullanımından türetilen kimliği anonimleştirilmiş verilerin modellerini geliştirmeye yardımcı olmuş olabileceğini dışlayamadığını da kabul etti.
Thom bu çerçeveyi tamamen reddetti: anonimleştirme bir ismi çıkarabilir, dedi, ama bir matematiksel fikrin entelektüel içeriğini ortadan kaldırmaz. Kullanıcıların sağladığı yayımlanmamış araştırmaların, rıza, açıklama ya da atıf olmadan, şirketin sonra bu kullanıcıların kendilerini yayına geçmek için yendiği modelleri keskinleştirmesine yol açması halinde bunun etik olarak savunulamaz olacağını söyledi. OpenAI, The Verge'un yorum talebine hemen yanıt vermedi.
Neden önemli
Tartışma, OpenAI için kutlama olması gereken bir anda patlak verdi. Efsanevi bir Milenyum Ödülü problemine iddia edilen çözümü, doğrulanırsa dikkat çekici bir başarı. Ancak The Verge'un belirttiğine göre bu, alışılmadık koşullar altında ele alındı: şirket, diğer araştırmacıların büyük ilerleme kaydettiğine dair söylentileri çevrimiçi duyduğunu ve problemi kendisinin kovalamaya karar verdiğini söylüyor.
Bu arka plan matematik genelinde kaygıyı besliyor. Birkaç araştırmacı The Verge'a, yakın bir atılım söylentisinin iyi kaynaklara sahip bir teknoloji deviyle bir yarışı tetikleyebileceğini bilmenin alanı gizliliğe iteceğinden ve uzun zamandır ilerlemeyi sürdüren açık paylaşımı zayıflatacağından endişe ettiklerini söyledi. Daha geniş sorun hesap verilebilirlik: ChatGPT gibi araçlarla yapılan görüşmeler sessizce eğitim sinyaline dönüşebiliyorsa, bu sistemleri kullanan her araştırmacı, kısmen kendi yayımlanmamış fikirleri üzerine inşa edilmiş bir rakibi besliyor olabilir — ve bunun olup olmadığının kanıtını yalnızca yapay zeka şirketinin kendisi inceleyebilir.
- #openai
- #chatgpt
- #training-data
- #mathematics
- #ai-ethics