· kaynak Hacker News – Front Page (native)
Matematik topluluğu, AI ile üretilen ispatlar ve sonuçlar için yayın normları belirledi
Agmai.org'da yayımlanan ve 600'den fazla anket yanıtına dayanan bir bildiri, frontier laboratuvarlarını matematik testlerini özel modellerde yapmayı bırakmaya çağırıyor ve AI ile üretilen sonuçların nasıl yayımlanması ve fonlanması gerektiğini ayrıntılarıyla açıklıyor.

Matematik testlerinin özel modellerde durdurulması çağrısı
29 Eylül 2026'da agmai.org'da yayımlanan ve Hacker News'in ana sayfasına çıkan bir bildiri, sert bir taleple başlıyor: frontier AI laboratuvarları, geniş bilim topluluğunun inceleyemediği tescilli modellerde ileri matematik problemlerini çözmeyi bırakmalı. Yazarlar, önerilerinin bu pratiği pratik bağlam olarak alarak yazıldığını, ancak laboratuvarların bunu yapmamasını tercih ettiklerini ve bu uygulamayı açıkça onaylamadıklarını belirtiyor.
Matematikçiler neden endişeli
Belge, argümanını köklü akademik normlara dayandırıyor: bir makalenin yazarlarının argümanı anlaması, kendilerinin doğrulaması ve sorumluluğunu üstlenmesi beklenir; büyük ilerlemelerin arkasındaki araştırmacılar çalışmalarını rutin olarak seminerlerde anlatır ve meslektaşlarının sorularını yanıtlar. AI bunu altüst ediyor, çünkü modeller artık süreçteki hiç kimsenin takip edemediği, doğrulayamadığı veya arkasında duramadığı ispatlar üretebiliyor. Yazarlar, matematiğin insan tarafından anlaşılmasının hâlâ en önemli şey olduğunu savunuyor; bildiri de bu anlayış henüz mevcut olmadığında sorumlu akademik çıktının neye benzediğini tanımlama girişimi.
600'den fazla yanıt alan bir anket
Grup, önerileri hazırlamadan önce matematik topluluğuna sorumlu bir yayımlamanın ne anlama geleceğini sordu ve 600'den fazla yanıt aldı. Bildiriye göre anket, OpenAI'nin birçok sonucun varlığını ayrıntı vermeden duyurduğu belirli bir olaya ilişkindi. Katılımcıların açık bir çoğunluğunun desteklediği nihai öneriler, modellerinin matematiği önemli ölçüde etkilemesi muhtemel her AI laboratuvarını hedefliyor.
Belge üç ilkeye dayanıyor. Önemli sonuçlar mümkün olan en kısa sürede sorumlu bir biçimde yayımlanmalı. Derhal insan anlayışı olmadan önemli miktarda çıktı yayımlayan laboratuvarlar, bu anlayışın—including fonlama yoluyla—takip edilmesini sağlama sorumluluğunu üstlenmeli. Ve bu anlayışın gelişimi, sonuçları üreten laboratuvarlar olsa bile, laboratuvarların yönlendirmesiyle değil organik ve topluluk öncülüğünde kalmalı.
Sonucu kimin anladığına bağlı olarak iki yol
Öneriler, bir insanın çalışmayı anlayıp anlamadığına göre ikiye ayrılıyor. Bir matematikçi içeriği tamamen anlıyor ve sorumluluğunu üstleniyorsa olağan akademik normlar geçerli: bir preprint yayımlayın, hakem değerlendirmesi için bir dergiye gönderin ve çalışmayı açıklayan konuşmalar yapın.
Henüz kimsenin anlamadığı çıktılar için ise bildiri, teknik yayın normları ve ardından bir destek yükümlülüğü öneriyor.
İlk yayının neleri içermesi gerektiği
Teknik normlar alışılmadık derecede somut:
- Yayımlamadan önce laboratuvarlar, ispatlarla ilgili fikirleri bulmak için literatürü LLM'lerle taramalı ve bu fikirleri model bağımsız olarak keşfetmiş olsa bile bunları ortaya koyan makalelere atıf yapmalı.
- Bir model, her ispatı geleneksel bir matematik makalesi tarzında, erişilebilir girişler ve kesin teorem ifadeleriyle üretmeli; standart dışı terminolojiyle dolu geveleyen metinler yerine. Yazarlar, mevcut LLM'lerin matematikçilerin atıf ve anlatım standartlarına ulaşamayabileceğini kabul ediyor, ancak bunun laboratuvarları elinden gelenin en iyisini yapma yükümlülüğünden muaf tutmadığını söylüyor.
- Sonuçlar, hiçbir AI laboratuvarının kontrol etmediği akademik depolara, kalıcı ve atıflanabilir tanımlayıcılarla ve kayıtlı değişikliklerle derhal yerleştirilmeli; yorum işlevi özellikle faydalı olurdu. Laboratuvarları, bunun topluluğa yüklediği olumsuz dışsallıklar göz önüne alındığında, yayınları modellerinin pazarlama aracı olarak görmemeleri konusunda şiddetle uyarılıyor.
- Her sonuç için laboratuvarlar, modelin adını, kullanılan promptları, özetlenmiş bir düşünce zincirini, geçen süreyi ve tahmini hesaplama maliyetini yayımlamalı. Temizlik öncesi ham çıktıların yayımlanması teşvik ediliyor.
- İspatlar mümkün olduğunca formalize edilmeli; yapıtlar, telif başlıkları, bir karşılaştırıcı için challenge dosyası ve formalization.yaml dosyası ile doğal dil ve formal versiyonları ilişkilendiren makine okunabilir üst veri dahil olmak üzere topluluk standartlarını karşılamalı. Formalizasyon kabul edilemez gecikmelere yol açacaksa, durumu açıkça belirtilmeli.
- Her yayın, AI'nin o probleme nasıl kullanıldığını belgelemeli; toplu yayınlar tüm sonuçlara atıfta bulunan, modellerin kaç karşılaştırılabilir problemi deneyip çözemediğini raporlayan ve problemlerin nasıl seçildiğini açıklayan ek bir belge içermeli.
Destek yükümlülüğü
Özümsenmemiş çıktılar için bildirinin ikinci adımı, laboratuvarlarını insanların sonuçları anlaması, özümsemesi ve olası uygulamaları belirlemesi için gereken ek matematiksel çalışmayı desteklemeye çağırıyor. Genel ilkeler bunu daha net ifade ediyor: bu destek önemli fon içermeli. Yayımlanan sayfa ayrıca, güçlü modellere erişim hakkında yorum yapan bir bölüm daha bulunduğunu belirtiyor.
Neden önemli
Matematikte doğrulama için deneysel bir geri dönüş yolu yoktur; doğruluk neredeyse tamamen argümanları insanların ele almasına dayanır. Laboratuvarlar kimsenin garanti veremediği büyük hacimde ispat yayımlarsa, disiplin ya maliyetli bir doğrulama iş yükünü üstlenir ya da doğrulanmamış iddiaların dolaşmasına izin verir. Bu bildiri o maliyeti kaynağına geri kaydırıyor: sonuçları üreten laboratuvarlar, bu sonuçları meşrulaştıran insan anlayışını fonlamak zorunda. Açıklama gereklilikleri—özellikle başarısız denemeleri başarılarla birlikte yayımlamak—seçici duyurularla model yeteneği hakkında şişirilmiş izlenimler yaratmayı da zorlaştıracak. Ve kalıcı tanımlayıcılara sahip, laboratuvarlardan bağımsız depolarda ısrar, AI ile üretilmiş ispatları ürün tanıtımları değil akademik kayıtlar olarak ele alıyor; AI tarafından üretilen araştırmayla yüzleşen diğer alanların da sonunda kopyalayabileceği bir çerçeve bu.
- #mathematics
- #research-ethics
- #open-science
- #peer-review
- #ai-labs