deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak The Verge

OpenAI, 10.000 agentin 90 yıllık Navier-Stokes problemini çözdüğünü iddia ediyor

OpenAI, dahili bir modelin ve eşzamanlı çalışan 10.000 agentin 90 yıldır çözülemeyen Navier-Stokes Milenyum Ödülü problemi için bir çözüm ürettiğini söylerken; matematikçiler eğitim verisi ve atıf konusunda sorular raise ediyor.

OpenAI, 10.000 agentin 90 yıllık Navier-Stokes problemini çözdüğünü iddia ediyor

OpenAI, The Verge'ün haberine göre salı günü, yaklaşık 90 yıldır açık kalan, akan sıvı ve gazların davranışına dair bir soru olan Navier-Stokes problemine bir çözüm bulduğunu duyurdu. Şirket, bunu yeni yayımlanan GPT-6 Astra'dan daha yetenekli olduğunu söylediği dahili bir AI modele ve eşzamanlı çalışan yaklaşık 10.000 agente bağladı.

The Verge, iddianın ilk olarak The New York Times ve Wired tarafından haberleştirildiğini, OpenAI'nin ise ardından bir blog yazısı yayımladığını belirtiyor. Navier-Stokes yedi Milenyum Ödülü Problemi'nden biri ve her biri 1 milyon dolarlık bir ödül taşıyor; OpenAI ödül parasını almayı planlamadığını söylüyor.

On bin agent ve milyonlarca dolar

dev.to'daki bir analizde atıf yapılan Axios haberine göre OpenAI, dahili bir model grubunun daha önce çözümler raporlanmışken 1 Eylül'de bu çalışmaya başladığını ve ortaya çıkan kanıtın üç boyutlu denklemlerde sonlu zamanlı bir tekilliğe işaret ettiğini söyledi. Çalışmanın yaklaşık 88 saat sürdüğü ve milyonlarca dolara malolduğu bildiriliyor. The Verge ayrıca OpenAI'nin dahili modeli 28 Ağustos'ta eğitmeye başladığını ve modelin şirketin kendi benchmark'larında, matematik dahil, öne çıkan sonuçlar verdiğini raporluyor.

Ölçek, dikkat çeken kısım. Tek bir modelin tek bir cevap üretmesi yerine, anlatılan tablo binlerce agentin paralel çalıştığını gösteriyor; bu da problemi bölmeyi, aday argümanlar üretmeyi ve ara adımları çapraz kontrol etmeyi akla getiriyor. Ancak dev.to'nun da işaret ettiği gibi, bu agentlerin nasıl görevlendirildiği, denetlendiği veya değerlendirildiğini açıklayan kamuya açık bir şey henüz yok.

Veri ve atıf üzerinde bir anlaşmazlık

OpenAI'nin duyurusundan bir gün önce, New York Üniversitesi'nden matematik profesörü Tristan Buckmaster, Anthropic'te araştırmacı olan Levent Alpöge ile birlikte ilgili bir sorun üzerine bulgular yayımladı. The Verge'ün aktardığına göre Buckmaster, OpenAI'nin ilerlemelerinden haberdar olduğunu öğrendikten sonra şirketle iletişime geçmiş ve şirketin, kendisinin ve Alpöge'nin üzerinde çalıştığı bir yol izleyerek bir kanıt ürettiğini görmüş; tüm proje taslakları Codex oturumlarında saklanıyormuş.

Buckmaster, modele o oturumlara erişim olup olmadığını veya o oturumlarla eğitilip eğitilmediğini sorduğunu söylüyor. Modelin kullanıcı verisine bakmadığı söylendiğini, ancak eğitim konusunu tekrar sorduğunda cevap alamadığını belirtiyor.

OpenAI, blog yazısını yansıtan The Verge'e yaptığı açıklamada, problemi çözmek için belirli bir kullanıcı verisine erişilmediğini; ancak ürünlerinin kullanımından türetilen kimliği anonimleştirilmiş verilerin modellerini geliştirmeye yardımcı olmuş olabileceğini dışlayamadığını kabul etti. OpenAI'den Sebastien Bubeck, şirketin iki araştırmacının çalışmalarından herhangi birini kamuya açıklamadan önce görmediğini ve kanıtların, kanıtlanan kesin sonuçlar dahil, önemli ölçüde farklı olduğunu ekledi. Buckmaster, Mastodon'dan yaptığı yanıtta açıklamanın, OpenAI'nin kendisinin ve Alpöge'nin sonucunu bulmasından sonraki bir döneme ait eğitim verisi kullandığını itiraf etmek anlamına geldiğini söyledi.

Doğrulanmış olan ve olmayan

Raporlanan bir kanıt, kabul edilmiş bir çözüm değildir. dev.to, iddianın arkasında kamuya açık bir teknik makale, ön baskı ya da bağımsız olarak incelenebilir bir argüman olmadığını ve matematik topluluğunun bunu çözülmüş saymadan önce tam kanıta ve ayrıntılı bir doğrulama sürecine erişmesi gerektiğini vurguluyor. Anlatımlar yayım durumu konusunda da ayrışıyor: The Verge, OpenAI'den salı günü yayımlanan bir blog yazısından bahsederken, aynı günkü dev.to analizi birinci taraf erişilebilir bir teknik yazı bulamadığını, sonucun yalnızca medya haberleri olarak mevcut olduğunu söylüyor.

Neden önemli

Kanıt tutarsa, bu, matematiğin en zor açık sorularından birine AI destekli bir yaklaşımdı ve büyük koordineli agent sistemlerinin tek seferlik cevaplar yerine sürekli muhakeme, yineleme ve doğrulama gerektiren işlerin üstesinden gelebileceğinin kanıtı olurdu. Atıf anlaşmazlığı en az bunun kadar önemli: AI kodlama araçları kullanan araştırmacılar artık taslaklarının bir laboratuvarın kendi modellerini dolaylı olarak keskinleştirip keskinleştiremeyeceğini tartmak zorunda ve OpenAI'nin kendi ifadeleri bu olasılığı açık bırakıyor. Eksiksiz bir kanıt yayımlanıp bağımsız olarak doğrulanana kadar bu, dönüm noktası niteliğinde bir sonuç değil, dönüm noktası niteliğinde bir iddia olarak kalıyor.

  • #openai
  • #mathematics
  • #ai-agents
  • #navier-stokes
  • #research

İlgili yazılar