deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak The Verge

OpenAI yaklaşık 400 yapay zeka üretimi matematik sonucunu yayınladı ve araştırmacılara yıllarca sürecek doğrulama işi bıraktı

OpenAI, 700'den fazla el yazması arasında yayımladığı yaklaşık 400 yapay zeka üretimi matematiksel sonuçla araştırmacıları şaşırttı; uzandılar, bu çalışmaları tam olarak sindirip doğrulamanın yıllar alabileceğini söylüyor.

OpenAI yaklaşık 400 yapay zeka üretimi matematik sonucunu yayınladı ve araştırmacılara yıllarca sürecek doğrulama işi bıraktı

OpenAI, 700'den fazla el yazmasına yayılmış yaklaşık 400 yapay zeka üretimi matematiksel sonucu yayınladı; araştırmacılar The Verge'e, bu şelaleyi düzgünce anlayıp doğrulamanın yıllar alabileceğini söyledi. Çalışmalar kombinatorik ve sayılar teorisinden topolojiye ve matematiksel fiziğe uzanan alanları kapsıyor ve koleksiyon o kadar geniş ki OpenAI, ilişkili GitHub deposunda gezinmek için kendi rehberini yayınladı.

Okunamayacak kadar büyük bir yayım

Üç düzineden fazla matematikçiyle konuşan The Verge'e göre tepkiler "etkileyici" ve "benzeri görülmemiş"ten "tamamen çılgınca"ya kadar uzanıyordu — hayranlık, bu selin alan için ne anlama geldiğine dair derin bir kaygıyla karışmıştı. Birkaç araştırmacı, yaklaşık 40 sayfalık içindekiler tablosu ve özetleri baştan sona geçmenin bir saatin büyük bölümünü aldığını söyledi. "Özetlerin tamamına göz atmak bile bunaltıcı," dedi Connecticut Üniversitesi'nden Álvaro Lozano-Robledo.

El yazmaları kombinatorik, geometrinin birkaç dalı, sayılar teorisi, teorik bilgisayar bilimi, cebir, topoloji, olasılık, istatistiksel mekanik ve matematiksel fiziği kapsıyor. Bir matematikçi The Verge'e yaptığı benzetmede, yapay zekalar yarın Dünya'yı terk eden uzaylılar gibi kaybolursa, alanın onları geride bıraktıklarını incelemekle gelecek on yılını geçireceğini söyledi.

Biçimsel doğrulama geride kalıyor

Koleksiyonun içine dağılmış durumda, sonuçların hesaplamalı olarak doğrulanmasını sağlayan ve araştırmacıların OpenAI'nin önceki matematiksel iddialarını değerlendirmesine yardımcı olan proof assistant Lean'de biçimlendirmeler var. Ancak kapsam eksiksiz değil. OpenAI, GitHub'da el yazmalarının doğrulamanın farklı aşamalarında olduğunu kabul etti ve 719 el yazması arasından yalnızca 300 üst düzey sonucun — kabaca yüzde 42'sinin — biçimlendirildiğini, zamanla daha fazlasının ekleneceğini söyledi.

Matematikçiler The Verge'e bu açığı şikayet ederek, Lean kodunun mevcut olduğu yerlerde bile biçimlendirmenin gerçekten belirtilen iddiayı kanıtladığını teyit etmenin kendi başına yavaş bir iş olduğunu belirtti. Makaleleri inceleyen birkaç kişi, biçimlendirmelerin kalitesinin tutarsız olduğunu ve doğrulanmış ifadelerin her zaman eşlik eden el yazmalarındaki iddialarla düzgün örtüşmediğini söyledi.

Londra Imperial College'dan cebirsel sayılar teorisinde çalışan Kevin Buzzard, alanında yalnızca yaklaşık altı teoremin hemen göze çarptığını gördüğünü ve bunlardan az bir kısmının biçimsel olarak doğrulanmış göründüğünü söyledi. Muhtemelen hatalı materyal okumak, başkalarının okumasını beklemek ya da biçimlendirmeyi beklemek arasında seçim yapmak zorunda kalan Buzzard, sonuçların doğru olup olmadığını henzen söyleyemeyeceğini belirtti.

Slopocalypse korkuları, kısmen yatıştı

Yayım öncesinde araştırmacılar beklenen sele "slopocalypse" adını vermeye başlamıştı; bu, özensun sunum ve zayıf ya da var olmayan atıflar nedeniyle eleştirilen OpenAI'nin önceki matematiksel yazılarına bir göndermeydi. The Verge, ilk izlenimlerin bu partiye daha fazla özen gösterildiğine işaret ettiğini raporluyor, ancak matematikçiler önceki yayımların çıtasının düşük olduğunu itiraf etti.

Daha iyi, yeterli demek değil. Brown Üniversitesi'nden Brendan Hassett, en iyi bildiği problemin yazımının hızlı bir okumanın ardından pek anlam ifade etmediğini, bir insan yazsaydı ona daha fazla zaman harcamayacağını — ardından yüzlerce başka ön baskı daha olduğunu not ederek — söyledi. The Verge, yorumunun OpenAI'nin üç makaleyi geri çekmesinden önce geldiğini belirtiyor.

Diğer araştırmacılar, düzgün bir incelemeden önce bunu alenen söylemekten çekinmekle birlikte, bazı makalelerin diğerlerinin çoktan işlediği zemini kapsadığına işaret etti. Bazıları, normalde yüzlerce sayfada geliştirilen sonuçların birkaç düzine ya da daha az sayfaya sıkıştırıldığı olağandışı kısalığı dile getirdi. Sydney Üniversitesi'nden Nalini Joshi, incelediği bazı makalelerin kısa kaynakçalara sahip olduğunu ve OpenAI'nin atıf uygulamalarına yönelik geçmiş eleştiriler göz önüne alındığında, atfın eksiksiz hikayeyi yansıtmıyor olabileceğinden endişeli olduğunu söyledi.

Altında etkileyici bir çalışma

Sunum sorunlarına rağmen The Verge, yayımın çok yüksek kalitede, gerçekten etkileyici matematik içerdiğine dair genel bir uzlaşı olduğunu raporluyor. Gerilim çarpıcı: Alanın inceleme kapasitesini bunaltan aynı hacim, araştırmacıların ciddi olarak nitelendirdiği sonuçlar da üretiyor. Bir araştırmacı, durumun akademik kültürde büyük bir çöküşe yol açabileceği ve matematik bölümlerini içten içe boşaltabileceği uyarısında bulundu ve yapay zeka laboratuvarlarını toplumsal sonuçları görmezden gelmekle suçladı.

Neden önemli

Bu yayım, yapay zeka sistemlerinin artık hiçbir insan ekibin eşleşemeyeceği bir hız ve genişlikte — hatta OpenAI'nin kendi iç inceleme kapasitesinin bile ötesinde — sınırları zorlayan matematik üretebildiğini gösteriyor. Bu, doğrulama yükünü sınırlı inceleme bant genişliğine sahip bir topluluğa aktarıyor ve atıf, katkı ve akran değerlendirmesi normlarını zorluyor. Birçok araştırmacı, OpenAI'nin alanın yetişmesini beklemeden daha fazlasını yayınlamaya devam edeceğinden korkuyor. Bu hız devam ederse, matematiğin yeni iş akışlarına ihtiyacı olabilir — önceliklendirilmiş biçimlendirme, dağıtılmış inceleme ve makine üretimi kanıtları atfetme kuralları gibi. Alanın nasıl uyum sağlayacağı, büyük olasılıkla yapay zeka üretimi araştırma seliyle karşı karşıya gelen diğer alanlar için bir şablon haline gelecek.

  • #openai
  • #mathematics
  • #formal-verification
  • #lean
  • #ai-research

İlgili yazılar