OpenAI, 372 matematik sorununa çözüm yayımladı; bilim insanları şüpheci
Yayınlanmamış bir modelin ürettiği 722 makale GitHub'a yüklendi; bağımsız doğrulama ve veri gizliliği tartışmaları başladı.

ÖNE ÇIKANLAR
- OpenAI 372 problem ailesine ait 722 makaleyi GitHub'da yayımladı
- Sonuçlar yayınlanmamış dahili bir modelden; ortalama 3 saat hesaplama/sorun
- Sadece %22'si (162 makale) Lean ile resmi doğrulamadan geçti
- Navier-Stokes, Riemann ve Hodge gibi Milenyum problemlerinde kısmi ilerleme
- Araştırmacılar veri sızıntısı ve taklit iddialarıyla şüpheci; model/istemler kapalı
OpenAI Salı günü GitHub üzerinden 372 aileye ayrılan 722 matematik makalesini paylaştı. Tüm sonuçlar halka açılmamış dahili bir modelden geliyor ve şirket ortalama her çözüm için üç saatlik hesaplama süresi harcadığını belirtti.
Yayınlananlar arasında Navier-Stokes, Riemann Hipotezi ve Hodge Hipotezi gibi Milenyum Ödül Problemi adayları da var. OpenAI bu sorunlardan hiçbirini tam çözmediğini, ancak ilerleme kaydettiğini itiraf ediyor.
“Model ve istemler yayınlanana kadar tek istemle tek ajan iddiası doğrulanamaz; kanıt istiyoruz.”
Sadece 162 makale (yüzde 22) Lean yazılımıyla bilgisayar kontrolünden geçmiş. MIT'li Andrew Sutherland, model ve istemler (prompt) yayınlanana kadar 'tek istemle tek ajan' iddiasının doğrulanamaz olduğunu vurguladı.
Danışma kurulu (AGMAI) istemlerin de paylaşılmasını önermişti; OpenAI bunu yapmadı. Bu eksiklik, sonuçların tekrarlanabilirliğini sorguluyor.
NYU profesörü Tristan Buckmaster, Codex oturumlarının izinsiz erişildiğini ve Navier-Stokes çözümünün kendi yolunu taklit ettiğini iddia ediyor. TU Dresden'lı Andreas Thom da 27 yıllık bir sorundaki kritik adımın kendi yöntemine benzediğini söylüyor.
Rutgers'lı Alex Kontorovich bir kanıtı 'insan yapsaydı anında Fields Medalı' niteliğinde bulurken, Clay Enstitüsü başkanı Martin Bridson hızı 'etkileyici' buldu. Her iki tarafta da doğrulama olmadan kabul edilemeyeceği vurgusu ortak.
Aşağıda 5 kaynak daha
YORUMLAR (0)
Henüz yorum yok. İlk yazan siz olun.
İLGİLİ HABERLER

OpenAI güvenlik araştırmalarının kovulması güvenlik kültürü tartışmasını alevlendirdi
Üç eski çalışan, işten çıkarma gerekçelerini reddedip şirketin ileri modelleri izleme yeteneğini kaybettiğini ve bağımsız denetimi engellediğini iddia etti.

Microsoft ve Nvidia, RTX Spark çipli Surface Laptop Ultra'yı duyurdu
Yerel AI ajanları için optimize edilen yeni Windows platformu ve donanım ekosistemi 16 Ekim'de piyasaya çıkıyor.

Musk, Ambani'yi 'Başbakan' diye alay ederek Starlink gecikmesini kişileştirdi
Elon Musk, Starlink'in Hindistan'daki lisans beklemesini güvenlik prosedürü yerine Mukesh Ambani'nin baskısıyla açıkladı, hükümet 'ayrımcılık yok' diye cevapladı.
- Sosyal medyaya 15 yaş sınırı: e-Devlet doğrulaması 1 Kasım'ta başlıyor
- AB Ticaret Şefi Şefçoviç, Çin ile Kritik Görüşmeler için Pekin'de
- İller Bankası sermayesi 250 milyar liraya çıkarıldı; enerji projeleri için acele kamulaştırma
- Panama'da 7.7 büyüklüğünde deprem: 27 yaralı, binalar yıkıldı
- Rusya-Ukrayna hava savaşında iki günde 70'den fazla ölü
Bu sayfa, yukarıda adı geçen yayınların haberlerinden yapay zekâ destekli olarak derlendi ve yayın öncesi otomatik dil denetiminden geçti. Montegre'nin muhabiri yoktur; imza satırında haberin derlendiği yayınlar yazar. Yöntem ve yayın ilkeleri