Trusence Her iddianın bir kaynağı var
Son güncelleme: 10 Ekim 2026 Ara English
← Tüm haberler
Araştırma

OpenAI’nin AI üretimi matematik sonuçları, alanın beklediği düzeye ulaşmadı

OpenAI’nin yayımladığı geniş sonuç paketi matematikçileri ikna etmedi; gerekçe, doğrulama ve biçimlendirme sürecinin hâlâ ağır kalması.

OpenAI, yapay zekâ ile üretilmiş yaklaşık 400 matematik sonucunu yayımladı ve bu sonuçlar 700’den fazla makale arasında dağıtıldı. Şirket ayrıca 719 makale içinden 300 üst seviye sonucun Lean içinde biçimlendirildiğini, bunun da yaklaşık yüzde 42 ettiğini söyledi.

Matematikçiler ise bu paketin alanın güven duyabileceği ya da üzerine inşa edebileceği düzeyde olmadığını söylüyor. Bunun nedeni, birçok iddianın hâlâ insan incelemesi gerektirmesi ve biçimsel ispatların eşlik eden yazılarla her zaman temiz biçimde örtüşmemesi. Tepkinin bir kısmı süreç odaklı: AGMAI grubu, frontier laboratuvarlardan ileri matematik testlerini proprietary modeller üzerinde yapmamalarını ve doğal dil ile formal çıktılar arasında machine-readable bağlantılar kurmalarını istemişti; OpenAI bu konuda burada tam uyum sağlamadı.

Neden önemli

Matematik alanı için asıl mesele, tek tek sonuçların varlığı değil, bunların ne kadar hızlı doğrulanabildiği ve başkalarının bunlara güvenip güvenemeyeceği. 300 sonucun formalize edilmiş olması, geriye kalan büyük kısmın hâlâ ciddi insan emeği istediği anlamına geliyor. Bu yüzden yayın, yeni matematik üretimi ile güvenilir, yeniden kullanılabilir matematik arasındaki farkı keskinleştiriyor.

Kaynaklar

  • TechCrunch
  • The Verge