OpenAI bu hafta GitHub'da 722 matematik makalesi yayımladı. Çalışmalar, şirketin kamuya açmadığı bir iç öncü model tarafından üretildi ve açık ile uzun süredir çözülemeyen problemlere ilişkin sonuçların 372 "ailesi" hâlinde gruplandı. Depo Apache-2.0 lisansıyla kamuya açık ve tamamlanmış metinlerin yanı sıra makineyle denetlenebilen Lean formalizasyonlarını da içeriyor; OpenAI eylül ayındaki tartışmalı Navier–Stokes iddiasında da bu ispat asistanına dayanmıştı.

Manşet ölçekte; hikâye ise doğrulamada. Makalelerin yalnızca küçük bir bölümü Lean ile doğrulanmış ana ispat içeriyor: matematikçiler arasında dolaşan bir sayıma göre 722 makalenin 162'sinde bu var, yaklaşık 560'ında makineyle denetlenmiş temel sonuç bulunmuyor. OpenAI'nin kendi README dosyası, formalize edilmemiş sonuçların "sorunlar içerebileceği" uyarısını yapıyor. Yayında modelin kendisi, ağırlıkları ya da çalışmaları üreten istemler yer almıyor; bu da matematikçileri sonuçları yeniden üretme imkânı olmadan metni elle denetlemeye bırakıyor. New Scientist'in değerlendirmesi sert: OpenAI "722 matematik makalesi boca etti, şimdi ortalığı toplaması gerekiyor".

Haberlerde, Riemann hipotezine yaklaştığı söylenen en az bir sonuç öne çıktı; sektör basınına konuşan bir matematikçi, bunu bir insan üretseydi Fields Madalyası'na değer bulacağını söyledi. Bu iddia da diğerleri gibi doğrulanmış değil. The Wall Street Journal, yayının şirketin eylül ayında duyurduğu ve GPT-6 Astra sistemiyle yaklaşık 17 saatte üretildiğini söylediği Navier–Stokes Milenyum Ödülü çözümünün ardından geldiğini hatırlattı ve yeni materyali potansiyel olarak "matematik tarihinin en önemli anı" diye nitelendiren bir gözlemciye yer verdi.

Bağlam önemli. OpenAI'nin eylül iddiası, matematikçilerin çalışmalarının atıf yapılmadan kullanıldığını öne sürmesiyle kamuya açık bir kredi tartışmasına yol açmıştı — bültenimiz bu tartışmayı o dönemde aktarmıştı. Dışarıdan bir danışma grubu, OpenAI'den makine çıktısını toplu yüklemek yerine makale yayımlamasını istemişti. Lean doğrulaması uygulandığı yerde titiz olsa da yalnızca ispatın doğru olduğunu denetler; teoremin ilginç mi yoksa sonucun yeni mi olduğunu söylemez.

Bundan sonrası yavaş ve insani bir emek: yüzlerce iddiayı okumak, kontrol etmek ve doğrulamak ya da reddetmek — üstelik çoğunun şu anda ekli bilgisayarca denetlenebilir bir ispatı yok. OpenAI yayını, incelenmeye açık bir davet olarak sundu; matematik camiası da tam olarak bunu yapıyor: her seferinde bir makale.