Model dan platform AI
OpenAI Merilis 722 Manuskrip Matematika Dari Model AI yang Belum Dirilis

Dalam post riset yang dipublikasikan 6 Oktober 2026, OpenAI mengatakan bahwa ia merilis beragam hasil matematika baru yang dihasilkan oleh model frontier internal yang belum dirilis, menerbitkan 722 manuskrip yang diatur dalam 372 keluarga di repositori publik GitHub bersama formalitas bukti Lean dan ringkasan singkat tentang penalaran model.
Di Dalam Repositori GitHub
Hasil-hasil tersebut dipublikasikan di repositori openai/math, dirilis di bawah lisensi Apache-2.0. README-nya menjelaskan isiannya sebagai manuskrip matematika dan artefak bukti pendukung yang dihasilkan oleh model internal OpenAI, disusun sebagai bagian dari evaluasi pengembangan model pada masalah riset terbuka.
Katalog saat ini berisi 722 manuskrip yang diatur dalam 372 keluarga. Sebuah keluarga mengelompokkan makalah terkait, yang dapat mencakup hasil utama, argumen pendamping, konsekuensi, atau bukti alternatif, dan setiap keluarga diklasifikasikan menurut disiplin matematika. Direktori preprint menyimpan PDF, file sumber, serta petunjuk kutipan dan pembangunan khusus manuskrip, sementara perpustakaan Lean dan katalog formalitas menjelaskan bukti formal yang tersedia, makalah terkait, dan konfigurasi verifikasi.
Koleksi ini mencakup berbagai tahap verifikasi. Banyak manuskrip memiliki formalitas pendamping dalam Lean, sebuah bahasa pemrograman yang memungkinkan bukti matematika diperiksa oleh komputer, namun tidak semuanya. README memperingatkan bahwa beberapa hasil yang belum diformalkan mungkin memiliki masalah, dan OpenAI menyatakan akan berusaha memperbaiki masalah tersebut dengan cepat sambil memperbarui repositori dengan lebih banyak formalitas ketika diperoleh. OpenAI juga menyatakan akan mempertahankan riwayat rilis publik koleksi, mencatat perbaikan dan revisi sebagai versi baru sambil menjaga versi yang sebelumnya dirilis tetap dapat diakses, dan setiap direktori manuskrip menyertakan blok BibTeX untuk kutipan.
Bagaimana Hasil-Hasil Itu Diproduksi
Menurut README, mayoritas besar hasil diperoleh dengan prosedur yang sama menggunakan model internal OpenAI yang belum dirilis. Selama evaluasi, model tersebut diberikan sekitar 4.000 masalah, dan OpenAI melaporkan bahwa rata-rata hasil menggunakan komputasi setara dengan kira-kira tiga jam pemikiran ChatGPT Pro. README menyatakan OpenAI memperluas evaluasi ini setelah kinerja pada evaluasi matematika yang ada mencapai jenuh, dan bahwa beberapa output dibangun di atas hasil sebelumnya yang dihasilkan oleh modelnya. Memerlukan tingkat signifikansi yang tepat dan mengagregasikan output ke dalam keluarga hasil dan manuskrip menghasilkan katalog yang dipublikasikan.
Dua pengecualian bernama menyimpang dari prosedur tetap tersebut: pekerjaan pada wilayah bebas nol untuk fungsi zeta Riemann dan bukti Konjektur Hodge untuk varietas abelian CM. Tulisan yang mencakup wilayah bebas nol Re(s) > 11/12 untuk fungsi zeta Riemann diedit secara manusiawi untuk meningkatkan keterbacaan.
Repositori juga menerbitkan 10 ringkasan singkat tentang penalaran model. Ringkasan tersebut mencakup hasil pada korelasi dua‑titik biasa fungsi multiplikatif, eksponen irasionalitas π, konjektur Mahler simetris dan umum, NP‑kesulitan biasa pada ambang semidefinite dasar, batas kuasipolynomial untuk progresi aritmetika, konjektur langsung‑finiteness Kaplansky dalam karakteristik dua, formula Mézard–Parisi untuk spin glass yang diencerkan, magnetisasi spontan dalam feromagnet Heisenberg kuantum, isomorfisme faktor grup bebas, dan sistem Vlasov–Maxwell relativistik tiga dimensi.
OpenAI mengatakan bahwa ia menerbitkan detail tambahan ini, termasuk perkiraan komputasi yang dinyatakan dalam penggunaan ChatGPT Pro dan statistik tentang jumlah masalah yang dicoba, untuk memajukan transparansi dan keterbukaan ilmiah.
Rekomendasi Kelompok Penasihat
OpenAI mengatakan bahwa ia telah berkonsultasi dengan Kelompok Penasihat independen tentang Matematika dan Kecerdasan Buatan di Institute for Advanced Study untuk mengembangkan praktik terbaik dalam berbagi hasil dengan komunitas matematika, dan bahwa ia mengacu pada saran kelompok tersebut serta rekomendasi publik untuk memperkuat rilis ini.
Kelompok penasihat menerbitkan rekomendasi rilis bertanggung jawabnya pada 29 September 2026, setelah menerima lebih dari 600 tanggapan dari komunitas matematika, dan menyatakan bahwa rekomendasi tersebut didukung oleh pluralitas responden yang jelas. Sebuah catatan kaki menyebutkan bahwa survei menanyakan tentang situasi spesifik di mana OpenAI mengumumkan keberadaan banyak hasil tanpa memberikan detail. Dokumen tersebut dibuka dengan mengamati bahwa beberapa laboratorium AI frontier menguji masalah matematika lanjutan pada model proprietari yang tetap tidak dapat diakses oleh komunitas ilmiah yang lebih luas, kemudian menyatakan: “kami tidak mendukung praktik ini, dan kami meminta mereka menghentikan pengujian masalah matematika lanjutan pada model proprietari.”
Rekomendasi tersebut meminta hasil-hasil disimpan di repositori ilmiah yang tidak dikendalikan oleh laboratorium AI mana pun, dengan pengidentifikasi yang dapat dikutip secara permanen dan modifikasi yang tercatat dengan tepat, serta mendesak laboratorium untuk tidak memperlakukan rilis hasil sebagai sarana pemasaran model mereka. Untuk setiap hasil yang dirilis, kelompok tersebut menyatakan laboratorium harus mempublikasikan nama model, prompt yang digunakan, rangkuman rantai pemikiran, waktu yang diperlukan, dan perkiraan biaya komputasi, serta menyatakan bukti harus diformalkan sejauh mungkin. Ketika banyak hasil dirilis sekaligus, rekomendasi meminta dokumen publik tambahan yang merujuk semua hasil tersebut dan menjelaskan berapa banyak masalah lain dengan tingkat kesulitan serupa yang dicoba dan gagal diselesaikan oleh model, serta bagaimana masalah-masalah tersebut dipilih.
Kelompok tersebut selanjutnya merekomendasikan agar laboratorium memberikan dukungan signifikan, termasuk pendanaan, untuk pengembangan pemahaman manusia terhadap output yang dihasilkan AI, dengan menyebut konferensi, sekolah musim panas, lokakarya terarah, kelompok kerja jangka panjang, serta buku atau artikel ekspositori panjang sebagai kegiatan kandidat. Mereka menyatakan keputusan tentang upaya mana yang didukung harus berada di tangan lembaga nirlaba yang sudah ada, bukan diarahkan oleh laboratorium, dan menyarankan memberikan komunitas matematika global akses yang luas dan adil ke model yang tersedia secara publik.
OpenAI mengatakan bahwa mereka terus mengeksplorasi alternatif yang dihosting komunitas untuk rilis ini yang memenuhi pedoman komite, dan bahwa mereka berkomitmen untuk meningkatkan sitasi, eksposisi matematika, dan penyajian hasil dalam rilis mendatang.
Latar Belakang Model Internal dan Langkah Selanjutnya
Frasa “model frontier internal” dalam posting OpenAI mengacu pada pengumuman 8 September 2026 laboratorium bahwa sebuah sistem internal OpenAI telah menghasilkan sebuah bukti, dengan formaliasi Lean, yang menunjukkan bahwa gerakan fluida tiga dimensi yang halus yang diatur oleh persamaan Navier–Stokes dapat menghasilkan singularitas dalam waktu terbatas. OpenAI mengatakan hasil tersebut menyelesaikan sebuah masalah yang dinamai oleh Clay Mathematics Institute sebagai salah satu dari Tujuh Masalah Hadiah Milenium pada tahun 2000, dan bahwa mereka tidak berniat mengklaim Hadiah Milenium untuknya. Dalam posting tersebut, OpenAI menyatakan bahwa model internal yang mereka gunakan secara signifikan lebih mampu daripada GPT-6 Astra, bahwa mereka telah melatih model tersebut sejak 28 Agustus 2026, bahwa mereka meluncurkan upaya evaluasi pada masalah Hadiah Milenium pada 1 September 2026, dan bahwa agen-agen mereka mencapai resolusi pada 5 September 2026.
OpenAI mengatakan bahwa mereka akan mendanai serangkaian lokakarya, konferensi, dan program khusus seputar pemahaman hasil utama yang dihasilkan AI, dan akan membagikan lebih banyak informasi tentang hal ini dalam waktu dekat. Mereka juga menyatakan bahwa mereka sedang bekerja untuk merilis model yang menghasilkan hasil tersebut secara bertanggung jawab, serta akan terus menanggapi masukan dari komunitas dan memperbarui standar mereka untuk pengungkapan masa depan tentang kemajuan ilmiah utama.












