OpenAI menerbitkan 722 manuskrip matematika yang dihasilkan oleh model perbatasan internal yang belum dirilis, menempatkan koleksi lengkapnya di repositori GitHub publik di bawah lisensi Apache-2.0. Rilis tersebut, yang diumumkan dalam postingan penelitian bertajuk "Berbagi kemajuan AI dalam matematika" pada tanggal 6 Oktober 2026, merupakan salah satu kumpulan terbesar hasil matematika yang dihasilkan AI hingga saat ini, dan disertai dengan pemeriksaan bukti Lean formal, ringkasan penalaran yang diringkas, dan detail yang tidak biasa tentang berapa banyak komputasi yang dikonsumsi setiap hasil.
Pergerakannya mendarat di lapangan yang sudah berada di tepinya. The New York Times melaporkan bahwa rilis tersebut semakin mengguncang komunitas matematika yang telah menghabiskan waktu berbulan-bulan bergulat dengan sistem AI untuk menghasilkan hasil penelitian yang serius, sementara Scientific American menggambarkan OpenAI sebagai mengeluarkan "ratusan hasil matematika lagi pada bidang yang sudah terguncang." Bagi pembaca yang memantau perkembangan penelitian AI terbaru, rilis ini merupakan uji coba bagaimana laboratorium terdepan membagikan ilmu pengetahuan yang dihasilkan mesin tanpa memicu sengketa kredit.
Apa yang Ada di Dalam Repositori
Koleksinya ada di repositori openai/math di GitHub. Menurut README-nya, isinya adalah manuskrip matematika dan artefak bukti pendukung yang dihasilkan oleh model OpenAI internal, yang disusun sebagai bagian dari evaluasi pengembangan model pada masalah penelitian terbuka. Katalog saat ini berisi 722 manuskrip yang disusun dalam 372 keluarga, di mana sebuah keluarga mengelompokkan makalah terkait yang mungkin mencakup hasil utama, argumen pendamping, konsekuensi, atau bukti alternatif, masing-masing diklasifikasikan berdasarkan disiplin matematika.
Direktori pracetak menyimpan PDF, file sumber, dan kutipan per manuskrip serta instruksi pembuatan. Perpustakaan Lean mengkatalogkan bukti formal beserta makalah terkait dan konfigurasi verifikasi. Tidak semua naskah telah diformalkan: banyak hasil disertai formalisasi dalam Lean, bahasa pemrograman yang digunakan agar komputer memeriksa bukti baris demi baris, namun README memperingatkan bahwa beberapa hasil yang tidak diformalkan dapat mengandung masalah. OpenAI mengatakan akan memperbaiki masalah tersebut dengan cepat, dan berkomitmen untuk melestarikan riwayat rilis publik koleksi tersebut, mencatat koreksi dan revisi sebagai versi baru sambil tetap menjaga agar versi sebelumnya dapat diakses. Setiap direktori naskah juga membawa blok BibTeX untuk kutipan.
Bagaimana Hasil Diproduksi
Sebagian besar hasil berasal dari prosedur tunggal yang tetap menggunakan model OpenAI internal yang belum dirilis. Selama evaluasi, model tersebut mengajukan sekitar 4.000 masalah. OpenAI melaporkan bahwa rata-rata hasil yang dipublikasikan menghabiskan waktu sekitar tiga jam komputasi pemikiran ChatGPT Pro, tingkat transparansi yang masih jarang terjadi di industri. Perusahaan mengatakan mereka memperluas evaluasi ini setelah kinerja pada tolok ukur matematis yang ada sudah jenuh, dan bahwa beberapa keluaran dibangun berdasarkan hasil sebelumnya yang dihasilkan oleh model mereka sendiri. Membutuhkan tingkat signifikansi yang sesuai dan menggabungkan keluaran mentah ke dalam kelompok dan manuskrip menghasilkan katalog yang diterbitkan.
Dua pengecualian yang disebutkan berangkat dari prosedur itu: pekerjaan membangun wilayah bebas nol untuk fungsi Riemann zeta, dengan penulisan mencakup wilayah Re(s) > 11/12 yang diedit manusia agar mudah dibaca, dan bukti Dugaan Hodge untuk varietas abelian CM. Keduanya merupakan matematika arus utama yang serius, dan keduanya kini akan menghadapi pengawasan komunitas.
Sepuluh ringkasan alasan model juga diterbitkan. Mereka mencakup hasil termasuk eksponen irasionalitas pi, dugaan Mahler yang simetris dan umum, isomorfisme faktor kelompok bebas, batas kuasipolinomial untuk perkembangan aritmatika, dugaan keterbatasan langsung Kaplansky dalam karakteristik dua, rumus Mezard-Parisi untuk gelas spin encer, magnetisasi spontan dalam feromagnet kuantum Heisenberg, dan sistem Vlasov-Maxwell relativistik tiga dimensi.
Sebuah Kelompok Penasihat Membantu Membentuk Pelepasan
OpenAI mengatakan pihaknya berkonsultasi dengan Kelompok Penasihat independen untuk Matematika dan Kecerdasan Buatan di Institute for Advanced Study sambil mengembangkan praktik terbaik untuk berbagi hasil. Kelompok tersebut menerbitkan rekomendasi rilis bertanggung jawab pada tanggal 29 September 2026, setelah menerima lebih dari 600 balasan dari komunitas matematika. Rekomendasinya sangat jelas: "kami tidak mendukung praktik ini, dan kami meminta mereka untuk berhenti menguji masalah matematika tingkat lanjut pada model berpemilik." Kelompok ini mendesak laboratorium untuk menyimpan hasil dalam repositori ilmiah yang tidak dikontrol oleh laboratorium AI, untuk menetapkan pengidentifikasi yang dapat dikutip secara persisten, untuk mengungkapkan nama model, petunjuk yang digunakan, dan merangkum rantai pemikiran, dan untuk tidak memperlakukan rilis hasil sebagai sarana pemasaran.
Peluncuran OpenAI jelas merupakan upaya untuk mematuhi kerangka kerja tersebut, bukan menentangnya. Apakah masyarakat menerimanya adalah pertanyaan lain. Survei kelompok penasihat secara khusus menanyakan tentang skenario di mana laboratorium mengumumkan adanya banyak hasil tanpa memberikan rincian, dan rekomendasi yang muncul mencerminkan kekhawatiran mendalam tentang pengumuman yang melampaui verifikasi.
Beban Verifikasi Beralih ke Matematikawan
Tantangan praktis kini menjadi milik para ahli matematika yang bekerja. Bukti Lean formal dapat diperiksa secara mekanis, dan kehadirannya menurunkan risiko kesalahan secara signifikan. Namun manuskrip tanpa formalisasi, yang oleh README sendiri ditandai sebagai berpotensi cacat, memerlukan tinjauan sejawat tradisional, dan 722 manuskrip jauh melampaui apa yang dapat diserap dengan cepat oleh komunitas. Ada juga pertanyaan tentang prioritas dan penghargaan: matematikawan yang menghabiskan waktu bertahun-tahun untuk menangani masalah-masalah ini ingin mengetahui secara pasti model apa yang ditanyakan, apa yang diberikan, dan apakah ada hasil manusia yang dimasukkan. Publikasi ringkasan perintah dan statistik komputasi OpenAI dirancang untuk menjawab beberapa pertanyaan tersebut sebelumnya.
Rilis ini juga menetapkan templat yang mungkin harus diikuti oleh pesaing. Anthropic, Google DeepMind, dan laboratorium lain dengan model terdepan yang mampu melakukan matematika tingkat penelitian kini menghadapi norma de facto, yang diartikulasikan oleh kelompok penasihat, bahwa hasil yang disembunyikan pada model berpemilik harus dirilis dengan sumber penuh atau tidak diungkap sama sekali.
Untuk saat ini, repositori tersebut sudah aktif, upaya formalisasi sedang berlangsung, dan koreksi sedang dilakukan untuk publik. Apakah hal ini akan menjadi pedoman standar untuk matematika yang dihasilkan oleh AI, atau titik konflik lainnya dalam konflik yang semakin meluas antara laboratorium dan komunitas penelitian yang mereka gunakan, akan bergantung pada bagaimana pengawasan yang dilakukan dalam beberapa minggu ke depan.
Tetap Terdepan dalam Kurva AI
Ilmu pengetahuan yang dihasilkan AI beralih dari siaran pers ke tinjauan sejawat. Ikuti berita AI terkini di aibuzzwire.news untuk liputan setiap rilis penelitian besar, peluncuran model, dan perubahan kebijakan.
Baca berita AI selengkapnya →