OpenAI menerbitkan 722 manuskrip matematik yang dihasilkan oleh model sempadan dalaman yang belum dikeluarkan, meletakkan koleksi penuh dalam repositori GitHub awam di bawah lesen Apache-2.0. Keluaran, yang diumumkan dalam catatan penyelidikan bertajuk "Berkongsi kemajuan AI dalam matematik" pada 6 Oktober 2026, merupakan antara pembuangan tunggal terbesar hasil matematik yang dijana AI setakat ini, dan ia tiba dengan semakan bukti Lean rasmi, ringkasan penaakulan ringkas dan perincian luar biasa tentang jumlah pengiraan setiap hasil yang digunakan.
Pergerakan mendarat di padang yang sudah di tepi. The New York Times melaporkan bahawa pelepasan itu terus merunsingkan komuniti matematik yang telah menghabiskan masa berbulan-bulan bergelut dengan sistem AI menghasilkan hasil penyelidikan yang serius, manakala Scientific American menyifatkan OpenAI sebagai mengeluarkan "ratusan lagi keputusan matematik pada bidang yang sudah dalam kejutan." Untuk pembaca yang menjejaki perkembangan penyelidikan AI terbaharu, keluaran ini ialah kes ujian untuk cara makmal sempadan berkongsi sains yang dijana mesin tanpa mencetuskan pertikaian kredit.
Apa yang Ada di Dalam Repositori
Koleksi disimpan dalam repositori openai/matematik di GitHub. Menurut READMEnya, kandungannya ialah manuskrip matematik dan artifak bukti sokongan yang dihasilkan oleh model OpenAI dalaman, yang dipasang sebagai sebahagian daripada penilaian pembangunan model mengenai masalah penyelidikan terbuka. Katalog semasa mengandungi 722 manuskrip yang disusun ke dalam 372 keluarga, di mana keluarga mengelompokkan kertas berkaitan yang mungkin termasuk hasil utama, hujah pengiring, akibat atau bukti alternatif, setiap satu diklasifikasikan mengikut disiplin matematik.
Direktori pracetakan menyimpan PDF, fail sumber dan arahan petikan dan binaan setiap manuskrip. Perpustakaan Lean mengkatalogkan bukti rasmi bersama kertas yang berkaitan dan konfigurasi pengesahan. Tidak semua manuskrip telah diformalkan: banyak hasil carian membawa pemformalkan yang disertakan dalam Lean, bahasa pengaturcaraan yang digunakan untuk membenarkan komputer menyemak bukti baris demi baris, tetapi README memberi amaran bahawa beberapa keputusan tidak rasmi mungkin mengandungi isu. OpenAI berkata ia akan menyelesaikan masalah sedemikian dengan cepat, dan ia komited untuk mengekalkan sejarah keluaran awam koleksi, merekodkan pembetulan dan semakan sebagai versi baharu sambil mengekalkan versi terdahulu boleh diakses. Setiap direktori manuskrip juga membawa blok BibTeX untuk petikan.
Bagaimana Keputusan Dihasilkan
Sebahagian besar keputusan datang daripada satu prosedur tetap menggunakan model OpenAI dalaman yang belum dikeluarkan. Sepanjang tempoh penilaian, model telah ditimbulkan kira-kira 4,000 masalah. OpenAI melaporkan bahawa purata hasil yang diterbitkan menggunakan kira-kira tiga jam pengiraan pemikiran ChatGPT Pro, tahap ketelusan yang masih jarang berlaku dalam industri. Syarikat itu berkata ia mengembangkan penilaian ini selepas prestasi pada penanda aras matematik sedia ada tepu, dan bahawa beberapa output membina hasil awal yang dihasilkan oleh modelnya sendiri. Memerlukan tahap kepentingan yang sesuai dan mengagregat keluaran mentah ke dalam keluarga dan manuskrip menghasilkan katalog yang diterbitkan.
Dua pengecualian dinamakan berlepas daripada prosedur itu: kerja mewujudkan kawasan bebas sifar untuk fungsi Riemann zeta, dengan penulisan meliputi Re(s) > 11/12 rantau yang disunting manusia untuk kebolehbacaan, dan bukti Hodge Conjecture untuk varieti CM abelian. Kedua-duanya adalah matematik arus perdana yang serius, dan kedua-duanya kini akan menghadapi penelitian masyarakat.
Sepuluh ringkasan ringkas tentang alasan model juga diterbitkan. Ia meliputi hasil termasuk eksponen ketidakrasionalan pi, konjektur Mahler simetri dan am, isomorfisme faktor kumpulan bebas, sempadan kuasipolinomial untuk janjang aritmetik, konjektur keterhinggaan langsung Kaplansky dalam ciri dua, formula Mezard-Parisi untuk gelas spin cair, kemagnetan spontan dalam kuantum-dimensi. sistem Vlasov-Maxwell yang relativistik.
Kumpulan Penasihat Membantu Membentuk Keluaran
OpenAI berkata ia berunding dengan Kumpulan Penasihat bebas mengenai Matematik dan Kecerdasan Buatan di Institut Kajian Lanjutan sambil membangunkan amalan terbaik untuk berkongsi keputusan. Kumpulan itu menerbitkan syor pelepasan bertanggungjawabnya pada 29 September 2026, selepas menerima lebih 600 balasan daripada komuniti matematik. Pengesyoran itu adalah jelas: "kami tidak menyokong amalan ini, dan kami meminta mereka berhenti menguji masalah matematik lanjutan pada model proprietari." Kumpulan itu menggesa makmal untuk mendepositkan keputusan dalam repositori ilmiah yang tiada kawalan makmal AI, untuk menetapkan pengecam yang boleh disebut yang berterusan, untuk mendedahkan nama model, gesaan yang digunakan, dan ringkasan rantaian penaakulan, dan untuk mengelak daripada menganggap keluaran hasil sebagai kenderaan pemasaran.
Keluaran OpenAI jelas merupakan percubaan untuk mematuhi rangka kerja itu dan bukannya menentangnya. Sama ada masyarakat menerimanya adalah persoalan lain. Tinjauan kumpulan penasihat secara khusus bertanya tentang senario di mana makmal mengumumkan kewujudan banyak keputusan tanpa memberikan butiran, dan pengesyoran yang muncul mencerminkan kebimbangan mendalam tentang pengumuman yang mengatasi pengesahan.
Beban Pengesahan Beralih kepada Ahli Matematik
Cabaran praktikal kini dimiliki oleh ahli matematik yang bekerja. Bukti Lean formal boleh disemak secara mekanikal, dan kehadirannya mengurangkan risiko ralat dengan ketara. Tetapi manuskrip tanpa pemformalkan, yang README sendiri membenderakan sebagai berpotensi cacat, memerlukan semakan rakan sebaya tradisional, dan 722 manuskrip jauh melebihi apa yang boleh diserap oleh masyarakat dengan cepat. Terdapat juga persoalan keutamaan dan kredit: ahli matematik yang menghabiskan masa bertahun-tahun bersebelahan dengan masalah ini akan ingin mengetahui dengan tepat apa model itu ditanya, apa yang diberikan, dan sama ada sebarang hasil manusia telah digabungkan. Penerbitan ringkasan gesaan dan statistik pengiraan OpenAI direka untuk menjawab beberapa soalan tersebut terlebih dahulu.
Keluaran itu juga menetapkan templat pesaing boleh ditekan untuk mengikuti. Makmal Anthropic, Google DeepMind dan lain-lain dengan model sempadan yang mampu untuk matematik peringkat penyelidikan kini menghadapi norma de facto, yang dinyatakan oleh kumpulan penasihat, bahawa keputusan yang disembunyikan pada model proprietari harus sama ada dikeluarkan dengan asal penuh atau tidak diusik sama sekali.
Buat masa ini, repositori disiarkan secara langsung, usaha pemformalkan sedang dijalankan dan pembetulan sedang dibuat versi secara terbuka. Sama ada ini menjadi buku main standard untuk matematik yang dijana oleh AI, atau titik kilat lain dalam konflik yang semakin meluas antara makmal dan komuniti penyelidikan yang mereka gunakan, akan bergantung pada bagaimana pemeriksaan beberapa minggu akan datang.
Kekal Mendahului Keluk AI
Sains yang dijana AI sedang beralih daripada siaran akhbar kepada semakan rakan sebaya. Ikuti berita terkini AI di aibuzzwire.news untuk liputan setiap keluaran penyelidikan utama, pelancaran model dan peralihan dasar.
Baca lebih banyak berita AI →