OpenAI telah mengeluarkan penemuan mengenai 377 masalah penyelidikan matematik, kata syarikat itu dalam catatan blog bertajuk "Berkongsi kemajuan AI dalam matematik" yang diterbitkan pada hari Selasa, 6 Oktober 2026, dalam penurunan matematik utama kedua dalam beberapa bulan.

Hasilnya merangkumi algebra, sains komputer teori dan logik matematik, dan tiba hanya beberapa minggu selepas OpenAI menuntut penyelesaian kepada persamaan Navier-Stokes, salah satu masalah tidak dapat diselesaikan paling terkenal di dunia dengan hadiah $1 juta dilampirkan. Dakwaan awal itu sudah membahagikan ahli matematik; keluaran minggu ini yang lebih besar telah menajamkan perdebatan. Bagi pembaca yang mengikuti berita terbaharu AI, episod itu telah menjadi ujian paling jelas tentang cara komuniti penyelidikan harus mengendalikan hasil yang dijana oleh mesin yang tidak dapat disahkan dengan mudah oleh manusia.

Apa yang Sebenarnya OpenAI Dikeluarkan

Menurut The Guardian, OpenAI menerbitkan "lebih 370 keputusan matematik merentasi pelbagai topik seperti algebra, sains komputer teori dan logik matematik." The New York Times meletakkan kiraan pada 377 masalah, manakala New Scientist melaporkan bahawa keluaran itu termasuk 722 penemuan matematik sebaik sahaja keputusan tambahan dikira. Kiraan yang berbeza-beza mencerminkan cara yang berbeza untuk mengumpulkan lemma, akibat dan penyelesaian penuh ke dalam "hasil" diskret.

Skala adalah apa yang mengejutkan pemerhati. Apabila tuntutan Navier-Stokes bulan lepas melibatkan satu keputusan yang diteliti dengan teliti, keluaran ini tiba sekali gus — beratus-ratus penemuan merentas berbilang subbidang, yang dihasilkan oleh model dalaman OpenAI yang paling maju. Kisah itu mendapat liputan daripada The Washington Post, The Economist, The Wall Street Journal, dan Fortune dalam masa sehari, dan catatan blog OpenAI mengungguli Berita Hacker dengan lebih seribu undian naik.

Institut Kajian Lanjutan Menolak

Institut Kajian Lanjutan di Princeton, New Jersey - rumah tokoh lama seperti Einstein dan von Neumann - berkata ia tidak menyokong amalan menguji model sempadan terhadap masalah terbuka yang paling sukar di lapangan, terutamanya apabila kerja itu berlaku secara tertutup.

"Kini AI boleh mengeluarkan hujah matematik dalam situasi tanpa manusia yang mendorongnya dapat memahami hujah, mengesahkannya, atau bertanggungjawab ke atasnya," kata organisasi itu dalam satu kenyataan. "Kami percaya bahawa pemahaman manusia tentang matematik kekal penting."

Kebimbangan bukanlah bahawa keputusan semestinya salah. Ia adalah bahawa matematik sebagai disiplin bergantung pada pengesahan, dan banjir dakwaan yang dijana mesin bahawa tiada manusia telah menyemak duduk gelisah dengan norma ilmiah.

Respons OpenAI: Tempat Duduk di Meja

Untuk menangani tindak balas tersebut, OpenAI mengumumkan ia akan bekerjasama dengan Institut Kajian Lanjutan untuk memberi "ahli matematik suara dalam cara kami bergerak ke hadapan." Apa yang syarikat itu tidak komited, The Guardian menyatakan, adalah sebarang perubahan kepada amalan asas: OpenAI tidak memberi petunjuk bahawa ia akan berhenti menguji masalah lanjutan pada model dalaman proprietari.

Lembaga penasihat Institut juga meminta makmal AI untuk memberikan "akses saksama" kepada sistem sempadan mereka. "Penggunaan model dalaman proprietari oleh makmal AI untuk melakukan risiko penyelidikan matematik mewujudkan sistem dua peringkat di mana makmal mengatasi seluruh bidang, dengan berkesan mengasingkan komuniti matematik daripada disiplinnya sendiri," tulis kumpulan itu.

'Ambil Kerja Seseorang dan Bawa Ia Hingga Selesai'

Ahli matematik yang hampir dengan masalah yang terjejas menimbulkan isu yang lebih halus: kredit. Tristan Buckmaster, seorang ahli matematik Universiti New York yang sedang mengusahakan masalah Navier-Stokes, memberitahu The New York Times bahawa penyelidik yang mendorong model AI mungkin membekalkan kemajuan separa model kemudian menyelesaikannya.

"Kemungkinan terdapat banyak hasil di mana mereka mengambil kerja seseorang dan kemudian menyelesaikannya," kata Buckmaster.

Jika tepat, dinamik itu merumitkan kedua-dua atribusi dan penilaian. Hasil yang kelihatan seperti penembusan mesin bebas sebenarnya mungkin merupakan langkah terakhir pada perancah yang dibina oleh manusia - yang tidak pernah dipersetujui oleh manusia untuk diserahkan.

Maksudnya untuk Penyelidikan AI

Keluaran matematik menjadi pameran berulang untuk keupayaan makmal sempadan, dan ujian tekanan berulang untuk cara sains menyerap output mesin. Pembingkaian Wall Street Journal menarik perhatian: AI menyelesaikan satu masalah matematik dan semua orang ketakutan — ia kini telah memecahkan ratusan lagi.

Tiga soalan akan membentuk apa yang berlaku seterusnya. Pertama, pengesahan: ahli matematik bebas memerlukan beberapa bulan untuk menyemak walaupun sebahagian kecil daripada 377 keputusan, dan ralat, jika ditemui, akan mendarat kuat pada kredibiliti OpenAI. Kedua, akses: sama ada makmal membuka model terkuat mereka kepada penyelidik luar, seperti yang diminta oleh Institut, atau memastikan gelung ditutup. Ketiga, keutamaan: seperti yang dicadangkan oleh kebimbangan Buckmaster, bidang itu mungkin memerlukan norma baharu untuk mengkreditkan bukti kolaboratif manusia-AI.

OpenAI tidak menjawab permintaan untuk mengulas mengenai kritikan itu, menurut The Guardian. Sama ada perkongsian dengan Institut Kajian Lanjutan menghasilkan norma yang boleh dilaksanakan — atau sekadar mendokumenkan perselisihan itu — berkemungkinan akan menentukan sama ada matematik kekal sebagai penanda aras utama untuk kemajuan AI sempadan, atau menjadi medan pertama yang menolaknya secara rasmi.

Kekal Mendahului AI Baca lebih banyak berita AI di AI Buzz Wire