OpenAI telah merilis temuan pada 377 masalah penelitian matematika, kata perusahaan itu dalam postingan blog berjudul "Berbagi kemajuan AI dalam matematika" yang diterbitkan pada Selasa, 6 Oktober 2026, yang merupakan penurunan besar kedua dalam bidang matematika dalam beberapa bulan.

Hasilnya mencakup aljabar, ilmu komputer teoritis, dan logika matematika, dan tiba hanya beberapa minggu setelah OpenAI mengklaim solusi persamaan Navier-Stokes, salah satu masalah paling terkenal di dunia yang belum terpecahkan dengan hadiah $1 juta. Klaim sebelumnya telah memecah belah ahli matematika; rilis yang jauh lebih besar pada minggu ini telah mempertajam perdebatan. Bagi pembaca yang mengikuti berita AI terkini, episode ini telah menjadi ujian paling jelas tentang bagaimana komunitas riset harus menangani hasil yang dihasilkan mesin yang tidak dapat diverifikasi dengan mudah oleh manusia.

Apa yang Sebenarnya OpenAI Dirilis

Menurut The Guardian, OpenAI menerbitkan "lebih dari 370 hasil matematika dalam berbagai topik seperti aljabar, ilmu komputer teoretis, dan logika matematika." The New York Times menghitung 377 soal, sementara New Scientist melaporkan bahwa rilis tersebut mencakup 722 penemuan matematika setelah hasil tambahan dihitung. Penghitungan yang bervariasi mencerminkan cara yang berbeda dalam mengelompokkan lemma, akibat wajar, dan solusi lengkap ke dalam "hasil" yang berbeda.

Skala inilah yang membuat para pengamat tercengang. Jika klaim Navier-Stokes bulan lalu melibatkan satu hasil yang diteliti dengan cermat, rilis ini menghasilkan semuanya sekaligus — ratusan temuan di berbagai subbidang, dihasilkan oleh model internal OpenAI yang paling canggih. Kisah ini mendapat liputan dari The Washington Post, The Economist, The Wall Street Journal, dan Fortune dalam satu hari, dan postingan blog OpenAI menduduki puncak Hacker News dengan lebih dari seribu suara positif.

Institute for Advanced Study Menolak

Institute for Advanced Study di Princeton, New Jersey – yang merupakan rumah lama bagi tokoh-tokoh seperti Einstein dan von Neumann – mengatakan pihaknya tidak mendukung praktik pengujian model frontier terhadap permasalahan terbuka yang paling sulit, terutama ketika pekerjaan dilakukan secara tertutup.

“Saat ini AI dapat mengeluarkan argumen matematis dalam situasi tanpa manusia yang mendorongnya untuk dapat memahami argumen tersebut, memverifikasinya, atau mengambil tanggung jawab atas argumen tersebut,” kata organisasi tersebut dalam sebuah pernyataan. “Kami percaya bahwa pemahaman manusia terhadap matematika tetap menjadi hal yang sangat penting.”

Kekhawatirannya bukanlah bahwa hasilnya selalu salah. Hal ini disebabkan karena matematika sebagai suatu disiplin ilmu bergantung pada verifikasi, dan banyaknya klaim yang dihasilkan mesin yang belum pernah diperiksa oleh manusia tidak sesuai dengan norma-norma ilmiah.

Tanggapan OpenAI: Kursi di Meja

Untuk mengatasi dampak buruk ini, OpenAI mengumumkan akan bekerja sama dengan Institute for Advanced Study untuk memberikan "suara para ahli matematika tentang bagaimana kita bergerak maju." Apa yang tidak dilakukan perusahaan, menurut The Guardian, adalah perubahan apa pun pada praktik yang mendasarinya: OpenAI tidak memberikan indikasi akan berhenti menguji masalah tingkat lanjut pada model internal berpemilik.

Dewan penasihat Institut juga meminta laboratorium AI untuk memberikan “akses yang adil” ke sistem terdepan mereka. “Penggunaan model internal yang dipatenkan oleh laboratorium AI untuk melakukan penelitian matematika berisiko menciptakan sistem dua tingkat yang membuat laboratorium lebih unggul dari bidang lainnya, sehingga secara efektif mengasingkan komunitas matematika dari disiplin ilmunya sendiri,” tulis kelompok tersebut.

'Ambil Pekerjaan Seseorang dan Selesaikan'

Matematikawan yang dekat dengan masalah yang terkena dampak ini mengangkat masalah yang lebih halus: kredit. Tristan Buckmaster, ahli matematika Universitas New York yang mengerjakan masalah Navier-Stokes, mengatakan kepada The New York Times bahwa para peneliti yang mendorong model AI mungkin memberikan sebagian kemajuan yang kemudian diselesaikan oleh model tersebut.

“Kemungkinan akan ada banyak hasil ketika mereka mengambil pekerjaan seseorang dan kemudian menyelesaikannya,” kata Buckmaster.

Jika akurat, dinamika tersebut memperumit atribusi dan evaluasi. Hasil yang tampak seperti terobosan mesin independen sebenarnya merupakan langkah terakhir dalam perancah buatan manusia – sesuatu yang tidak pernah disetujui oleh manusia untuk diserahkan.

Apa Artinya Bagi Penelitian AI

Rilisan matematika ini menjadi ajang pameran berulang untuk kemampuan laboratorium terdepan, dan ujian berulang mengenai bagaimana ilmu pengetahuan menyerap keluaran mesin. Pembingkaian The Wall Street Journal menangkap pukulan telak tersebut: AI memecahkan satu soal matematika dan semua orang ketakutan — AI kini telah memecahkan ratusan soal matematika lainnya.

Tiga pertanyaan akan menentukan apa yang terjadi selanjutnya. Pertama, verifikasi: ahli matematika independen memerlukan waktu berbulan-bulan untuk memeriksa bahkan sebagian kecil dari 377 hasil, dan kesalahan, jika ditemukan, akan berdampak buruk pada kredibilitas OpenAI. Kedua, akses: apakah laboratorium membuka model terkuatnya kepada peneliti luar, sesuai tuntutan Institut, atau tetap menutupnya. Ketiga, prioritas: seperti yang ditunjukkan oleh kekhawatiran Buckmaster, bidang ini mungkin memerlukan norma-norma baru untuk menghargai bukti kolaboratif manusia-AI.

OpenAI tidak menanggapi permintaan komentar atas kritik tersebut, menurut The Guardian. Apakah kemitraan dengan Institute for Advanced Study menghasilkan norma-norma yang bisa diterapkan – atau sekadar mendokumentasikan ketidaksepakatan – kemungkinan besar akan menentukan apakah matematika tetap menjadi tolok ukur utama kemajuan AI, atau menjadi bidang pertama yang secara resmi menentangnya.

Tetap Terdepan dalam AI Baca berita AI selengkapnya di AI Buzz Wire