Hanya sehari selepas OpenAI membuat model yang paling berkuasa secara amnya, syarikat itu berkata sistem itu telah menghasilkan bukti lengkap tentang Kitaran Double Cover Conjecture - masalah terbuka yang terkenal dalam teori graf yang telah menentang ahli matematik selama kira-kira setengah abad.
Penyelidik OpenAI Ethan Knight mengumumkan keputusannya pada 10 Julai 2026, menyiarkan bahawa GPT-5.6 Sol Ultra "menghasilkan bukti Cycle Double Cover Conjecture berusia 50 tahun menggunakan 64 subagen dalam masa kurang dari satu jam." Tuntutan itu dengan cepat naik ke bahagian atas Berita Hacker, menarik beratus-ratus komen daripada ahli matematik dan jurutera yang membahaskan sama ada bukti itu bertahan.
Bagi sesiapa yang menjejaki perkembangan AI terkini, hasilnya ialah demonstrasi yang menarik tentang ke mana model sempadan menuju — dan peringatan bahawa tuntutan matematik mereka masih perlu disemak dengan cara lama.
Apakah Konjektur Kulit Berganda Kitaran?
Konjektur terletak dalam cabang matematik yang dipanggil teori graf. Secara ringkasnya, ia menanyakan soalan mudah yang mengelirukan: bolehkah tepi mana-mana graf "tanpa jambatan" — satu tanpa tepi yang penyingkirannya akan membelahnya — sentiasa diliputi oleh koleksi kitaran supaya setiap tepi muncul tepat dua kali?
Masalah ini ditimbulkan secara bebas oleh beberapa ahli matematik selama ini, termasuk Paul Seymour pada tahun 1979 dan George Szekeres pada tahun 1973, dengan akar awal dalam karya W. T. Tutte dan oleh Alon Itai dan Michael Rodeh. Walaupun kenyataannya ringkas, ia menjadi salah satu masalah yang tidak dapat diselesaikan yang paling terkenal dalam bidang, dan hasil separa hanya diketahui untuk kelas graf khas.
Menurut nota bukti OpenAI yang diterbitkan, hujah mengurangkan masalah kepada graf padu tanpa gelung, kemudian bersandar pada hasil klasik — teorem aliran nowhere-sifar ke atas kumpulan F32 (bersamaan dengan teorem 8-aliran Tutte) — dan langkah algebra linear utama yang menukar pelabelan tepi ke dalam struktur yang diperlukan untuk penutup berganda kitaran. Tulisan ini hanya beberapa halaman panjang dan, terutamanya, menggunakan "tiada matematik yang dibangunkan dalam tempoh 30 tahun yang lalu," seperti yang diperhatikan oleh seorang pengulas Berita Hacker.
Bagaimana GPT-5.6 Sol Ultra Mendekatinya
Apa yang membezakan hasil ini daripada jawapan chatbot biasa ialah cara model itu digunakan. GPT-5.6 Sol Ultra dijalankan dalam mod "multiagent v2" OpenAI, memutarkan sistem sehingga 64 subagen bekerjasama yang meneroka strategi bukti berbeza secara selari. OpenAI mengeluarkan gesaan penuh bersama bukti, menawarkan pandangan yang jarang berlaku pada arahan yang diberikan kepada sistem.
Gesaan itu mengarahkan model untuk "menggunakan multiagen v2 secara agresif dan dinamik," untuk mengekalkan "portfolio pendekatan yang pelbagai," dan menggunakan ejen lawan untuk mengaudit mana-mana bukti calon untuk perangkap biasa — seperti denai tertutup yang menyamar sebagai kitaran atau alasan pekeliling yang tidak disengajakan. Ia juga memberitahu sistem untuk "menghabiskan sekurang-kurangnya 8 jam untuk ini sebelum berfikir untuk kembali atau menyerah," walaupun larian terakhir dilaporkan selesai dalam masa kurang satu jam.
Dalam bahagian "Pernyataan penggunaan AI" nota bukti, OpenAI adalah eksplisit: "Bukti dalam nota ini sepenuhnya disebabkan oleh GPT 5.6 Sol Ultra dan penulisan dengan Codex (dengan GPT 5.6 Sol)."
Belum Semua Orang Yakin
Komuniti matematik telah bertindak balas dengan gabungan keterujaan dan berhati-hati - dan keraguan itu diletakkan dengan baik. Sehingga penerbitan, bukti belum disahkan secara rasmi dalam pembantu bukti seperti Lean, dan tidak lulus semakan rakan sebaya tradisional.
Pada Berita Hacker, beberapa pengulas menyatakan bahawa bukti ringkas dan elegan dari sangkaan terkenal patut diteliti dengan teliti. "Ia adalah bukti yang sangat singkat yang tidak menggunakan matematik yang dibangunkan dalam tempoh 30 tahun yang lalu," tulis seorang pengguna. "Ini tidak semestinya salah, tetapi jika tiada mekanisasi dalam Lean atau semakan rakan sebaya yang betul, saya fikir adalah terlalu awal untuk menyiarkannya."
Yang lain menegaskan bahawa perpustakaan bukti formal terkemuka teori graf belum cukup matang untuk menyemak keputusan peringkat penyelidikan jenis ini, bermakna pengesahan mungkin perlu datang daripada pakar manusia yang membaca hujah baris demi baris. OpenAI sendiri merangka pengumuman itu sebagai sebahagian daripada corak yang lebih luas: "Lebih banyak pengiraan masa ujian membawa kepada kecerdasan yang lebih besar," kata syarikat itu, memberi isyarat bahawa pendekatan multiagen - bukan hasil tunggal ini - adalah kisah sebenar yang ingin diceritakan.
Mengapa Ia Penting
Walaupun bukti Kulit Berganda Kitaran akhirnya memerlukan pembetulan, episod itu menandakan anjakan bermakna dalam perkara yang boleh dilakukan oleh model bahasa besar dalam matematik tulen. Sistem AI Frontier sebelum ini telah menghasilkan hasil penyelidikan baru dalam domain khusus — termasuk dakwaan baru-baru ini tentang masalah yang diselesaikan dalam geometri dan kombinatorik — tetapi menyerang satu tekaan yang dinamakan, berdekad-dekad lamanya dengan segerombolan ejen penaakulan yang diselaraskan meningkatkan bar dengan ketara.
Bagi penyelidik, pengambilan adalah dua kali ganda. Pertama, resipi multiagen — banyak percubaan bebas, pendebungaan silang idea dan pengauditan lawan — nampaknya merupakan templat yang benar-benar berguna untuk menyelesaikan masalah yang sukar. Kedua, kesesakan pengesahan kini tepat pada manusia: model boleh menjana bukti calon lebih cepat daripada yang boleh disemak oleh komuniti.
Ketegangan itu berkemungkinan menentukan fasa seterusnya bagi matematik berbantukan AI. Seperti yang dikatakan oleh seorang pengulas, jika bukti ini bertahan, "seseorang akan memulakan senarai" masalah lama lain untuk dilemparkan kepada model generasi akan datang.
Buat masa ini, ahli matematik akan membaca nota tiga muka surat dengan teliti — pensel di tangan — manakala industri AI yang lain memerhati sama ada usaha selama sejam GPT-5.6 menjadi sebahagian daripada rekod matematik kekal.
Kekal Mendahului AI
Untuk mendapatkan maklumat lanjut tentang penemuan model sempadan dan liputan penyelidikan AI, lawati halaman utama AI Buzz Wire.
Baca lebih banyak berita AI →



