OpenAI telah menarik balik tirai pada Astra, sistem yang belum dikeluarkan yang dipanggil "model utama kami yang seterusnya," selepas versi dalaman menghasilkan sepuluh kemajuan ketara dalam matematik dan sains komputer teori. Syarikat itu menyelitkan pengumuman itu di dalam catatan penyelidikan yang mendokumentasikan keputusan matematik, mendorong kedua-dua keterujaan dan penelitian daripada penyelidik yang mengikuti berita terbaharu AI dengan teliti.

Masalah yang dipecahkan oleh Astra telah melihat "tiada kemajuan pada keputusan pusat mereka selama sekurang-kurangnya satu dekad, dan dalam kebanyakan kes, lebih lama lagi," tulis OpenAI. Hasilnya merangkumi bidang termasuk geometri dimensi tinggi, teori pengekodan, kerumitan litar aritmetik, teori kumpulan, kerumitan kuantum, kriptografi kekisi dan kombinatorik ekstrem — wilayah di mana kemajuan biasanya diukur dalam tahun, bukan penyelidikan tunggal dijalankan.

Bukti Disahkan, Bukan Sekadar Jawapan

Apa yang membezakan output Astra daripada chatbot yang meneka matematik ialah pengesahan. OpenAI berkata penyelidik manusia menggunakan model yang sama untuk menyediakan hujah sebagai manuskrip, dan Astra kemudiannya memformalkan setiap hujah sebagai sijil Lean. Lean ialah pembantu bukti sumber terbuka yang boleh menyemak mesin hujah matematik, bermakna ahli matematik lain tidak perlu mengambil keputusan berdasarkan kepercayaan — mereka boleh disahkan secara bebas oleh perisian dalam beberapa saat.

Perbezaan itu penting. Model bahasa boleh menghasilkan bukti yang kelihatan munasabah yang mengandungi ralat yang halus dan boleh membawa maut. Dengan menterjemah setiap hujah ke dalam Lean, OpenAI menukar tuntutan pemasaran kepada artifak yang boleh disemak. Menurut BleepingComputer, yang melaporkan butirannya, kemajuan khusus termasuk bukti yang membuktikan kewujudan kumpulan bukan sofik, menyelesaikan soalan terbuka utama dalam teori kumpulan; menyangkal sangkaan ketegaran Connes; sempadan baharu untuk pembungkusan sfera berdimensi tinggi; dan keputusan menyelesaikan beberapa masalah yang pada asalnya ditimbulkan oleh ahli matematik prolifik Paul Erdős.

OpenAI menyatakan bahawa jumlah bilangan token yang diperlukan untuk mencari penyelesaian ini akan menelan kos kira-kira $2,000 pada kadar API semasa - titik data yang menarik tentang jejak pengiraan penemuan matematik moden, dan satu yang meletakkan penyelidikan peringkat sempadan dalam jangkauan pasukan akademik yang dibiayai dengan baik dan bukannya makmal itu sendiri.

Ahli Matematik Bertindak balas

Thomas Bloom, seorang ahli matematik di Universiti Manchester yang mengendalikan tapak rujukan masalah Erdős erdosproblems.com, menggelar keputusan itu sebagai "berita besar" pada X, menurut The Decoder. Dia menilai mereka lebih penting daripada contoh balas kepada jangkaan jarak unit yang diterbitkan pada bulan Mei. "Mungkin tidak lebih besar daripada bukti jarak unit, tetapi dari segi pembinaan, ini besar," tulis Bloom.

Bloom juga menolak pembingkaian bahawa AI menggantikan ahli matematik, dengan alasan dakwaan itu tidak masuk akal apabila sistem itu menggunakan lebih daripada satu abad teori, dibina oleh ahli matematik, dan dilatih mengenai semua yang pernah ditulis oleh ahli matematik.

Noam Brown, seorang penyelidik di sebalik teknologi penaakulan masa ujian yang Astra bergantung pada, lebih diukur. "Malangnya, tiada Masalah Hadiah Milenium (belum)," dia menyiarkan di X, merujuk kepada tujuh masalah terkenal yang mana Institut Matematik Tanah Liat menawarkan $1 juta setiap satu - hanya satu yang telah diselesaikan sejak hadiah diumumkan pada tahun 2000.

Tidak semua orang kagum. Pengkritik AI Gary Marcus menggelar model itu "hebat — tetapi terlampau terjual" dalam siaran Substack, garis keraguan yang biasa apabila makmal sempadan mendakwa satu kejayaan. Ketegangan antara pencapaian teknikal tulen dan pembingkaian promosi mungkin menentukan cara Astra diterima.

Keluarga Model Baharu untuk Tugas Panjang

Maklumat secara bebas mengesahkan bahawa Astra ialah keluarga model baharu yang dibina untuk beban kerja yang berpanjangan. OpenAI menyifatkannya sebagai sistem yang membolehkan berbilang ejen AI bekerjasama pada bahagian yang berbeza dalam masalah yang lebih besar — ​​reka bentuk yang ditujukan tepat pada tugas yang mengambil masa berjam atau hari berbanding saat, seperti membuktikan teorem atau memfaktorkan semula pangkalan kod yang besar.

BleepingComputer melaporkan bahawa OpenAI belum memutuskan sama ada model itu akan dihantar sebagai GPT-5.7, GPT-6, atau di bawah nama lain. Ketua Pegawai Eksekutif Sam Altman telah pun mempamerkan Astra di Washington, D.C., The Decoder melaporkan, menandakan bahawa syarikat itu melihat sistem itu cukup matang untuk diletakkan di hadapan pembuat dasar.

Halangan Kajian Kerajaan

Mungkin perincian yang paling penting adalah peraturan. Menurut The Decoder, Astra akan menjadi antara model pertama yang melalui proses semakan kerajaan A.S. yang dirancang yang memerlukan kelulusan rasmi sebelum dikeluarkan kepada umum. Itu menambahkan lapisan ketidakpastian politik pada garis masa pelancaran yang tidak pernah dihadapi oleh model perdana sebelum ini — dan meningkatkan kepentingan tentang cara OpenAI mencirikan keupayaan Astra.

Debut juga tiba di tengah-tengah perlumbaan berat terbuka yang sengit. Beberapa hari sebelumnya, Thinking Machines Lab mengeluarkan model berat terbuka Inkling-Small, dan makmal China terus mendorong sistem sempadan terbuka. Astra memberi isyarat kepada pertaruhan OpenAI bahawa proprietari, penaakulan berskala besar — ​​disahkan oleh alatan seperti Lean — kekal sebagai laluan kepada kejayaan terbesar.

Buat masa ini, Astra masih belum dikeluarkan. Tetapi debut matematiknya telah merangka semula perbualan tentang apa sistem AI sempadan boleh menyumbang kepada sains tulen, dan sejauh mana orang ramai harus meneliti dakwaan yang mengiringi mereka.

Kekal Mendahului AI

Ingin mengikuti perkembangan seperti Astra dan perlumbaan model sempadan yang lebih luas? Tandai halaman hab kami untuk perkembangan AI terkini.

Baca lebih banyak berita AI →