Masalah sing dibantu Astra wis katon "ora ana kemajuan ing asil utama paling sethithik sepuluh taun, lan umume, luwih suwe," tulis OpenAI. Asil rentang lapangan kalebu geometri dimensi dhuwur, teori coding, kerumitan sirkuit aritmetika, teori grup, kerumitan kuantum, kriptografi kisi, lan kombinatorik ekstrem - wilayah ing ngendi kemajuan biasane diukur ing taun, ora ana riset siji-sijine.
Bukti Diverifikasi, Ora Mung Jawaban
Sing misahake output Astra saka chatbot sing ngira matematika yaiku verifikasi. OpenAI ujar manawa peneliti manungsa nggunakake model sing padha kanggo nyiapake argumen minangka manuskrip, lan Astra banjur resmi saben argumen minangka sertifikat Lean. Lean minangka asisten bukti open-source sing bisa mriksa mesin-mesin argumen matematika, tegese matématikawan liyane ora kudu njupuk asil kanthi iman - bisa diverifikasi sacara mandiri dening piranti lunak sajrone sawetara detik.
Bedane sing penting. Model basa bisa ngasilake bukti sing bisa ditemokake sing ngemot kesalahan sing fatal. Kanthi nerjemahake saben argumen menyang Lean, OpenAI ngowahi pratelan marketing dadi artefak sing bisa dipriksa. Miturut BleepingComputer, sing nglaporake rincian kasebut, kemajuan khusus kalebu bukti sing netepake anane kelompok non-sofic, ngrampungake pitakonan mbukak utama ing teori grup; a disproof saka conjecture rigidity Connes kang; wates anyar kanggo kemasan bal dimensi dhuwur; lan asil ngrampungake sawetara masalah sing asale ditimbulake dening ahli matematika sing produktif Paul Erdős.
OpenAI nyathet yen jumlah total token sing dibutuhake kanggo nemokake solusi kasebut bakal regane kira-kira $2,000 kanthi tarif API saiki - titik data sing nggumunake babagan jejak komputasi panemuan matematika modern, lan sing nyedhiyakake riset tingkat wates ing jangkauan tim akademik sing didanai kanthi apik tinimbang mung laboratorium dhewe.
Matématikawan Reaksi
Thomas Bloom , ahli matematika ing Universitas Manchester sing mbukak situs referensi Erdős-masalah erdosproblems.com, nyebat asil kasebut "kabar gedhe" ing X, miturut The Decoder. Dheweke menehi rating luwih penting tinimbang conto kontra kanggo konjektur jarak unit sing diterbitake ing Mei. "Mungkin ora luwih gedhe tinimbang bukti jarak unit, nanging babagan konstruksi, iki gedhe," tulis Bloom.Bloom uga mbantah babagan framing yen AI ngganti matématikawan, kanthi alesan pratelan kasebut ora ana gunane nalika sistem kasebut nggunakake teori luwih saka abad, dibangun dening para ahli matematika, lan dilatih babagan kabeh sing wis ditulis dening ahli matematika.
Noam Brown, peneliti ing mburi teknologi penalaran wektu tes sing diandalake Astra, luwih diukur. "Sayang, ora ana Masalah Hadiah Milenium (durung)," dheweke ngirim ing X, nuduhake pitung masalah sing misuwur sing ditawakake Institut Matematika Clay $ 1 yuta - mung siji sing wis ditanggulangi wiwit hadiah kasebut diumumake ing taun 2000.Ora saben wong kesengsem. Kritikus AI Gary Marcus nyebat model kasebut "nggumunake - nanging oversold banget" ing kiriman Substack, garis skeptisisme sing akrab nalika lab perbatasan ngaku tonggak sejarah. Ketegangan antarane prestasi teknis asli lan framing promosi bisa uga nemtokake cara ditampa Astra.
Kulawarga Model Anyar kanggo Tugas Panjang
Informasi kasebut kanthi mandiri negesake manawa Astra minangka kulawarga model anyar sing dibangun kanggo beban kerja sing dawa. OpenAI njlèntrèhaké minangka sistem sing ngidini macem-macem agen AI bisa kolaborasi ing macem-macem bagean saka masalah sing luwih gedhe - desain sing ngarahake tugas-tugas sing butuh jam utawa dina tinimbang detik, kayata mbuktekake teorema utawa refactoring basis kode gedhe.
BleepingComputer nglaporake yen OpenAI durung mutusake manawa model kasebut bakal dikirim minangka GPT-5.7, GPT-6, utawa kanthi jeneng liya . CEO Sam Altman wis nampilake Astra ing Washington, D.C., The Decoder lapor, menehi tandha manawa perusahaan kasebut ndeleng sistem kasebut cukup diwasa kanggo dilebokake ing ngarep para pembuat kebijakan.
Rintangan Review Pemerintah
Mbok menawa rincian sing paling penting yaiku peraturan. Miturut The Decoder, Astra bakal dadi salah sawijining model pisanan sing bakal ngliwati proses tinjauan pamrentah AS sing direncanakake sing mbutuhake persetujuan resmi sadurunge rilis umum. Iki nambah lapisan ketidakpastian politik ing garis wektu peluncuran sing durung nate diadhepi dening model unggulan - lan nambah taruhan babagan kepiye OpenAI menehi ciri kemampuan Astra.
Debut uga teka ing tengah-tengah balapan bobot mbukak sing sengit. Dina sadurunge, Thinking Machines Lab ngrilis model bobot mbukak Inkling-Small, lan lab China terus nyurung sistem frontier bobot mbukak. Astra menehi tandha taruhan OpenAI yen proprietary, pertimbangan skala gedhe - diverifikasi dening alat kaya Lean - tetep dadi dalan kanggo terobosan paling gedhe.
Nganti saiki, Astra isih durung dirilis. Nanging debut matematika kasebut wis ngrampungake obrolan babagan apa sistem AI wates sing bisa menehi kontribusi kanggo ilmu murni, lan kepiye masarakat kudu nliti klaim kasebut.
Tetep Ahead saka AI
Pengin ngetutake perkembangan kaya Astra lan balapan model perbatasan sing luwih akeh? Tetenger hub kita kanggo perkembangan AI paling anyar.
Waca liyane AI warta →