OpenAI a publicat 722 de manuscrise matematice produse de un model de frontieră intern nelansat, plasând întreaga colecție într-un depozit public GitHub sub o licență Apache-2.0. Lansarea, anunțată într-o postare de cercetare intitulată „Partajarea progresului AI în matematică” din 6 octombrie 2026, se numără printre cele mai mari depozite unice de rezultate matematice generate de AI până în prezent și vine cu verificări formale Lean proof, rezumate de raționament prescurtate și detalii neobișnuite despre cât de mult calcul a consumat fiecare rezultat.
Mutarea aterizează într-un câmp deja pe margine. New York Times a raportat că lansarea a tulburat și mai mult o comunitate de matematică care a petrecut luni de zile luptă cu sistemele AI care produc rezultate serioase de cercetare, în timp ce Scientific American a descris OpenAI ca dezlănțuind „încă sute de rezultate matematice într-un domeniu deja în stare de șoc”. Pentru cititorii care urmăresc cele mai recente dezvoltări ale cercetării AI, versiunea este un caz de testare pentru modul în care laboratoarele de frontieră împărtășesc știința generată de mașini fără a declanșa dispute de credit.
Ce este în interiorul depozitului
Colecția se află în depozitul openai/math de pe GitHub. Potrivit README, conținutul este manuscrise matematice și artefacte de dovezi de sprijin produse de un model intern OpenAI, asamblat ca parte a evaluărilor de dezvoltare a modelului pe probleme de cercetare deschise. Catalogul actual conține 722 de manuscrise organizate în 372 de familii, în care o familie grupează lucrări conexe care pot include un rezultat principal, argumente însoțitoare, consecințe sau dovezi alternative, fiecare clasificată pe disciplină matematică.
Un director de pretipărire conține fișiere PDF, fișiere sursă și instrucțiuni de realizare și citare per manuscris. O bibliotecă Lean cataloghează dovezile formale împreună cu lucrările asociate și configurațiile de verificare. Nu fiecare manuscris a fost oficializat: multe rezultate au formalizări însoțitoare în Lean, limbajul de programare folosit pentru a permite computerelor să verifice dovezile rând cu rând, dar README avertizează că unele rezultate neformalizate ar putea conține probleme. OpenAI spune că va rezolva rapid astfel de probleme și se angajează să păstreze istoricul lansărilor publice al colecției, să înregistreze corecțiile și revizuirile ca versiuni noi, păstrând în același timp versiunile anterioare accesibile. Fiecare director de manuscrise poartă, de asemenea, un bloc BibTeX pentru citare.
Cum au fost produse rezultatele
Marea majoritate a rezultatelor au provenit dintr-o singură procedură fixă, folosind un model intern OpenAI nelansat. Pe parcursul evaluării, modelului i s-au pus aproximativ 4.000 de probleme. OpenAI raportează că rezultatul mediu publicat a consumat echivalentul a aproximativ trei ore de calcul de gândire ChatGPT Pro, un nivel de transparență care este încă rar în industrie. Compania spune că a extins aceste evaluări după ce performanța pe criteriile de referință matematice existente s-a saturat și că unele rezultate se bazează pe rezultate anterioare produse de propriile modele. Solicitarea unui nivel adecvat de semnificație și agregarea rezultatelor brute în familii și manuscrise a produs catalogul publicat.
Două excepții numite au plecat de la această procedură: munca de stabilire a unei regiuni fără zero pentru funcția zeta Riemann, cu redacția care acoperă regiunea Re(s) > 11/12 editată de om pentru a fi lizibilă și o dovadă a Conjecturii Hodge pentru soiurile abeliene CM. Ambele sunt matematici serioase, iar ambele se vor confrunta acum cu controlul comunității.
Sunt publicate și zece rezumate prescurtate ale raționamentului modelului. Acestea acoperă rezultate, inclusiv exponentul de iraționalitate al lui pi, conjecturile simetrice și generale Mahler, izomorfismul factorilor de grup liber, limitele cvasipolinomiale pentru progresiile aritmetice, conjectura lui Kaplansky de finalitate directă în caracteristica a doua, formula Mezard-Parisi pentru ochelari de spin diluat, magnetizarea spontană în sistemul cuantic Heisenberg și tridimensional relativx.
Un grup consultativ a contribuit la modelarea lansării
OpenAI spune că a consultat Grupul consultativ independent pentru matematică și inteligență artificială de la Institutul pentru Studii Avansate în timp ce a dezvoltat cele mai bune practici pentru partajarea rezultatelor. Acel grup și-a publicat recomandările de eliberare responsabilă pe 29 septembrie 2026, după ce a primit peste 600 de răspunsuri din partea comunității matematice. Recomandările sunt clare: „nu susținem această practică și le cerem să nu mai testeze probleme matematice avansate pe modele proprietare”. Grupul îndeamnă laboratoarele să depună rezultatele în arhivele academice pe care niciun laborator AI nu le controlează, să atribuie identificatori citabili persistenti, să dezvăluie numele modelului, solicitările utilizate și lanțurile de raționament rezumate și să se abțină de la tratarea lansărilor de rezultate ca vehicule de marketing.
Lansarea OpenAI este, în mod evident, o încercare de a se conforma acestui cadru, mai degrabă decât de a-l sfida. Dacă comunitatea o acceptă este o altă întrebare. Sondajul grupului consultativ a întrebat în mod specific despre un scenariu în care un laborator anunță existența multor rezultate fără a oferi detalii, iar recomandările care au apărut reflectă îngrijorarea profundă cu privire la anunțurile care depășesc verificarea.
Sarcina de verificare se transferă la matematicieni
Provocarea practică aparține acum matematicienilor care lucrează. Probele formale Lean pot fi verificate mecanic, iar prezența lor scade substanțial riscul de eroare. Dar manuscrisele fără formalizări, pe care README însuși le semnalează ca fiind potențial viciate, necesită o evaluare inter pares tradițională, iar 722 de manuscrise este mult peste ceea ce comunitatea poate absorbi rapid. Există, de asemenea, problema priorității și a creditului: matematicienii care au petrecut ani de zile lângă aceste probleme vor dori să știe exact ce model a fost cerut, ce i s-a dat și dacă a fost încorporat vreun rezultat uman. Publicarea de către OpenAI a rezumatelor prompturilor și a statisticilor de calcul este concepută pentru a răspunde la unele dintre aceste întrebări în avans.
Lansarea stabilește, de asemenea, un șablon pe care concurenții trebuie să-l urmeze. Anthropic, Google DeepMind și alte laboratoare cu modele de frontieră capabile de matematică la nivel de cercetare se confruntă acum cu o normă de facto, articulată de grupul consultativ, conform căreia rezultatele ascunse pe modelele proprietare ar trebui fie să fie lansate cu proveniența completă, fie deloc tachinate.
Deocamdată, depozitul este live, efortul de formalizare este în desfășurare, iar corecțiile sunt versionate în mod public. Dacă acesta devine manualul standard pentru matematica generată de AI, sau un alt punct de foc într-un conflict tot mai mare între laboratoare și comunitățile de cercetare din care se bazează, va depinde de modul în care vor decurge următoarele câteva săptămâni de control.
Rămâi înaintea curbei AI
Știința generată de AI trece de la comunicatul de presă la evaluarea inter pares. Urmăriți știrile de ultimă oră AI pe aibuzzwire.news pentru acoperirea fiecărei lansări majore de cercetare, lansare de model și schimbare de politică.
Citiți mai multe știri AI →