OpenAI a retras trei dintre cele 722 de preprinturi de cercetare pe care le-a publicat pe GitHub pe 6 octombrie, a raportat Retraction Watch pe 8 octombrie, după ce o eroare de semn a invalidat un argument central și, odată cu acesta, două rezultate care au depins de acea construcție. Retragerea a survenit la mai puțin de 24 de ore după lansarea în masă, pe care OpenAI o catalogase drept un efort „de a împinge granița cunoașterii umane și a permite progrese suplimentare în matematică”.

Preprinturile descriu progresele pretinse ale unui model AI intern pe 372 de probleme nerezolvate din geometrie, informatică, algebră și alte domenii. Mișcarea a atras atenția imediată din partea comunităților de cercetare – și, așa cum am descris la începutul acestei săptămâni în raportul nostru privind lansarea inițială a celor 722 de manuscrise matematice, compania a încadrat scăderea ca o demonstrație fără precedent a ceea ce poate produce modelul său de frontieră nelansat. Urmărește cele mai recente despre această poveste în cele mai recente evoluții AI acoperire.

O eroare de semn se scurge prin dovezi dependente

Pe 7 octombrie, OpenAI a anunțat retragerea a trei manuscrise din cauza unei erori de semn. Potrivit anunțului, eroarea a invalidat un argument dintr-un manuscris și construcția folosită de două lucrări dependente. Fiecare hârtie retrasă poartă acum o notificare care explică „decalajul”.

Compania a mai spus că a revizuit alte 14 manuscrise cu reparații de dovezi, declarații corectate, ipoteze și dependențe mai clare și o corecție la o citare învechită. Dan Roberts, un lider de cercetare la OpenAI, a anunțat retragerile pe X și a scris că compania va „continua să actualizeze repo-ul cu noi formalizări și cu orice erare pe care le vom observa”.

Un purtător de cuvânt al OpenAI a declarat pentru Retraction Watch că compania a identificat erorile în timpul unui audit, descriind procesul ca fiind iterativ „ca și în cazul altor manuscrise de cercetare”. Purtătorul de cuvânt a adăugat că OpenAI salută controlul și va „lucra pentru a corecta [erorile] prompt și va retrage documentele dacă nu pot fi găsite remedieri”.

În special, un purtător de cuvânt al OpenAI a spus că colaboratorii companiei de la Grupul consultativ pentru matematică și inteligență artificială (AGMAI) au recomandat publicarea rezultatelor fără a aștepta „formalizarea completă” – și că aproximativ 50% dintre rezultate au fost publicate neconfirmate.

Matematicieni: remedieri rapide, încredere pierdută

Reacțiile matematicienilor de cercetare au fost măsurate, dar subliniate. Alex Townsend, profesor asociat de matematică la Universitatea Cornell, a declarat pentru Retraction Watch că o eroare în cascadă în trei manuscrise nu a fost surprinzătoare și că bănuiește că vor fi găsite mai multe erori. „Având în vedere scepticismul AI în comunitatea de matematică, cred că OpenAI ar fi trebuit să anunțe manuscrisele care au fost verificate Lean mai întâi”, a spus el, referindu-se la limbajul de programare open-source care verifică mecanic dovezile matematice. Un anunț separat ar fi putut apoi invita comunitatea să verifice restul, a argumentat el.

Andrew Sutherland, cercetător senior la departamentul de matematică al MIT, a spus că apreciază că OpenAI acționează rapid după ce a găsit erorile, numind-o „lucru responsabil de făcut”. Dar el a subliniat că mulți matematicieni rămân „nemulțumiți de modul în care OpenAI s-a comportat până în acest moment”, subliniind în special anunțul companiei din 8 septembrie că un sistem AI a rezolvat problema Navier-Stokes – o afirmație pe care un grup de cercetători de frunte a criticat-o ca fiind grăbită, „fără timp pentru o redactare corectă, pentru izolarea ideilor și a altor metode relevante și a altor metode relevante”. Peste 8.000 de cercetători au susținut aceste preocupări.

Asociația pentru Matematica Umană a mers mai departe într-o declarație publicată pe 7 octombrie: "Matematicienii nu au cerut ca această muncă să fie făcută. Eliberarea a peste 700 de fișiere deodată nu este o demonstrație de bursă, ci o demonstrație de putere. Îndemnăm matematicienii să-și întrerupă activitatea cu OpenAI și să revină la o viziune a științei care centrează înțelegerea umană".

Ce înseamnă asta pentru știința generată de AI

Episodul se conturează ca un caz de testare timpuriu pentru modul în care laboratoarele de inteligență artificială ar trebui să gestioneze cercetarea generată de mașini la scară. Abordarea OpenAI – lansare rapidă, auditare în public, retragere a ceea ce eșuează – contrastează cu abordarea de verificare formală pe care o preferă mulți matematicieni, în care rezultatele sunt verificate într-un asistent de dovezi precum Lean înainte de orice anunț.

Există argumente rezonabile de ambele părți. Așteptarea formalizării complete ar putea întârzia rezultatele utile cu luni de zile, iar OpenAI spune că a fost lansat cu binecuvântarea AGMAI. Însă efectul în cascadă – o eroare de semn care elimină două lucrări dependente – ilustrează de ce verificarea înainte de publicare a fost norma în matematică și de ce este probabil să apară mai multe erori pe măsură ce comunitatea lucrează prin restul de aproximativ 700 de manuscrise.

Deocamdată, OpenAI spune că vrea să învețe din feedback și că va urma protocolul AGMAI „cât mai bine putem” în continuare. Dacă acest lucru este suficient pentru a reconstrui credibilitatea în comunitatea matematică este o altă întrebare. După cum a spus Sutherland: „Cred că retragerile și corecțiile vor fi privite pozitiv de comunitatea de matematică, dar va fi nevoie de mult mai mult decât atât pentru a recâștiga încrederea pe care și-au pierdut-o”.

---

Rămâneți înaintea AI

Obțineți cele mai recente știri, analize și descoperiri despre AI - toate într-un singur loc.

Citiți mai multe știri AI →