OpenAI stáhlo tři ze 722 výzkumných předtisků, které zveřejnilo na GitHubu 6. října, Retraction Watch informovalo 8. října poté, co chyba v znaménku zneplatnila hlavní argument a spolu s ním dva výsledky, které na této konstrukci závisely. Stažení přišlo necelých 24 hodin po hromadném vydání, které OpenAI účtovalo jako snahu „posunout hranici lidského poznání a umožnit další pokrok v matematice“.
Předtisky popisovaly údajný pokrok interního modelu umělé inteligence na 372 nevyřešených problémech napříč geometrií, informatikou, algebrou a dalšími obory. Tento krok vyvolal okamžitou kontrolu ze strany výzkumných komunit – a jak jsme se zabývali začátkem tohoto týdne v naší zprávě o [počátečním vydání 722 matematických rukopisů] (https://aibuzzwire.news), společnost tento pokles zarámovala jako bezprecedentní ukázku toho, co může její nevydaný hraniční model vytvořit. Sledujte nejnovější informace o tomto příběhu v našem nejnovějším vývoji AI.
Chyba znaménka prochází závislými důkazy
7. října OpenAI oznámila stažení tří rukopisů kvůli chybě ve znaku. Podle oznámení chyba znehodnotila argument v jednom rukopise a konstrukci použitou dvěma závislými články. Každý stažený papír nyní nese upozornění vysvětlující „mezera“.
Společnost také uvedla, že revidovala 14 dalších rukopisů s opravami důkazů, opravenými prohlášeními, jasnějšími hypotézami a závislostmi a jednou opravou zastaralé citace. Dan Roberts, vedoucí výzkumu v OpenAI, oznámil stažení na X a napsal, že společnost bude "pokračovat v aktualizaci repo s novými formalizacemi a se všemi chybami, kterých si všimneme."
Mluvčí OpenAI řekl Retraction Watch, že společnost identifikovala chyby během auditu a popsala proces jako iterativní „jako u jiných výzkumných rukopisů“. Mluvčí dodal, že OpenAI vítá kontrolu a „bude pracovat na okamžité opravě [chyb] a stažení dokumentů, pokud nebudou nalezeny žádné opravy.
Mluvčí OpenAI zejména uvedl, že spolupracovníci společnosti v Poradní skupině pro matematiku a umělou inteligenci (AGMAI) doporučili zveřejnit výsledky bez čekání na „úplnou formalizaci“ – a že zhruba 50 % výsledků bylo zveřejněno nepotvrzených.
Matematici: Rychlé opravy, ztracená důvěra
Reakce výzkumných matematiků byly změřeny, ale ukázaly se. Alex Townsend, docent matematiky na Cornell University, řekl Retraction Watch, že chyba kaskádovitá do tří rukopisů není překvapivá a že má podezření, že bude nalezeno více chyb. "Vzhledem ke skepsi AI v matematické komunitě si myslím, že OpenAI měla nejprve oznámit rukopisy, které byly ověřeny Lean," řekl s odkazem na programovací jazyk s otevřeným zdrojovým kódem, který mechanicky kontroluje matematické důkazy. Samostatné oznámení pak mohlo pozvat komunitu, aby pomohla ověřit zbytek, tvrdil.
Andrew Sutherland, vedoucí výzkumný pracovník na matematickém oddělení MIT, řekl, že oceňuje rychlé jednání OpenAI po nalezení chyb a nazval to „odpovědnou věcí“. Zdůraznil však, že mnoho matematiků zůstává „nespokojených s tím, jak se OpenAI chovala až do tohoto bodu“, a poukázal zejména na oznámení společnosti z 8. září, že systém umělé inteligence vyřešil problém Navier-Stokes – tvrzení, které skupina předních výzkumníků kritizovala jako unáhlené, „nezbývající čas na řádné sepsání, izolaci nových metod a nápadů ostatních a citování relevantních informací“. Tyto obavy podpořilo více než 8 000 výzkumníků.
Asociace pro lidskou matematiku zašla ještě dále v prohlášení vydaném 7. října: "Matematici nežádali, aby byla tato práce vykonána. Uvolnění více než 700 souborů najednou není demonstrací učenosti, ale demonstrací síly. Vyzýváme matematiky, aby přestali pracovat s OpenAI a vrátili se k vizi vědy, která je středem lidského porozumění."
Co to znamená pro vědu generovanou umělou inteligencí
Epizoda se formuje jako raný testovací případ toho, jak by laboratoře AI měly zvládnout strojově generovaný výzkum ve velkém. Přístup OpenAI – rychlé zveřejnění, audit na veřejnosti, stažení toho, co selhalo – je v kontrastu s přístupem, který mnozí matematici preferují nejprve formální ověření, ve kterém jsou výsledky před jakýmkoli oznámením kontrolovány v asistentovi důkazů, jako je Lean.
Na obou stranách jsou rozumné argumenty. Čekání na úplnou formalizaci by mohlo zpozdit užitečné výsledky o měsíce a OpenAI říká, že to vyšlo s požehnáním AGMAI. Ale kaskádový efekt – jedna znaménková chyba, která odstraní dva závislé články – ilustruje, proč bylo ověřování před zveřejněním v matematice normou a proč se pravděpodobně objeví další chyby, když komunita pracuje na zbývajících zhruba 700 rukopisech.
OpenAI zatím říká, že se chce poučit ze zpětné vazby a bude se dále řídit protokolem AGMAI „jak nejlépe umíme“. Zda to stačí k obnovení důvěryhodnosti u matematické komunity, je jiná otázka. Jak řekl Sutherland: "Myslím, že matematická komunita bude na výběry a opravy nahlížet pozitivně, ale bude to trvat mnohem víc, než si získat zpět důvěru, kterou ztratili."
---
Stay Ahead of AIZískejte nejnovější zprávy, analýzy a průlomové informace o umělé inteligenci – vše na jednom místě.
Přečtěte si další zprávy o AI →
