OpenAI heeft bevindingen vrijgegeven over 377 wiskundige onderzoeksproblemen, aldus het bedrijf in een blogpost met de titel "Het delen van AI-vooruitgang in de wiskunde", gepubliceerd op dinsdag 6 oktober 2026, in de tweede grote wiskundedaling in evenveel maanden.

De resultaten omvatten algebra, theoretische informatica en wiskundige logica, en komen slechts enkele weken nadat OpenAI een oplossing claimde voor de Navier-Stokes-vergelijkingen, een van 's werelds beroemdste onopgeloste problemen waaraan een prijs van $ 1 miljoen was verbonden. Die eerdere bewering verdeelde wiskundigen al; de veel grotere release van deze week heeft het debat aangescherpt. Voor lezers die breaking AI news volgen, is deze aflevering de duidelijkste test tot nu toe geworden van hoe de onderzoeksgemeenschap moet omgaan met door machines gegenereerde resultaten die mensen niet gemakkelijk kunnen verifiëren.

Wat OpenAI daadwerkelijk heeft uitgebracht

Volgens The Guardian publiceerde OpenAI "meer dan 370 wiskundige resultaten over een verscheidenheid aan onderwerpen, zoals algebra, theoretische informatica en wiskundige logica." De New York Times schatte de teller op 377 problemen, terwijl New Scientist meldde dat de publicatie 722 wiskundige ontdekkingen omvatte nadat de aanvullende resultaten waren opgeteld. De variërende aantallen weerspiegelen verschillende manieren om lemma's, uitvloeisels en volledige oplossingen te groeperen in afzonderlijke 'resultaten'.

Het is de schaal die waarnemers verbijsterde. Waar de Navier-Stokes-claim van vorige maand slechts één nauwkeurig onderzocht resultaat betrof, kwam deze publicatie in één keer binnen: honderden bevindingen verspreid over meerdere subvelden, gegenereerd door de meest geavanceerde interne modellen van OpenAI. Het verhaal kreeg binnen een dag aandacht van The Washington Post, The Economist, The Wall Street Journal en Fortune, en de OpenAI-blogpost stond bovenaan Hacker News met ruim duizend stemmen.

Het Institute for Advanced Study duwt terug

Het Institute for Advanced Study in Princeton, New Jersey – de thuisbasis van figuren als Einstein en von Neumann – zei dat het de praktijk van het testen van grensmodellen aan de moeilijkste open problemen in het veld niet onderschrijft, vooral niet als het werk achter gesloten deuren gebeurt.

"Het is nu zo dat AI wiskundige argumenten kan produceren in situaties zonder dat de mens die daartoe aanleiding heeft gegeven, de argumenten kan begrijpen, verifiëren of er de verantwoordelijkheid voor kan nemen", aldus de organisatie in een verklaring. "Wij geloven dat het menselijk begrip van wiskunde van het allergrootste belang blijft."

De zorg is niet dat de resultaten noodzakelijkerwijs verkeerd zijn. Het is dat de wiskunde als discipline afhankelijk is van verificatie, en dat een stortvloed aan door machines gegenereerde beweringen die geen mens heeft gecontroleerd, ongemakkelijk aansluit bij wetenschappelijke normen.

Reactie van OpenAI: een plaats aan tafel

Om de reactie aan te pakken, kondigde OpenAI aan dat het zal samenwerken met het Institute for Advanced Study om “wiskundigen een stem te geven in de manier waarop we verder gaan.” Waar het bedrijf zich niet toe heeft verbonden, merkte The Guardian op, is elke verandering in de onderliggende praktijk: OpenAI gaf geen enkele indicatie dat het zal stoppen met het testen van geavanceerde problemen op eigen interne modellen.

De adviesraad van het Instituut vroeg AI-laboratoria ook om “billijke toegang” tot hun grenssystemen te verlenen. “Het gebruik van bedrijfseigen interne modellen door AI-laboratoria om wiskundig onderzoek te doen, riskeert een tweeledig systeem te creëren waarin laboratoria de rest van het veld overtreffen, waardoor de wiskundige gemeenschap effectief wordt vervreemd van haar eigen discipline”, schrijft de groep.

'Neem iemands werk en voltooi het'

Wiskundigen die dicht bij de getroffen problemen staan, brengen een subtieler probleem aan de orde: krediet. Tristan Buckmaster, een wiskundige van de New York University die aan het Navier-Stokes-probleem werkte, vertelde The New York Times dat onderzoekers die AI-modellen aandragen mogelijk een gedeeltelijke vooruitgang opleveren die de modellen vervolgens voltooien.

"Er zullen waarschijnlijk een heleboel resultaten zijn waarbij ze iemands werk nemen en het vervolgens voltooien", zei Buckmaster.

Indien accuraat, bemoeilijkt deze dynamiek zowel de attributie als de evaluatie. Een resultaat dat lijkt op een onafhankelijke machinedoorbraak zou in feite de laatste stap kunnen zijn op een door mensen gebouwd schavot – een schavot dat de mens nooit heeft willen overdragen.

Wat het betekent voor AI-onderzoek

De wiskunde-releases worden een terugkerend voorbeeld van de mogelijkheden van grenslaboratoria, en een terugkerende stresstest voor de manier waarop de wetenschap machine-output absorbeert. De formulering van de Wall Street Journal vatte de whiplash samen: AI loste één wiskundig probleem op en iedereen raakte in paniek – het heeft er nu nog honderden opgelost.

Drie vragen zullen bepalen wat er daarna gebeurt. Ten eerste verificatie: onafhankelijke wiskundigen zullen maanden nodig hebben om zelfs maar een fractie van 377 resultaten te controleren, en als er fouten worden gevonden, zal dit de geloofwaardigheid van OpenAI hard aantasten. Ten tweede, toegang: of laboratoria hun sterkste modellen openstellen voor externe onderzoekers, zoals het Instituut eist, of de cirkel gesloten houden. Ten derde: prioriteit: zoals de bezorgdheid van Buckmaster suggereert, heeft het veld mogelijk nieuwe normen nodig voor het erkennen van samenwerkingsbewijzen tussen mens en AI.

OpenAI heeft volgens The Guardian niet gereageerd op verzoeken om commentaar op de kritiek. Of de samenwerking met het Institute for Advanced Study werkbare normen oplevert – of slechts het meningsverschil documenteert – zal waarschijnlijk bepalen of wiskunde de leidende maatstaf blijft voor grensverleggende AI-vooruitgang, of het eerste vakgebied wordt dat er formeel tegenin gaat.

Blijf AI een stap voor Lees meer AI-nieuws over AI Buzz Wire