OpenAI claimt bewijs voor Navier-Stokes, ruzie over eer
OpenAI zegt dat een zwerm van ongeveer 10.000 AI-agents in 88 uur een bewijs heeft geproduceerd voor het Navier-Stokes-probleem, een van de zeven Millennium Prize Problems van het Clay Mathematics Institute waar een miljoen dollar op staat. CNBC meldde de claim woensdag. Binnen een dag ging het gesprek niet meer over de wiskunde, maar over wie het eerst was.
Wat het bewijs beweert
De vergelijkingen van Navier-Stokes beschrijven hoe vloeistoffen en gassen stromen. De open vraag sinds de jaren dertig is of oplossingen altijd netjes blijven, of dat ze kunnen ontsporen. Het door OpenAI gepresenteerde bewijs kiest de tweede kant: een wervel kan in eindige tijd een oneindige snelheid bereiken terwijl de totale energie eindig blijft. Dat heet blow-up, en het zou betekenen dat de standaardmodellen op zeker moment stukgaan.
Voorlopig is het een preprint, geen erkend resultaat. Het Clay Institute hanteert een wachttijd van twee jaar en publicatie in een peer-reviewed tijdschrift voordat een prijs wordt toegekend. De vorige keer dat een AI-systeem dicht bij dit terrein kwam, ging het om een bewijs rond de Euler-vergelijkingen dat in Lean werd gecontroleerd. Zo’n formele verificatie ontbreekt hier nog.

De ruzie over de eer
NYU-wiskundige Tristan Buckmaster en Anthropic-onderzoeker Levent Alpoge werkten aan een nauw verwant resultaat en gebruikten daarbij zelf AI-tools. Buckmaster schreef op Mastodon dat OpenAI-onderzoeker Sebastien Bubeck van hun ongepubliceerde werk wist en druk uitoefende rond de volgorde van publiceren. Hij vraagt zich hardop af of materiaal dat via OpenAI-producten werd ingevoerd invloed kan hebben gehad op het model. Fortune tekende beide kanten op.
OpenAI, Bubeck en Sam Altman ontkennen dat. Bubeck plaatste berichten waaruit volgens hem blijkt dat hij het team van Buckmaster juist aanbood als eerste te publiceren. OpenAI stelt dat de onderzoekers en de agents geen enkel deel van dat werk hebben gezien en dat er geen specifieke gebruikersdata is geraadpleegd, met de kanttekening dat het bedrijf niet kan uitsluiten dat geanonimiseerde data uit productgebruik de modellen heeft helpen verbeteren. Die laatste zin is precies waar het ongemak zit.
Waarom 10.000 agents
De schaal is het opvallendste deel van het verhaal. Waar eerdere wiskundige claims uit een enkel model kwamen, zoals toen Claude een ondergrens rond de Riemann-zeta-functie aanscherpte, gaat het nu om een gecoordineerd systeem dat 88 uur lang deelproblemen verdeelt en resultaten samenvoegt. Dat past bij de richting die OpenAI al langer inslaat met beheerde agentsystemen.
Tegelijk zijn de cijfers van OpenAI eerder onderwerp van discussie geweest. Het bedrijf paste na de lancering van Astra benchmarkscores aan, en bij een eerdere claim bleef peer review lang uit.
Wat betekent dit
Als het bewijs standhoudt, is dit het eerste Millennium-probleem waar een AI-systeem het zware werk deed. Dat is groot nieuws voor de wiskunde en voor iedereen die vloeistofstromingen modelleert, van weersvoorspelling tot vliegtuigontwerp. Maar het oordeel ligt bij menselijke referenten, en die hebben maanden nodig. Belangrijker voor de korte termijn is het tweede deel van deze week: er is nu een concrete casus waarin onderzoekers zich afvragen of hun invoer in een commerciele AI-dienst bij een concurrent terechtkomt. Universiteiten en labs die met AI-tools werken zullen dat meewegen bij de vraag welk model ze op ongepubliceerd werk loslaten.
