OpenAI kondigde dinsdag aan dat het een van de legendarische Millenniumprijs-problemen van de wiskunde heeft opgelost, wat een triomfantelijk moment had moeten zijn. Het resultaat is zowel een onmiskenbare prestatie als een treffende demonstratie van hoe snel AI de wiskunde transformeert. Maar nog voordat het officieel werd aangekondigd, was de doorbraak al gecompliceerd door de ongebruikelijke omstandigheden die OpenAI ertoe brachten het probleem aan te pakken: nadat het had gehoord dat andere onderzoekers vorderingen maakten, schijnt het zijn aanzienlijke middelen in een last-minute inspanning te hebben gegooid om hen voor te zijn. De daaropvolgende controverse heeft beschuldigingen aan het licht gebracht van scooping, spionage en flagrante schendingen van langdurige academische normen waarvan onderzoekers vrezen dat ze een afschrikwekkend effect op het vakgebied kunnen hebben.

Zoals Abhishek Saha, hoogleraar wiskunde aan Queen Mary University of London, het uitlegt, heeft OpenAI zich beziggehouden met "het soort dingen dat wiskundigen over het algemeen niet doen".

In een dinsdag gepubliceerde blogpost zei OpenAI dat het een van zijn niet-uitgebrachte modellen slechts 88 uur kostte om een oplossing te vinden voor het Navier-Stokes-probleem, een weerbarstige kwestie betreffende de beweging van vloeistoffen. Vanwege de beschikbare premie van $1 miljoen voor wie het oplost, is het probleem een van de meest onderzochte in de wiskunde, maar toch heeft het menselijke onderzoekers al bijna 90 jaar verbijsterd. OpenAI zei dat zijn model het probleem oploste door een zwerm van ongeveer 10.000 AI-agenten, aangedreven door zijn interne model, op de taak te richten en prees de prestatie als een "mijlpaal".

Maar de timing van de aankondiging heeft wenkbrauwen doen fronsen. Slechts één dag eerder publiceerde Tristan Buckmaster, hoogleraar wiskunde aan New York University, bevindingen over een gerelateerd probleem met Levent Alpöge, een onderzoeker bij OpenAI's aartsrivaal Anthropic (hoewel Alpöge hier niet namens zijn werkgever werkte). Buckmaster zei dat hij contact opnam met OpenAI nadat hij vernam dat het bedrijf op de hoogte was van hun vorderingen, om te vragen wanneer het aan het probleem begon te werken en met welke data zijn model was getraind. Het gesprek, zei hij, werd al snel zuur, waarbij een OpenAI-onderzoeker hem vroeg: "Waarom zou je je carrière verpesten?" toen hij zei dat hij naar buiten zou treden met wat er was gebeurd. Toen hij vroeg waarom naar buiten treden zijn carrière zou verpesten, zei Buckmaster het volgende antwoord te hebben gekregen: "Als je niet wilt dat ik aardig ben, dan hoef ik niet aardig te zijn." OpenAI drong er bij Buckmaster op aan om in plaats daarvan het werk te publiceren en OpenAI's interne model te crediteren, en Alpöge als coauteur te laten vallen.

Buckmaster zei dat hij OpenAI vroeg of het toegang had gehad tot zijn sessies op Codex, die hij had gebruikt bij het aanpakken van het probleem, maar dat OpenAI steeds ontwijkender, zelfs vijandig, werd in zijn reacties. In verklaringen sindsdien, waaronder de blogpost waarin het resultaat werd aangekondigd, heeft OpenAI categorisch ontkend specifieke gebruikersgegevens te hebben gebruikt. "Wij (de onderzoekers en de agenten) hebben geen van hun werk via welke weg dan ook gezien totdat zij het publiekelijk vrijgaven - in het bijzonder is er geen specifieke gebruikersdata geraadpleegd om dit probleem op te lossen," zei het bedrijf.

Maar OpenAI kon een indirecte invloed niet definitief uitsluiten. "Hoewel onwaarschijnlijk, kunnen we niet uitsluiten dat geanonimiseerde data afgeleid van hun gebruik van onze producten heeft geholpen onze modellen te verbeteren," zei het, terwijl het benadrukte dat de twee bewijzen aanzienlijk verschillen. Opmerkingen van OpenAI-onderzoekers op X echoën die ontkenningen.

Het is moeilijk te zeggen wat er precies is gebeurd. Tijdlijnen zijn verward, onderzoek overlapt, en de herkomst van AI-gegenereerd werk is moeilijk, zo niet onmogelijk, vast te stellen in de beste tijden. En het is nauwelijks verrassend dat verschillende spelers zouden wedijveren om een van de beroemdste wiskundeproblemen ter wereld op te lossen, vooral een met een flinke prijs.

Maar aspecten van OpenAI's verslag zijn moeilijk te verklaren. Volgens het bedrijf zelf was de inspanning een haastige en ongelooflijk dure aangelegenheid, die miljoenen dollars kostte. Toch zegt het bedrijf niet van plan te zijn de premie op te eisen, die sowieso nog moet worden toegekend.