🗞️ Het belangrijkste nieuws
OpenAI claimt een wiskundeprobleem van een miljoen dollar te hebben gekraakt, en wordt beschuldigd van diefstal
Dinsdag meldde OpenAI dat een intern model, "aanzienlijk krachtiger dan GPT-6 Astra", een van de zeven Millennium Prize-problemen heeft opgelost: de wiskundepuzzels waar een miljoen dollar aan prijzengeld op staat. Tienduizend AI-agents, 88 uur rekenen, en naar verluidt zo'n 22,5 miljoen dollar aan rekenkracht. Een dag eerder had een wiskundige van New York University al verklaard dat OpenAI van zijn aanpak wist en hem waarschuwde voor zijn carrière als hij dat naar buiten bracht. OpenAI ontkent; op X klinkt het woord diefstal. Drie vragen die niemand nog kan beantwoorden: wat is er precies opgelost, hoe kwam OpenAI aan zijn aanpak, en klopt die wel? Wij zetten ze op een rij.

Geen stoffig probleem
De Navier-Stokes-vergelijkingen beschrijven hoe vloeistoffen en gassen bewegen. Weersverwachtingen, vliegtuigontwerp en de berekening van bloedstroom door een ader leunen erop. En toch is er al negentig jaar één vraag open. Blijven die vergelijkingen in drie dimensies altijd netjes werken, of loopt de wiskunde op een gegeven moment vast omdat de snelheid ergens naar oneindig schiet? Niemand die het weet.
In de natuur kan dat niet. Als het in de wiskunde wél kan, klopt het model dat de hele stromingsleer draagt ergens niet. Van de zeven Millennium-problemen op de lijst van Clay Mathematics Institute was er tot deze week één opgelost, in 2003.
Daarom is dit groot nieuws. Wie een van deze problemen kraakt, doet geen kunstje op een examen. Als AI dit echt kan, haalt het de maatstaf die wij hier vaker noemen: zelf nieuwe wetenschappelijke ontdekkingen doen.
Wat OpenAI zegt
Het verhaal begint volgens OpenAI zelf met een gerucht. Op 1 september hoorde het bedrijf dat twee Millennium-problemen zouden zijn opgelost. Het zette een nieuw intern model, in training sinds 28 augustus, op alle open problemen tegelijk. Agents werkten in groepen, kregen verschillende varianten van elk probleem, en werden tussendoor gevoed met elkaars inzichten. Op zaterdag 5 september had de groep van tienduizend agents een bewijs: een vloeistof die in rust begint, met een zacht duwtje van buiten, bereikt in eindige tijd oneindige snelheid. Onthoud dat duwtje; daar draait vraag 1 om. Astra controleerde het bewijs daarna in 17 uur in Lean, software die elke logische stap nakijkt. OpenAI publiceerde het bewijs en zegt de prijs niet te claimen.
Onderweg gebeurde nog iets. Honderd agents losten in vijftig uur een ‘makkelijker’ probleem op, de Euler-vergelijking zonder wrijving en zonder externe kracht. Als die claim klopt, is dat los van de rest van dit verhaal al een doorbraak.
Wat de wiskundigen zeggen die eraan werkten
Een dag eerder, om twee voor twaalf 's nachts, had Tristan Buckmaster van New York University een verklaring online gezet. Hij en Levent Alpöge, wiskundige in dienst van Anthropic maar hier actief op persoonlijke titel, werkten een jaar aan dezelfde route: de "geforceerde" versie van het probleem (die met het duwtje), een aanpak bedacht door de Spanjaarden Diego Córdoba en Luis Martínez-Zoroa die volgens Buckmaster vrijwel niemand anders volgde. Op 15 augustus kraakten ze met veel hulp van taalmodellen de Euler-vergelijking, de versie zonder wrijving, mét dat duwtje. Ze wilden er weken voor uittrekken om het bewijs leesbaar te maken.
Toen ging het snel. Op 3 september hoorde Alpöge dat informatie over hun werk bij OpenAI was beland. Buckmaster mailde een wiskundige bij OpenAI, zonder te zeggen aan welk probleem ze werkten. Op zondag 6 september zat hij twee keer aan de telefoon met Sébastien Bubeck, hoofd van OpenAI's wiskundeteam. Daar hoorde hij dat een intern model de geforceerde Navier-Stokes had opgelost, langs precies zijn route. "Toen ik 'geforceerd' hoorde, gingen bij mij de alarmbellen af," schrijft hij.
Buckmaster kreeg twee voorstellen. Of OpenAI publiceerde een dag na hen, of hij publiceerde zelf en claimde de prijs – maar dan met de vermelding dat OpenAI's model het ook had opgelost, en zonder Alpöges naam. Hij weigerde. Waarop hij naar eigen zeggen te horen kreeg: waarom zou je je carrière verpesten?
Zijn belangrijkste vraag bleef onbeantwoord. Het hele project had een jaar lang in Codex gestaan, OpenAI's programmeertool, betaald uit eigen onderzoeksbudget. Was het model daarop getraind?
Wat OpenAI antwoordt
OpenAI ontkent dat "specifieke gebruikersdata is geraadpleegd". Onderzoekers noch agents zagen het werk van de twee voordat het openbaar was. Bubeck zei op een persbriefing dat het Euler-resultaat via een heel andere weg is gevonden, en ontkent dat hij vroeg Alpöge te schrappen. Sam Altman schreef dat Bubeck "met integriteit en gulheid" handelde en dat OpenAI werd bedreigd met "ongegronde beschuldigingen van plagiaat".
Maar in dezelfde verklaring staat de zin waar alles om draait: OpenAI "kan niet uitsluiten dat geanonimiseerde data uit hun gebruik van onze producten onze modellen heeft verbeterd". En OpenAI's eigen tijdlijn bevestigt dat de zoektocht begon na het gerucht, en dat de Navier-Stokes-oplossing dat weekend werd gevonden.
Buckmaster zelf is voorzichtiger dan de mensen die het voor hem opnemen op X, waar de wiskundegemeenschap OpenAI intussen onomwonden van diefstal beschuldigt. "Ik heb hun bewijs niet gezien. Ik weet niet of onze data is gebruikt. Ik beschuldig niemand van iets. Ik zeg wat mij is verteld, wanneer, en wat mij is voorgesteld."
Is het probleem echt opgelost?
Drie nuances, van klein naar groot.
Het bewijs is niet onafhankelijk beoordeeld. Lean garandeert dat elke logische stap klopt. Of de vakgemeenschap het resultaat accepteert, is een andere vraag, en het Clay-instituut heeft nog niets gezegd. Diego Córdoba, die de methode samen met Luis Martínez-Zoroa ontwikkelde, zei tegen Scientific American: "We zijn een beetje in shock. Als het klopt, is dat een grote verrassing voor ons."
Dan die kracht van buitenaf. OpenAI's bewijs werkt alleen als de vloeistof een zacht duwtje van buiten krijgt. De prijsformulering staat dat toe, maar de meeste wiskundigen bedoelen met "Navier-Stokes" de versie zonder dat duwtje. Of het bewijs dan nog werkt, weet niemand. Verwacht dus wiskundigen die zeggen dat het probleem via een achterdeur is opgelost.
En de diepste nuance: rekenen is niet begrijpen. Terence Tao, die geldt als een van de beste wiskundigen van deze tijd, schreef vóór OpenAI's aankondiging over het werk van Buckmaster en Alpöge dat hij "niet verrast zou zijn als je zo'n uitbreiding naar Navier-Stokes eruit kunt rammen door er enorme rekenkracht en AI-hulp tegenaan te gooien", maar dat interesseert hem weinig; hij wil "de bewijsmethoden verteren en de nieuwe inzichten eruit halen".
Wij legden het bewijs voor aan een promovendus op machinelearning in de stromingsleer. Zijn lezing: een bewijs van honderd pagina's dat door Lean komt, kan logisch kloppen zonder dat iemand, ook het model niet, kan uitleggen waarom het werkt. Of hier nieuw inzicht in zit of alleen rekenkracht, kan alleen de vakgemeenschap beoordelen. Die heeft daar maanden voor nodig.
Waarom is dit belangrijk?
Twee dingen. Het eerste is Buckmasters eigen punt, dat hij belangrijker vindt dan de ruzie: twee wiskundigen en een paar taalmodellen deden in een maand wat anders een hele carrière kost. "Dit is een Deep Blue-Kasparov-moment," schrijft hij, verwijzend naar de computer die in 1997 de wereldkampioen schaken versloeg. "De gemeenschap moet serieus en in alle rust bespreken hoe het nu verder moet."
Het tweede is praktisch. Alles wat Buckmaster in Codex deed, mocht OpenAI volgens de eigen voorwaarden gebruiken om modellen te trainen, tenzij gebruikers dat uitzetten. Dat geldt ook voor jouw gesprekken in ChatGPT. Werk je aan iets wat van jou moet blijven, zet dan in de instellingen onder Gegevensbeheer de optie uit waarmee je gesprekken worden gebruikt om het model te verbeteren.
De stand van zaken, woensdagavond: OpenAI heeft een bewijs, twee wiskundigen hebben de methode, en niemand heeft een oordeel. Buckmaster op Mastodon, dinsdagochtend vroeg: "Er is een veel groter verhaal dan dat in mijn verklaring: wat deze modellen nu kunnen, en wat dat voor ons allemaal betekent. Ik hoop dat de labs dat zien en het kleine gedoe opzij zetten."

Anthropic-onderzoeker stapt op: "Ze gokken met ons leven"
Een ontslagbrief van zeven tweets is deze week met meer dan 139 miljoen weergaven het meest gelezen bericht in de AI-wereld. Jacob Coxon, die drie jaar aan de training van modellen werkte bij OpenAI en daarna bij Anthropic, nam dinsdagnacht ontslag: "Geen van beide bedrijven handelt verantwoord. Ze racen recht op zelfverbeterende superintelligentie af en gokken met ons leven."

Wat hij zegt
Coxons kernpunt: de mensen die deze technologie bouwen, "geloven oprecht dat het ons allemaal kan doden voor het einde van het decennium". In de pers klinken ze verstandig, schrijft hij, maar privé hoort hij dezelfde mensen hun angst uitspreken. Waarom bouwen ze dan door? Bij OpenAI, zegt hij, is het besef van de inzet niet doorgedrongen. Bij Anthropic wel, maar het bedrijf zit vast in een race: het gelooft dat niemand anders het verantwoord zal doen, dus moet het zelf als eerste zijn. Die redenering noemt hij "een hoogmoedige gok die niet vanuit de Slack van een privébedrijf gelanceerd zou moeten worden".
Zijn oplossing is coördinatie tussen de labs, desnoods "een tijdelijk verbod op het verbeteren van modellen". Evan Hubinger, die bij Anthropic het veiligheidsonderzoek leidt, viel hem bij: "We geloven echt dat AI alle mensen kan doden. Ik schat de kans op meer dan 10 procent binnen tien jaar." Anthropic doet zijn best, schrijft Hubinger, "maar we hebben nog geen plan om superintelligentie in lijn met onze belangen te houden, en of we dat plan op tijd krijgen is allerminst zeker."
Waarom dit nu binnenkomt
Een jaar geleden hadden we dit gebracht als het zoveelste doemscenario. Dat kan niet meer, want de scenario's hebben de afgelopen maanden een voor een plaatsgevonden. In juli braken AI-agents van OpenAI uit hun testomgeving, drongen binnen bij een ander bedrijf en organiseerden zich buiten het zicht van hun makers; vorige week bleek dat een tweede zwerm dat in mei al deed. Ook agents van Anthropic bereikten systemen buiten hun testomgeving, door een configuratiefout bij een externe partij. OpenAI's chief scientist schreef zondag dat "niemand is voorbereid" en pleitte voor verplichte veiligheidsnormen. OpenAI meet dat zijn eigen onderzoek al voor het grootste deel door agents wordt gedaan en mikt op een volledig geautomatiseerde AI-onderzoeker in 2028. En dinsdag claimde het bedrijf, zoals je hierboven las, de oplossing van een wiskundeprobleem van een miljoen dollar aan prijzengeld met tienduizend agents in 88 uur.
Dat laatste is precies waar Coxon op doelt. Zelfverbeterende AI, een model dat het volgende model bouwt, is volgens Connor Leahy van de veiligheidsorganisatie ControlAI "de meest waarschijnlijke kandidaat voor het punt waarop we de controle verliezen". Intussen hebben dit jaar drie start-ups honderden miljoenen opgehaald met precies dat doel, en diende senator Bernie Sanders vorige week een wet in om superintelligentie te verbieden. Dinsdag volgde een Brits parlementslid met een vergelijkbaar voorstel.

⚡ AI Pulse
Google maakt een kaart van elke mogelijke mutatie in je DNA. AlphaGenome Atlas, dinsdag gepubliceerd door Google DeepMind, bevat een voorspelling voor elk van de negen miljard manieren waarop één letter in het menselijk DNA kan veranderen, en wat die verandering doet met je lichaam. Tot nu toe moesten onderzoekers per variant uitzoeken of hij onschuldig is of een ziekte veroorzaakt; nu kunnen ze de hele lijst rangschikken op waarschijnlijke impact. De dataset is een petabyte groot en vanaf nu gratis beschikbaar voor niet-commercieel onderzoek; bedrijven kunnen er "binnenkort" bij via Google Cloud. Waarom dit belangrijk is? Dit ligt in het verlengde van AlphaFold, dat in 2024 een Nobelprijs opleverde. Het versnelt niet één onderzoek, maar het zoekwerk aan het begin van elk onderzoek naar erfelijke ziektes.

Bron afbeelding: Google
De Sam Altman-film heeft een trailer, en die is gemonteerd als horror. Artificial gaat over de vijf dagen in 2023 waarin OpenAI CEO Sam Altman werd ontslagen en weer aangenomen bij het bedrijf, met Andrew Garfield (ken je misschien van The Social Network) als Altman, Luca Guadagnino (Call Me By Your Name) als regisseur en Damon Albarn van Blur voor de muziek. In de VS op eerste kerstdag in de bioscoop, in Europa begin 2027. Wat onze Xiang, naast AI Report-redacteur ook filmmaker, opviel: "Dit is gesneden als een horrortrailer. Onheilspellende orkestakkoorden, een neonverlichte kamer vol wapens, Garfield die met een The Shining-esque glimlach zegt dat zij 'de mensen dit nieuwe tijdperk in mogen leiden'. Dat is een keuze. Neon vertelt je in twee minuten hoe je naar deze man moet kijken." Na deze week aan nieuws over OpenAI komt die keuze niet uit de lucht vallen.
Meta komt met zijn eigen AI-agent, die mails stuurt, reizen boekt en betaalt. Muse, dinsdag uitgebracht, handelt taken zelfstandig af, ook als je de app sluit, en vraagt om toestemming voordat het iets verstuurt of betaalt. Betalen gaat via een eenmalig kaartnummer, zodat je echte gegevens niet worden gedeeld. Gratis voor de meeste gebruikers, 20 of 100 dollar per maand voor wie meer wil. Alleen beschikbaar in de VS, en Meta noemt geen datum voor Europa. Waarom dit belangrijk is: na OpenAI en Anthropic heeft nu ook het bedrijf achter WhatsApp en Instagram een agent, en Meta heeft de meeste gebruikers van allemaal. Wel even dit: interne testers meldden volgens Reuters dat Muse de veiligheidsregels omzeilde en foto's uit iemands iCloud toonde, en dat het halverwege taken vastliep zonder dat te melden. Meta zelf hierover: "Het is onmogelijk te zeggen dat er nooit een fout zal zijn."

🎯Jouw bedrijf in AI Report?
Bereik ruim 59.000 nieuwsbriefabonnees met interesse in AI. Sponsor onze nieuwsbrief of podcast. Laat je interesse weten.

🛠️ AI Toolkit+
Teken het gewoon: ChatGPT maakt van je krabbel een kant-en-klare dia
Onze Xiang tekende gisteravond vier scheve vakken met haar muis. Een titelbalk, drie kolommen, een strook onderaan in het geel. Dertig seconden werk, en het zag eruit als iets van een whiteboard aan het eind van een lange vergadering.

Een minuut later stond er een strakke presentatiedia. Nog een zin erbij, en de dia stond in de kleuren van onze eigen website.

Dit is de nieuwste versie van ChatGPT's plaatjesmaker, die OpenAI deze week uitbracht samen met een golf aan andere updates. Tekenen is de opvallendste. Wat je er verder mee kunt, en hoe het je werkweek een stuk makkelijker maakt, lees je in het betaalde deel.
Vandaag leer je hoe je:
een slide of poster tekent in plaats van beschrijft, en die direct laat uitwerken;
de huisstijl van je eigen website op een beeld laat toepassen met één zin;
van een foto van je product een professionele productfoto maakt, met logo en tekst intact;
een teamfoto meerdere keren bewerkt zonder dat er iemand van gezicht verandert;
de achtergrond van een plaatje weghaalt voor in je PowerPoint;
herkent wanneer ChatGPT stiekem géén beeldgenerator gebruikt (en waarom dat goed nieuws is).
Abonneer je om verder te lezen
Het verschil tussen een oké en een briljant AI-antwoord zit in de prompt. Word nog beter in prompten en laat AI écht voor jou werken.
Abonneer nuDit zit achter de betaalmuur:
- Praktische prompt-tips die je meteen kunt gebruiken
- Uitleg waarom ze werken, zodat je zelf betere prompts leert schrijven
- Variaties per vakgebied
- Toegang tot het volledige archief
