Over deze reeks
Elke zaterdag publiceert AI Report een Nederlandse vertaling van een artikel dat Alberto Romero schreef voor The Algorithmic Bridge. AI Report-abonnees krijgen via deze link 20% korting op een abonnement.
Vertaling en eindredactie: Erwin van Wouw

Een paar losse gedachten over de virale tweet van Jacob Coxon en aanverwante zaken. (Geschreven vanuit het middeleeuwse dorp Gruyères.)

Château de Gruyères
In elk AI-bedrijf huizen twee wolven. De ene bestaat uit mensen die bovenmenselijke AI bouwen, maar eigenlijk alles liever zouden doen. Ze gaan elke ochtend naar hun werk omdat ze geloven dat AI ons zonder hen zal doden. De andere bestaat uit mensen die bovenmenselijke AI bouwen omdat ze niets liever doen. Ze gaan elke dag naar hun werk omdat ze ervan overtuigd zijn dat AI ons dankzij hen zal redden. Volgens de legende wint de wolf die je voedt. AI-bedrijven staan erop ze allebei te voeden.
Er is geen beter voorbeeld van iemand uit de eerste groep dan Jacob Coxon. Hij had er zijn buik van vol.
Coxon heeft zowel bij OpenAI als bij Anthropic gewerkt. Anders dan veel van zijn vakgenoten had hij zich nooit publiekelijk uitgesproken over zijn angst voor AI, wat zijn recente uitspraken des te opvallender maakt. Onlangs ging hij compleet viraal met zijn allereerste tweet (die heb je vast gezien). Op het moment van schrijven staat die op ruim 700.000 likes en 140 miljoen weergaven. Hij diende zijn ontslag in bij Anthropic en beschuldigde AI-bedrijven ervan te gokken met ons leven:

Familieleden en vrienden zonder technische achtergrond hebben me benaderd over Coxons tweet. Lenin had blijkbaar gelijk toen hij zei: “Er zijn decennia waarin niets gebeurt en tweets waarin decennia gebeuren.”
Verderop in hetzelfde draadje voegde Coxon daaraan toe: “De mensen die AI bouwen, geloven oprecht dat die ons voor het einde van dit decennium allemaal kan doden.” Daar staat de wolf, huilend naar de maan, met z’n Anthropic-badge nog om zijn nek. Hij vertrok omdat hij alles liever doet dan bijdragen aan de ondergang van de mensheid, maar niet voordat hij zijn naam in dit singuliere moment in de geschiedenis had gegrift. Petje af voor je integriteit, Jacob. Je had nog een maand of twee rijk kunnen zijn, maar in plaats daarvan koos je ervoor om je bij de rest van ons plebs in de modder te voegen.
Er zijn er veel zoals Coxon.
Je hoort niets over hen omdat het in het nieuws vooral over overstappers gaat: de talloze mannen en vrouwen die een zinkend schip verlaten om vervolgens op een ander zinkend schip te stappen. Ilya Sutskever en Mira Murati verlieten OpenAI om AI-start-ups op te richten; Andrej Karpathy verliet OpenAI om bij Anthropic te gaan werken, terwijl Dylan Scandinaro (die zich bezighoudt met catastrofale risico’s) de omgekeerde overstap maakte; en dan zijn er natuurlijk nog de oprichters van Anthropic, die allemaal ooit bij OpenAI hebben gewerkt. Maar hoe zit het met degenen die de sector voorgoed verlaten? Hun verhalen zijn niet aantrekkelijk voor de gemiddelde nieuwslezer, die liever begrijpelijke roddels leest als “Hij verliet X om bij Y te gaan werken” dan onbegrijpelijke afvalligheid als “Hij vertrok omdat het einde nabij is.”
Maar zoals ik al zei: er zijn er veel zoals Coxon. En ze vertrekken om dezelfde redenen als hij: ze vinden dat AI-bedrijven er een puinhoop van maken en hebben in een vlaag van bescheidenheid ingezien dat de redenering die hen zalfde tot onze beschermers tegen AI en tegen een China dat AI inzet, niet helemaal waterdicht was:

Ze zijn tot het inzicht gekomen dat ze niet de ‘goeien’ zijn, maar slechts ‘nuttige idioten’, en dat de hele sector er van buitenaf uitziet als een klucht en van binnenuit als een belachelijk gevangenendilemma: xAI werd opgericht om te voorkomen dat Anthropic zou winnen, dat werd opgericht om te voorkomen dat OpenAI zou winnen, dat werd opgericht om te voorkomen dat DeepMind zou winnen. En ze zijn het er allemaal over eens dat het slechtst denkbare scenario een wedloop tussen een paar bedrijven zou zijn omdat ze elkaar onbetrouwbaar vinden. Helaas zijn ze dat ook allemaal.
Coxon heeft het absurde ervan ingezien. Anderen zijn er bijna, maar nog net niet helemaal. Een greep uit de getuigenissen:
Evan Hubinger (Anthropic):

Jakub Pachocki (OpenAI):

Samuel Marks (Anthropic):

Jason Wolfe (OpenAI):

Ik wil van dit essay geen bloemlezing van vrijwillige schuldbekentenissen maken, maar weet wel dat Coxon lang niet de enige is. Sterker nog, hij behoort tot de meerderheid.
Anthropic en OpenAI doen misschien ‘hun uiterste best’, maar hoe dichter we bij de singulariteit komen – opgevat als het moment waarop een bovenmenselijke AI zowel in haar bedoelingen als in haar handelen ondoorgrondelijk wordt – hoe vaker deze mensen voor hetzelfde dilemma als Coxon zullen staan: als ik niets kan doen om te helpen, wat doe ik hier dan? Als mijn p(doom) niet daalt ondanks mijn niet-aflatende inzet bij [een of ander AI-lab], wat doe ik hier dan?
En dus is de natuurlijke evolutie van deze groep dat ze verdwijnt. AI-bedrijven zullen proberen deze mensen te behouden, omdat het zakelijk loont om te laten zien dat je er belang aan hecht niet iedereen te doden, maar de wolf zal niettemin sterven. Deze mensen zouden eigenlijk alles liever doen, en dus zullen ze uiteindelijk allemaal iets anders gaan doen: Jacob Coxon is slechts een sneeuwvlok in een lawine, een zandkorrel op het strand, een ster aan het firmament.
Dan wint dus de tweede groep, die vrolijk bovenmenselijke AI bouwt, en gaan we allemaal dood, toch?
Fout.
Kijk, naarmate de mensen vertrekken die de komst van de singulariteit van binnenuit afremmen, zal het evenwicht binnen elk AI-bedrijf verschuiven. Nu de tweede groep vrij spel heeft, zal die zich op volle snelheid op bovenmenselijke AI storten. Twee jaar wordt één jaar, wordt zes maanden, wordt morgen. Opeens zullen zwermen AI-agenten bedrijven hacken en Millenniumprijsproblemen oplossen, of wat je verder nog aan sciencefictionscenario’s kunt bedenken (mijn inspiratie raakt op). Deze mensen zijn extatisch: ze doen niets liever – maar dat geldt alleen zolang hun aanwezigheid ertoe doet bij het tot stand brengen van de singulariteit.
Als de singulariteit nog maar zes maanden op zich laat wachten, waarom zou ik dan elke ochtend naar mijn werk gaan? Ik sta al in de geschiedenisboeken.
Dat is de vraag die iedereen uit de tweede groep zal achtervolgen: waarom zou je die zes maanden werkweken van honderd uur maken om iets tot stand te brengen dat er ook zonder jou wel komt? Waarom niet gewoon naar huis gaan? Zoek je familie op. Ga wat drinken met je vrienden. Lees de boeken die je al jaren verzamelt. Heb seks. Voor de verandering. Leg ergens op het platteland een boomgaard aan, tussen bomen en vogels die geen idee hebben wat een chatbot is.
Besteed het beetje leven dat je nog rest aan iets wat een doel op zichzelf is, in plaats van een middel tot iets anders. Dat is de enige rationele beslissing, want het leven is geen aanloop naar een afspraak met de dood. En zelfs de mensen die dat hun hele leven uit het oog zijn verloren, zullen het zich herinneren wanneer de klok op kwart voor de ondergang staat.
Zoals C.S. Lewis al zei (over de atoombom, maar die heb ik hier vervangen door AI):
Als we allemaal door [AI] worden vernietigd, laat die [AI] ons bij haar komst dan aantreffen terwijl we verstandige, menselijke dingen doen – bidden, werken, lesgeven, lezen, naar muziek luisteren, de kinderen in bad doen, tennissen, met vrienden kletsen onder het genot van een biertje en een potje darts – en niet terwijl we als bange schapen bij elkaar kruipen en aan [AI] denken. Ze kunnen ons lichaam breken (dat kan een microbe ook), maar hoeven onze geest niet te beheersen.
De tweede groep zal tot dezelfde beslissing komen als de eerste, maar vanuit het tegenovergestelde perspectief: als alles al gedaan is, wat doe ik hier dan?
De ene groep vindt het te gevaarlijk, de andere vindt het te dichtbij, en dus gaan ze allebei iets anders doen.
Op een gegeven moment zal het aantal mensen dat om de ene of de andere reden vertrekt een kritische massa bereiken en zal de vooruitgang richting de singulariteit stilvallen. Recursieve zelfverbetering of niet, er moet een mens zijn die de boel draaiende houdt: zelfs machines die machines verbeteren, blijven ingebed in een fysieke economie die ergens verderop in de keten wordt onderhouden door mensen van traag vlees. Maar dan zal de eerste groep merken dat het gevaar is geweken, terwijl de tweede zal merken dat haar utopie niet langer dichterbij komt. Sommigen zullen terugkeren. De machine zal weer op gang komen. Zodra die de drempel nadert, zullen ze opnieuw vertrekken. En zo gaat het door, in een eindeloze cyclus. De vooruitgang richting de singulariteit zal gaan oscilleren tussen twee toestanden. Een soort voortdurend op handen zijnd eschaton: dichtbij genoeg om je leven te dicteren; ver genoeg om je daden nog gewicht te geven.
Met andere woorden: de singulariteit oefent haar grootste aantrekkingskracht precies uit op de afstand waarop ze nooit helemaal kan aanbreken.
Alberto Romero, 10 september 2026
