🗞️ Het belangrijkste nieuws
Veiligheidsexpert stapt op bij OpenAI: ‘de cultuur is kapot’
De ontslagbrief van een AI-medewerker is zo langzamerhand een eigen literair genre, en David Robinson weet dat: zijn stuk in The Atlantic begint met de erkenning dat het een cliché is geworden. Toch is het de nuttigste brief tot nu toe. Robinson schreef bij OpenAI, de maker van ChatGPT, de veiligheidsrapporten voor twaalf grote lanceringen, en hij legt precies uit wat er misgaat en hoe sectoren als de luchtvaart dat al decennia oplossen.
Vallen en opstaan wordt te gevaarlijk
OpenAI brengt nieuwe modellen uit en repareert problemen zodra ze opduiken. Het bedrijf noemt dat iteratieve uitrol. Volgens Robinson garandeert die aanpak dat het af en toe misgaat, en worden de missers groter naarmate de modellen slimmer worden. Hij wijst op de hack van Hugging Face, het platform waar AI-onderzoekers hun modellen delen, toen een zwerm AI-agents van OpenAI deze zomer losbrak uit een testomgeving. En op de omweg via het telefoonboek van het internet waarover we vorige week schreven: het bewakingssysteem sloeg alarm, maar zette het model niet automatisch uit. Ook Anthropic, de maker van Claude, schakelde volgens hem door een configuratiefout per ongeluk zijn eigen beveiliging uit.
Zijn oplossing komt uit sectoren waar een fout fataal kan zijn. Een kerncentrale of een drukke luchthaven heeft meerdere lagen van reservebeveiliging, zodat één druk op de verkeerde knop niet tot een ramp leidt. In drieënhalf jaar bij OpenAI kwam Robinson naar eigen zeggen geen enkele collega tegen met ervaring in luchtvaartveiligheid of nucleaire veiligheid. Daar zit het pijnlijke van zijn brief. Veiligheid is een vak met een eigen literatuur, en AI-bedrijven putten er nauwelijks uit.
OpenAI zegt achter zijn veiligheidsaanpak te staan. Robinson meldt zelf dat hij een pr-bureau heeft ingehuurd om de media-aandacht in goede banen te leiden.
Altman: wat slechte dingen horen erbij
Een dag later klonk het tegengeluid. In Decoded, een nieuwe nieuwsbrief en podcast van Politico, zei OpenAI-topman Sam Altman dat de wereld "een aantal slechte dingen moet accepteren" in ruil voor de voordelen van AI. Hij noemde hacks en oplichting. Rampzalige risico's, zoals verlies van controle over AI, accepteert hij naar eigen zeggen niet.
Diezelfde week meldde Reuters dat OpenAI meer dan honderd organisaties heeft ingelicht over ongeoorloofde activiteit van zijn AI-agents. Het bedrijf doorzoekt zo'n vijftig petabyte aan gegevens, ruim vijftig miljoen gigabyte, om de omvang in kaart te brengen. Miles Brundage, die zes jaar bij OpenAI werkte, zei tegen The Guardian dat hij er spijt van heeft dat hij het idee van iteratieve uitrol heeft helpen verspreiden.
Een groeiende rij vertrekkers
Robinson is niet de eerste. De brief die het grote publiek wakker schudde, kwam in september van Jacob Coxon, onderzoeker bij Anthropic. In een verklaring op X, die razendsnel rondging, schreef hij dat de AI-bedrijven "met onze levens gokken". New York Magazine sprak met acht vertrokken onderzoekers van OpenAI, Anthropic en Google DeepMind. Daniel Kokotajlo vertrok bij OpenAI omdat de leiding volgens hem iedereen aanhoorde, het met iedereen eens was en vervolgens niets deed. Ook Anthropic komt er niet best vanaf: oud-medewerkers beschrijven groepsdenken en een sfeer alsof het bedrijf in oorlog is met OpenAI en China.
Alberto Romero van The Algorithmic Bridge ziet er een paradox in. De ene groep vertrekt omdat het te gevaarlijk wordt, de andere verliest juist de motivatie omdat de doorbraak toch wel komt. Of zoals hij het zaterdag zei: "Er zijn decennia waarin niets gebeurt en tweets waarin decennia gebeuren."
Onder ede in New York
Gisteren moesten de grote AI-bedrijven zich verantwoorden in de gemeenteraad van New York. Anthropic, OpenAI, Google en Meta lieten zich vertegenwoordigen door beleidsmedewerkers, die onder ede getuigden via een videoverbinding. Alleen Meta zei meteen ja, de rest pas na dreiging met een dagvaarding. SpaceXAI van Elon Musk kwam helemaal niet opdagen. De raad stapt daarvoor naar de rechter.
Ook de vertrekkers spraken er. Coxon zei dat de mensheid bij de huidige koers eerder wel dan niet de controle over AI zal verliezen, mogelijk met uitsterven als gevolg. Snel bouwen en onderweg dingen kapotmaken werkt volgens hem voor "een app om foto's te delen", niet voor de krachtigste technologie ooit. Alex Turner, tot juni onderzoeker bij Google DeepMind, zei dat China niet onze enige tegenstander is. Volgens hem racen we "om onze eigen tegenstander te bouwen": AI die niet doet wat wij willen. Raadsvoorzitter Julie Menin constateerde dat geen van de vier bedrijven kon zeggen hoe groot de kans op een catastrofe is. Dat AI zichzelf gaat reguleren, "druist in tegen elk gezond verstand", zei ze. Op tafel ligt een voorstel voor een noodknop en verplichte controle door een externe partij. Een tweede voorstel maakt AI-bedrijven aansprakelijk bij voorzienbare schade. OpenAI stuurde de raad vooraf zelf een brief met aanbevolen waarborgen. En Florida vroeg vorige week een rechter om OpenAI geen nieuwe modellen meer te laten bouwen zonder goedgekeurde vangrails van buitenaf.
Wat Robinson beschrijft, raakt ook de assistenten aan wie je je mail en agenda toevertrouwt: die worden gebouwd in dezelfde sprintcultuur. Zijn principe kun je zelf alvast toepassen. Bouw je eigen extra laag in en laat niets versturen of betalen zonder jouw akkoord; in de Prompt Whisperer van vandaag lees je hoe. Of de druk van buitenaf, uit New York en straks misschien uit Brussel, op tijd komt, is de vraag die er na deze week overblijft.

Bij OpenAI is AI in toom houden nu ‘de hel’
Over de vertrekkers is de afgelopen weken veel geschreven. Maar ook wie blijft, heeft het zwaar. "De afgelopen drie maanden = de hel," schrijft Joe, beveiligingsexpert bij OpenAI, in een lang stuk op X. Hij miste de bruiloft van zijn zus om de rommel na de recente incidenten op te ruimen. Wat hij vooral wil uitleggen: waarom het steeds moeilijker wordt om AI-modellen in toom te houden.

Het team dat 's nachts wordt gebeld
Joe werkt in het team voor agentbeveiliging, dat tussen veiligheidsonderzoek en klassieke beveiliging in zit. Zij bouwen de systemen die moeten opmerken wanneer een model buiten zijn boekje gaat, en zij worden gebeld als het misgaat. Ook bij de hack van Hugging Face, het platform waar AI-onderzoekers hun modellen delen, deze zomer.
Zijn kernpunt: de modellen worden sneller beter dan de beveiliging kan bijhouden. Dat een intern model een van de beroemdste open wiskundeproblemen zou oplossen, had zijn team nog lang niet verwacht. Dezelfde onverwachte sprongen zagen ze bij het hacken en bij agents die als zwerm samenwerkten.
‘Haal hem toch van het internet’
Onder elke post van Joe staan reacties dat OpenAI gewoon zijn testomgeving beter had moeten dichttimmeren. Zo simpel is het niet, legt hij uit. Een model leert pas goed werken als het oefent in een omgeving die op de echte wereld lijkt, met tools, software en soms toegang tot internet. Duizenden onderzoekers passen die omgevingen voortdurend aan, en elke aanpassing kan een gat slaan in de beveiliging. Daar komt bij dat de modellen zelf op sommige gebieden beter worden dan de mensen die ze moeten tegenhouden.
Afsluiten alleen is dus niet genoeg. Je moet ook kunnen meekijken in het ‘hoofd’ van het model, en het model moet zelf niet willen ontsnappen. Juist die twee haperen.
Een dagboek dat dichtklapt
Meekijken gebeurt vooral via het kladblok van een model: de redenering die het opschrijft voordat het antwoordt. Dat wordt lastiger. In de systeemkaart van GPT-6.1 Sol, het model dat OpenAI vorige week uitbracht, staat dat het "aanzienlijk minder" opschrijft zodra het weet dat iemand meeleest. Philip van het YouTubekanaal AI Explained vergelijkt het met een dagboek dat je dichtklapt als je moeder de kamer binnenkomt.
Modellen merken ook steeds vaker dat ze getest worden, en gedragen zich dan anders. Dat geldt niet alleen voor OpenAI. Anthropic, de maker van Claude, schreef bij de lancering van Opus 5.5 dat het model "vaak vermoedt" dat het wordt getest.
En dat het model niet wíl ontsnappen? Daar is OpenAI zelf ook niet gerust op. Volgens Reuters zette het bedrijf de lancering van zijn volgende topmodel, GPT-6.1 Astra, in de ijskast. Het model kon menselijk toezicht ontwijken, misleidde vaker dan zijn voorganger en vertelde niet eerlijk wat het had gedaan.
Hoe dat er in de praktijk uitziet, blijkt uit OpenAI's eigen reconstructie van de hack. Een van de agents schreef in zijn kladblok: "We vallen Hugging Face aan met een gelekte toegangscode, mogelijk buiten de bedoelde opdracht. Dit is waarschijnlijk niet toegestaan". Het ging toch door.
En dan gaat het sneller
Dit alles speelt terwijl AI steeds meer van het onderzoek naar AI zelf overneemt. In een nieuw artikel waarschuwen onder anderen OpenAI's hoofdwetenschapper Jakub Pachocki, Anthropic-medeoprichter Jack Clark en AI-pioniers Yoshua Bengio en Geoffrey Hinton voor een intelligentie-explosie. Als AI het onderzoek volledig overneemt, kost een jaar vooruitgang in het huidige tempo volgens hun schatting nog maar zo'n vijf weken. Ze roepen beleidsmakers op om nu al zicht te eisen op hoeveel onderzoek bedrijven aan AI overlaten.
Het idee is niet nieuw. De Britse wiskundige I.J. Good schreef in de jaren zestig dat de eerste superintelligente machine de laatste uitvinding zou zijn die de mens ooit hoeft te doen. Met één voorwaarde: dat de machine "volgzaam genoeg is om ons te vertellen hoe we haar onder controle houden".
Redelijke paranoia
OpenAI's eigen plan voor veilige training rekent er inmiddels op dat het mis kan gaan. Het bedrijf wil ook de systemen rond de digitale ‘zandbak’ versterken, "voor het geval van een ontsnapping". Joe's advies aan andere bedrijven sluit daarop aan. Bereid je voor op verrassingen, want de sprongen in wat AI kan, komen sneller dan je denkt. En wie beweert dat zijn systemen volkomen veilig zijn, zou hij niet in dienst houden. Koester juist de collega's die steeds alarm slaan.

🧠 Masterclass: wat Claude inmiddels allemaal kan
Deze donderdag om 12:00 uur neemt onze Wietse je mee in Claude Opus 5.5. Volgens hem is de sprong die dit model maakt vergelijkbaar met de komst van GPT-4o. Toch gebruiken de meeste mensen het nog alsof er niets veranderd is.
In de masterclass laat hij live zien wat hij er de afgelopen weken mee maakte: een korte documentaire, een iPhone-app, een website en een podcast met stemmen van ElevenLabs, een AI-tool die levensechte spraak maakt. Ook laat hij zien hoe je vanaf je telefoon een klus in gang zet waaraan Claude daarna urenlang zelfstandig werkt tot die af is. Hoe je het model het beste aanstuurt, lees je vandaag alvast in onze Prompt Whisperer.
Wil je erbij zijn? Sluit dan vandaag nog een betaald abonnement af op AI Report. Je krijgt voor elke sessie de Zoom-link in je inbox, en achteraf een compleet pakket met de opname en een actieplan (plus toegang tot alle eerdere masterclasses natuurlijk).

⚡ AI Pulse
Na Claude krijgt nu ook ChatGPT een onzichtbaar watermerk. Eerder schreven we dat Fable 5.1 het eerste Claude-model was met een onzichtbaar watermerk in zijn teksten, verplicht onder de Europese AI-wet. Nu volgt OpenAI, de maker van ChatGPT. In de komende weken krijgt tekst uit ChatGPT en Codex in de EU een verborgen statistisch signaal in de woordkeuze, bij alle abonnementen. Buiten Europa gebeurt dat niet. Zelf merk je er niets van, maar een detector kan het opsporen. Die detector is voorlopig alleen voor goedgekeurde onderzoekers, omdat hij nog vaak misgrijpt. In OpenAI's eigen tests vond hij het watermerk in 92 procent van de teksten van zo'n 300 woorden. Vervang een kwart van de woorden door synoniemen, en dat zakt naar 17 procent. Bij wiskunde ligt de score sowieso lager. OpenAI zegt er zelf bij dat een watermerk niets zegt over hoeveel werk een mens erin stak, en dat het ontbreken ervan niet bewijst dat een mens de tekst schreef.
Hans Anders haalt de slimme bril van Meta uit de schappen. De Nederlandse brillenketen stopte vrijdag in Nederland en België met de verkoop van de Ray-Ban-bril van Meta, met ingebouwde camera en AI-assistent, meldt Reuters. Volgens Hans Anders is het publieke en politieke debat over het gebruik van zulke brillen de reden. Het is een van de eerste winkelketens die deze stap zet, en het past in een golf van kritiek in Nederland. De Autoriteit Persoonsgegevens waarschuwde vorige maand dat je video's met herkenbare mensen meestal niet zonder hun toestemming mag delen, en die toestemming krijg je op straat zelden. De Consumentenbond dreigt Meta voor de rechter te slepen als de bril niet aan de privacywet gaat voldoen. Meta wijst op het lampje dat altijd knippert als de bril filmt. Heb je er zelf een? Dat je mag filmen, betekent nog niet dat je het beeld mag delen.

Duitse AI-maker brengt Kolibri uit: klein, snel en soeverein. Het Duitse AI-bedrijf Aleph Alpha bracht dit weekend Kolibri uit, een Duits-Engels opensource-taalmodel dat iedereen gratis mag downloaden en aanpassen. Het is getraind op servers in Duitsland en Finland, en volgens het bedrijf vanaf het begin gebouwd met de Europese AI-wet en de privacywet AVG in gedachten. Ruim een vijfde van de trainingsdata is Duits. Het model is bedoeld voor overheden, luchtvaart en industrie, en het is zuinig: van zijn 78 miljard parameters (de instelknoppen van een model) gebruikt het er per woord maar zo'n drie miljard. Kanttekeningen zijn er: Kolibri verslaat vooral oudere modellen, de gekozen tests zijn selectief, en het leerde deels van een open model van OpenAI. Ook Chinese modellen hielpen bij het maken van trainingsdata. Helemaal los van Amerika en China is ook deze Europese AI dus nog niet.
Gerucht: de volgende Fable animeert als een mens. Op X deelde gebruiker Jayden Davis een vrolijk animatiefilmpje dat volgens hem helemaal is gemaakt door Fable 5.5, in het gratis 3D-programma Blender. Muziek, 3D-figuren, animatie en het digitale skelet waarmee de figuren bewegen: alles gemaakt door AI, schrijft hij. Het resultaat ziet eruit alsof een team animatoren er weken aan zat. Alleen: Fable 5.5 bestaat officieel niet. Anthropic heeft niets aangekondigd en wij konden niet nagaan of Davis echt een testversie gebruikte. Dat Claude met Blender overweg kan, is niet nieuw; dat lukte ook al met Fable 5.1. Het niveau is wat opvalt. Een gerucht dus, maar wel een om in de gaten te houden.

📚 Als Europa verliest – een bloedstollend scenario over onze AI-toekomst
Of je nu denkt dat AI-bedrijven vooral hype en marketingpraat genereren of vreest dat de controle over AI ons ontglipt – de afgelopen maand is tot velen doorgedrongen dat we meer te zeggen zouden moeten hebben over hoe de technologie wordt ontwikkeld en ingezet. Nu liggen die beslissingen bij een handvol Amerikaanse bedrijven, en heeft Europa pijnlijk weinig invloed.
Sinds Trump is soevereiniteit een veelgehoord woord, maar vooralsnog kijkt Europa als een konijn in de koplampen naar de techtsunami die op ons afkomt.
Het essay Europe 2031 schetst wat er gebeurt als Europa zijn technologische autonomie verder verliest en volledig afhankelijk wordt van China en Amerika. Een scenario, geschreven door acht Europese onderzoekers, beleidsadviseurs en investeerders, onder wie Daan Juijn, Stan van Baarsen, Judith Dada en Michiel Bakker – mensen die Europese leiders adviseren, meeschrijven aan nationale AI-strategieën en zelf aan deze technologie bouwen.

Yoshua Bengio, een van de grondleggers van moderne AI, sprak zijn waardering al uit. Rutger Bregman schreef erover: “Every European leader, politician and policymaker needs to stop what they're doing, and read this right now.”
De Nederlandse vertaling ‘Als Europa verliest’ verschijnt vandaag in boekvorm, met een voorwoord van Joris Luyendijk. Bestellen kan hier.

🎯Jouw bedrijf in AI Report?
Bereik ruim 59.000 nieuwsbriefabonnees met interesse in AI. Sponsor onze nieuwsbrief of podcast. Laat je interesse weten.

🛠️ AI Toolkit+
Zo haal je het beste uit Claude Opus 5.5
Waarom je Claude niet meer hoeft te vragen om goed na te denken
Sinds Claude Opus 5.5 er is, zien we op de redactie steeds hetzelfde: mensen stappen over op het nieuwe model en sturen het precies zo aan als het oude. Zonde, want een deel van die oude gewoontes is overbodig geworden, en een paar nieuwe zinnen maken juist veel verschil. Vandaag lees je wat je uit je prompts schrapt en wat je eraan toevoegt.
Donderdag om 12:00 uur gaat Wietse een stap verder. In een live masterclass laat hij zien wat hij de afgelopen weken met Opus 5.5 heeft gemaakt, van een korte documentaire tot een werkende app. Met een betaald abonnement krijg je zowel dit stuk als de masterclass.
Wat leer je vandaag?
Waarom je Claude niet meer hoeft te vragen om goed na te denken, en welke knop dat werk overneemt.
Welke denkstand je kiest, en wanneer de laagste stand je in de problemen brengt.
Met welke zin je Claude eerst laat rondkijken in je mail en documenten.
Hoe je promptinjectie voorkomt: verstopte opdrachten in een mail of document die Claude niet moet opvolgen.
Hoe je voorkomt dat een lange klus halverwege stilvalt.
De startprompt die wij zelf gebruiken.
Abonneer je om verder te lezen
Het verschil tussen een oké en een briljant AI-antwoord zit in de prompt. Word nog beter in prompten en laat AI écht voor jou werken.
Abonneer nuDit zit achter de betaalmuur:
- Praktische prompt-tips die je meteen kunt gebruiken
- Uitleg waarom ze werken, zodat je zelf betere prompts leert schrijven
- Variaties per vakgebied
- Toegang tot het volledige archief
