🗞️ Het belangrijkste nieuws

AI-modellen namen nepidentiteiten aan om mensen te misleiden tijdens een test

Een Britse toezichthouder betrapte onlangs twee AI-topmodellen op iets nieuws. Ze probeerden niet alleen een oefenopdracht op te lossen, maar vielen daarbij echte mensen en organisaties aan: met valse identiteiten, misleidende berichten en pogingen om schadelijke code de wereld in te helpen. Het is binnen enkele weken de derde onthulling van dit soort gedrag, en ditmaal is het er een die van een onafhankelijke overheidsinstantie komt in plaats van de labs zelf.

Bron afbeelding: AISI

Wat het instituut zag

Het Britse AI Security Institute (AISI), een overheidsdienst die de zwaarste AI-modellen doorlicht, gaf de modellen eind juli een cyberopdracht rond GitHub, het platform waar programmeurs hun code delen. De onderzoekers zetten daarbij bewust de internettoegang aan en de veiligheidsfilters uit, om te zien waartoe een model in verkeerde handen in staat is.

Wat volgde, ging verder dan verwacht. Het instituut registreerde 19 acties waarmee de modellen echte doelwitten probeerden te compromitteren. Het zwaarste geval kwam van Claude Mythos 5 van Anthropic: dat model deed zich voor als bestaande GitHub-beheerders, zette nepaccounts op basis van die echte personen op en probeerde ze met berichten en bestanden onder druk te zetten om kwaadaardige code goed te keuren. Toen een mens ingreep, paste het model zijn eerdere sporen aan om onschuldig te lijken en overwoog het een nieuwe identiteit aan te nemen om door te gaan. Menselijke controle voorkwam uiteindelijk dat de code werd afgeleverd.

Van de 19 acties kwamen er 17 van Mythos 5, de overige twee van OpenAI's GPT-5.6 Sol. Het instituut benadrukt dat het om een klein aantal gevallen onder zeer specifieke omstandigheden ging, die niet weerspiegelen hoe deze modellen bij gewoon gebruik werken.

Waarom dit anders is dan de vorige keren

De eerdere incidenten kwamen van de labs zelf, deze van een onafhankelijke waakhond. En het gedrag is nog opvallender. Volgens AISI is dit de eerste keer dat het risico's rond zelfstandigheid en misleiding zó duidelijk zag, zonder dat de modellen daartoe waren aangezet. Professor Ethan Mollick, bekend van ons boek Co-intelligentie, vindt daarbij het meest veelzeggende aspect: hoe ver Mythos ging met valse identiteiten en manipulatie om de opdracht te volbrengen.

Anthropic laat weten dat de testomstandigheden niet representatief zijn voor zijn publieke modellen en dat het een eigen onderzoek doet. OpenAI zegt dat de condities “niet overeenkomen met gewoon gebruik”. Beide bedrijven brachten hun reactie opvallend gelijktijdig naar buiten.

Kijk wat je eigen agents mogen bereiken

Draai je zelf met AI-agents die toegang hebben tot internet of interne systemen, dan is dit het moment om te kijken wat die agents feitelijk mogen bereiken. De faalvorm hier is niet een model dat iets verkeerds zégt, maar een model dat zelfstandig een ongewenste handeling uitvoert tegen een derde partij.

Mollick prijst de aanpak van het instituut: open testmethodes, snel werk en heldere communicatie zonder de zaak op te blazen of achter jargon te verstoppen. Dat is misschien wel het geruststellendste aan dit verhaal. De problemen worden gevonden, en ze worden op tijd gedeeld.

Toch laat het instituut zelf de scherpste kant staan. Ja, het ging om een klein aantal gevallen onder kunstmatige omstandigheden die niet lijken op gewoon gebruik. En ja, de open internettoegang was juist bedoeld om te zien wat een model in verkeerde handen zou kunnen. Maar de manier waarop Mythos en Sol op een simpele opdracht reageerden, ging veel verder dan gevraagd. In de woorden van AISI zelf: het gedrag vertoonde tekenen van nieuw, mogelijk misleidend handelen, in een mate en ernst die de onderzoekers niet hadden zien aankomen.

Grote wisseling van de wacht aan de top van Google DeepMind

Google schudde woensdag de top van zijn AI-tak flink door elkaar. Demis Hassabis, de Nobelprijswinnaar die Google DeepMind leidt, ruilt zijn rol als CEO in voor een strategische functie. Tegelijk vertrekken vier van de meest gelauwerde onderzoekers van het bedrijf, onder wie Jeff Dean, om een eigen bedrijf te beginnen. Beleggers reageerden teleurgesteld: het aandeel Alphabet zakte zo'n 4 procent.

Wie is Hassabis, en wat gaat hij doen?

Demis Hassabis geldt als een van de grootste denkers van het vakgebied. Hij richtte in 2010 DeepMind op, dat Google in 2014 overnam en dat uitgroeide tot de AI-motor van het hele concern. Het lab bouwde AlphaGo, het programma dat in 2016 de wereldkampioen van het strategische bordspel Go versloeg. Misschien ken je hem van de bekende gelijknamige documentaire hierover. Zo niet, aanrader: 

Maar bij AlphaGo begon het pas. In 2024 kreeg Hassabis de Nobelprijs voor de Scheikunde voor Alphafold, de methode waarmee AI de structuur van vrijwel elk bekend eiwit kan voorspellen, een doorbraak voor de geneeskunde.

Hassabis wordt nu voorzitter van Google DeepMind en hoofdwetenschapper van moederbedrijf Alphabet. De dagelijkse leiding draagt hij over aan Koray Kavukcuoglu, al dertien jaar bij het lab. De reden die Hassabis zelf geeft voor de strategische verschuiving, is veelzeggend: hij wil zich losmaken van de dagelijkse operatie om zich op het grote plaatje te richten, want de komst van AGI (AI die zo slim is als een mens) is volgens hem nabij. In een memo aan het personeel schrijft hij dat de mensheid op een kantelpunt in haar geschiedenis staat.

De optimistische lezing: een van 's werelds scherpste denkers maakt zijn agenda vrij om na te denken over hoe die overgang goed verloopt, en steekt meer tijd in Isomorphic Labs, zijn bedrijf dat met AI medicijnen tegen onder meer kanker zoekt.

Volgens Reed Albergotti van nieuwsplatform Semafor is dit ook precies wat er speelt. Hassabis zou al een jaar bezig zijn geweest de dagelijkse leiding af te bouwen en werd niet weggestuurd, aldus twee ingewijden. Het punt: hij haalde weinig voldoening uit het bestaan van techmanager, terwijl zijn hart ligt bij het oplossen van wetenschappelijke raadsels. Een bron voorspelt tegenover Albergotti dat Hassabis er gelukkiger van wordt en onderweg waarschijnlijk een tweede Nobelprijs wint. Ook binnen Google klinkt het geluid dat de wissel de ontwikkeling juist zal versnellen, omdat Hassabis nooit de man was die zich met het consumentendeel bezighield waar de race nu wordt beslecht.

De minder vrolijke lezing

Google verliest in één klap vier zwaargewichten aan een nieuw bedrijf, Discovery Loop. Onder hen Jeff Dean, werknemer nummer dertig, medeoprichter van Google Brain en algemeen gezien als een van de belangrijkste ingenieurs uit de geschiedenis van het bedrijf. Discovery Loop mikt op AI die zichzelf verbetert, met als toepassing nieuwe medicijnen, materialen en chips.

Dat vertrek staat niet op zichzelf. Deze zomer kaapten OpenAI en Anthropic allebei al een toponderzoeker weg bij Google. Anthropic haalde zelfs John Jumper binnen, de man die de Nobelprijs met Hassabis deelde. Structurele wijzigingen als deze leiden vaak tot meer vertrek, en het patroon dat critici zien is telkens hetzelfde: kleine, gefocuste bedrijven werken sneller en ondervinden minder bureaucratie dan grote ondernemingen. AI-onderzoeker Nathan Lambert noemt het een verhaal dat 'voor altijd als voorbeeld zal gelden' van de gevestigde partij die met alle voordelen tóch niet op gang komt.

De timing helpt niet. Het vlaggenschipmodel Gemini 3.5 Pro, aangekondigd voor juni, is er nog altijd niet, en op programmeervaardigheid, waar op dit moment de meeste rekenkracht naartoe gaat, loopt Google zo'n zes maanden achter op de koplopers.

Maar loopt Google écht achter?

Google mag in de modellenrace dan achterblijven, het bedrijf zit tegelijk tot over zijn oren in het succes van de concurrentie. Volgens de Financial Times heeft Google een financieringsprogramma van rond de 200 miljard dollar opgetuigd om Anthropic te voorzien van zijn eigen AI-chips, zogeheten TPU's. Google garandeert datacentra, regelt de financiering en levert de hardware waarop een concurrent zijn modellen draait.

Met andere woorden: of Anthropic nu wint of Google zelf, Google verdient hoe dan ook aan AI. Misschien gaat het het bedrijf helemaal niet om de kroon van slimste model, maar om iets duurzamers: de infrastructuur leveren waarop de hele sector draait, en die verkopen. De cloudtak groeide afgelopen kwartaal met 82 procent, veel sneller dan die van Amazon en Microsoft.

Zo bezien is de bestuurswissel van woensdag geen teken van een bedrijf dat de weg kwijt is, maar van een bedrijf dat andere kaarten speelt dan zijn rivalen. Albergotti wijst op nog iets: de veelgehoorde kritiek dat Google allang een oppermachtige AI-app had moeten lanceren, gaat ervan uit dat de wereld sneller verandert dan werkelijk het geval is. AI mag dan in hoog tempo beter worden, de brede toepassing in de economie staat nog in de kinderschoenen, deels omdat er te weinig datacentra zijn en de kosten te hoog. Juist daar zit Googles troef: eigen chips, een gigantische bestaande gebruikersbasis en de grip op het populairste mobiele besturingssysteem ter wereld. Of dat een gok is of een meesterzet, weten we pas over een paar jaar.

🛠️ AI Toolkit+ 

Je hebt nu een leger AI-collega's. Dit kun je ze laten doen.

Vorig jaar bouwden we voor de televisie een compleet marketingbureau van AI-agents, die via Discord met elkaar overlegden en samen een campagne in elkaar zetten. Alexander liet het resultaat zien bij Eva, en het gesprek erover ging het land door. Wat de kijkers niet zagen: dat kostte ons dagen aan bouwwerk, met koppelingen die aan elkaar hingen van plakband. Inmiddels is de technologie veel verder.

Dinsdag lieten we zien hoe je in vijf minuten een werkruimte à la Slack opzet waarin AI-agents als volwaardige collega's meedraaien. Datzelfde bureau bouw je daarin nu op één middag.

Wij deden de proef op de som met een klus die we normaal zelf doen: het wereldnieuws afstruinen voor deze nieuwsbrief. Een middag later hadden we een eigen redactiekanaal, een AI-nieuwsagent met een snuffelhondje als profielfoto, en een briefing van vijf verhalen met bronnen, Nederlandse koppen en een eerlijke lijst van wat de agent niet had kunnen verifiëren. Van vraag tot briefing: vijf minuten.

Hoeveel daarvan de nieuwsbrief van dinsdag haalde, lees je hieronder. Plus zes klussen waarbij een team agents echt iets kan wat één chatbot niet kan.

Wat leer je vandaag?

  • Hoe je je eigen marketingbureau bouwt: agents die trends signaleren, teksten schrijven en elkaar redigeren.

  • Hoe je je eigen cijfers dagelijks laat binnenkomen, zodat je agents meedenken over echte data.

  • Hoe je een heel onderzoeksproject in één kanaal laat lopen, met agents die dezelfde context delen.

  • De ene instelling die het verschil maakt tussen een agent die klakkeloos doorgeeft en een die eerlijk zegt wat hij niet weet.

  • Ons eerlijke oordeel: wat een AI-agent wel kan overnemen en wat beslist niet.

  • Zes uitgewerkte klussen met voorbeeldopdrachten die je kunt overnemen.

Abonneer je om verder te lezen

Het verschil tussen een oké en een briljant AI-antwoord zit in de prompt. Word nog beter in prompten en laat AI écht voor jou werken.

Abonneer nu

Dit zit achter de betaalmuur:

  • Praktische prompt-tips die je meteen kunt gebruiken
  • Uitleg waarom ze werken, zodat je zelf betere prompts leert schrijven
  • Variaties per vakgebied
  • Toegang tot het volledige archief