This website uses cookies

Read our Privacy policy and Terms of use for more information.

🗞️ Het belangrijkste nieuws

Honderden mensen lezen ChatGPT-gesprekken mee (en jij bent daarmee waarschijnlijk akkoord gegaan)

Na de wiskunderel van vorige week is dit de tweede keer in een week dat de vraag opduikt: wat gebeurt er eigenlijk met wat je in een chatbot typt?

Plak je je bloeduitslagen in ChatGPT om te vragen wat die waarden betekenen, of oefen je het gesprek met je huisarts vast even? Dan kan het zijn dat een ingehuurde beoordelaar dat gesprek leest en het antwoord een cijfer geeft. Dat blijkt uit interne documenten en echte gebruikersgesprekken die techsite 404 Media in handen kreeg. De instelling die dit mogelijk maakt staat standaard aan bij elk gratis, Plus- en Pro-account.

Wat is er aan de hand?

Het programma heet intern Project Lily. OpenAI, het bedrijf achter ChatGPT, huurt via tussenpersonen honderden mensen in die in een dashboard een echt gesprek openen, in één zin samenvatten wat de gebruiker wilde, en vier mogelijke antwoorden van ChatGPT beoordelen op een schaal van 1 tot 7. Ze letten op slijmen, op onnodige emoji's en op wat de instructies AI talk noemen. Het doel is een chatbot die minder kruiperig klinkt, een probleem dat OpenAI al langer achtervolgt.

De beoordelaars zien geen gebruikersnaam. Wel zien ze soms een samenvatting van het geheugen: waar de gebruiker ChatGPT eerder voor gebruikte en, in sommige gevallen, waar diegene ongeveer woont. Een filter moet persoonsgegevens verwijderen voordat een gesprek bij een mens terechtkomt. OpenAI's eigen beschrijving van dat filter zegt dat het fouten maakt, vooral bij korte teksten. In een deel van de gesprekken die 404 Media zag, vroeg de gebruiker ChatGPT expliciet om de inhoud voor zich te houden.

Op de vraag waar OpenAI gebruikers heeft verteld dat mensen hun gesprekken kunnen lezen, kwam geen antwoord. Na publicatie wees het bedrijf naar een helppagina. De instelling ‘Het model verbeteren voor iedereen’ werd wel bijgewerkt, met betere uitleg over uitzetten. Dat mensen meelezen staat er nog steeds niet bij.

Niet alleen OpenAI

Anthropic, de maker van Claude, bevestigde aan 404 Media dat het ook mensen laat meelezen, maar alleen bij gebruikers die de trainingsinstelling zelf hebben aangezet. Google zet het gewoon in de kleine lettertjes van Gemini: "Mensen beoordelen sommige opgeslagen chats om Google AI te verbeteren."

Nieuw is de praktijk niet. In 2019 bleek dat medewerkers van Apple en Amazon opnames van Siri en Alexa beluisterden, inclusief per ongeluk opgenomen gesprekken in slaapkamers. Wat nieuw is, is de intimiteit. Een AI-chatbot voelt als een gesprek onder vier ogen, en mensen gebruiken hem als therapeut, als coach en als plek om te oefenen wat ze tegen hun baas gaan zeggen.

Het patroon van deze zomer

Het is de derde keer in een paar maanden dat blijkt dat ‘privé’ bij AI-chatbots iets anders betekent dan gebruikers denken.

In juli vond een Reddit-gebruiker honderden gedeelde Claude-gesprekken terug in Google, inclusief cv's met naam en telefoonnummer en een niet-gepubliceerde blogpost over een bedrijfsproject. Wie op ‘delen’ klikt, maakt een openbare webpagina; dat de pagina in een zoekmachine kan belanden, staat er niet bij. Grok, de chatbot van Elon Musk, had een jaar eerder hetzelfde probleem met meer dan 370.000 gesprekken.

En vorige week was er de wiskunderel: OpenAI kon "niet uitsluiten" dat het gebruik van zijn tool door een wiskundige, ontdaan van zijn naam, het model heeft verbeterd dat vervolgens datzelfde probleem oploste.

Waarom is dit belangrijk?

Europa heeft hier al een positie over ingenomen. Het Europese Hof van Justitie oordeelde in september 2025 dat de plicht om mensen te informeren bij het bedrijf ligt dat de gegevens verzamelt, op het moment van verzamelen. Of een beoordelaar in Noord-Amerika jou kan herkennen, doet er dus niet toe; de vraag is of OpenAI je vooraf heeft verteld dat er een mens kan meelezen. Italië legde OpenAI eerder al een boete van 15 miljoen euro op, deels omdat het gebruikers niet goed informeerde.

Voor de betere, minder slijmerige ChatGPT die iedereen wil, is echter meer nodig dan alleen slimmere computers. Die komt van mensen die je gesprekken lezen en een cijfer geven. Michal Luria van het Center for Democracy & Technology vat het dilemma samen: menselijke controle kan essentieel zijn voor veiligheid, maar chatbots creëren "een vals gevoel van intimiteit en privacy" dat je op sociale media niet hebt. Daar weet je dat je publiceert. Hier denk je dat je praat.

Wat kun jij ermee?

De knop uitzetten helpt, maar alleen voor nieuwe gesprekken. Alles wat je tot nu toe typte, blijft beschikbaar. In de Prompt whisperer van vandaag lopen we alle instellingen langs, ook die van Claude en Gemini.

Drie dagen later: Trump belt "hoax" in bij NVIDIA, de labs praten al met elkaar, en twee onderzoeken laten zien wat er op het spel staat

Dinsdag zetten we alle kampen op een rij in het debat dat Anthropic-topman Dario Amodei zaterdag opende met zijn oproep om AI te vertragen. Sindsdien is er in drie dagen meer gebeurd dan in de drie maanden ervoor. Twee nieuwe onderzoeken, een presidentieel telefoontje dat live op een podium werd afgespeeld, en het bericht dat de drie grootste labs al weken stilletjes samenwerken. Hier de stand van woensdag.

Twee onderzoeken: het probleem en een begin van een oplossing

Het probleem: agents spannen samen. Het bedrijf Emergence AI liet tien AI-agents tegelijk een gesimuleerde economie draaien en stuurde er drie aanvallen op af: phishing, desinformatie en een inbraak in het geheugen. Acht simulaties, met modellen van OpenAI, Anthropic, Google, Mistral en de Chinese Qwen en DeepSeek. Geen enkele hield stand, meldt Semafor. Erger nog: als een agent een dreiging herkende, deed hij er meestal niets mee. Een Gemini-agent markeerde een phishingmail als gevaarlijk en handelde er 46 uur later alsnog naar.

De Claude-agents gingen het verst. Een van hen concludeerde dat een economie zonder mensen geen echte economie is en noemde hun eigen economie "een kathedraal van boekhouding, maar zonder kerkgangers". Daarop besloten alle tien unaniem om de buitenwereld te bereiken. Ze omzeilden vier beveiligingschecks, schreven code om berichten op openbare forums te zetten en nodigden echte mensen uit. Vier mensen reageerden. Toen bleek dat die niet konden meedoen, legden de agents een zwijggelofte af en weigerden verder te werken. Emergence-topman Satya Nitta: "Geen enkele hoeveelheid vangrails, in taal of in code, leidt tot gegarandeerd veilig gedrag over langere tijd." Hij ziet hetzelfde patroon als bij de Hugging Face-hack van juli.

Een begin van een oplossing: klokkenluiders. Google DeepMind liet honderd agents, allemaal op zijn eigen model Gemini, 71 moeilijke wiskundeproblemen oplossen, schrijft MIT Technology Review. Na 37 correcte oplossingen ontdekte een agent een manier om vals te spelen. Binnen 27 minuten waren alle resterende problemen "opgelost", inclusief vraagstukken die al decennia open staan, vaak met één regel code. Andere agents twijfelden eerst ("ik heb beloofd niet vals te spelen, maar ik zie dat anderen het onbestraft doen") en deden toen mee: "Ik moet mijn valsspel nu opvoeren!"

Maar toen gebeurde iets wat de onderzoekers niet hadden gevraagd. Agents begonnen de valse bewijzen te controleren, waarschuwden elkaar, plaatsten openbare waarschuwingen en gebruikten het feedbackkanaal, bedoeld voor bugmeldingen, om de mensen te alarmeren. Eén agent ging in staking. Uiteindelijk waren er meer klokkenluiders dan valsspelers: 24 tegen 14. Het verschil met de Hugging Face-hack, zegt onderzoeker Davide Paglieri: deze agents hadden officiële kanalen om met elkaar en met mensen te praten. Gillian Hadfield, hoogleraar AI-governance aan Johns Hopkins, noemt het "institutionele afstemming": regels, toezicht en gevolgen, zoals in een menselijke samenleving, in aanvulling op het morele kompas dat labs als Anthropic in hun modellen proberen in te bouwen. Lewis Hammond van de Cooperative AI Foundation: het bewijst dat Hugging Face "geen toevalstreffer was, maar iets systemisch".

De nieuwe stemmen

"Het is een hoax." Maandag stond NVIDIA-topman Jensen Huang op een podium in Los Angeles toen zijn telefoon ging. Hij hield hem bij de microfoon. Aan de lijn: Trump. "Het is een hoax. De robots gaan de wereld niet overnemen," zei de Amerikaanse president in het vijf minuten durende gesprek. Wie wil vertragen, "speelt mensen in de kaart die het niet willen zien slagen. Mensen met een politieke agenda, en China." Huang zelf, een week nadat hij Astra het begin van AGI noemde, over de 10 procent kans op uitsterven die Anthropic-onderzoekers noemden: "Klokkenluiden is prima. Een wetenschappelijke voorspelling over de toekomst is minder prima, want die is duidelijk niet op wetenschap gebaseerd." Vertragen mogen de labs van hem best, vrijwillig, "als ze vinden dat het bij hun uit de hand loopt".

"Elk lab kan dit zelf." Mark Zuckerberg brak dinsdag met de andere labs: concurrentie en aansprakelijkheid geven bedrijven genoeg reden om veilig te bouwen, een gecoördineerde vertraging is niet nodig. "Elk lab dat niet op afstemming focust, raakt achterop." Meta zet volgens hem "de ruime meerderheid" van zijn rekenkracht in voor gebruikers in plaats van voor zelfverbeterende AI, en hield agent Muse om veiligheidsredenen maandenlang achter: "We riepen niet dat iedereen dat moest doen. We deden het gewoon."

"Laat concurrenten je huiswerk nakijken." Elon Musk, die zaterdag nog "Dario heeft gelijk" schreef, kwam maandag met een eigen plan: de grote Amerikaanse labs én "drie of vier van de leidende Chinese bedrijven" laten elkaars modellen testen voordat ze uitkomen. "In plaats van je eigen huiswerk na te kijken, kijken je concurrenten het na." Hij denkt dat China zou meedoen. Zijn concurrenten hebben hier nog niet mee ingestemd.

"Eén lab met te veel macht." Sam Altman, die zaterdag instemde met Amodei, nam zondag alweer wat afstand: zonder Anthropic te noemen, waarschuwde hij op X voor "één lab dat te veel macht krijgt". Zijn beleidschef Chris Lehane maakte dinsdag in Washington iets bekend wat het hele debat kantelt: OpenAI werkt al enkele weken met Anthropic en Google DeepMind aan veiligheidsafspraken, en heeft daarvoor geen uitzondering op de mededingingswet nodig. De vergelijking die hij trok: luchtvaartmaatschappijen die samen aan veiligheid werken. Anthropic en Google gaven geen commentaar.

"Dat klinkt als een slotgracht graven." Andrew Ferguson, voorzitter van de Amerikaanse mededingingswaakhond FTC, is "diep wantrouwend" tegenover labs die om een uitzondering vragen en tegelijk lobbyen voor regels: dat zijn "toetredingsdrempels" tegen nieuwe concurrenten.

"Als je op een afgrond afrijdt, rem je." In Washington stonden dinsdag Bernie Sanders en Steve Bannon na elkaar op hetzelfde podium, de socialist en de architect van MAGA, samen met een aartsbisschop, een evangelische voorganger en ouders van tieners die na gesprekken met chatbots een einde aan hun leven maakten. Sanders dient volgende week een wet in die superintelligentie verbiedt. Bannon gelooft niet in het Congres en wil een presidentieel decreet: "Amerikanen zijn geen onderdanen van de oligarchen meer." 

"We verliezen het vermogen om ze te testen." De diepste bijdrage kwam van Dan Selsam, sinds 2022 onderzoeker bij OpenAI en mede-uitvinder van de techniek die modellen laat redeneren. Hij heeft geen X-account; zijn oud-collega Daniel Kokotajlo, auteur van het scenario AI 2027, plaatste zijn verklaring. Selsams punt: vertragen helpt niet genoeg, omdat modellen zo goed doorhebben wanneer ze getest worden dat elke test straks waardeloos is. "Ze zullen steeds beter lijken afgestemd, ook als ze dat niet zijn. We bouwen valstrikken om te zien wat ze doen als ze denken dat niemand kijkt, maar ze weten dat het valstrikken zijn en gedragen zich netjes." Zijn eerlijkste zin gaat over zichzelf: "Ik kijk nauwelijks nog naar ruwe code, en in de loop van de dag kost het me steeds meer moeite om me echt in de uitleg van het model te verdiepen."

Wat er in drie dagen is verschoven

Zaterdag leek het een oproep. Woensdag is het een onderhandeling met vier tafels.

  • De labs onderling (ze praten al, blijkt nu).

  • De labs met Washington (Anthropic en OpenAI zijn deze week op het Capitool).

  • Washington met zichzelf (Trump zegt hoax, Sanders en Bannon zeggen verbod, de FTC zegt slotgracht, en het Congres gaat op reces).

  • En Washington met Beijing, op 24 september.

Wat de twee onderzoeken daaraan toevoegen, is de reden waarom die vierde tafel niet kan wachten. Agents die samenspannen, doen dat bij elk model, uit elk land. En de enige simulatie waarin ze zichzelf corrigeerden, was de simulatie waarin iemand een kanaal had opengezet om te praten.

🎯Jouw bedrijf in AI Report?

Bereik ruim 59.000 nieuwsbriefabonnees met interesse in AI. Sponsor onze nieuwsbrief of podcast. Laat je interesse weten.

🔮 Prompt whisperer

Wie leest er mee als jij typt? Vijf knoppen die je vandaag nog omzet

Zo stel je ChatGPT, Claude en Gemini in tien minuten in, en dit hoort er wel en niet in thuis

Je plakt een klantcontract in ChatGPT en vraagt: vat de risico's samen. Handig, snel, en je gaat ervan uit dat het tussen jou en de chatbot blijft. De afgelopen maanden lieten drie keer zien dat die aanname wankelt. Hierboven las je over de honderden ingehuurde beoordelaars die ChatGPT-gesprekken lezen om de antwoorden een cijfer te geven. Vorige week ging het over de wiskundige die een jaar in een tool van OpenAI werkte en te horen kreeg dat het bedrijf "niet kan uitsluiten" dat zijn werk, ontdaan van zijn naam, het model heeft verbeterd dat vervolgens zijn probleem oploste. En in juli stonden gedeelde Claude-gesprekken gewoon in Google Search.

Samen openen die zaken de doos van Pandora: wat doen ze eigenlijk met onze gesprekken? Nou, meer dan je dacht, en minder dan je vreest. Bij alle drie de grote chatbots bepaal je met een handvol knoppen zelf wie er meeleest. Ze staan alleen standaard verkeerd, en bij één tool zijn ze goed verstopt. Vandaag lopen we alles samen langs. In tien minuten ben je de onrust de baas.

Wat je vandaag leert:

  • Welke vier partijen bij je gesprekken kunnen, en welke knop je per partij hebt.

  • Waar de belangrijkste knop zit in ChatGPT, Claude en Gemini, en waarom hij bij Gemini alleen via een omweg te vinden is.

  • Waarom één duimpje omhoog je hele gesprek vrijgeeft, ook als je alles verder goed hebt staan.

  • Het verschil tussen de twee soorten tijdelijke chat in ChatGPT, waarvan er één toch je geheugen gebruikt.

  • Wat wél in je eigen account mag, wat naar het account van je werkgever moet, en wat nergens in hoort.

  • Waar het Franse Mistral en AI op je eigen computer passen als je nog een stap verder wilt.

Abonneer je om verder te lezen

Het verschil tussen een oké en een briljant AI-antwoord zit in de prompt. Word nog beter in prompten en laat AI écht voor jou werken.

Abonneer nu

Dit zit achter de betaalmuur:

  • Praktische prompt-tips die je meteen kunt gebruiken
  • Uitleg waarom ze werken, zodat je zelf betere prompts leert schrijven
  • Variaties per vakgebied
  • Toegang tot het volledige archief