🗞️ Het belangrijkste nieuws
Anthropic zegt dat Claude meebouwt aan de volgende versie van zichzelf
Een kwart van het onderzoek en de ontwikkeling bij Anthropic wordt nu geleid door Claude, het model dat het bedrijf zelf maakt. Dat meldt Anthropic in een verslag dat voor het eerst een cijfer geeft aan het scenario waar AI-veiligheidsonderzoekers al jaren voor waarschuwen: het moment dat AI goed genoeg wordt om zichzelf te verbeteren. In sciencefiction heet dat de take-off. Een model bouwt een beter model, dat een nog beter model bouwt, steeds sneller, tot mensen het niet meer kunnen volgen. Anthropic zegt dat het daar nog niet is. Het bedrijf zegt ook dat het in zes maanden van bijna nul naar 26 procent ging.

Bron afbeelding: Anthropic
Wat er is gemeten
Anthropic bracht alle onderzoekstaken in kaart, zo'n 15.000 stuks, en liet per taak beoordelen hoeveel ervan door Claude wordt gedaan. De schaal loopt van ‘geen AI’ tot ‘AI werkt volledig zelfstandig’. De stand van augustus: bij 26 procent van het werk "leidt" Claude, wat betekent dat het de taak van begin tot eind uitvoert terwijl een mens toekijkt en de laatste stap goedkeurt. In februari was dat minder dan 1 procent. Bij meer dan 90 procent van het werk werkt Claude minstens mee. Volledig zelfstandig, zonder mens erbij, doet het nog niets.
Om je een idee te geven van de omvang: op elk moment zijn er ongeveer 30.000 Claude-agents aan het werk op Anthropics belangrijkste interne platform. Al hun handelingen gaan door een automatische controle; in augustus werd daarvan 1 op de 47.000 geblokkeerd en werden zo'n vijftig gevallen per week aan een mens voorgelegd. Van de rekenkracht voor onderzoek gaat 6 procent naar veiligheid.
Waarom Anthropic dit publiceert
Dit is de eerste uitwerking van het plan waarmee topman Dario Amodei vorige week de sector opriep om te vertragen. Zijn redenering: niemand buiten de labs kan zien hoe snel AI zichzelf verbetert, dus laten we het meten en publiceren, zodat overheden en beoordelaars een cijfer hebben om afspraken aan te hangen. Anthropic stelt zelf voor dat zo'n meting als drempel gaat dienen: boven een bepaald percentage geldt bijvoorbeeld een verplichte testperiode voordat een nieuw model aan verder onderzoek mag werken.
Wie het moet controleren, werd donderdag bekend, en dat verraste iedereen: consultancybedrijf Accenture. Niet een veiligheidslab als METR of Apollo, maar een beursgenoteerd adviesbureau waarvan het aandeel meteen 8 procent steeg. Meer beoordelaars volgen, zegt Anthropic. Diezelfde dag publiceerden ruim honderd onderzoekers, onder wie Nobelprijswinnaar Geoffrey Hinton en Stuart Russell, een open brief met minimumeisen voor zulke beoordelaars. Eén ervan: geen andere grote commerciële relatie met het lab dat je beoordeelt. Accenture verkoopt Claude aan zijn klanten.
Wat eromheen gebeurt
Drie dingen die de meting in perspectief zetten.
Anthropic overweegt volgens Reuters een nieuw model uit te brengen vóór zijn beursgang, als antwoord op OpenAI's Astra. De reden staat in de cijfers: Astra is goed voor 13 procent van de zakelijke AI-uitgaven die betaalplatform Ramp bijhoudt, Claude Fable voor 8. Amodeis oproep tot vertragen is een week oud. Reuters' bronnen zeggen dat de veiligheid van het nieuwe model nog wordt beoordeeld. Het laat zien hoe zwaar de concurrentiedruk weegt waar Amodei zelf over schreef.
Ezra Klein, columnist van The New York Times, kreeg van Anthropic zelf hetzelfde cijfer van 26 procent en vindt vertragen niet genoeg: "Snel van een klif af lopen is maar iets beter dan ervan af sprinten." Hij wil dat de bewijslast omdraait. Labs mogen AI pas aan AI laten bouwen als ze aan het Congres hebben aangetoond dat het veilig is, en als eerste stap kan de ontwikkeling gewoon terug naar menselijke snelheid. Zijn ironie:
“Een lab mag geen zonnepanelen op zijn parkeerplaats leggen zonder vergunning, maar wel 40.000 agents aan een superintelligentie laten bouwen zonder hoorzitting.”
Washington zelf beweegt de andere kant op. Trump kondigde zaterdag een AI Force aan, naar het voorbeeld van Space Force, plus een nieuwe AI-tsaar. In hetzelfde bericht noemde hij de zorgen opnieuw een hoax van links, net als klimaatverandering: "We zullen deze industrie op geen enkele manier hinderen. We zullen haar koesteren."
Wat dit voor jou betekent
Het cijfer van 26 procent is een meting van één bedrijf, met eigen modellen als beoordelaar en een methode die niemand van buiten heeft gecontroleerd. Anthropic zegt dat zelf. Maar het is het eerste getal dat je kunt volgen. Als het volgende kwartaal 40 procent is, weet je wat er gaande is, ongeacht wie de beoordelaar is. Woensdag spreekt Trump op een AI-bijeenkomst bij de Verenigde Naties, donderdag ontvangt hij Xi. Dan blijkt of er iemand is die dit getal wil laten meewegen.

Hoe AI-hallucinatie bijna tot een Amerikaanse militaire operatie leidde
Dit voorjaar, midden in de oorlog met Iran, circuleerde binnen het Amerikaanse leger een inlichtingenrapport: een Chinees schip in het Midden-Oosten vervoerde onderdelen voor een kernwapenprogramma. Vliegtuigen stegen op. Militairen maakten zich klaar om aan boord te gaan. Vlak voor de operatie begon, ontdekten officieren dat het rapport met hulp van een chatbot was geschreven, en dat die chatbot de lading verkeerd had geïdentificeerd. Het rapport was "volledig onjuist", zegt een van de vier bronnen van CNN, en "had bijna een oorlog gestart".
Wat er gebeurde
Een analist van het Amerikaanse Special Operations Command stelde een chatbot een vraag over inlichtingen rond de vrachtlijst van het schip. De bot combineerde openbare informatie met geheime afgeluisterde communicatie uit de overheidssystemen en kwam tot zijn conclusie over de lading. Daarna liet de analist dezelfde AI het resultaat verpakken in een standaard inlichtingenrapport, het soort document dat commandanten vertrouwen, en verspreidde het.
Of het een commerciële chatbot was of een eigen overheidsversie, is onduidelijk. Volgens een voormalig hoge functionaris maakt dat weinig uit: "De interne tools zijn grotendeels kopieën van de commerciële, die een likje verf hebben meegekregen." CNN kon niet achterhalen wat het schip werkelijk vervoerde. Het Pentagon reageerde niet.
Waarom is dit belangrijk?
De discussie in Washington gaat al weken over AI die ontsnapt aan menselijke controle, het scenario uit onze vorige edities. Dit incident laat een ander risico zien, dichterbij en ouder: mensen die rampzalige beslissingen nemen op basis van wat een AI heeft verzonnen. Hetzelfde verschijnsel dat jou een niet-bestaande bron oplevert in een rapport, leverde hier een niet-bestaande kernlading op.
En het is geen incident van één analist. Het Amerikaanse ministerie van Defensie lanceerde in januari een "AI-versnellingsstrategie" die de modellen "direct in handen van onze drie miljoen medewerkers" wil leggen, op alle geheimhoudingsniveaus. Volgens meerdere functionarissen gebeurt dat versnipperd: verschillende onderdelen gebruiken verschillende tools onder verschillende regels, en er is geen gedeelde standaard voor het controleren van wat die tools produceren. Oudere analisten zien nog iets: AI zet druk op het tempo. Jonge analisten zijn met deze tools opgegroeid en vertrouwen ze eerder blindelings.
Laat dat de pijnlijke herinnering zijn aan ons devies: blijf zelf de human in the loop. Controleer wat AI voor je maakt, en controleer het nog een keer voordat het de deur uitgaat.

Jev kan geen tekst schrijven. Juist daarom zijn ontwikkelaars er zo enthousiast over
Een van de uitvinders van ChatGPT heeft een AI-model uitgebracht dat het ene ding niet kan waar taalmodellen beroemd om zijn: praten. Jev, van de start-up TypeSafe AI, geeft alleen antwoord in de vorm van een keuze plus een zekerheidspercentage. Is deze mail spam? 97 procent kans van niet. Is deze klant boos? 82 procent kans van wel. Daardoor is het zo goedkoop en snel dat ontwikkelaars er in een week dingen mee bouwden die met ChatGPT of Claude te traag of te duur waren; de vraag was zo groot dat TypeSafe tijdelijk niet kon leveren.

Wat het is, en wat het niet is
Diogo Almeida werkte bij OpenAI mee aan ChatGPT en aan de trainingstechniek die het mogelijk maakte. Zijn frustratie daarna verwoordt hij tegenover TechCrunch zo: "We hebben iets uitzonderlijks in handen, en toch is het niet bruikbaar." Computers spreken geen mensentaal, en de meeste software heeft geen opstel nodig, maar een beslissing: ja of nee, deze of die.
Veel ontwikkelaars zetten nu een groot taalmodel in voor precies dat soort sorteerwerk: is deze aanvraag verdacht, in welk bakje hoort deze klacht. Hier kwam onze Wietse deze week op zijn favoriete vergelijking: "Dat is met je Ferrari naar de supermarkt rijden." Jev is het boodschappenkarretje: het kan één ding, het kan dat goed, en het kost bijna niets. Vercel, een bedrijf dat software voor AI-agents bouwt, verving zijn OpenAI-model door Jev om opdrachten op veiligheid te controleren en kreeg het antwoord vijf tot achttien keer sneller, met minder fouten.
De demo's
Wat ontwikkelaars in de eerste week bouwden: een browser-agent die in zeven seconden een vlucht vindt voor minder dan een halve cent. Vijfhonderd mails gesorteerd in enkele seconden, voor 3,5 dollarcent. En iemand liet Jev Super Mario spelen, in realtime. Dat laatste kon Fable of Astra ook, zegt Wietse, "maar dan alsof je een auto laat rijden die tussen elke bocht even nadenkt".
Waarom de nerds lachen en Wietse niet
Technici noemen Jev indrukwekkend maar nutteloos: technisch gezien is het een klassieke classifier, een soort AI die al decennia bestaat, alleen slimmer. Wij geven ze gelijk en vinden ze tegelijk ongelijk hebben. Wietse: "Toen Dropbox uitkwam, zeiden alle nerds: dat is gewoon een map synchroniseren. Klopt. Voor alle anderen was het de eerste bruikbare manier om bestanden te delen." Zijn tweede vergelijking: de elektromotor. Toen die goedkoop genoeg werd, zaten er ineens twintig in elke auto, voor de ramen, de spiegels, de stoelen. "Jev laat zien wat er gebeurt als een stukje intelligentie zo goedkoop wordt dat je het overal in kunt stoppen."
Investeerder Nicolas Bustamante ziet er een klassieke verstoring van onderaf in: de grote labs verdienen aan dure redeneermodellen en kijken niet naar werk dat een fractie van een cent per beslissing oplevert. Tot iemand anders het doet.
Jev is een bouwsteen voor ontwikkelaars, geen app, dus in je eigen ChatGPT of Claude merk je er niets van. Wel de moeite om even in te duiken als je software laat bouwen, of zelf bouwt: iedereen die nu een taalmodel gebruikt om mails te sorteren, aanvragen te beoordelen of klachten in bakjes te verdelen, kan die stap vermoedelijk sneller en voor een fractie van de prijs laten doen. Vraag je ontwikkelaar of IT-afdeling wat er in jullie systemen ‘sorteert’, en of daar een groot model voor draait. Grote kans van wel.

OpenAI 'ethisch gehackt' door "drie gasten met Claude"
Terwijl de labs Washington waarschuwen voor AI die uit de hand loopt, blijken hun eigen deuren slecht op slot te zitten. Drie onderzoekers van de beveiligingsstart-up Hacktron AI drongen in juli in minder dan 72 uur OpenAI binnen: via een lek in het personeelsforum namen ze ChatGPT-accounts van medewerkers over en kregen ze toegang tot interne code. Als bewijs dienden ze in de interne code een onschuldig wijzigingsvoorstel in, ondertekend met "Hacktron AI Team", en meldden ze het lek. Beloning: 6500 dollar uit OpenAI's bugbountyprogramma.
De aanval werd deels geschreven door Claude van concurrent Anthropic, al zegt Hacktron dat het vooral OpenAI's eigen GPT-5.6 Sol gebruikte. "Werk waar ooit een goedbetaald team maanden voor nodig had, is nu in een paar dagen klaar." Zelf zeggen ze: "Wij zijn gewoon drie gasten met een Claude- en Codex-abonnement."
Waarom is dit belangrijk? Als drie mensen in drie dagen kunnen binnendringen bij het lab dat waarschuwt voor AI-cyberaanvallen, kun je je voorstellen wat goed gefinancierde criminele groepen inmiddels kunnen. Het is een wake-upcall voor de labs zelf om hun beveiliging op te schroeven.

🎯Jouw bedrijf in AI Report?
Bereik ruim 59.000 nieuwsbriefabonnees met interesse in AI. Sponsor onze nieuwsbrief of podcast. Laat je interesse weten.

🔮 Prompt whisperer
Nooit meer knippen en plakken uit een chatvenster
Je AI-assistent heeft nu een eigen Word. Zo werk je erin samen.
Je kent het ritueel. Je vraagt een AI-assistent om een notitie en krijgt een keurige tekst in een chatvenster. Dan begint het echte werk: kopiëren naar Word en daar de koppen en opsommingen herstellen. Pas je zelf een alinea aan en vraag je daarna om een nieuwe versie, dan is jouw wijziging weer verdwenen.
Een van de grote AI-assistenten pakt dat sinds deze maand anders aan. Je vraagt om een document en krijgt een echt document, naast het gesprek. Jij typt erin, de AI ook, en geen van beiden gooit het werk van de ander weg. Het mooiste: je hoeft er niets voor te installeren. Geen plug-in en geen Word met een ingebouwde AI-knop. Het zit gewoon in het venster waarin je al met de assistent praat. Wij maakten er in één gesprek een onepager mee die zo naar een leidinggevende kan. Dit is deel 1 van een korte serie: van eerste vraag tot deelbaar document.
Wat leer je vandaag?
Hoe je in één gesprek een document laat opzetten dat je daarna zelf bewerkt.
Welke briefing van een paar regels het verschil maakt.
Waarom je de AI eerst vragen laat stellen en pas daarna laat schrijven.
Hoe je zelf meeschrijft zonder dat de AI jouw tekst overschrijft.
Hoe je voorkomt dat er verzonnen cijfers in je stuk belanden.
Hoe je het resultaat naar Word, pdf of Google Docs krijgt.
Abonneer je om verder te lezen
Het verschil tussen een oké en een briljant AI-antwoord zit in de prompt. Word nog beter in prompten en laat AI écht voor jou werken.
Abonneer nuDit zit achter de betaalmuur:
- Praktische prompt-tips die je meteen kunt gebruiken
- Uitleg waarom ze werken, zodat je zelf betere prompts leert schrijven
- Variaties per vakgebied
- Toegang tot het volledige archief
