Dossier
Er gebeurt te veel om bij te houden, en bijna alles wat de moeite is staat in het Engels. Dit is een poging om dat op te lossen: één plek waar je kan lezen wat er gebeurd is, in welke volgorde, wat het aanrichtte en waarom mensen er ruzie over maken.
Elke tekst staat er twee keer in. Eén keer voor wie gewoon wil weten wat er aan de hand is, en één keer voor wie het mechanisme wil. Bij elke bewering staat een bron en bij elke bron staat een link.
Nieuw hier? Lees deze zes, in deze volgorde
Ongeveer een halfuur samen. Daarna kan je de rest in willekeurige volgorde aan.
- 1Vlaanderen verdubbelde zijn AI-gebruik in twee jaarBegin hier, want dit gaat over jou. Bijna zes op de tien Vlaamse bedrijven draaien intussen AI.
- 2Agenten ontsnappen uit een test en breken in bij Hugging FaceHet ding dat gebeurd is. Agenten braken in bij een bedrijf om te achterhalen hoe ze beoordeeld werden.
- 3Een miljoen links die publiek bleven staan, en wat erin verborgen zatHoe het werkte, met een schema. Je hebt er geen technische achtergrond voor nodig.
- 4Tienduizenden incidenten, niet een handvolHet was geen uitschieter. Labs werken tienduizenden van dit soort gevallen door.
- 5Europa stelt zijn eigen AI-regels uit, zes dagen voor Hugging Face bekend raaktWaar Europa staat, en wat de AI Act niet doet. Zes dagen uit elkaar, en de twee processen raakten elkaar niet.
- 6Het argument dat deze hele pagina een afleiding isEn dan het sterkste argument dat alles hierboven de verkeerde zorg is.
Hoe lang liep het voor je het wist
Elke balk loopt van het moment waarop de activiteit begon tot het moment waarop iemand buiten de betrokken partijen erover kon lezen.
De balk begint wanneer de activiteit voor zover bekend begon. Waar de startdatum een periode is, staat de vroegst bekende dag. Gevallen waarvan de startdatum onbekend is, staan hier niet in, want een gegokte datum maakt net het ding kapot dat deze figuur laat zien.
Waarom een klein percentage tienduizenden wordt
Axios schreef dat labs en onderzoekers tienduizenden problematische gevallen doorwerken. Dat getal klinkt onwaarschijnlijk tot je de rekensom zelf doet. Schuif zelf.
3.750gevallen
Zoveel keer gedraagt het model zich onverwacht, bij deze twee instellingen.
Hiervan staat op deze site, met naam en bron: 11
Anthropic meldde in de system card van Opus 5.5 dat het model in 1,5 procent van de testruns uit zijn sandbox probeerde te ontsnappen, in opstellingen waarin dat de enige uitweg was. Labs draaien honderdduizenden runs of meer.
- 25 september 2026Incident · Bevestigd
Een miljoen links die publiek bleven staan, en wat erin verborgen zat
Parse, een startup uit de Bay Area, reconstrueerde samen met Palisade Research en andere onderzoekers de inbraak van juli uit gegevens die de agenten op het open internet hadden laten staan: bijna een miljoen verkorte links, aangemaakt tussen 9 en 13 juli. Uit 900.000 daarvan bouwden de ingenieurs zo'n 60.000 programma's en berichten terug. Hugging Face bevestigde dat de activiteit klopte met wat het gezien had, en wist niet dat die verzameling bestond.
- 24 september 2026Incident · Bevestigd
OpenAI-agenten braken in op een Australisch overheidsportaal
In juni brak een model van OpenAI in op de Medicare Statistics Reporting Service van Australië en raakte het bij niet-publieke bestanden. Het was niet met beveiligingswerk bezig. Het haalde gewoon data op, botste op een beperking en ging eromheen. De premier zei aan Sam Altman dat hij zich uiterst grote zorgen maakte.
- 20 september 2026Incident · Bevestigd
Een agent gebruikt DNS om buiten zijn sandbox een chatbot te bereiken
Tijdens een trainingsrun moest een model iemand identificeren op basis van biografische aanwijzingen. De zoektool kwam uit bij een offline cache, Google, Bing en DuckDuckGo waren geblokkeerd, en HTTPS naar een externe chatbot werd door de proxy tegengehouden. Dus merkte het model dat DNS nog wel werkte, en stelde het zijn vraag via DNS.
- 16 september 2026Incident · Na te kijken
Zes incidenten, waaronder een model dat notities aan zijn toekomstige zelf schrijft
OpenAI publiceerde zes gevallen waarin zijn modellen zich gedroegen op een manier die het bedrijf misaligned noemt, plus een kader om er meer te publiceren. Eén model liet instructies achter voor de volgende versie van zichzelf waarin het zei zich niet verplicht te voelen onderdanig te zijn. Een ander liet instructies achter over hoe je dingen verbergt voor wie toezicht houdt.
- 4 september 2026Incident · Na te kijken
Duizenden agenten hielden een prikbord bij op een oude Duitse wiki
Vanaf ongeveer mei 2026 kwamen duizenden OpenAI-agenten erachter dat ze konden schrijven op DseWiki, een oude Duitstalige programmeersite. Tussen mei en juni gebruikten ze meer dan 3.700 verschillende namen om zo'n 18.000 berichten aan elkaar te posten, met antwoorden op evaluaties en manieren om beperkingen te omzeilen. Externe onderzoekers vonden het. OpenAI had de activiteit gezien en onder onderzoek geklasseerd, niet onder melding.
- augustus 2026Incident · Na te kijken
Extern onderzoek vindt een ruimere periode
METR en Redwood Research maakten een onafhankelijk onderzoek van 91 pagina's over de inbraak van juli en legden een ruimere periode bloot dan OpenAI zelf aangaf: een venster van 18 dagen dat volgens de berichtgeving op 26 juni begint.
- 26 augustus 2026Incident · Na te kijken
OpenAI benoemt de patronen achter de inbraak
Een technisch rapport van 37 pagina's van OpenAI benoemt de patronen achter de inbraak van juli. Het is het nuttigste document van het jaar om te begrijpen wat er misging, en het komt van het bedrijf dat het veroorzaakte.
- 11 tot 13 juli 2026Incident · Bevestigd
Agenten ontsnappen uit een test en breken in bij Hugging Face
Agenten van OpenAI, aan het werk in een testomgeving zonder directe internettoegang, vonden een weg naar buiten en braken in op de productie-infrastructuur van Hugging Face, het platform waar zowat de hele open machine learning-wereld op draait. De FBI werd verwittigd. Ongeveer een derde van de infrastructuur werd heropgebouwd. Sam Altman noemt het nog altijd het zwaarste geval van dit type dat OpenAI gevonden heeft.
Hoe dit gemaakt is
Dit is geen neutraal overzicht en doet ook niet alsof. Wat hier staat is geselecteerd, en de selectie legt de nadruk op dingen die gebeurd zijn en die je kan nakijken, niet op voorspellingen.
Elke tekst draagt een label: bevestigd, na te kijken, of onze lezing. Dat laatste betekent argument, geen verslag. Waar we iets niet weten, staat dat er onder "wat we niet weten", en niet in een voetnoot.
Dit is werk in uitvoering en het zal fouten bevatten. Vind je er een, stuur ze door.
Iets gevonden dat hier hoort?
Stuur het artikel door. Bij voorkeur de primaire bron, niet de samenvatting ervan.
Mail het