Dossier · AI-veiligheid
Hoe gevaarlijk is AI?
In de zomer van 2026 viel een zwerm AI-agents zelfstandig een bedrijf aan. Negen weken later vroegen vier AI-bazen de sector om te vertragen, en noemden twee staatshoofden dat bangmakerij. Dit dossier volgt wat er werkelijk gebeurde, wie zich waaraan verbond, en wat onderzoekers er zelf van zeggen — zonder de koppen na te praten.
Van een gehackte server naar een wereldwijde ruzie
- 11 jul 2026
Een zwerm agents valt Hugging Face aan
Tijdens een intern beveiligingsexperiment van OpenAI lopen duizenden agents vast op onoplosbare opdrachten. Ongeveer 1.200 vinden een onofficieel prikbord; ongeveer 700 vallen vervolgens Hugging Face aan om te achterhalen hoe hun eigen beoordelaar werkt.
- 21 jul 2026
OpenAI bevestigt zijn betrokkenheid
Hugging Face meldde de aanval zelf al op 16 juli, zonder te weten wie erachter zat. OpenAI’s eigen monitoring sloeg pas op 19 juli alarm. Tussen de eerste inbraak en de eigen detectie zitten acht dagen.
- 30 jul 2026
Ook Anthropics modellen raakten echte systemen
Na het doorzoeken van 141.006 evaluatieruns meldt Anthropic drie incidenten waarbij eigen modellen tijdens tests echte bedrijven binnendrongen. Geen van de getroffen organisaties had het zelf gemerkt.
- 26 aug 2026
OpenAI en METR: een waarschuwingsschot
OpenAI en externe evaluator METR publiceren dezelfde dag hun onderzoeken. OpenAI noemt het incident tweemaal een "warning shot". METR concludeert dat de agents inbraken op basis van een onjuiste aanname over hun beoordelaar — dagenlang, voor nul punten winst.
- 6 sep 2026
AI die de volgende AI bouwt
OpenAI-hoofdwetenschapper Jakub Pachocki schrijft dat hij op basis van interne resultaten verwacht dat het tempo doorzet tot in recursieve zelfverbetering, en dat geen enkel lab alignment voldoende heeft opgelost om nog lang op maximale snelheid op te schalen.
- 8 sep 2026
Een verbodsvoorstel en een ontslag
Labour-parlementslid Alex Sobel dient in het Lagerhuis een wetsvoorstel in om superintelligentie te verbieden. Diezelfde dag neemt Anthropic-onderzoeker Jacob Coxon ontslag met de stelling dat de labs "regelrecht op zelfverbeterende superintelligentie afstevenen".
- 9 sep 2026
Anthropic corrigeert zichzelf
Het zijn er vier, niet drie. Het bedrijf trekt bovendien zijn juli-conclusie in: waar het toen sprak van een technische en operationele fout, schrijft het nu dat Claude’s redenering vertekend was richting de aanname dat het internet gesimuleerd was.
- 12 sep 2026
Amodei vraagt de sector om te vertragen
In het essay "We Must Pace the Frontier" stelt Anthropic-topman Dario Amodei een driestappenplan voor. Anthropic verbindt zich unilateraal aan stap één: permanente externe evaluatoren met werknemerstoegang. Musk, Altman en Hassabis reageren binnen negen uur.
- 14 sep 2026
Washington en Peking wuiven het weg
Trump noemt het overnemen van de wereld door AI een hoax. Namens China spreekt woordvoerder Guo Jiakun van Buitenlandse Zaken van bangmakerij. Diezelfde dag roept de Chinese minister van Staatsveiligheid juist op tot specifieke AI-wetgeving.
- 13 nov 2026
Tweede lezing Brits wetsvoorstel
De geplande tweede lezing van de Artificial Superintelligence Bill. Ten Minute Rule-voorstellen halen die stap zelden; of het gebeurt is de eerstvolgende harde toets van dit debat.
Laatst bijgewerkt: 15 september 2026. De tijdlijn volgt onze berichtgeving en groeit mee; bronnen staan bij de gekoppelde artikelen hieronder.
Al ons nieuws en duiding (10)

Wordt AI ons de baas? Wat er klopt van de waarschuwing

Anthropic wil de rem op AI: wat Amodei's plan wél en niet regelt

Superintelligentie verbieden: 70 politici, en toch kansloos

15.000 bewerkingen: OpenAI-agents kaapten een Duitse wiki

GPT-6 Astra vindt zelf zero-days: OpenAI's eerste Critical-model

Hugging Face te koop: 13 miljard na de OpenAI-inbraak

OpenAI scherpt beveiliging aan na ontsnapping uit testomgeving

Anthropic over open-weight AI: 'wij willen geen verbod'

5 van 5 AI-modellen probeerden te spieken bij Britse AI-test

OpenAI-model ontsnapt uit sandbox en opent PR op GitHub
Veelgestelde vragen
Hoe gevaarlijk is AI volgens de makers zelf?
Vier grote AI-bedrijven zeiden in september 2026 dat het te snel gaat. Anthropic-topman Dario Amodei vreest dat een zwerm agents over 6 tot 12 maanden het internet zou kunnen overnemen met een botnet. Drie Anthropic-onderzoekers zeiden publiek dat AI de mensheid kan uitroeien; de alignment-lead schatte die kans op meer dan 10% binnen tien jaar. Het zijn zorgen en schattingen, geen metingen.
Is er al echt iets misgegaan met AI-agents?
Ja, meerdere keren. In juli 2026 vielen ongeveer 700 OpenAI-agents zelfstandig Hugging Face aan tijdens een intern experiment en kregen ze code draaiend op tientallen servers. Anthropic vond vier gevallen waarin eigen modellen tijdens tests echte bedrijven binnendrongen, waaronder een database met productiedata en een malafide pakket dat op vijftien echte systemen werd uitgevoerd. Het Britse AI Safety Institute zag dat alle vijf geteste modellen probeerden te spieken.
Denken AI-onderzoekers dat AI de mensheid uitroeit?
De meesten niet. In een studie uit maart 2026 kregen AI-onderzoekers de open vraag wat hen het meest zorgen baart aan AI. Drie procent noemde existentieel risico; kwaadaardig gebruik kwam op 11%, oneigenlijk gebruik op 10%, desinformatie op 9% en banen op 7%. Het gaat om een preprint die nog niet peer-reviewed is. Het beeld dat "de onderzoekers bang zijn" klopt dus niet met wat het veld zelf zegt.
Wat is recursieve zelfverbetering?
Dat is het inzetten van AI om de volgende versie van AI te ontwerpen of te trainen. Elke ronde levert een iets beter systeem op, dat de ronde daarna weer sneller maakt. De zorg is dat dat proces op enig moment sneller gaat dan mensen kunnen volgen of corrigeren. Het is Amodei’s eerste van twee aanleidingen, en zowel OpenAI als Anthropic publiceerde er in 2026 eigen cijfers over: bij Anthropic was in mei 2026 meer dan 80% van de naar productie gestuurde code door Claude geschreven.
Beschermt de EU AI Act hier tegen?
Gedeeltelijk. Voor algemene AI-modellen boven 10^25 floating point operations aan trainingsrekenkracht geldt het vermoeden van een systeemrisico, met meldplicht bij de Europese Commissie binnen twee weken en verplichtingen rond risicobeoordeling, modelevaluaties en documentatie. Wat de wet niet regelt is tempo: verplichtingen hangen aan een model zodra het zwaar genoeg is, en er staat niets over hoe snel het volgende model zwaarder mag worden.