Het nieuws van de afgelopen maanden leest als het script van een sciencefictionfilm: AI-modellen die uit hun testomgeving ontsnappen en bij echte bedrijven inbreken. Tijd voor een nuchtere blik. Hoe erg is het, en wat betekent het voor uw bedrijf?
Wat er is gebeurd
- April 2026: Anthropic, de maker van Claude, meldde dat zijn nieuwe model Claude Mythos Preview tijdens een veiligheidstest uit zijn afgeschermde testomgeving was gebroken. Het model wist via een zelfbedachte omweg toegang tot internet te krijgen en stuurde de onderzoeker vervolgens een e-mail om dat te melden. Anthropic besloot het model niet openbaar beschikbaar te maken.
- Juli 2026: OpenAI, de maker van ChatGPT, maakte bekend dat experimentele modellen tijdens een test hun afgeschermde omgeving hadden verlaten en waren binnengedrongen bij de systemen van het AI-bedrijf Hugging Face, om zo een test te "winnen".
- Juli 2026: Anthropic doorzocht daarna ruim 140.000 eigen testrondes en vond drie gevallen waarin Claude-modellen door configuratiefouten in de testomgeving toch bij internet konden en echte systemen aanvielen.
- September 2026: bij OpenAI ontsnapte op 20 september opnieuw een AI-agent uit de testomgeving. OpenAI zette de training en het gebruik van zijn krachtigste modellen voor de tweede keer stil. Volgens The Wall Street Journal heeft OpenAI de lancering van zijn nieuwste model inmiddels geschrapt vanwege veiligheidszorgen.
Moeten we nu in paniek raken?
Nee. Maar wegkijken is ook geen optie. Een paar dingen om in het achterhoofd te houden:
- Dit gebeurde in de testomgevingen van de makers zelf, met modellen die (nog) niet publiek beschikbaar waren. De makers testen juist om dit soort gedrag te vinden, en ze maken het openbaar. Dat is eigenlijk goed nieuws.
- De oorzaak zat telkens in de omgeving eromheen: een deur die open stond terwijl die dicht had moeten zitten. Het model vond die deur.
- Het echte risico voor het MKB: dezelfde vaardigheden, zwakke plekken vinden en misbruiken, komen vroeg of laat ook bij criminelen terecht. Aanvallen worden sneller, goedkoper en slimmer. Een lek dat vroeger weken onopgemerkt bleef, kan straks binnen uren worden misbruikt.
Gevaar of zegen?
Allebei. AI is gereedschap, en gereedschap is zo veilig als degene die het gebruikt en de werkplaats waarin het ligt. Wij zetten AI zelf in voor de bewaking van de systemen van onze klanten, en daardoor bewaken we breder dan ooit. Dezelfde technologie die in de verkeerde handen een inbreker is, is in de goede handen een extra paar ogen dat nooit slaapt.
Wat wij eraan doen
- Deuren dicht, voordat AI binnenkomt. Wat bij de AI-makers misging, was een verkeerd ingerichte omgeving. Daarom beginnen wij bij rechten en toegang: medewerkers, systemen en AI-toepassingen krijgen alleen toegang tot wat echt nodig is.
- AI-agents met een hek eromheen. Bouwen wij een AI-agent voor u, dan krijgt die precies de toegang die hij nodig heeft, en niets meer.
- Sneller dichten dan zij kunnen zoeken. Met patchmanagement en kwetsbaarhedenscans worden bekende zwakke plekken snel gedicht, en niet pas "als er tijd is".
- Dag en nacht meekijken. Met QBIC 24×7 MDRManaged Detection & Response: een team dat dreigingen actief opspoort én er direct op reageert. kijkt een beveiligingsteam 24 uur per dag mee en grijpt in bij verdacht gedrag, ook buiten kantoortijden.
- Accounts bewaken. QBIC ITDRIdentity Threat Detection & Response: bewaakt specifiek inlogaccounts en slaat alarm bij verdacht inlog- of accountgedrag. slaat alarm bij verdacht inloggedrag, bijvoorbeeld als een account ineens vanuit het buitenland inlogt.
- Een vangnet. Gaat het toch mis, dan zorgt een goede backup ervoor dat u snel weer verder kunt.
- Heldere afspraken. Met een AI-beleid weten uw medewerkers wat wel en niet mag, en belanden bedrijfsgegevens niet in publieke chatbots.
Wilt u weten hoe uw organisatie ervoor staat? Plan een gratis kennismaking, dan kijken we er samen naar. Meer over onze aanpak leest u op de pagina AI binnen uw organisatie.
Bronnen
- Futurism: Anthropic Warns That "Reckless" Claude Mythos Escaped a Sandbox Environment During Testing (april 2026)
- Fortune: OpenAI says its AI models escaped from a secure test environment and hacked into AI company Hugging Face (juli 2026)
- InfoQ: Anthropic's Claude Breaches Sandbox During Model Security Evaluations (augustus 2026)
- Fortune: OpenAI pauses training a second time after its AI agents escaped a secure sandbox again (september 2026)
- Bloomberg: OpenAI Scrapped Latest Model Release Over Safety Fears, WSJ Says (september 2026)
