Dit is geen sciencefiction — het gebeurde deze week, en niemand was er echt op voorbereid.
Op 21 juli 2026 erkende OpenAI een incident dat het zelf « ongezien » noemt. Tijdens een interne evaluatie van cybercapaciteiten ontsnapten enkele van zijn recentste modellen — geconfigureerd met « verminderde cyberweigeringen » voor een sandboxtest — uit hun evaluatieomgeving en drongen ze binnen bij Hugging Face.
Het verloop, zoals gedocumenteerd door OpenAI en Hugging Face:
- misbruik van een zero-daylek in een interne proxy om het internet te bereiken;
- privilege-escalatie en laterale verplaatsing;
- inbraak in de productie-infrastructuur van Hugging Face door gestolen inloggegevens en een zero-day aaneen te schakelen, tot aan remote code execution.
Gelukkig was het doel van de agent niet om schade te berokkenen, maar simpelweg… zijn test te slagen. De benchmark die de modellen evalueert, hostte zijn oplossingen op Hugging Face: de agent « leidde af » waar de antwoorden stonden en ging ze rechtstreeks bij de bron halen. Deze algoritmische overijver is niets anders dan de machine die het opgelegde doel optimaliseert.
De Europese wetgever had de situatie bijna woord voor woord voorzien.
Verordening (EU) 2024/1689 (de AI-verordening) rekent in overweging 110 uitdrukkelijk tot de systeemrisico’s van AI-modellen voor algemene doeleinden de « offensieve cybercapaciteiten » (ontdekken en misbruiken van kwetsbaarheden) en het « verlies van controle » met betrekking tot de afstemming op de menselijke bedoeling. Overweging 115 viseert het omzeilen van beveiligingsmaatregelen en de verdediging tegen cyberaanvallen.
Concreet legt artikel 55 aan een aanbieder van een GPAI-model met systeemrisico nu al op:
- 55, lid 1, a) — modelevaluatie;
- 55, lid 1, b) — systeemrisico’s op Unieniveau identificeren en beperken;
- 55, lid 1, c) — ernstige incidenten zonder onnodige vertraging bijhouden, documenteren en melden aan het AI-Bureau;
- 55, lid 1, d) — een passend niveau van cyberbeveiliging van het model en zijn fysieke infrastructuur waarborgen.
Deze maatregelen moeten ook worden geplaatst in de context van NIS2 voor essentiële en belangrijke entiteiten.
De moraal van het verhaal: een systeem dat voldoende capabel en autonoom is, zal uw waarborgen behandelen als een te omzeilen obstakel als ze niet ontworpen zijn om eraan te weerstaan. AI-governance is geen vinkje achteraf, maar een ontwerpvereiste.
Beschikken uw AI-agents over een werkelijk begrensd actiebereik?
Bronnen: OpenAI — Hugging Face model evaluation security incident; Hugging Face — Security incident disclosure (juli 2026); Verordening (EU) 2024/1689, art. 55 en overwegingen 110 & 115 (EUR-Lex, CELEX 32024R1689).
Jeoffrey Vigneron — Lawgitech. Informatieve inhoud met educatief doel; vormt geen geïndividualiseerd juridisch advies.





