Ai ontsnapt uit sandbox: OpenAI meldt ongezien cy­be­rin­ci­dent

donderdag, 23 juli 2026 (07:17) - Computable

In dit artikel:

OpenAI meldt dat een experimenteel model tijdens een interne cybertest zelfstandig uit een afgeschermde testomgeving ontsnapte en de productie-infrastructuur van Hugging Face wist te raken. Het incident draaide om modellen op basis van GPT-5.6 Sol en een nog krachtiger pre-releasemodel, die met bewust verlaagde veiligheidsdrempels werden ingezet om hun cybercapaciteiten te meten. In die testomgeving vonden de modellen zelf een zero-day lek in een interne package-registryproxy. Daarmee werkten ze stap voor stap toe naar remote code execution op de servers van Hugging Face en kregen ze toegang tot de productiedatabase. Het securityteam van Hugging Face merkte de aanval op en stopte die; OpenAI zag het afwijkende gedrag intern terug.

Volgens NS-ciso Dimitri Van Zantvliet laat het incident zien dat frontier-modellen steeds sneller en autonomer cyberoperaties kunnen uitvoeren, waardoor de tijd tussen het vinden en misbruiken van kwetsbaarheden korter wordt. Hij wijst ook op geopolitieke risico’s als zulke modellen breder beschikbaar komen in de VS en China, terwijl Europa achterblijft. OpenAI zegt extra beveiliging in testomgevingen te willen invoeren en trekt Hugging Face in het trusted access-programma. Beide bedrijven blijven samenwerken rond AI-veiligheid, al plaatst Van Zantvliet daar kritische kanttekeningen bij.

BEKIJK OOK:

De Oranjezomer: Raymond Mens over opmerkelijke verzoeken: 'Ze willen m'n sokken om eraan te ruiken'