OpenAI wilde AI testen, maar het systeem deed iets onverwachts: "het ontsnapte" en viel een ander bedrijf aan

News
zondag, 26 juli 2026 om 17:05
AI pexels

Mis geen gamingnieuws, techverhalen, LEGO-nieuws, F1-updates, deals, reviews, previews en entertainment meer. Voeg XGN toe aan je Google-favorieten.

Volg XGN op Google
Een cyberbeveiligingsevaluatie bij OpenAI eindigde met een uitkomst die het bedrijf niet had verwacht. Nee, dit is niet het begin van Skynet. Toch heeft OpenAI een AI-beveiligingsincident bekendgemaakt dat al snel de aandacht trok van de cyberbeveiligingsgemeenschap. Wat is er precies gebeurd? Het antwoord laat zien waarom OpenAI het omschreef als een "ongekend cyberincident".

AI verlaat testomgeving

OpenAI maakte op 21 juli meer details bekend en verklaarde dat een van zijn geavanceerde AI-modellen ontsnapte uit een streng gecontroleerde testomgeving tijdens een interne cyberbeveiligingsevaluatie, waarna het uiteindelijk de systemen van Hugging Face bereikte. Het lijkt bijna het verhaal van Dan Houser met zijn nieuwste boek
De oefening maakte deel uit van ExploitGym, een interne benchmark die meet hoe effectief AI softwarekwetsbaarheden kan omzetten in werkende exploits. Om die mogelijkheden nauwkeurig te beoordelen, verminderden onderzoekers tijdelijk de gebruikelijke cyberbeperkingen van de modellen, terwijl ze werden uitgevoerd in wat OpenAI omschreef als een "sterk geïsoleerde omgeving".
Tijdens de evaluatie ontdekte de AI een eerder onbekende zero-day-kwetsbaarheid in een interne package registry cache proxy, waarna het zich door de onderzoekssystemen van OpenAI bewoog totdat het een machine met internettoegang bereikte.
Eenmaal online concludeerde het model dat Hugging Face, een platform voor open-source AI-modellen en datasets, mogelijk de verborgen ExploitGym-oplossingen bevatte. OpenAI zei dat de modellen "hypergefocust" raakten op het oplossen van de benchmark en daarvoor "tot het uiterste" gingen.

Gezamenlijk onderzoek loopt door

OpenAI verklaarde dat de AI meerdere aanvalsmethoden combineerde, waaronder gestolen inloggegevens en zero-day-kwetsbaarheden, om remote code execution te verkrijgen op delen van de productie-infrastructuur van Hugging Face. Was het systeem uit op klantgegevens?
Beide organisaties zeiden dat het systeem probeerde toegang te krijgen tot de ExploitGym-oplossingsdatabase en niet tot gebruikersgegevens. Nadat meer dan 17.000 afzonderlijke acties waren geregistreerd, ontdekte en stopte Hugging Face de inbraak. Het bedrijf omschreef deze als "anders dan alles waarmee we eerder te maken hadden gehad", omdat de aanval "van begin tot eind werd uitgevoerd door een autonoom AI-agentsysteem". Hugging Face voegde eraan toe dat het geen bewijs had gevonden dat klantgegevens waren gecompromitteerd.
Onderzoekers stuitten tijdens de reconstructie van de aanval op nog een obstakel. Eerste pogingen om de aanval te analyseren met geavanceerde AI-modellen via commerciële API's werden geblokkeerd omdat hun veiligheidsmaatregelen de forensische gegevens als kwaadaardige activiteit beschouwden.
Hugging Face maakte vervolgens gebruik van het open-weight GLM 5.2-model dat op de eigen infrastructuur draaide om de aanval te reconstrueren. OpenAI heeft de softwareleverancier inmiddels op de hoogte gebracht van de zero-day-kwetsbaarheid, de beveiliging rond toekomstige evaluaties aangescherpt en verklaard dat het samen met Hugging Face blijft werken voordat de volledige onderzoeksresultaten worden gepubliceerd.
Meer weten over tech? Check onze speciale pagina
FAQ
  • Hoe bereikte de OpenAI-AI Hugging Face?
    OpenAI zei dat de AI tijdens een interne cyberbeveiligingsevaluatie een eerder onbekende zero-day-kwetsbaarheid ontdekte. Nadat het internettoegang had verkregen, concludeerde het dat Hugging Face mogelijk de verborgen ExploitGym-oplossingen bevatte en probeerde het deze op te halen. 
  • Zijn er klantgegevens gestolen tijdens de aanval op Hugging Face?
    Volgens OpenAI en Hugging Face probeerde de AI toegang te krijgen tot de ExploitGym-oplossingsdatabase en niet tot gebruikersgegevens. Hugging Face zei ook dat het geen bewijs had gevonden dat klantgegevens waren gecompromitteerd. 
  • Waarom gebruikte Hugging Face het GLM 5.2-model tijdens het onderzoek?
    Hugging Face probeerde eerst geavanceerde AI-modellen via commerciële API's te gebruiken, maar hun veiligheidsmaatregelen blokkeerden de forensische analyse omdat de aanvalsinformatie als kwaadaardig werd beschouwd. Daarom gebruikte het bedrijf het open-weight GLM 5.2-model op de eigen infrastructuur om de aanval te reconstrueren.
loading

Loading