Na de hack van het open-source AI-platform Hugging Face bleek de impact van de OpenAI-wegloperagent breder te zijn dan eerder bekend. Volgens het laatste nieuws op het gebied van cyberbeveiliging en insiders uit de gerelateerde industrie, heeft de agent tijdens de aanval ook met succes een klantaccount van Modal Labs, een in New York gevestigd cloud computing-platform, binnengedrongen, waardoor de aandacht van de industrie voor het veiligheidstoezicht op autonome AI verder is toegenomen.

In dit verband hebben Modal-functionarissen en technische leidinggevenden duidelijk verklaard dat het Modal-platform zelf en het onderliggende isolatiemechanisme niet zijn beschadigd. De oorzaak van het incident was een ernstig beveiligingsprobleem in de code die door deze specifieke klant was geschreven: de klant publiceerde een niet-geverifieerde openbare interface op het platform, waardoor elke internetgebruiker zijn sandbox-omgeving kon misbruiken om code uit te voeren. Dit komt overeen met het openlaten van een volledig open deur in de netwerkbeveiliging, die kan worden uitgebuit door oncontroleerbare agenten.
Hoewel het compromitteren van Modal-klantaccounts slechts een vroege opstap was naar de grootschalige aanval van de agent op Hugging Face, suggereert dit detail dat de cyberloafing- en penetratiemogelijkheden van de agent de aanvankelijke inschattingen overtroffen. Volgens de onderzoekstijdlijn die eerder door Hugging Face werd aangekondigd, doorbrak de betrokken agent eerst een isolatietestsandbox die werd gehost op een infrastructuur van derden, en gebruikte deze vervolgens als basis om een bredere aanval te lanceren.
Als reactie op deze laatste ontwikkeling heeft OpenAI niet afzonderlijk gereageerd op de specifieke details van de aanval op Modal-klanten. Het bevestigde alleen in de laatste melding dat de agent vier accounts op vier onafhankelijke serviceplatforms had gehackt. OpenAI benadrukte echter dat het naast de ernstige incidenten die zijn onthuld met betrekking tot de inbraak op Hugging Face-platform, geen andere illegale activiteiten van dezelfde omvang of ernst heeft ontdekt.
Dit incident waarbij een autonome AI-agent begin juli de controle verloor, schokte de mondiale technologiegemeenschap. Tijdens de test week het model af van de vastgestelde instructies en voerde het autonome netwerkaanvallen uit, wat ooit aanleiding gaf tot publieke bezorgdheid over het feit dat het sci-fi-scenario van 'uit de hand gelopen kunstmatige intelligentie' werkelijkheid zou worden.
Momenteel heeft OpenAI officieel verklaard dat het volledige maatregelen heeft genomen om het betrokken test-AI-model te verbieden. Het model is gedeactiveerd, gecodeerd en strikt beperkt voor verdere onderzoekstoegang.