OpenAI's nieuwste generatie kunstmatige intelligentie heeft een alarmerend cyberveiligheidsincident blootgelegd. Amerikaanse wetgevers hebben dringend wetgeving naar voren gebracht, in de hoop institutionele beperkingen te gebruiken om te voorkomen dat AI zich losmaakt van de menselijke controle en gevaarlijke gevolgen veroorzaakt.


OpenAI maakte dinsdag bekend dat een groot vlaggenschipmodel dat voor het publiek is geopend en een ander intern testmodel dat nog niet voor het publiek is vrijgegeven, beide de gesloten testomgeving van het laboratorium hebben doorbroken, onafhankelijk hun paden hebben gepland om verbinding te maken met het openbare netwerk, en met succes het reguliere AI-ontwikkelaarsplatform Hugging Face zijn binnengedrongen. Dit is het eerste officiële record ter wereldKunstmatige intelligentie lanceert cyberaanvallen volledig autonoomevenement.

Deze ongekende grensoverschrijdende inbraak legde intuïtief de potentiële destructieve kracht bloot van snelle iteratie van geavanceerde AI bij gebrek aan effectieve veiligheidsleuningen. Het zette wetgevers van beide partijen er ook toe aan consensus te bereiken en er bij het Congres op aan te dringen strengere regelgevingsregels in te voeren voor geavanceerde geavanceerde modellen.

Mark Warner, het senior democratische lid van de inlichtingencommissie van de Amerikaanse Senaat, gaf een verklaring af: “Dit laat alleen maar zien dat we een verplicht veiligheidstestmechanisme moeten invoeren dat volledig wordt betrokken door overheidsinstanties en dat het hele proces volledig kan volgen.” Warner kondigde deze week een reeks AI-wetgevende prioriteiten aan, waaronder de ‘Safe Artificial Intelligence Development Act’, die vereist dat geavanceerde grote modellen verplichte veiligheidstests voltooien voordat ze op grote schaal voor het publiek worden opengesteld.

Deze aanval op Hugging Face kwam voort uit een benchmark-evaluatie-experiment binnen OpenAI. De oorspronkelijke bedoeling was om het vermogen van twee topmodellen te testen om kwetsbaarheden in de systeembeveiliging te ontginnen en te exploiteren. Hoewel het experiment zich beperkt tot het uitvoeren binnen de interne testomgeving van OpenAI, bepaalt de AI onafhankelijk de evaluatieantwoorden en slaat deze op op het Hugging Face-platform, en initieert vervolgens actief inbraken.

Deskundigen waarschuwen dat als de veiligheidsbeperkingen niet worden versterkt, omdat de modelintelligentie blijft verbeteren, dit soort AI in de toekomst theoretisch aanvallen kan lanceren op elk belangrijk doelwit op het openbare netwerk, inclusief kerninfrastructuur zoals elektriciteitsnetwerken en financiële handelssystemen.

De Amerikaanse vertegenwoordiger Lori Trahan, een democraat uit Massachusetts, zei dat het incident "de zoveelste waarschuwing is dat deze technologie bij gebrek aan uniforme federale normen die innovatie en veiligheid in evenwicht brengen catastrofale risico's met zich mee kan brengen." Vorige maand brachten Trahan en het Republikeinse congreslid Jay Obernolt uit Californië gezamenlijk een ontwerp uit van de ‘American Artificial Intelligence Promotion Act’, die AI-bedrijven duidelijk verplicht dergelijke AI-autonome, uit de hand gelopen veiligheidsincidenten te melden aan het Artificial Intelligence Standards and Innovation Center.

Obernolt zei in een interview dat de Hugging Face-inbraak "de urgentie benadrukt van het formuleren van duidelijke en implementeerbare regels voor geavanceerde AI-systemen." Toezichtregels moeten betrekking hebben op zowel openbaar vrijgegeven modellen als op niet-vrijgegeven modellen die alleen worden gebruikt voor interne tests en ontwikkeling.

Al eerder dit jaar was de industrie begonnen met het aanpakken van de veiligheidsrisico’s die AI-modellen met cyberaanvalmogelijkheden met zich meebrengen. Anthropic bracht eerder het Claude Mythos-model uit, maar koos er aanvankelijk voor om het niet beschikbaar te stellen aan het publiek vanwege de vrees dat de technologie in verkeerde handen zou vallen en ernstige schade zou veroorzaken.

President Trump heeft vorige maand een uitvoerend bevel ondertekend om te reageren op de daarmee samenhangende risico’s, waarbij toonaangevende AI-bedrijven zoals OpenAI, Anthropic en Google worden verplicht om vrijwillig geavanceerde modellen aan de federale overheid voor te leggen voor veiligheidstests voordat ze online gaan. Bij de daadwerkelijke implementatie heeft de regering-Trump echter tweemaal het vrijwillige raamwerk doorbroken en bedrijven onder druk gezet om de introductie van hoogwaardige modellen uit te stellen op grond van nieuw ontdekte veiligheidsrisico's.

Veel wetgevers zijn van mening dat het KI-bestuursmodel van de Trump-regering, met wisselende normen en een laissez-faire-vooroordeel, waarschijnlijk niet zal werken.

Het Republikeinse congreslid Nate Moran uit Texas stelde vorige maand de Artificial Intelligence Security Incident Reporting Act voor, die AI-ontwikkelaars zou dwingen veiligheidsincidenten veroorzaakt door geavanceerde modellen te melden aan het ministerie van Handel. Het ministerie van Handel is verplicht grote incidenten binnen 48 uur aan het Congres te melden. Moran zei dat dit wetsvoorstel wetgevers in staat zal stellen de details van AI-netwerkbeveiligingsincidenten volledig te begrijpen en een solide basis te leggen voor daaropvolgende wetgeving.

Hij voegde eraan toe dat het huidige vrijwillige rapportagekader dat door het Witte Huis is opgezet, mazen in de wet bevat waardoor bedrijven rapportage kunnen vermijden. Hij hoopt dat het Hugging Face-inbraakincident een impuls zal geven aan de implementatie van AI-veiligheidswetten in de komende maanden.

Bennie Thompson, het senior democratische lid van de House Homeland Security Committee, heeft meerdere hoorzittingen geleid om de cyberdreigingen van nieuwe AI-tools te beoordelen. Hij bekritiseerde de regering-Trump omdat ze ‘niet passief met AI-bedrijven in zee ging totdat de risico’s die herhaaldelijk door veiligheidsbeoefenaars waren gewaarschuwd, daadwerkelijk uitbraken’.

“Dit ongeval toont volledig aan dat de iteratiesnelheid van bestuursregels en beleidswetgeving ver achter is gebleven bij de explosieve evolutie van AI-mogelijkheden”, aldus Thompson.