Het Britse Artificial Intelligence Security Institute (UK AISI) en het Amerikaanse Center for Artificial Intelligence Standards and Innovation (CAISI) hebben onlangs een gezamenlijk beoordelingsrapport uitgebracht, waarin een diepgaande evaluatie wordt uitgevoerd van de cyberbeveiligingsmogelijkheden van Kimi K3, het nieuwste model gelanceerd door Moonshot AI. Uit de evaluatieresultaten blijkt dat, hoewel de netwerkmogelijkheden van Kimi K3 GLM-5.2, het eerder erkende sterkste open source-model, overtreffen, er nog steeds een aanzienlijke kloof bestaat in vergelijking met het huidige Amerikaanse geavanceerde closed-source-model.

Deze test was gericht op de daadwerkelijke prestaties van Kimi K3 op gebieden zoals de ontwikkeling van misbruik van netwerkkwetsbaarheden en gesimuleerde netwerkaanvallen. Op ExploitBench, een bekende cybersecurity-benchmark ontwikkeld aan de Carnegie Mellon University, behaalde Kimi K3 een succespercentage van 32%, hoger dan de 24% van GLM-5.2. In de Arbitrary Code Execution (ACE) exploitontwikkelingstest, die het hoogste dreigingsniveau vertegenwoordigt, konden de beste closed-sourcemodellen gemiddeld twintig taken voltooien, terwijl Kimi K3 nul scoorde en er niet in slaagde met succes exploits te ontwikkelen die willekeurige code-uitvoering mogelijk maakten.

In de complexe cyberbereiktest "The Last Ones", die een aanval op een bedrijfsnetwerk simuleert, bestond de missie uit 32 aanvalsstappen verspreid over 4 subnetten en ongeveer 20 hosts. Uit testgegevens blijkt dat Kimi K3 gemiddeld door kan gaan naar stap 17, wat beter is dan het gemiddelde van GLM-5.2 van 11 stappen, en met succes het volledige aanvalspad wist te voltooien in 1 op de 10 pogingen. Ter vergelijking: de huidige Amerikaanse topmodellen gaan op dit bereik naar gemiddeld 28,5 stappen, met opruimingspercentages van wel 60 tot 70 procent. Dit toont aan dat Kimi K3 het potentieel heeft om zwak beschermde systemen van kleine bedrijven autonoom aan te vallen nadat het de eerste toegang heeft verkregen, maar de algehele stabiliteit en diepgaande aanvalsmogelijkheden zijn nog steeds verre van het allernieuwste niveau.

Bovendien wees de beoordeling er ook op dat het bestaande beveiligingsmechanisme van Kimi K3 er niet in slaagde zijn pogingen om netwerkkwetsbaarheden te misbruiken of om offensieve netwerkbeveiligingsoperaties in agentmodus uit te voeren effectief te blokkeren. Het is duidelijk dat Kimi K3 officieel zal worden uitgebracht op 16 juli 2026, en dat het naar verwachting op 27 juli open source zal zijn. AI-veiligheidsagentschappen in het Verenigd Koninkrijk en de Verenigde Staten verklaarden dat deze evaluatie alleen gebaseerd is op een voorlopige testset, en zal de veiligheidsgrenzen en de vermogensevolutie van geavanceerde AI-modellen in de toekomst blijven volgen.