Den amerikanske regering satte Kinas nyeste AI-model igennem en hacking-test. Det viste sig, at Moonshot AI’s Kimi K3 ligger langt under de bedste amerikanske modeller.
Center for AI Standards and Innovation (CAISI), et amerikansk bureau, udførte testene sammen med en britisk partner. Resultaterne kom blot én dag efter, at Washington anklagede Moonshot for at have bygget Kimi K3 med stjålet amerikansk teknologi.
Kimi K3 lever ikke op til amerikanske cyber-målinger
Handelsministeriet delte resultaterne i torsdags. De sagde, at Kimi K3 rangerede langt under de største amerikanske modeller og henviste til en fælles test med britiske eksperter.
Moonshot lancerede Kimi K3 den 16. juli. Efterspørgslen var så høj, at virksomheden måtte sætte nye tilmeldinger på pause inden for to dage.
Lanseringen rystede også amerikanske chip-aktier og skabte nye tvivl om USA’s føring i kunstig intelligens.
En af testene, kaldet ExploitBench, bruger faktiske Chrome-browser fejl udviklet af Carnegie Mellon University. Kimi K3 scorede 32 %. Det var over Kinas GLM-5.2, som fik 24 %. Men de største amerikanske modeller nåede omkring 76 %.
Det sværeste trin er at få fuld kontrol over en målmaskine. Kimi K3 klarede det ikke i nogen af de 41 test. De bedste amerikanske modeller gjorde det i 20 tilfælde.
En anden test, The Last Ones, simulerer et angreb på et falsk firmanetværk med 32 trin. En menneskelig ekspert skal bruge cirka 20 timer på opgaven. Kimi K3 nåede til trin 17 i gennemsnit. De bedste amerikanske modeller nåede i snit trin 28,5. Kimi K3 gennemførte hele angrebet kun én gang ud af 10 forsøg.
De bedste amerikanske systemer skulle have klart det seks eller syv gange.
Men forskellen ser måske større ud, end den er
Men tallene fortæller ikke hele historien. Rapportens småt skrevne afslører flere forbehold.
For det første blev de amerikanske modeller testet uden deres sikkerhedsfiltre. Det viser deres fulde potentiale. Offentlige versioner har filtrene slået til. Dvs. de amerikanske scorer er et bedste-tilfælde – ikke hverdagen.
Holdet kaldte også arbejdet tidligt og begrænset. Kimi K3 blev kun testet på én opgave og kun dele af hele sættet. Så vurderingen er usikker. Nogle test er også private, så udenforstående kan ikke kontrollere arbejdet.
Der er også en grundlæggende forskel: Kimi K3 er en åben model, som alle kan downloade. De amerikanske modeller er lukkede, private systemer. Det britiske institut vurderede, at åbne modeller typisk er fire til syv måneder bagud i forhold til de bedste lukkede. Kimi K3 får først en fuld test, når Moonshot har frigivet den til offentligheden.
Disse tests er heller ikke ægte angreb. Netværket havde ingen forsvarsspillere eller alarmer. Alligevel overgik Kimi K3 den sidste åbne topmodel. Og den gennemførte hele angrebet én gang.
Tidspunktet for rapporten og afsenderen vækker også spørgsmål. CAISI var tidligere USA’s AI Safety Institute. Trump-administrationen gav det nyt navn i juni 2025. Det ligger i samme ministerium, der begrænser amerikansk chip-salg til Kina. Rapporten om en kinesisk konkurrent kom desuden bare én dag efter anklagen om tyveri.
Svage sikkerhedsforanstaltninger øger risikoen
Men lave scorer betyder ikke, at Kimi K3 er ufarlig. Testen viste, at dens beskyttelser ikke forhindrede den i at forsøge at udvikle angreb eller bryde ind i systemer.
Det er vigtigt, fordi der snart sker mere. Moonshot vil frigive hele modellen den 27. juli. Når den først er ude, kan den ikke trækkes tilbage. Alle kan downloade den og fjerne sikkerhedsfiltrene.
Testen kommer også efter anklager om tyveri. Washington siger, at Moonshot byggede Kimi K3 på amerikansk AI-teknologi, der er stjålet. Teknologichef i Det Hvide Hus, Michael Kratsios, sagde, at firmaet i al hemmelighed kopierede Anthropic’s Claude Fable 5. Metoden, såkaldt distillation, lærer en ny model med svarene fra en stærkere model.
Anthropic bakker op om anklagen. I februar sporede virksomheden over 3,4 millioner Claude-chats til Moonshot via hundredvis af falske konti. De advarede om, at kopierede modeller mister de originale sikkerhedskontroller. Det er samme svaghed, som denne test netop fandt.
USA investerer stadig 23 gange mere i kunstig intelligens end Kina. Men kinesiske laboratorier indhenter USA stille og roligt. Den virkelige test kommer, når Kimi K3 frigives, og uafhængige eksperter kan undersøge påstandene selv.








