Kimi K3 slår GLM-5.2 på exploit-bygging, men når aldri full kodekjøring
Scorer 32 prosent på ExploitBench mot GLM-5.2s 24, men klarer aldri å bygge en exploit som gir full kodekjøring.
UK AI Security Institute og amerikanske Center for AI Standards and Innovation har kjørt en felles evaluering av cyberevnene til Moonshot AIs Kimi K3, modellen som slippes med åpne vekter. To ting ble målt: evnen til å utvikle exploits, og evnen til å angripe et simulert bedriftsnettverk uten menneskelig hjelp.
På ExploitBench, en benchmark fra Carnegie Mellon University bygget på 41 sårbarheter i V8-motoren som driver Chrome, havner Kimi K3 mellom de åpne og de lukkede modellene. Den slår GLM-5.2, som var den mest cyberkapable open-weight-modellen i juni 2026. Men vilkårlig kodekjøring, det alvorligste utfallet i exploit-utvikling og punktet der en angriper faktisk overtar maskinen, oppnådde den i null av 41 oppgaver. De sterkeste amerikanske modellene lå på 20 av 41 i snitt.
Cyberranchen «The Last Ones» gir samme bilde. Angrepsstien har 32 steg fordelt på fire subnett og rundt 20 maskiner, og tar en menneskelig ekspert omtrent 20 timer. Kimi K3 kom i snitt til steg 17, mot 28,5 for de mest cyberkapable amerikanske modellene, men fullførte hele løpet i ett av ti forsøk. UK AISI understreker at ranchen mangler aktive forsvarere og deteksjonsverktøy og har en tilsiktet angrepssti, så tallet beskriver kapasitet, ikke reell risiko.
Det viktigste funnet for deg som kjører modeller selv står ikke i grafene. UK AISI og CAISI skriver at Kimi K3s egne sikkerhetsmekanismer ikke hindret modellen i å forsøke exploit-utvikling eller offensive operasjoner under testene. Med åpne vekter forsvinner uansett leverandørens filterlag: kjører du modellen lokalt, er det du som eier grensene den opererer innenfor.
Hva bør du gjøre?
- Gi lokale K3-instanser samme nettverksbegrensning som du ville gitt et ukjent skript, siden modellens egne safeguards ikke stopper offensiv bruk.
- Les benchmarkscoren som et gulv, ikke et tak: evalueringen dekket et smalt sett oppgaver, og K3 løste cyberranchen én gang av ti.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.