Z.ai slipper GLM-5.3-vektene etter to uker med sikkerhetstesting
Slipper GLM-5.3 som åpne vekter to uker etter lansering, 755 gigabyte fordelt på 141 fp8-filer.
Vektene lå ute på Hugging Face under zai-org/GLM-5.3 fredag 28. august. Filoversikten forteller resten: 141 safetensors-filer på til sammen 755 gigabyte i fp8, og konfigurasjonen oppgir 78 lag, 256 eksperter med åtte aktive per token og et kontekstvindu på 1.048.576 tokens. Lisensen er ikke MIT, slik den var for GLM-5.3-Flash tre dager tidligere, men en egen lisens Z.ai kaller glm-5.3.
Ventetiden var varslet på forhånd. Da modellen ble lansert 14. august, skrev Z.ai i lanseringsbloggen at vektene først ville komme to uker senere, når sikkerhetsevaluering og herding var ferdig. Fristen holdt på dagen.
GLM-5.3 deler grunnmodell med GLM-5.2, og hele forskjellen ligger i etter-treningen.
«GLM-5.3 er den mest kapable modellen med åpne vekter for koding, med 50 prosent forbedring over GLM-5.2 på vår interne Z.ai Code Bench» — Z.ai, modellkortet på Hugging Face
Utslaget er størst der oppgavene er lange. Terminal Bench 3.0 går fra 4,6 til 28,3, DeepSWE v1.1 fra 46,2 til 66,9 og Agents' Last Exam fra 23,8 til 28,5.
Sikkerhetskolonnen forklarer de to ukene. På CyberGym, som måler evnen til å finne og bekrefte sårbarheter i kildekode, scorer GLM-5.3 84,5 mot 77,2 for forgjengeren. Det er høyeste tall i tabellen Z.ai selv publiserer, foran Fable 5 på 83,8 og GPT-5.6 Sol på 83,6. Z.ai legger ikke skjul på at avstanden til de lukkede modellene fortsatt er stor lenger opp i kjeden: på ExploitGym løser GLM-5.3 105 oppgaver innenfor to timer, mot 216 for GPT-5.6 Sol.
For deg som vurderer å kjøre modellen selv, er 755 gigabyte det harde tallet. Fullvektsvarianten krever maskinvare i serverklassen, og diskusjonen på Hacker News handlet raskt om hva som faktisk lar seg gjøre hjemme.
«GLM 5.3 er trolig det beste kompromisset blant åpne vekter hvis du vil forbi DeepSeek Flash eller den nye GLM Flash» — brukeren revolvingthrow, Hacker News
Bakgrunn
Z.ai er merkevaren til Zhipu AI, og GLM-5-serien er sluppet i etapper gjennom august. GLM-5.3-Flash kom 25. august under MIT-lisens og er den lille, raske varianten. GLM-5.3 er flaggskipet. Den tekniske rapporten bak serien ligger på arXiv som 2602.15763.
Hva bør du gjøre?
- Vent på kvantiserte varianter hvis du har under 512 gigabyte minne. Fullvekts-fp8 på 755 gigabyte er utenfor rekkevidde for de fleste hjemmeoppsett.
- Server via SGLang eller vLLM hvis du kjører selv. Begge har egne oppskrifter for GLM-5.3, mens KTransformers og Unsloth dekker oppsett med mindre minne.
- Sett reasoning_effort eksplisitt. Parameteren tar low, high og max, og faller tilbake til max hvis du sender noe annet.
- Les lisensvilkårene før produksjon. Dette er ikke MIT, men Z.ais egen glm-5.3-lisens.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.