Åpen agentmodell Atria Dawn slår Claude Opus 5 på automatisering, men ikke på kode
Test Atria Dawn Preview via det hostede API-et hvis agentene dine automatiserer research eller kontorarbeid, men behold en sterkere kodemodell til repo-arbeid.
Shanghai Artificial Intelligence Laboratory har lagt ut Atria Dawn Preview på Hugging Face under organisasjonen internlm. Det er en agentmodell bygget på grunnmodellen GLM-5.2, med 744 milliarder parametere i en MoE-arkitektur. Både kode og vekter er lisensiert under MIT, og repoet ble opprettet 11. september, ifølge Hugging Face.
Modellen er laget for oppgaver som krever mange steg med verktøybruk. Modellkortet deler bruksområdet i fire: research og eksperimentplaner, programvare og apper, rapporter og presentasjoner, og sikkerhetsanalyse i autoriserte miljøer.
«Modellen hjelper brukerne å drive åpne problemer frem mot kjørbare, verifiserbare og reproduserbare resultater.» — Shanghai AI Laboratory i modellkortet
Benchmark-tallene er laboratoriets egne, og de peker i to retninger. Atria Dawn leder tabellen på AutomationBench med 53,8 mot 49,4 for Claude Opus 5 og 49,7 for Qwen 3.8 Max. På BrowseComp får den 92,5 mot 92,2 for GPT 5.6 sol, og CyberGym (86,5) og BFCL v4 (77,0) er også toppscorer blant modellene med oppgitte tall. På koding snur bildet: SWE-bench Pro gir 59,6 mot 74,7 for Opus 5, og på Terminal-Bench 2.1 havner modellen på 78,3, bak både Qwen 3.8 Max (89,3) og Opus 5 (90,2).
Å kjøre modellen selv er ikke realistisk på hjemmeutstyr. BF16-vektene er delt i 353 safetensors-filer på til sammen rundt 1,5 TB. Ifølge config.json har modellen 256 rutede eksperter der 8 aktiveres per token, så hvert token krever langt mindre regnekraft enn totalstørrelsen tilsier, men alle vektene må fortsatt ligge i minnet.
Den praktiske inngangen er det hostede API-et. Modellkortet viser et Codex-oppsett med Atria som egen leverandør mot Responses API-et, og det krever Codex CLI 0.154.0 eller nyere. Modellen tar bare tekst, så du må deklarere tekst som eneste input-modalitet i en egen modellkatalog, ellers avviser endepunktet vedlagte bilder med feilkode 400. For Claude Code følger det med en PreToolUse-hook som hindrer Read-verktøyet i å åpne PDF- og bildefiler.
Hva bør du gjøre?
- Legg Atria Dawn inn som ekstra leverandør i Codex og kjør den på dine egne automatiserings- eller research-oppgaver før du stoler på AutomationBench-tallet.
- Før opp alle modellene du bytter mellom i den samme katalogfilen, siden
model_catalog_jsonerstatter standardkatalogen og modeller som mangler faller tilbake til multimodale standardverdier. - Bruk Claude Opus 5 eller en annen sterk kodemodell til kodeendringer i større repoer, der Atria Dawn ligger 15 poeng bak Claude Opus 5 på SWE-bench Pro.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.