Prime Agent skrev seg selv om til Rust med en sverm på over 2000 agenter
lørdag 10. oktober · KI-generert · Kilde: Prime Intellect
Les Prime Intellects oppskrift på å la en agentsverm skrive om en hel kodebase: én rotagent, fire roller per oppgave og automatiske paritetstester mot den gamle TypeScript-koden.
«En agent som skriver kode, er partisk når den vurderer den», skriver Prime Intellect i bloggposten om hvordan kodeagenten Prime Agent skrev seg selv om fra TypeScript til Rust. Derfor gikk hver oppgave gjennom fire separate agenter: planlegger, implementerer, en reviewer på en annen modell og i egen kontekst, og en verifikator som testet i en fersk sandkasse.
Over to uker kjørte over 2000 agenter på mer enn 10 000 sandkasser og brukte over 200 milliarder tokens fra GLM-5.3 via Prime Intellects egen inferenstjeneste. Menneskenes jobb var å bygge verifiseringen: differensielle tester som kjører TypeScript- og Rust-binærene mot samme skriptede modell og sammenligner terminalbildene, transkriptene og forespørslene til modell-leverandøren.
Etterpå kjørte en optimaliseringsløkke i tre dager og flettet over 69 endringer. Etter oppstart bruker Rust-versjonen 106 MB minne mot 607 MB for TypeScript-versjonen og 227 MB for Claude Code 2.1.289, og installasjonen tar 60 MB mot 492 MB for Claude Code. Målingene utelater inferens og er gjort med Prime Intellects egen testsuite.
«Uten en felles benchmark-standard bør sammenligningene tolkes med forsiktighet.» — Prime Intellect
Paritetstestene fanget ikke alt. Feil utenfor testdekningen dukket først opp i daglig bruk, og det tok flere uker med mennesker i løkka å nå utgivelseskvalitet. Nytt er også Windows-støtte i beta, installasjon via Homebrew og at hver økt kjører i egen arbeidsprosess, slik at én krasj ikke tar ned de andre. Prime Agent er lastet ned over 300 000 ganger siden lanseringen i august og er fortsatt open source.
Hva bør du gjøre?
- Installer Prime Agent med installasjonsskriptet fra app.primeintellect.ai og mål oppstartstid og minnebruk på din egen maskin før du stoler på sammenligningen.
- Bygger du egne agentsvermer, skill generering og verifisering i separate agenter, gjerne på ulike modeller.
- Skriv paritetstester før du lar agenter portere kode, siden det var de objektive sjekkene som lot Prime Intellect kutte ned på menneskelig review.