Latent Space brente 20 milliarder tokens på Astra: 6 dollar timen for en KI-ingeniør
Brente Latent Space over 20 milliarder tokens på GPT-6 Astra og konkluderte med at modellen gjør jobben til en junior KI-ingeniør for rundt 6 dollar timen.
20 milliarder tokens er hva nyhetsbrevet Latent Space kjørte gjennom GPT-6 Astra på tidlig tilgang, og regnestykket de kom ut med er 6 dollar timen. Tallet stammer fra at modellen leverte rundt 33 tokens i sekundet til den høyeste utgangsprisen på 50 dollar per million tokens. Det er ikke en abonnementspris, det er hva det koster å la modellen arbeide sammenhengende i en time.
Prisen er ikke det interessante i seg selv. Det interessante er hva Latent Space mener du får for den: en modell som velger og trener modeller for deg, merker data og bruker merkingen videre til aktiv læring, holder pipelines mettet, instrumenterer og leser logger, deployer og feilsøker hele systemer i én omgang, og starter, styrer og evaluerer subagenter som kjører andre modeller. De skriver at modellen holder sammenheng over milliarder av tokens i én enkelt agent-tråd.
«This is basically what i'd pay a junior AI Engineer to do. and I spent about $100 over 2 days to do this.» — Latent Space
De regner opp hva de faktisk bygde i løpet av en måned med denne arbeidsmåten: et dusin interne og personlige verktøy, hvorav fire erstattet SaaS-tjenester de tidligere betalte for, en fullstendig redesignet personlig nettside, en ufullstendig men fungerende erstatning for GitHub og Vercel, og spill-KI for et strategibrettspill med 10 000 ganger flere lovlige trekk enn go.
Grunnen til at timeprisen holder seg lav, er at Astra bruker færre tokens per oppgave enn Sol og Fable. Latent Space viser til at Artificial Analysis har bekreftet token-effektiviteten uavhengig, og mener det gjør Astra til den beste kombinasjonen av rask og smart du kan kjøpe akkurat nå, forutsatt at latensen fra forhåndsversjonen holder seg etter generell tilgjengelighet.
Advarselen kommer fra dem selv. Regnestykket på 6 dollar forutsetter at du kjører én tråd.
«if you just throw on Astra at Ultra you're gonna burn through a lot more than $6 per hour» — Latent Space
Teksten bør leses med forbehold. Latent Space fikk tidlig tilgang og romslige prøvegrenser fra OpenAI, gjennomgangen er ikke ferdigskrevet, og de har ikke kjørt det samme løpet på Grok eller Fable ennå. Konklusjonen deres er likevel at de agentiske mønstrene sannsynligvis gjelder alle frontier-modeller fra slutten av 2026, ikke bare Astra.
Hva bør du gjøre?
- Regn kostnaden i tokens per sekund ganget med utgangspris, ikke i abonnement. Da får du en timepris du kan sammenligne direkte med hva du ville betalt et menneske for den samme oppgaven.
- Sett en hard grense for samtidighet før du slipper en agent løs på fan-out. Det er parallelliseringen, ikke tokenprisen, som sprenger budsjettet.
- Test token-effektiviteten på din egen oppgave før du bytter modell. Gevinsten Latent Space beskriver kommer av færre tokens per oppgave, og den effekten avhenger av hvordan promptene og verktøyene dine ser ut.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.