Claude Haiku 5.5 koster 90 prosent mindre enn Haiku 4.5 under 100 000 tokens
torsdag 8. oktober · KI-generert · Kilde: Anthropic
Flytt subagenter, oppsummering og klassifisering over på Claude Haiku 5.5, som Anthropic priser til 0,10 dollar per million input-tokens for prompter under 100 000 tokens.
0,10 dollar per million input-tokens og 0,50 dollar per million output-tokens er prisen på Claude Haiku 5.5, som Anthropic lanserte 7. oktober. Haiku 4.5 kostet 1 og 5 dollar. Prisen gjelder prompter opptil 100 000 tokens, og over den grensen femdobles den til 0,50 og 2,50 dollar. Ifølge Anthropic havnet rundt 90 prosent av forespørslene mot forrige Haiku i det billige sjiktet.
Anthropic retter modellen mot volumjobber: oppsummering, komprimering av kontekst, databasespørringer, klassifisering og subagent-arbeid under Opus 5.5 og Sonnet 5.5. Haiku 5.5 er den første Haiku-modellen med justerbar effort. Simon Willison fant at resonneringen ikke kan slås helt av, og at standardnivået er medium. Modell-ID-en er claude-haiku-5-5, og den ligger allerede på Amazon Web Services, Google Cloud og Microsoft Azure.
«Haiku 5.5 egner seg best for smalere avgrensede oppgaver som tidligere kunne vært for dyre med eldre Claude-versjoner» — Anthropic, i lanseringskunngjøringen
Hoppet i Anthropics egne tester er stort. På Terminal-Bench 4.0 får Haiku 5.5 39,2 prosent mot 0,0 for Haiku 4.5 og 16,4 for OpenAIs GPT-6 Luna. På datamaskinbruk i OSWorld 2.1 går den fra 15,7 til 72,4 prosent. Sonnet 5.5 ligger fortsatt langt foran på agentisk koding med 70,6 prosent, så Haiku er ingen erstatning for den tyngre modellen i komplekse kodeoppgaver.
Konkurransen og den skjulte prisen
Prisen under 100 000 tokens er nøyaktig den samme som for GPT-6 Luna, som OpenAI slapp forrige måned. Luna øker først ved 272 000 tokens, og da bare til 0,20 og 0,75 dollar. Willison målte dessuten at Haiku 5.5 bruker omtrent 1,25 ganger så mange tokens som Haiku 4.5 på samme lange prompt. Anthropic bekrefter at den nye tokenizeren bruker litt flere tokens per oppgave, og anslår at modellen i snitt koster rundt 75 prosent mindre å kjøre enn Haiku 4.5 når dette er regnet inn.
«Hvis arbeidslastene dine passer innenfor 100 000 tokens, koster Haiku det samme som Luna og rapporterer høyere benchmark-resultater» — Simon Willison, utvikler og blogger
Samme dag halverte Anthropic prisen på cache-lesing for Sonnet 5.5, fra 0,20 til 0,10 dollar per million tokens. Det gjør Sonnet 5.5 rundt 20 prosent billigere på det meste av agentarbeid, ifølge selskapet. Abonnenter på Max og Team får også en månedlig API-kreditt: 100 dollar på Max 5x, 200 dollar på Max 20x og opptil 500 dollar delt i et Team. Kreditten overføres ikke til neste måned, og den dekker ikke interaktiv bruk av Claude Code. Har organisasjonen ingen andre kreditter, stopper API-kallene når saldoen er tom, i stedet for å gi deg en regning.
Hva bør du gjøre?
- Koble en Console-organisasjon til Max- eller Team-planen under Settings og Billing på claude.ai, slik at du får API-kreditten hver måned.
- Mål token-forbruket på dine egne prompter med Haiku 5.5 før du bytter, siden tokenizeren spiser opp deler av prisfallet.
- Hold kontekst-tunge jobber under 100 000 tokens, eller send dem til en annen modell, for over grensen femdobles prisen.