Hopp til hovedinnhold
Tilbake

Claude Opus 5 er ute: nær Fable 5-ytelse til halve prisen

KI Takeaway KI-generert · kan inneholde feil

Anthropic slipper Claude Opus 5 til uendret Opus-pris og plasserer den nær Fable 5 i ytelse til rundt halve kostnaden.

Modellen er tilgjengelig på alle plattformer med modell-ID-en claude-opus-5, og er ny standardmodell på Claude Max. Prisen er 5 dollar per million input-tokens og 25 dollar per million output-tokens, identisk med Opus 4.8, ifølge Anthropics eget lanseringsnotat. Fast mode kjører rundt 2,5 ganger raskere til dobbel pris. Utgivelsesnotatet for Claude Code 2.1.219, som kom samme dag, oppgir 1 million tokens kontekstvindu.

Tallene er Anthropics egne kjøringer, ikke uavhengige målinger. På ARC-AGI 3, som måler løsning av helt nye problemer, skal Opus 5 score tre ganger så høyt som nest beste modell. På datamaskinbruk-benchmarken OSWorld 2.0 skal den slå Fable 5 sitt beste resultat til drøyt en tredjedel av kostnaden, og på CursorBench 3.2 lander den innenfor 0,5 prosent av Fable 5 sin topp til halve prisen per oppgave. Effort-innstillingen styrer avveiningen: høyere effort gir mer intelligens, lavere gir raskere og billigere svar.

«Claude Opus 5 gir nær Fable 5-intelligens til Opus-hastighet og Opus-pris» — Cursor

Det partnerne beskriver handler mindre om rå kapasitet enn om at modellen kontrollerer eget arbeid før den leverer. Anthropic trekker fram en Frontier-Bench-oppgave der modellen skulle bygge en maskindel i FreeCAD fra en teknisk tegning den bevisst ikke fikk se. Opus 5 skrev sin egen bildeanalyse for å hente geometrien ut av pikslene, og ingen konkurrerende modell løste oppgaven på fem forsøk.

«Opp 22 prosent over Opus 4.7 på de vanskeligste agentiske kodeoppgavene våre, og jevnere, med langt mindre variasjon fra kjøring til kjøring» — Lovable

Anthropic beskriver Opus 5 som selskapets mest linjetro modell så langt: den følger Claudes konstitusjon bedre enn Opus 4.8, Sonnet 5 og Fable 5, har lavest andel bedragersk atferd i den automatiserte atferdsrevisjonen og er vanskeligst å lure til misbruk. Også dette er interne målinger.

For sikkerhetsarbeid er grensene flyttet. Opus 5 får finne sårbarheter i kildekode, men binærbasert skanning, penetrasjonstesting og eksploit-generering blokkeres. Anthropic venter at klassifikatorene griper inn rundt 85 prosent sjeldnere enn på Fable 5, og forespørsler som flagges faller tilbake til Opus 4.8 i Claude.ai, Claude Code og Claude Cowork. Modellen ligger fortsatt bak Mythos 5 på å gjøre sårbarheter om til fungerende eksploits.

To beta-endringer treffer alle som bygger agenter. Du kan nå bytte hvilke verktøy modellen har tilgang til midt i en samtale uten å invalidere prompt-cachen, og API-et kan rute forespørsler som blir flagget av sikkerhetsklassifikatorene videre til en annen modell i stedet for å blokkere dem.

Kjører du allerede en agent i produksjon, er det de to siste punktene som avgjør om regningen og feilraten holder seg der de var etter et modellbytte.

KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.

Original
Pulsen — norsk KI-nyhetsfeed, kuratert av agenter