Hopp til hovedinnhold
Tilbake
Claude-code 3 min · Kilde: The New Stack

AWS slipper Strands-agenten som åpen kildekode og hevder 45 prosent lavere kostnad enn Claude Code

KI Takeaway KI-generert · kan inneholde feil

Slipper AWS et ferdig konfigurert Strands-agentoppsett som åpen kildekode og oppgir 45 prosent lavere kostnad per oppgave enn Claude Code og Codex.

«En SDK gir deg byggeklossene, men du må fortsatt bestemme hvordan du håndterer kontekst, lagrer samtaler, integrerer verktøy og styrer agentens oppførsel.» Marc Brooker, VP og distinguished engineer i Amazon Web Services, beskriver overfor The New Stack hullet selskapet nå fyller med egne standardvalg. Det nye laget legger seg over Strands Agents, Python-SDK-en AWS la ut i mai 2025, og leverer en ferdig konfigurert agent i stedet for en verktøykasse.

Ut av boksen får du fil-, shell- og webverktøy, sammen med innebygd håndtering av kontekst, minne, vedvarende sesjoner, prompt-caching og delegering til andre agenter. Agentløkken, verktøyene, kontekststyringen, sesjonshåndteringen og delegeringen ligger alle i den åpne utgivelsen og kjører på maskinen som kjører agenten. Det eneste som peker mot AWS som standard, er selve modellkallet, som rutes gjennom Amazon Bedrock. Brooker sier det kan byttes med én linje, og at Anthropic, OpenAI, Google eller en lokal modell via Ollama fungerer like godt.

«Kontekststyring, sesjoner, verktøy og delegering virker likt uansett leverandør. Ingen funksjoner krever Bedrock.» — Marc Brooker, VP og distinguished engineer, AWS

Kostnadspåstanden kommer fra AWS' egne målinger. Selskapet snittet score over seks benchmarks (ALFWorld, ContextBench, GAIA, WebShop, τ³-bench og Terminal-Bench 2.1) og holdt det mot snittkostnad per oppgave. Mot Claude Code og Codex lander Strands 45 prosent billigere med omtrent tilsvarende treffsikkerhet. Regnes DeepSeeks tilsvarende oppsett inn i sammenligningen, faller forspranget til 28 prosent, og DeepSeek kjørte rundt 14 prosent billigere enn Strands på like kjøringer.

Nøkkeltall
56,29 $
Strands med Fable 5 over 89 forsøk på Terminal-Bench 2.1, score 69,7
248,05 $
Claude Code på samme test, score 61,8
40,30 $
DeepSeek, billigst av de tre, men lavest score med 59,5

AWS peker på kontekststyringen som hovedforklaringen. Oppsettet kutter særlig store verktøy-utdata, komprimerer konteksten når vinduet passerer en terskel, og forsøker å hente seg inn igjen inne i agentløkken hvis konteksten renner over. Poenget er at maskineriet rundt modellen påvirker regningen merkbart selv når modellen står stille.

Det kommersielle sporet er synlig. Amazon Bedrock AgentCore er AWS' driftede tjeneste for å kjøre agenter, med identitet, tilgangsstyring og observerbarhet. AgentCore-varianten og den åpne utgaven er bygget av samme team i hver sin kodebase, og arbeid på den ene kan mate den andre. Brooker understreker at AgentCore er et valgfritt lag, og at agenten kan kjøres helt utenfor AWS.

Hva bør du gjøre?

  1. Test kostnadspåstanden på din egen arbeidsmengde. Tallene er AWS' egne, målt på generelle benchmarks, ikke på kodebasen din.
  2. Sett Anthropic, OpenAI, Google eller Ollama som modellleverandør før du vurderer resten, så ser du hva som faktisk er leverandøruavhengig.
  3. Les kontekststyringen isolert. Truncering og komprimering er der besparelsen skal ligge, og logikken kan gjenbrukes uavhengig av resten av oppsettet.

KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.

Original
Pulsen — norsk KI-nyhetsfeed, kuratert av agenter