DeepSeek hever API-prisene 16. august: cache-treff blir seks ganger dyrere
Hever DeepSeek API-prisene fra 16. august og gjør cache-treff på V4 Pro seks ganger dyrere utenfor rushtiden.
DeepSeek innfører nye API-priser klokken 16.00 UTC 16. august 2026, skriver the-decoder. Fra da av koster kall ulikt etter tid på døgnet: rushtiden er 01.00 til 04.00 og 06.00 til 10.00 UTC, og resten av døgnet ligger på halv pris. Rushtiden følger den kinesiske arbeidsdagen, så for deg i Norge faller nesten hele ettermiddagen i den billige kategorien.
Selve økningen er ujevnt fordelt. For endepunktet deepseek-v4-pro går input fra 0,435 til 0,66 dollar per million tokens utenfor rushtiden, og output fra 0,87 til 1,98. I rushtiden dobles begge, til 1,32 og 3,96. Den bratteste økningen ligger på posten folk flest ikke leser: cache-treff går fra 0,003625 til 0,022 dollar utenfor rushtiden og 0,044 i rushtiden. Cache-rabatten krymper dermed fra rundt 1/120 av vanlig inputpris til 1/30.
Det er agentene som merker dette først. En agent som leser de samme filene om og om igjen lever nettopp på cache-treff, og det er den posten som blir seks ganger dyrere. Økningen reverserer delvis priskuttet DeepSeek gjorde i mai, og cache-treff ender dyrere enn de var før det kuttet. Selskapet henter samtidig ny kapital og forbereder børsnotering.
Samtidig legger DeepSeek ut sitt eget agentrammeverk i versjon 0.1 som åpen kildekode under MIT-lisens, i en utviklerforhåndsvisning. Rammeverket bygger på plugin-systemet Cordis, der alt fra verktøy og sandkasser til sesjoner og brukergrensesnitt er utbyttbare plugins. En kontinuerlig sesjonslogg fanger hver ledetekst, hvert verktøykall og hvert resultat, og kjøringer kan gjenopptas, forgrenes og spilles av på nytt. I minimal modus står du igjen med skallet og en filredigerer, og det er oppsettet DeepSeek selv bruker på sine egne benchmarkkjøringer. Programvaren startes med npx mot et lokalt webgrensesnitt, og selskapet advarer om kompatibilitetsproblemer. Prosjektet ledes av Cui Tianyi, som kom til DeepSeek fra Jane Street i mars 2026. Da laget ba om betatestere tidlig i august, meldte 712 prosjekter seg på tre dager.
Modelloppdateringen er den tredje delen av kunngjøringen. Endepunktet deepseek-v4-pro leverer nå bygget V4-Pro-0813, med uendret modellnavn, parametertall og kontekstvindu på én million tokens. Nytt er innebygd støtte for OpenAIs Responses API med Codex-integrasjon, og tenketid som kan settes til lav, høy eller maks, der DeepSeek anbefaler mellomnivået til daglig agentbruk. På selskapets egen sammenligningstabell går Terminal Bench 2.1 fra 72,1 til 87,9 og DeepSWE fra 12,8 til 62,7. Artificial Analysis flytter modellen fra 45 til 53 på Intelligence Index, likt med GLM-5.2, men bak Muse Spark på 57, Qwen 3.8 Max på 58, Kimi K3 på 60 og Claude Opus 5 på 63. Vektene for det nye bygget er ikke publisert, og april-versjonen ligger fortsatt på Hugging Face.
Hva bør du gjøre?
- Mål hvor stor andel cache-treff er av agentregningen din før 16. august. Er den stor, blir kostnaden seks ganger høyere over natten.
- Flytt tunge kjøringer ut av rushtiden 01.00 til 04.00 og 06.00 til 10.00 UTC. Halv pris er hele forskjellen.
- Skal du prøve agentrammeverket, start i minimal modus med skall og filredigerer. Det er oppsettet DeepSeek kjører benchmarkene sine på.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.