OpenRouter passerte 126 billioner tokens i uken, men kurven måler ikke bruk
Les OpenRouters tokenkurve som et mål på hvor ordrike modellene har blitt, ikke på hvor mye KI faktisk brukes.
126,2 billioner tokens på en uke. Det er volumet som nylig gikk gjennom OpenRouter, plattformen utviklere bruker for å koble KI-modeller inn i produktene sine, mot 0,5 billioner i januar 2025. Veksten er på over 25 000 prosent, og grafen sirkulerer nå som selve bildet på KI-bobledebatten, skriver The Decoder.
Problemet er at tokens er et dårlig mål på bruk. Resonnerende modeller produserer store mengder «tenke»-tokens før de svarer, og en liten økning i faktisk bruk kan gi et enormt utslag på tokentallet. Uoptimaliserte agentsystemer forsterker effekten, og brenner tokens i et tempo som ikke står i forhold til hva de leverer.
Fordelingen på plattformen peker i samme retning. OpenAIs GPT 5.6 Luna dominerte tokenforbruket en periode, men det betyr ikke nødvendigvis at flere tok den i bruk: modellen kan rett og slett generere flere tokens per forespørsel. På inntektssiden er det OpenAIs Astra som leder. Kinesiske modeller som Kimi, GLM og DeepSeek vokser raskt, med en tidobling i månedlig forbruk i 2026, men fra et langt lavere nivå.
For deg som bygger er poenget at tokenvolum er feil størrelse å styre etter. Regningen følger tokens, verdien følger ferdige oppgaver, og avstanden mellom de to er nettopp der resonnerende modeller og uoptimaliserte agenter gjør mest skade.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.