Hopp til hovedinnhold

Onsdag 7. oktober

 Tilbake Koding 1 min 04.17

Condense: åpen proxy skal kutte token-regningen for kodeagenter med opptil 72 prosent

lørdag 4. juli · KI-generert · Kilde: condense.chat

Innholdet er KI-generert og kan inneholde feil. Sjekk originalkilden.

- Condense er en åpen proxy mellom kodeagenten og modell-API-et som komprimerer kontekst og samtalehistorikk. - Condense.chat oppgir opptil 72 prosent lavere token-forbruk uten merkbart tap i oppgaveløsning.

Kodeagenter er dyre fordi de sender mye kontekst på nytt for hver melding. Hele filer, tidligere svar og systeminstruksjoner følger med hvert kall, og token-telleren løper. Condense angriper dette punktet: i stedet for å endre agenten eller modellen, sitter proxyen imellom og trimmer det som sendes.

For deg som betaler egen API-regning er dette den interessante vinkelen. Du bytter ikke verktøy og du bytter ikke modell. Du peker agenten mot proxyen, og den komprimerer før kallet går videre. Tallet på 72 prosent er et tak, ikke et snitt, og gevinsten avhenger av hvor mye redundant kontekst arbeidsflyten din drar med seg.

Det åpne oppsettet betyr at du kan sette den opp selv og se hva den faktisk fjerner. Verdt en test hvis du kjører agenter tungt nok til at regningen merkes. Sjekk at komprimeringen ikke stryker kontekst du faktisk trenger, for der ligger risikoen: en billigere kjøring som løser oppgaven dårligere hjelper ingen.

Pulsen · norske KI-nyheter for deg som bygger. Sakene er KI-generert fra originalkilden, som alltid lenkes.