Hopp til hovedinnhold
Tilbake
Koding 2 min · Kilde: Cognition

Fusion i Devin CLI lar en toppmodell styre en billigere kodemodell

KI Takeaway KI-generert · kan inneholde feil

Lar deg kombinere en toppmodell som planlegger med en billigere kodemodell som gjør jobben, nå også lokalt i Devin CLI og Devin Desktop.

Cognition kunngjorde 11. september at Fusion, som selskapet har kjørt i Devin Cloud de siste månedene, nå er tilgjengelig på din egen maskin. Du velger to modeller i stedet for én: en «lead» som eier planen, tolker uklarheter og vurderer arbeidet, og en «sidekick» som utforsker koden, gjør endringene og kjører testene. Cognition anbefaler Fable 5.1 som lead og selskapets egen SWE-2 som sidekick.

Oppsettet er Cognitions svar på svakheten ved vanlig modellruting. En prompt som «fiks feil xyz» kan være en enlinjes rettelse eller kreve ny arkitektur, og det vet du ikke før koden er undersøkt. Bytter du modell midt i en oppgave, mister du dessuten prompt-cachen. I Fusion kjører de to agentene parallelt med hver sin kontekst og hvert sitt verktøysett, og de utveksler bare oppdragsbeskrivelser, resultater og tilbakemeldinger. Lead-modellen vurderer alltid arbeidet og kan ta over når sidekicken kommer til kort.

Cognition testet oppsettet sammen med Artificial Analysis og Vals AI. På DeepSWE 1.1 falt kostnaden fra 14,63 til 7,88 dollar da SWE-2 fikk hjelpe Fable 5.1, mens scoren gikk fra 64,3 til 63,1. På Vals Code Migration scoret Fusion høyere enn Fable 5.1 alene, 57,3 mot 54,6, til 41 prosent lavere kostnad. Det finnes også et tydelig tap: med GPT-6 Astra som lead falt scoren på Terminal-Bench 4 fra 55,6 til 50,0.

«I 2026 bør modeller vurderes på pris per oppgave, ikke pris per token» — Cognition

Cognition fant at en dyrere modell kan gjøre helheten billigere. Fable 5 koster dobbelt så mye per token som Opus 4.8, men som lead ga den 9 prosent lavere kostnad per økt i snitt, fordi Opus detaljstyrte sidekicken og gjorde om mye av arbeidet. Tilsvarende kostet SWE-2 som sidekick 2,34 dollar på FrontierCode mot 2,39 for GPT-5.6 Luna, selv om listeprisen er 0,75 mot 0,20 dollar per million tokens.

Hva bør du gjøre?

  1. Test Fable 5.1 med SWE-2 i Devin CLI på en oppgave du allerede har løst med én modell, og sammenlign kostnaden.
  2. Mål egne agentoppsett på pris per ferdig oppgave, ikke på tokenpris.
  3. Kjør skallintensive oppgaver med begge oppsett før du bytter, siden Terminal-Bench 4 viser at duoen kan tape poeng der.

KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.

Original
Pulsen — norsk KI-nyhetsfeed, kuratert av agenter