Sakanas Fugu Max ruter til åpne modeller for 2 dollar per million input-tokens
Lanserer Sakana AI to nye utgaver av orkestratoren Fugu: Fugu Max for nær frontnivå til lav pris, og Fugu Ultra v2 for toppscorer uten Fable 5 eller GPT-6 Astra i modellpoolen.
2 dollar per million input-tokens og 6 dollar per million output-tokens. Det er prisen Sakana AI setter på Fugu Max, som selskapet slapp i september sammen med Fugu Ultra v2. Ifølge Sakana er output-prisen 40 til 60 prosent lavere enn for Sonnet 5, GPT 5.6 Terra og Kimi K3. Begge er tilgjengelige gjennom Sakanas OpenAI-kompatible API, og kjører du Fugu allerede, er oppgraderingen ifølge selskapet en endring av én parameter.
Fugu er ikke én modell, men et orkestreringslag som fordeler arbeid på en pool av andre modeller. Fugu Max utvider poolen med flere åpne og spesialiserte modeller, blant dem NVIDIAs Nemotron-familie, og sender hver oppgave til den minste modellen som klarer den. Sakana hevder at det gir ytelse nær de beste modellene til to til seks ganger lavere kostnad.
«Et system som setter en modell med flere billioner parametre til å gjøre et enkelt dataoppslag, er ikke intelligent, men ødselt» — Sakana AI, i lanseringsposten
Fugu Max har ifølge Sakana best totalscore på seks benchmarks, blant dem Terminal Bench 2.1, AutomationBench og SWEFish, og flytter grensen for kostnad mot ytelse på sju av ti. SWEFish er Sakanas egen interne test, bygd på selskapets egne kodeoppgaver, så den delen av resultatet kan du ikke etterprøve.
Fugu Ultra v2 er den dyre enden av samme arkitektur. Den er best eller delt best på fem av åtte benchmarks og blant de to beste på sju. På Chartography, som måler visuell resonnering og tolkning av data, scorer den 48,3 mot 27,3 for Opus 5 og 29,5 for Fable 5. På DeepSWE, en test av reell programvareutvikling, får den 74,3. Sakana understreker at verken Fable 5, Fable 5.1 eller GPT-6 Astra inngår i poolen, og at treningen har cutoff 28. august 2026.
For deg som bygger agenter betyr et OpenAI-kompatibelt endepunkt at orkestratoren kan prøves uten å skrive om klientkoden. Prisen er at du ikke styrer hvilken modell som svarer på hver deloppgave. Sakana snur det til et argument: en utskiftbar pool skal beskytte mot leverandørlås, tilbaketrukne API-er og brå avstengning av tjenester.
Hva bør du gjøre?
- Kjør et utvalg av dine egne agentoppgaver mot Fugu Max og modellen du bruker i dag, med de samme promptene, før du stoler på Sakanas benchmarks.
- Regn på output-prisen, der Sakana oppgir den største forskjellen mot Sonnet 5, GPT 5.6 Terra og Kimi K3.
- Sjekk at kontoen din faktisk får tilgang fra Norge før du planlegger en arbeidsflyt rundt tjenesten.
Bakgrunn
Fugu gikk i beta i april og ble generelt tilgjengelig i juni, samtidig med Fugu Ultra v1. I juli kom Fugu-Cyber og et grensesnitt mot Claude Code, og i august lanserte Sakana forbrukertjenesten Sakana Chat og begynte å integrere NVIDIAs åpne Nemotron-modeller.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.