Google lanserer Gemini 4 Argon med 1 million tokens output, men foreløpig bare for cyberforsvarere
Noter deg Gemini 4 Argon, Googles nye frontiermodell med 1 million tokens output og $2/$10 i introduksjonspris, men vent med å bygge på den til Google åpner API-et for utviklere.
Google kunngjorde onsdag kveld Gemini 4 Argon i et blogginnlegg signert Koray Kavukcuoglu. Modellen ruller foreløpig bare ut til en gruppe betrodde cyberforsvarere gjennom det Google kaller Fairwind-programmet. Utviklere, bedrifter og forbrukere må vente, og Google oppgir ingen dato. Når modellen åpnes bredere, kommer betalende API-kunder og Google AI Ultra-abonnenter først.
Den største tekniske endringen er output-grensen. Argon kan skrive opptil 1 million tokens i ett svar, opp fra 64 000 tidligere. Google begrunner det med at modellen skal kunne resonnere lenge og produsere hundretusenvis av tokens i én kjøring for å løse vanskelige oppgaver i ett forsøk. Introduksjonsprisen er $2 per million input-tokens og $10 per million output-tokens, med 95 prosent rabatt på cachet input.
Tallene Google selv publiserer er sterke. Argon setter ny rekord på DeepSWE v1.1 med 77,9 prosent, rangerer først på Zapiers AutomationBench med 51,3 prosent og deler førsteplassen på CWE-bench v1 med 68 prosent. Artificial Analysis, som tester modeller uavhengig, gir Argon (High) 53 poeng på sin Intelligence Index, mot en median på 26 i samme prisklasse. Den samme testen viser en bakside: Argon brukte 110 millioner output-tokens på indeksen, mot en median på 82 millioner. Lange svar kan altså spise opp deler av prisfordelen.
Google viser også til egen bruk. Argon-agenter migrerer C- og C++-kode til Rust internt, fra titusenvis av linjer i biblioteker som re2 til over 800 000 linjer i Fuchsias Zircon-kjerne. I videodekoderen libgav1 erstattet agentene 32 000 linjer SIMD-kode med trygg Rust som kompilatoren vektoriserer selv, og dekoderen kjører nå 2,7 ganger raskere enn den forrige Rust-porten.
Cybersikkerhet forklarer den trinnvise utrullingen. Google har trent Argon til å finne, validere og patche sårbarheter på egen hånd, og betrodde forsvarere får modellen uten cyber-guardrails. Wiz bruker den allerede i programmet Scan for Good, der modellen ifølge Google fant en kritisk sårbarhet i sykehusprogramvare som tidligere frontiermodeller hadde oversett. Google deltar samtidig i den amerikanske regjeringens frivillige ordning for tilgang til modeller før lansering.
«Vi vil fortsette å samle tilbakemeldinger fra tidlige testere mens vi jobber videre med guardrails, før vi gjør Argon tilgjengelig for utviklere, bedrifter og forbrukere så snart som mulig.» — Koray Kavukcuoglu, Google
Google overvåker også Argons chain-of-thought og handlinger, og stopper kjøringen hvis modellen går lenger enn brukeren ba om. Selskapet skriver at funnene fra overvåkingen bevisst holdes utenfor treningen, slik at modellen ikke lærer å skjule resonnementet sitt.
På Hacker News samlet lanseringen over 670 poeng og 400 kommentarer på få timer. Flere påpeker at modellen ennå ikke er tilgjengelig for vanlige brukere, og entusiasmen blandes med tretthet over benchmark-tall.
«Det føles virkelig som om benchmarkene er hypermettet for tiden. Jeg venter til jeg har prøvd den selv før jeg blir for gira.» — jjcm på Hacker News
For deg som bygger agenter er output-grensen det viktigste signalet: en modell som kan skrive 1 million tokens i én kjøring til $10 per million, åpner for kodemigreringer og lange rapporter i ett kall, men først når Google slipper den ut av den lukkede testfasen.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.