GPT-6 Astra krever Responses API for verktøykall og dropper temperature
Migrer til Responses API før du bytter til GPT-6 Astra, for verktøykall via Chat Completions slutter å virke.
Tre punkter i OpenAIs API-changelog for 3. september avgjør om koden din fortsatt kjører når du bytter modell. GPT-6 Astra støtter ikke nivået none for reasoning effort. Den godtar ikke egne verdier for temperature eller top_p, og den returnerer ikke log-sannsynligheter (logprobs). Og bruker du verktøy gjennom Chat Completions, må du flytte kallene.
«Verktøykall krever Responses API. Bruker du verktøy med Chat Completions, følg migreringsguiden for Responses» — OpenAIs API-changelog, 3. september 2026
Dette er siste steg i en opprydding OpenAI har holdt på med lenge. Assistants API ble slått av 26. august, og Responses API er nå det eneste stedet der verktøy, samtaletilstand og agent-kjøringer henger sammen. Bruker du et rammeverk som allerede snakker Responses, merker du lite. Har du egen kode mot Chat Completions med function calling, er dette en reell migrering, ikke en modellstreng du bytter ut.
Til gjengjeld kommer tre nye kontroller bygget for langkjørende agenter, og de er den egentlige nyheten for deg som bygger. Async tool calling lar modellen jobbe videre mens applikasjonen din kjører et verktøy, og resultatene leveres etter hvert som de blir klare. Mid-turn steering lar deg sende nye instruksjoner over WebSockets mens svaret er underveis, slik at modellen kan ta inn korreksjoner midt i en oppgave. Og du kan endre reasoning effort midt i en samtale, opp for det vanskelige og ned for rutinemessige oppfølginger, uten å ødelegge den hurtigbufrede prompt-prefiksen.
Den siste endringen er mindre hyggelig. OpenAI har lagt inn misalignment monitoring, som asynkront ser etter problemer mens agenten jobber i støttede Responses-kall. Sjekkene kan utløse sikkerhetsvarsler eller stanse en samtale for gjennomgang. For en agent som kjører uten tilsyn betyr det at kjøringen kan bli avbrutt av noe annet enn din egen kode, og at du trenger håndtering for det tilfellet.
Prisen er den andre grunnen til å tenke seg om. GPT-6 Astra koster 10 dollar per million input-tokens og 50 dollar per million output-tokens ifølge OpenAIs prisside, mot 4 og 20 dollar for GPT-5.6 Sol. Bufret input ligger på 1 dollar per million, og batch halverer alt. På prissiden opplyser OpenAI at Astra rulles ut til bedrifter i selskapets Trusted Access Program først, og at tilgang via API og Plus-, Pro-, Business- og Enterprise-planene kommer i dagene etter.
Hva bør du gjøre?
- Kartlegg hvor du kaller function calling mot Chat Completions. Det er den eneste endringen som gir harde feil, ikke bare endret oppførsel.
- Fjern hardkodet
temperature,top_poglogprobsfra Astra-kall. Har du evals som styrer på temperatur, må de skrives om. - Behold Sol som standard for rutinearbeid og send kun de tunge, langkjørende oppgavene til Astra. Prisforskjellen er 2,5 ganger på begge sider av tokenregnskapet.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.