OpenAI lanserer Decisions API for raske agentvalg og Ultrafast til seks ganger prisen
Skill planlegging fra enkeltvalg: OpenAIs nye Decisions API svarer med forhåndsdefinerte svar, mens Ultrafast selger deg fart på GPT-6 Astra for seks ganger standardprisen.
300 tokens i sekundet er farten OpenAI lover i Codex med den nye Ultrafast-tieren, opptil åtte ganger raskere enn standard, skriver The Decoder fra DevDay i San Francisco. I API-et er Ultrafast opptil seks ganger raskere og koster seks ganger standardprisen. For GPT-6 Astra betyr det 60 dollar per million input-tokens og 300 dollar per million output-tokens. Astras eksisterende Fast-modus gir 2,5 ganger farten for dobbel pris.
For agentbyggere er Decisions API den mer interessante nyheten. Du definerer et spørsmål med et begrenset sett forhåndsdefinerte svar, sender inn kontekst som tekst eller bilder og får ett svar tilbake. Under panseret ligger en versjon av GPT-6 Luna, OpenAIs lavprismodell, og OpenAI nevner klassifisering av innhold, ruting av forespørsler og valg av agentens neste steg som bruksområder. API-et starter som begrenset preview, og bred tilgang er ventet i løpet av få dager.
«API-et bruker Luna til å svare på et sett brukerdefinerte spørsmål med forhåndsdefinerte svar» — TechCrunch
Med dette går OpenAI inn i feltet for såkalte System One-modeller. TypeSafe AI, startupen til den tidligere OpenAI-forskeren Diogo Almeida, slapp beslutningsmodellen Jev i midten av september og utløste stor interesse blant utviklere. Mønsteret er en sterk modell som planlegger og en rask modell som tar de mange små valgene. The Decoder viser til en Minecraft-agent der GPT-6 Astra setter mål og veipunkter, mens Jev velger enkelthandlinger som å utvinne, lage gjenstander eller slåss.
«Å koble en sterkere modell som orkestrator med en rask beslutningsmodell ser lovende ut» — The Decoder
Agents API, som har vært i offentlig beta siden 11. september, får samtidig Computer Use, slik at agenter kan betjene programvare på egen hånd. API-et får også Codex sine multiagent-funksjoner, Tool Search og Context Compaction, som komprimerer lange kontekster automatisk. Hos AWS tar Bedrock Managed Agents over kjernefunksjonene, så du kan bygge OpenAI-agenter som kjører helt på AWS.
Prisene per million output-tokens viser spennet i OpenAIs modellstige:
Abonnementene endres også. Den nye Pro 500-planen koster 500 dollar i måneden og gir Ultrafast i ChatGPT Work og Codex. Den eksisterende Pro-planen til 200 dollar gir nå 10 ganger Plus-bruk i ChatGPT Work og Codex, ned fra 20, og GPT-6 Pro-meldinger i chat halveres fra 200 til 100 i uken. Eksisterende kunder beholder dagens grenser i en overgangsperiode og får en engangskreditt.
Hva bør du gjøre?
- Test Decisions API når preview-tilgangen åpner, hvis agenten din bruker en stor modell til ja/nei-valg eller ruting, og mål latens og pris mot dagens oppsett.
- Regn på Ultrafast per oppgave, ikke per token. Seks ganger prisen lønner seg bare der ventetid koster mer enn tokens, for eksempel i interaktive kodeøkter.
- Sjekk Pro-grensene dine før overgangsperioden går ut, siden 200-dollarsplanen nå gir halvparten så mye bruk i Codex.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.