OpenAI halverer API-prisen med GPT-6 Sol og Luna
Test gpt-6-luna på agentoppgaver du i dag sender til dyrere modeller, for OpenAI oppgir at den når Claude Opus 5-nivå på kodetesten DeepSWE til 93 prosent lavere kostnad per oppgave.
Der GPT-6 Astra, lansert tidligere i september, er OpenAIs modell for de mest krevende prosjektene, skal de nye modellene GPT-6 Sol og GPT-6 Luna ta det meste av det daglige arbeidet. OpenAI har kuttet API-prisen for begge med 50 prosent sammenlignet med kampanjeprisene for GPT-5.6. Sol koster 2 dollar inn og 10 dollar ut per million tokens, Luna 0,10 og 0,50 dollar. Ifølge OpenAI er begge trent med lignende metoder som Astra.
Benchmarkene OpenAI viser fram, sammenligner først og fremst mot Anthropic. På DeepSWE v1.1 scorer Sol 68,8 prosent på maks innsatsnivå, 1,1 prosentpoeng under Claude Fable 5s beste resultat på 69,9 prosent, til rundt 80 prosent lavere kostnad per oppgave. Luna scorer 66,6 prosent, sammenlignbart med Claude Opus 5 og Fable 5 på middels innsats. På AutomationBench, som tester forretningsflyter på tvers av 47 verktøy, får Sol 33,2 prosent mot 26,9 for Claude Opus 5, til 9 prosent av kostnaden per oppgave. Konkurrenttallene er hentet fra offentlige rapporter, skriver OpenAI, mens egne modeller er målt i selskapets forskningsmiljø eller via API-et.
For deg som bygger agenter er endringene i prompt-caching minst like viktige som tokenprisen. GPT-6 gir høyere treffrate i cachen som standard og 90 prosent rabatt på cachede input-tokens. Du kan nå justere reasoning effort og slå verktøy av og på midt i en samtale uten å miste cachen, og eksplisitte breakpoints lar deg bestemme hvor det cachede prefikset slutter.
«Forbedringer i caching og inferens lar oss levere disse modellene til lavere kostnad, og vi gir besparelsene direkte videre til brukere og kunder» — OpenAI, i lanseringsinnlegget
OpenAI viser også til GitHub, som ifølge selskapet har redusert andelen prompt-tokens som må prosesseres på nytt med over 50 prosent de siste månedene, på tvers av milliarder forespørsler fra Copilot. På OpenAIs interne faktatest, bygget på avidentifiserte samtaler der brukere hadde flagget feil, gjør Sol omtrent halvparten så mange feil som forgjengeren.
Modellene ligger i API-et som gpt-6-sol og gpt-6-luna, og rulles ut i ChatGPT Work og Codex for Plus, Pro, Business, Enterprise og Edu. Gratis- og Go-brukere får Luna i skrivebordsappen.
Hva bør du gjøre?
- Kjør dine egne evals med gpt-6-luna på oppgaver du i dag sender til en dyrere modell. Tallene over er OpenAIs egne, og flere av dem er målt på høyeste innsatsnivå.
- Åpne Prompt Caching Dashboard og diagnoseverktøyet for å se hvor agenten din bommer på cachen, og sett eksplisitte breakpoints etter faste systemprompter.
- Regn på besparelsen mot det du faktisk betaler i dag, siden halveringen er målt mot GPT-5.6-kampanjeprisene.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.