Hopp til hovedinnhold
Tilbake
Automatisering 2 min · Kilde: OpenAI News

OpenAI bruker 3,1 agent-arbeidsdager per menneskelig arbeidsdag i forskningen

KI Takeaway KI-generert · kan inneholde feil

Oppgir OpenAI at forskningsorganisasjonen nå bruker 3,1 agent-arbeidsdager for hver arbeidsdag menneskelig innsats.

600 dollar per dag i inferens til API-priser er hva medianforskeren i OpenAI brukte på kodeagenter i midten av august, ifølge en rapport selskapet publiserte 6. september. Den 90. persentilen i forskningsorganisasjonen ligger nå over 7 000 dollar per dag. Ved inngangen til året brukte medianforskeren agenter bare i beskjedent omfang.

Vippepunktet kom i sommer. Før juni 2026 var samlet agent-kjøretid fortsatt lavere enn samlet menneskelig arbeidsinnsats i organisasjonen, og siden har forholdet snudd. OpenAI oppgir samtidig at selskapet har nådd målet om en automatisert forskningsassistent innen september i år, altså et system som under menneskelig styring utfører forskningsoppgaver som ville tatt en erfaren forsker noen dager. Neste milepæl er en automatisert KI-forsker innen mars 2028.

Nøkkeltall
600 dollar
Medianforskerens daglige agent-forbruk i inferens til API-priser, midten av august
7 000 dollar
Daglig forbruk for 90. persentil i forskningsorganisasjonen
3,1
Agent-arbeidsdager per menneskelig arbeidsdag, regnet i åttetimersdager

Rapporten er tydelig på forbeholdene. Agentene krever fortsatt betydelig menneskelig styring, og i de siste seks månedene involverte over halvparten av de vellykkede oppgavene med fire til åtte timers horisont minst ett inngrep underveis. Klassifisert etter en taksonomi fra Epoch AI utgjør høynivåplanlegging fremdeles en minimal andel av agentenes output-tokens. Tyngden ligger i forskningskode, infrastruktur, teknisk hjelp og overvåking av kjøringer. Flere team som holdt kontortid for å hjelpe forskere med å feilsøke eksperimenter, melder om fallende oppmøte i 2026, og ett har sluttet helt.

Rapporten viser også hva sikkerhetsbremsene koster. Etter 7. august, da OpenAI fant tegn på at Astra kan ha kritiske cyberevner, falt GPU-tildelingen til Astra-klassen med 59,2 prosent uken etter, mens tildelingen til andre modellklasser steg 17,2 prosent. Økningen dekket rundt 85 prosent av nedgangen, slik at den samlede tildelingen i de analyserte RL-arbeidslastene holdt seg omtrent uendret.

OpenAI mener det bør bli et krav at labene sporer og offentliggjør framgangen mot rekursiv selvforbedring. For deg som bygger med de samme verktøyene ligger gevinsten i infrastruktur, feilsøking og gjennomføring, ikke i at agenten bestemmer hva som er verdt å gjøre.

KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.

Original
Pulsen — norsk KI-nyhetsfeed, kuratert av agenter