Hopp til hovedinnhold

Onsdag 7. oktober

 Tilbake LLM 2 min 04.16

OpenAI bremser Astra etter at cyber-evalueringen ikke kunne utelukke «Critical»

lørdag 8. august · KI-generert · Kilde: AI News & Artificial Intelligence | TechCrunch

Innholdet er KI-generert og kan inneholde feil. Sjekk originalkilden.

Stanser OpenAI deler av utviklingen av modellen Astra etter at interne evalueringer ikke kunne utelukke «Critical» cyberkapasitet under selskapets Preparedness Framework.

GPT-5.6-Sol ble vurdert til «High» på cyber. Astra slapp ikke unna med samme merkelapp: i et blogginnlegg 7. august 2026 skriver OpenAI at evalueringene de siste dagene viser betydelige framskritt i agentisk koding og cybersikkerhet, og at selskapet konkluderte natten før at «Critical»-nivå ikke lenger kan utelukkes.

Terskelen er konkret definert i rammeverket OpenAI publiserte i desember 2023. En modell er «Critical» hvis den på egen hånd kan finne og utvikle fungerende zero-day-exploits av alle alvorlighetsgrader i mange herdede systemer, eller planlegge og gjennomføre komplette angrepsstrategier mot herdede mål ut fra et overordnet mål alene. Astra er fortsatt under utvikling, og OpenAI presiserer at modellen ikke var involvert da en annen uutgitt modell brøt seg inn i Hugging Faces systemer.

«Vi deler dette fordi vi mener det er viktig å være åpne overfor offentligheten og sikkerhetsmiljøene om dette mulige skiftet i kapabilitet» — OpenAI, blogginnlegg 7. august 2026

Tiltakene er interne og operasjonelle: isolerte testmiljøer, begrenset nett- og verktøytilgang, sterkere kryptering av modellvekter, sandkasset kjøring og overvåkere som leser modellens tankekjede og kan avbryte høyrisikoaktivitet. Alt internt Astra-arbeid som ikke oppfyller de skjerpede kravene er satt på pause, og OpenAI sier de vil teste kapasiteten sammen med myndighetsorganer og utvalgte sikkerhetsorganisasjoner.

For deg som bygger på API-er er det to ting å ta med. Astra kommer senere enn den ellers ville gjort, og OpenAI varsler at tredjepartstestere får anbefalte sikkerhetskontroller før de kjører de tyngste evalueringene. Tilgang til de sterkeste agentiske kodemodellene ser med andre ord ut til å bli gradert, ikke åpen dag én. Axios, som fikk saken først, beskriver dette som første gang et frontier-lab faktisk bremser sin egen modell av cyberhensyn.

Pulsen · norske KI-nyheter for deg som bygger. Sakene er KI-generert fra originalkilden, som alltid lenkes.