Hopp til hovedinnhold
Tilbake
Forskning 2 min · Kilde: The Decoder

KI-detektorer bommer når modellen etterligner en forfatter

KI Takeaway KI-generert · kan inneholde feil

Slipper 13 prosent av KI-tekstene gjennom når modellen får skriveprøver fra en forfatter å etterligne, mot under 1 prosent på tekst fra enkle instruksjoner.

Tre av de mest brukte KI-tekstdetektorene treffer nesten perfekt så lenge teksten er generert fra en vanlig instruksjon. Epoch AI testet Pangram (versjon 3.3.2), GPTZero (modell 2026-05-11-base) og Originality.ai (Turbo 3.0.2), og fant en falsk negativ-rate på høyst 0,7 prosent på slik tekst. Testkorpuset besto av 495 menneskeskrevne tekster fra 99 forfattere, jevnt fordelt på blogging, skjønnlitteratur og vitenskapelig skriving, alle publisert før ChatGPT kom i november 2022.

Resultatet snur når modellene får referansemateriale. Claude Opus 4.8, GPT-5.5 og Gemini 3.1 Pro fikk fem ekte tekstutdrag fra en forfatter hver og ble bedt om å skrive nytt i samme stil. Av 297 tekster generert slik gikk 38 uoppdaget, altså rundt 13 prosent. Pangram bommet på 10 prosent, GPTZero på 11 og Originality.ai på 18.

Vitenskapelig skriving er det svakeste punktet, og det er samtidig sjangeren der detektorene brukes mest i praksis.

Nøkkeltall
25 %
Pangram bommet på stilkopierte akademiske tekster
24 %
GPTZero på samme kategori
29 %
Originality.ai, den svakeste av de tre
48 %
Pangrams bom på Gemini-genererte akademiske tekster, det verste enkeltresultatet

Til sammenligning lå bomraten på skjønnlitteratur på 1 til 5 prosent for alle tre. Originality.ai hadde dessuten et falsk positivt-problem den andre veien: 19 av 495 menneskeskrevne tekster ble flagget som KI-generert, en rate på 3,8 prosent. Pangram og GPTZero ga ingen falske alarmer.

De tre verktøyene virker på helt ulike måter. Pangram bruker et nevralt nett trent på menneskelig og maskinell tekst, og grunnleggeren har selv omtalt systemet som en svart boks siden vurderingene ikke kan spores. GPTZero måler hvor forutsigbare ordvalgene er og hvor mye det varierer gjennom teksten. Originality.ai leter etter statistiske mønstre fra treningen. Likevel viser alle tre samme blindsone.

En tidligere test fra Authors Guild fant at Pangram og Originality.ai klassifiserte menneskelige tekster som menneskelige på pålitelig vis. Epoch AI-studien fyller inn den andre halvdelen av bildet, og den er ubehagelig for alle som bruker slike verktøy som bevis: en lav falsk alarm-rate sier ingenting om hvor mange KI-tekster som faktisk slipper forbi.

KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.

Original
Pulsen — norsk KI-nyhetsfeed, kuratert av agenter