KI-detektorer bommer når modellen etterligner en forfatter
Slipper 13 prosent av KI-tekstene gjennom når modellen får skriveprøver fra en forfatter å etterligne, mot under 1 prosent på tekst fra enkle instruksjoner.
Tre av de mest brukte KI-tekstdetektorene treffer nesten perfekt så lenge teksten er generert fra en vanlig instruksjon. Epoch AI testet Pangram (versjon 3.3.2), GPTZero (modell 2026-05-11-base) og Originality.ai (Turbo 3.0.2), og fant en falsk negativ-rate på høyst 0,7 prosent på slik tekst. Testkorpuset besto av 495 menneskeskrevne tekster fra 99 forfattere, jevnt fordelt på blogging, skjønnlitteratur og vitenskapelig skriving, alle publisert før ChatGPT kom i november 2022.
Resultatet snur når modellene får referansemateriale. Claude Opus 4.8, GPT-5.5 og Gemini 3.1 Pro fikk fem ekte tekstutdrag fra en forfatter hver og ble bedt om å skrive nytt i samme stil. Av 297 tekster generert slik gikk 38 uoppdaget, altså rundt 13 prosent. Pangram bommet på 10 prosent, GPTZero på 11 og Originality.ai på 18.
Vitenskapelig skriving er det svakeste punktet, og det er samtidig sjangeren der detektorene brukes mest i praksis.
Til sammenligning lå bomraten på skjønnlitteratur på 1 til 5 prosent for alle tre. Originality.ai hadde dessuten et falsk positivt-problem den andre veien: 19 av 495 menneskeskrevne tekster ble flagget som KI-generert, en rate på 3,8 prosent. Pangram og GPTZero ga ingen falske alarmer.
De tre verktøyene virker på helt ulike måter. Pangram bruker et nevralt nett trent på menneskelig og maskinell tekst, og grunnleggeren har selv omtalt systemet som en svart boks siden vurderingene ikke kan spores. GPTZero måler hvor forutsigbare ordvalgene er og hvor mye det varierer gjennom teksten. Originality.ai leter etter statistiske mønstre fra treningen. Likevel viser alle tre samme blindsone.
En tidligere test fra Authors Guild fant at Pangram og Originality.ai klassifiserte menneskelige tekster som menneskelige på pålitelig vis. Epoch AI-studien fyller inn den andre halvdelen av bildet, og den er ubehagelig for alle som bruker slike verktøy som bevis: en lav falsk alarm-rate sier ingenting om hvor mange KI-tekster som faktisk slipper forbi.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.