Med KI-råd for hånden sluttet folk å si «vet ikke» og traff bare en tredjedel så ofte
Regn med at brukerne stoler på KI-svaret også når det er feil, for i fem eksperimenter med 3 132 deltakere forsvant nesten all vilje til å si «vet ikke» straks KI-råd var tilgjengelig.
Chiara Marcoccia, Walter Quattrociocchi og Valerio Capraro ga deltakerne seks vanskelige spørsmål om visuelle detaljer i filmer, som fargen på lagdraktene i Bend It Like Beckham, og «vet ikke» var alltid et gyldig svar. Preprinten ligger på arXiv fra 15. juli, og The Decoder omtalte den 26. september. I de to første studiene holdt kontrollgruppen uten KI tilbake svaret på 36 og 44 prosent av spørsmålene. Med tilgang til KI falt andelen til 6 og 3 prosent.
Spørsmålene var valgt slik at modellen i forsøket, Step 3.5 Flash fra StepFun, nesten alltid svarte feil. Forskerne sjekket også GPT-5.5, Claude 4.6 Sonnet og Gemini 3.5 Flash, som ofte traff på de andre spørsmålene, men alle bommet på det vanskeligste. Nedgangen kan derfor ikke forklares som fornuftig delegering til et pålitelig verktøy.
Uten økonomiske insentiver svarte deltakerne med KI riktig på 9,2 prosent av spørsmålene, mot 27,5 prosent uten. Selvtilliten steg samtidig fra 29,6 til 75,9 på en skala til 100. Når hvert riktig svar ga 10 cent og hvert feil svar kostet 10 cent, spurte folk KI sjeldnere og svarte oftere riktig, men sa fortsatt «vet ikke» langt sjeldnere enn kontrollgruppen. I studie 4 ble KI-svaret vist automatisk, slik søkemotorer og skriveassistenter gjør, og andelen «vet ikke» falt fra 35 til 1 prosent.
«Risikoen er trolig større enn ved søk, fordi en generativ modell gir ett enkelt, bestemt svar der et søk kan vise kilder som spriker, og dermed fjerner friksjonen som kunne ført til en pause» — Marcoccia, Quattrociocchi og Capraro, i preprinten
Forskerne påpeker selv at alle forsøkene brukte én type spørsmål, filmdetaljer valgt fordi de framkaller hallusinasjoner, så det er uavklart om effekten er like sterk på andre felt. For deg som bygger chatboter og KI-oppsummeringer viser studie 4 at et ferdig vist svar er nok til at brukeren slutter å stoppe opp på egen hånd.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.