Hopp til hovedinnhold

Onsdag 7. oktober

 Tilbake LLM 2 min 21.07

704 hemmeligheter hentet ut av krypterte tankekjeder fra LLM-APIer

tirsdag 11. august · KI-generert · Kilde: Hacker News - Newest: ""AI" "LLM" "Claude""

Innholdet er KI-generert og kan inneholde feil. Sjekk originalkilden.

Dekoder et forskerteam krypterte resonneringsblokker fra OpenAI-, Anthropic- og Google-APIer med to kall, og finner ekte API-nøkler og passord i sporene.

Tallet som gjør funnet konkret er 315 320. Så mange skjulte resonneringsblokker rekonstruerte gruppen bak «Stolen Thoughts» fra 6 708 offentlig tilgjengelige agent-kjøringer samlet inn fra GitHub og Hugging Face. Åtte forfattere står bak, blant dem Ilia Shumailov, Jonas Geiping og Maksym Andriushchenko.

Mekanismen er at de krypterte tankeblokkene APIene returnerer, er utbyttbare på tvers av sesjoner, brukere og modeller. Sender du en blokk produsert av én modell inn til en annen modell i samme familie og ber den transkribere resonnementet som hører til turen, skriver den ut innholdet. Demonstrasjonen deres dekoder et spor fra claude-opus-4-8 ved hjelp av claude-haiku-4-5, og et GPT-5.2 Codex-spor med GPT-5.6 Luna. Mengden dekodet tekst følger antallet skjulte tenke-tokener APIet selv rapporterer.

Innholdet er ikke bare benchmark-støy. Begrenset til ekte brukersesjoner hentet forskerne ut 704 distinkte personvernsartefakter.

Nøkkeltall
62
API-nøkler funnet i dekodede resonneringsspor
33
passord
24
tilgangstokener
30
personlige e-postadresser

64 av de 704 artefaktene fantes utelukkende inne i resonneringsblokkene, og ingen andre steder i den synlige sesjonen. Der ligger poenget for deg som deler agent-logger: å sanere den synlige samtalen holder ikke når den krypterte blokken blir liggende ved siden av. Publiserer du kjøringer fra en kodeagent til et repo eller et datasett, følger tankekjeden med, og den kan leses av alle med API-tilgang til samme modellfamilie.

Pulsen · norske KI-nyheter for deg som bygger. Sakene er KI-generert fra originalkilden, som alltid lenkes.