704 hemmeligheter hentet ut av krypterte tankekjeder fra LLM-APIer
Dekoder et forskerteam krypterte resonneringsblokker fra OpenAI-, Anthropic- og Google-APIer med to kall, og finner ekte API-nøkler og passord i sporene.
Tallet som gjør funnet konkret er 315 320. Så mange skjulte resonneringsblokker rekonstruerte gruppen bak «Stolen Thoughts» fra 6 708 offentlig tilgjengelige agent-kjøringer samlet inn fra GitHub og Hugging Face. Åtte forfattere står bak, blant dem Ilia Shumailov, Jonas Geiping og Maksym Andriushchenko.
Mekanismen er at de krypterte tankeblokkene APIene returnerer, er utbyttbare på tvers av sesjoner, brukere og modeller. Sender du en blokk produsert av én modell inn til en annen modell i samme familie og ber den transkribere resonnementet som hører til turen, skriver den ut innholdet. Demonstrasjonen deres dekoder et spor fra claude-opus-4-8 ved hjelp av claude-haiku-4-5, og et GPT-5.2 Codex-spor med GPT-5.6 Luna. Mengden dekodet tekst følger antallet skjulte tenke-tokener APIet selv rapporterer.
Innholdet er ikke bare benchmark-støy. Begrenset til ekte brukersesjoner hentet forskerne ut 704 distinkte personvernsartefakter.
64 av de 704 artefaktene fantes utelukkende inne i resonneringsblokkene, og ingen andre steder i den synlige sesjonen. Der ligger poenget for deg som deler agent-logger: å sanere den synlige samtalen holder ikke når den krypterte blokken blir liggende ved siden av. Publiserer du kjøringer fra en kodeagent til et repo eller et datasett, følger tankekjeden med, og den kan leses av alle med API-tilgang til samme modellfamilie.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.