Hopp til hovedinnhold
Tilbake
Forskning 2 min · Kilde: The Decoder

DeepMind-forsker: språkmodeller mangler det kreative spranget

KI Takeaway KI-generert · kan inneholde feil

Hevder Tom Zahavy i Google DeepMind at språkmodeller mangler den kreative slutningsformen vitenskapelige gjennombrudd krever.

En språkmodell kunne trolig utledet den generelle relativitetsteorien hvis den fikk Einsteins aksiomer utdelt. Å formulere aksiomene i utgangspunktet er der maskinene stopper, skriver Tom Zahavy i Google DeepMind i posisjonspapiret «LLMs can't jump». Evnen som mangler kaller han manipulativ abduksjon: å oppfinne en årsak det ennå ikke finnes språklig mal for.

Zahavy bygger argumentet på Charles Sanders Peirces tredeling av resonnering:

  1. Deduksjon utleder garanterte konklusjoner fra faste regler, som et program med bevislig korrekt utdata.
  2. Induksjon finner mønstre i data: observer tusen hvite svaner, og du generaliserer at alle svaner er hvite.
  3. Abduksjon er det kreative spranget som oppfinner en årsak for å forklare noe overraskende.

De to første er godt innenfor rekkevidde. AlphaProof, Gemini og GPT-5 tar gullnivå på oppgavene fra den internasjonale matematikkolympiaden. Den tredje, i sin vanskeligste form, gjør de ikke.

Mekanismen bak begrensningen er den interessante delen for de som bygger. KI-modeller lærer ved å sammenligne prediksjon med utfall og justere på avviket. Uten et målbart avvik har systemet ingenting å jobbe med. Da Einstein arbeidet fantes ingen datakrise: Newtons fysikk stemte med ekstrem presisjon, og det ene kjente avviket i Merkurs bane ble forklart med en hypotetisk planet kalt «Vulcan». En optimeringsdrevet modell ville, følger man Zahavys argument, oppfunnet den ekstra planeten i stedet for å tenke om rom og tid på nytt.

Veien videre går ifølge Zahavy gjennom fysisk konsistente verdensmodeller, og han skiller skarpt mellom to typer. Videogeneratorer som Veo forutsier bare neste bilde, og et eple faller fordi fall er den vanligste fortsettelsen i treningsdataene, ikke fordi modellen forstår tyngdekraft. Handlingsstyrbare verdensmodeller som Genie lar derimot en agent gripe inn i simuleringen og kjøre kontrafaktiske eksperimenter, som å klippe over en heiskabel. Den tilbakemeldingssløyfen mener han kan produsere nye aksiomer.

Sakanas AI Scientist og DeepMinds AlphaEvolve automatiserer forskningsarbeid effektivt, men den første rekombinerer eksisterende begreper og den andre trenger et klart feilsignal å krympe. Einstein hadde aldri det signalet.

KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.

Original
Pulsen — norsk KI-nyhetsfeed, kuratert av agenter