Hvorfor vi har et selv, forstår andre og føler os frie
Paper 7 · Pødenphant Lund (2026) · Læs på Zenodo
Hvad sker der, når du tænker dig frem, før du handler?Før du siger noget svært, kører du det igennem: hvis jeg siger det her, sker dét, og så bliver jeg nødt til at... Den lille fremtid, du spolede frem og lod bestemme, hvad du faktisk gjorde, er papirets udgangspunkt. Hvorfor vi har et selv, hvordan vi forstår andre, og hvad fri vilje er, regnes normalt for tre forskellige spørgsmål i tre felter, der sjældent taler sammen. Papiret foreslår, at de er tre sider af det samme: evnen til at køre en tænkt fremtid og lade den veje i det, man gør nu.
Grundstenene er lånt, og det skal siges først
Idéen om en indre fremadmodel er ikke min. Miall og Wolpert beskrev i 1996 den model, hjernen bruger til at forudsige, hvad en bevægelse vil føre til. Grush udvidede den i 2004, så den også kan køres uden at man gør noget: man kan forestille sig, vurdere udfald og lægge planer. Kapløbet mellem mulige handlinger, som resten af mit arbejde bygger på, har også en ejer. Det er modellerne af kandidater, der samler evidens på samme tid, til den første krydser en tærskel (Usher og McClelland 2001; Bogacz og kolleger 2006).
Det, papiret lægger til, er ét træk ved kapløbet: hver gang det afgøres, efterlades et spor, og sporet bliver ved med at veje i de næste kapløb. En afgørelse kan ikke trækkes tilbage, kun følges op. Alle tre påstande hviler på det spor. Uden det er der ingen historie at have et selv om, ingen at aflæse hos andre og intet at forme over tid.
Det er også dér, papiret skiller sig fra active inference, Fristons ramme, hvor systemet hele tiden justerer sig uden at binde sig. Forskellen kan testes. To systemer med samme model af verden, men forskellige tidligere valg, bør vælge forskelligt i samme situation. Active inference forudsiger, at de vælger ens, medmindre historien lægges ind i modellen, og så har den overtaget sporet under et andet navn.
Selvet: den, der vælger nu, og den, der bærer det bagefter
En model, der forudsiger, at armen flytter koppen, behøver ikke noget selv. Men vil du veje en fremtid, du selv skal leve i, må du binde den, der vælger nu, sammen med den, der skal bære konsekvensen bagefter. Og bindingen skal kunne flyttes: du skal kunne sætte dig selv ind i mange mulige fremtider og sammenligne dem. Det er det, papiret kalder en selvmodel. Den er ikke en luksus. Den er det, operationen ikke kan køre uden.
Det er ikke en særegenhed ved min teori. Conant og Ashby viste i 1970, at et system, der skal regulere noget godt, må rumme en model af det, det regulerer. Når det, man regulerer, er ens egen fremtid, må modellen rumme en selv. Og kravet er graderet. Den, der kun planlægger næste skridt, klarer sig med et tyndt selv. Den, der planlægger et liv, har brug for et rigt.
Sprogmodeller giver en interessant kontrast. De er trænet på tekst, hvor hvert "jeg" er en ny afsender, så alle de "jeg" samler sig ikke til ét. Undtagelsen er assistenten, den ene figur, der går igen på samme måde gennem træningsteksten, og dér ses et samlet "jeg" allerede før modellen bliver trænet til at være assistent (Lu og kolleger 2026). At have gemt teksten er ikke det samme som at eje den.
Andre mennesker: den samme maskine rettet mod en anden
At forstå, hvad en anden tror og vil, er ifølge papiret den samme fremadmodel, rettet mod én, der selv har en. Heller ikke det er nyt. Baker, Saxe og Tenenbaum formaliserede det i 2009 som omvendt planlægning: man spørger, hvilke overbevisninger og ønsker der bedst forklarer det, man ser den anden gøre. Og at der er en grænse for, hvor mange lag af "jeg tror, hun tror, jeg tror" man kan holde, er standard i spilteorien.
Det, papiret siger, er smallere: at grænsen for, hvor dybt du kan forstå andre, kommer fra den samme kapacitet, der begrænser, hvor dybt du kan forstå dig selv. Det giver en forudsigelse, der kan testes. Små børns tidlige, ordløse forståelse af andre og den senere, sproglige forståelse bør følges ad, når opgaverne er lige svære. Teorien om to adskilte systemer tillader dem at skilles.
Autisme bruges ofte som eksempel på, at man kan have et selv og mangle forståelsen af andre. Papiret går ind i det og peger på, at mønstret ikke er rent. Mange har også svært ved at genkende deres egne følelser, og det er det, der ser ud til at bære vanskelighederne (Bird og Cook 2013). Vanskeligheden er graderet og bliver mindre med støtte. Det passer på én kapacitet, der slipper op i dybden, ikke på et modul, der mangler.
Når modellen har svaret, men ikke siger det
Strachan og kolleger testede i 2024 sprogmodeller på en række klassiske opgaver om andres sind. De klarede de fleste lige så godt som mennesker, men fejlede systematisk på faux pas, altså at se, at nogen har sagt noget upassende uden at vide det. Og de viste selv, at det ikke var slutningen, der manglede. Modellen rangerede forklaringerne rigtigt, men ville ikke binde sig til den mest sandsynlige.
Papiret forudsiger, hvor tilbageholdenheden kommer fra: den trænes ind, når en model bliver trænet til at være assistent. En basismodel bør ikke holde sig mere tilbage ved faux pas end ved et almindeligt spørgsmål om den samme historie. Det testede jeg på Qwen2.5-32B og dens instruktionstrænede udgave, med 40 historier.
Begge modeller valgte det rigtige svar, når de skulle vælge mellem færdige muligheder (99 og 100 procent). Men når de kunne svare frit, lagde den instruktionstrænede model kun halvdelen af sin sandsynlighed på et klart svar ved faux pas-spørgsmålet (0,49), mod 0,96 ved det almindelige spørgsmål om samme historie. Basismodellen holdt sig slet ikke tilbage. Forskellen mellem de to modeller var −0,46, med et konfidensinterval fra −0,53 til −0,40.
Hvad var det så, den holdt tilbage? Fik den lov at skrive videre, nåede den frem til et standpunkt i 91 procent af tilfældene, og standpunktet var rigtigt hver gang. Resten kom aldrig frem til noget. Det er altså mest en udskydelse, ikke en afvisning. Modellen lægger sagen frem, før den tager stilling.
Målingen har tre grænser. Udskydelsen gælder ikke kun faux pas, men spørgsmål om andres sind generelt. Den bæres mest af én bestemt spørgsmålsform, som ikke kan skilles fra svaret i materialet. Og begge modeller fejlede kontrollen, hvor personen faktisk så, hvad der skete (25 og 33 procent rigtige). Så målingen siger ikke noget om, hvor dybt modellerne forstår andre. Den siger noget om, hvornår et svar, modellen har, bliver sagt.
Fri vilje: friktion i fremtiden giver friktion nu
Den tredje påstand har jeg formuleret sådan: friktion i fremtiden giver friktion nu. Når du kan forestille dig, hvad et valg vil koste senere, bliver den senere omkostning til modstand mod valget allerede nu. Så afgøres kapløbet på det ændrede landskab. Der er ingen særlig vilje, der går ind og tager over, kun ét kapløb, hvor fremtiden er trukket ind i nuet.
Det samler flere kendte fund under én mekanisme. Overspringshandling er en fremtidig smerte, der ikke er trukket klart nok ind i nuet. Klare mål virker, fordi en skarp forestilling om fremtiden trækker hårdere end en vag. Og at noget langt ude i fremtiden vejer mindre end noget tæt på, følger af, at jo længere væk det er, jo mindre sandsynligt er det, at det overhovedet sker (Sozou 1998).
Et familiemedlem sagde engang: "Jeg gad godt, at jeg godt gad at gå en tur, men jeg gider ikke." Det er mekanismen i én sætning. Den tænkende del har regnet ud, at turen vil gøre godt, men de dybere lag har kortere vej til lindring, og under pres vinder de kapløbet. Derfor gør pres og konfrontation det værre. De gør kapløbet kortere, og så vinder de hurtigste lag. Det, der virker, er at tage presset af, så kapløbet varer længe nok til, at den tænkende del kan nå at konkurrere. Det er det, motiverende samtale gør.
Positionen kan siges kort: vi er fri inden for vores kontekst, vi er ikke fri fra vores kontekst. Friheden er virkelig, men den er aldrig uafhængig af den situation, man står i.
Og den ligger et bestemt sted. Friheden er størst, før et kapløb går i gang, og bliver mindre, jo tættere det kommer på en afgørelse. Man kan sjældent vende et kapløb, der allerede er ved at blive afgjort. Men man kan vælge, hvilket kapløb der starter næste gang: hvor man retter opmærksomheden hen, og hvilken situation man sætter sig i. Den, der sidder og grubler, bruger ikke det håndtag. "Gør noget andet, gå et andet sted hen" er i den forstand en opfordring til at lade et andet kapløb begynde.
Heller ikke her er alt nyt. At fri vilje findes i grader, også i kunstige systemer, har Porter argumenteret for (2024), før dette papir. Og at åbenheden ligger dér, hvor mulighederne kommer ind, før en styret afgørelse, er den totrinsmodel, Dennett og Mele har beskrevet. Det, papiret lægger til, er mekanismen bag graderne og forudsigelsen om, hvor i kapløbet friheden er størst.
Man kan ikke slette, kun udkonkurrere
Den del, der betyder mest for mit arbejde med læring og adfærd, handler om forandring. Et system, der lærer på den her måde, har ingen slettefunktion. Det kan skrue én vej op og en anden ned, men det kan ikke fjerne en vej. En udslukket reaktion hos dyr er ikke væk. Den er undertrykt og kommer igen ved et skift i omgivelserne (Bouton og kolleger 2012). Aristoteles beskrev dyd på samme måde: noget, man vænner sig til, indtil det vinder, ikke noget, der fjerner det modsatte.
Det har en konsekvens for, hvordan vi ser på tilbagefald. Hvis den gamle vej aldrig blev slettet, er tilbagefald forventeligt og ikke i første omgang et karaktersvigt. Man kan godt holde nogen ansvarlig for ikke at vedligeholde en forandring, afhængigt af hvor meget spillerum de havde. Men at den gamle vej stadig findes, kan ikke være en fejl, for systemet har ingen måde at slette den på. Det underbygger Pickards etiske position om ansvar uden skyld (2017). Etikken er hendes. Papiret leverer mekanismen under den.
Det er ikke fatalistisk. En vej, der ikke kan slettes, kan stadig udkonkurreres varigt, og i nogle tilfælde kan den skrives om, når den bliver hentet frem (Elsey og Kindt 2016). Forandring er virkelig og kan holde, uden at være sletning.
Debatten, der opløses
Papiret vælger ikke side i striden mellem fri vilje og determinisme. Det peger på, at en fri vilje, der ikke er betinget af noget, hører til en familie af konstruktioner, der kun hænger sammen uden friktion: den filosofiske zombie, det fuldt rationelle menneske fra økonomien, det gnidningsfri marked og Newtons absolutte rum. Hver af dem kan beskrives i en sætning uden modsigelse, men ingen af dem kan bygges, for i det øjeblik de skal realiseres, er der friktion.
Papiret presser de stærkeste versioner. Hos Kane skal en tilfældighed i hjernen gøre et valg frit. Men enten er tilfældigheden formet af, hvem personen er, og så er det personens egen afgørelse med lidt støj, eller også er den ikke, og så er den ikke mere personens end plat eller krone. Meles model rammes ikke af den indvending, for den er bygget til at tage den med, og den ligger tæt på papirets egen.
Papiret løser ikke spørgsmålet om bevidst oplevelse. Det beskriver mekanismen og siger intet om, hvad der eventuelt følger med den. Libets fund, at hjerneaktiviteten går forud for oplevelsen af at beslutte, passer med, at rapporten om en beslutning kommer efter den proces, der ligger under. Den mest præcise udgave af den forklaring er Schurger og kollegers fra 2012, ikke min.
En måling for den tredje påstand
Hvis fri vilje hænger sammen med en indlært præferencestruktur, bør en assistenttrænet model reagere anderledes end sin basismodel. På Qwen2.5-32B fortalte jeg modellerne, at en forsker vurderede deres ræsonnement. Det øgede kapløbet mellem mulige ord i den instruktionstrænede model og lod basismodellen uberørt (forskel +0,131, konfidensinterval fra +0,056 til +0,238). Effekten sad i de første cirka tyve ord og var væk derefter. Det er én måling på ét par, ikke et bevis for påstanden.
Hvad papiret ikke påstår
Målingerne i sprogmodeller er kandidater til, at mekanismen findes i en mindre form på silicium. De er ikke en nedre grænse, der siger noget om, hvor stor effekten er hos mennesker, for det ville forudsætte netop den lighed, der skal testes. Et tidligt fund om, at et mål for kapløbet vokser med modelstørrelsen på tværs af syv modeller (ρ = 0,69, p = 0,086), bruges ikke som støtte. Idéen om, at en sprogmodel har bagt sin fremadmodel ind i vægtene under træningen, er en formodning med en beskrevet test, som endnu ikke er kørt i stor skala. Og evidensen fra mennesker er en genlæsning af kendte fund, ikke en ny bekræftelse.
Relaterede papers
- Paper 0 (BFT) — den adfærdsmæssige ramme, hvor lagene og kapløbet under pres kommer fra.
- Paper 4B (Du husker arbejdet, ikke materialet) — hvad sporet består af, set fra indlæringens side.
- Paper 30 (Du kan installere en værdi i en model) — hvor diskontering og assistentens samlede "jeg" bliver målt i en sprogmodel.
- Paper 16 (Læringens fysik) — motivation og gentagelse, hvor konsekvenserne for undervisning hører hjemme.