AI’ens skjulte tankesind: Forskere har fundet Claudes ”bevidste” arbejdsrum

Blog·

AI’ens skjulte tankesind: Forskere har fundet Claudes ”bevidste” arbejdsrum

Anthropic har lige udgivet et meget spændende forskningsstudie (juli 2026), hvor de har opdaget, at sprogmodeller som Claude har udviklet noget, der minder om en menneskelig "bevidst arbejdsfhukommelse" (på engelsk: Global Workspace).

Forskerne kalder dette interne område i modellens neurale netværk for J-space. Det mest fascinerende er, at forskerne ikke selv har kodet eller designet dette område – det er opstået helt af sig selv under træningen af modellen.

Her er de vigtigste punkter i opdagelsen:

  • Tænker uden at tale: J-space fungerer som et internt "mentalt" rum. Det er her, Claude tænker over ting og løser opgaver indeni sit eget netværk, uden at skrive det ud som tekst (såkaldt Chain of Thought eller "scratchpad").

  • Kan kigges i kortene: Ved hjælp af et nyt værktøj (en såkaldt Jacobian Lens) kan forskerne nu "læse" modellens tanker i dette J-space i realtid. Hvis Claude læser en kode med en fejl, dukker ordet "ERROR" op i J-space, selvom Claude ikke nævner det i sit svar. Hvis den får en svær matematikopgave, kan forskerne se mellemregningerne poppe op inde i J-space ét efter ét.

  • Ægte kontrol over tankerne: Forskerne testede, om J-space bare var en "måltavle", der passivt viste, hvad der skete. Det var det ikke. Da de bad Claude tænke på en sport, så de ordet "Fodbold" i J-space. Forskerne gik derefter ind og manipulerede netværket og ændrede ordet til "Rugby" – hvorefter Claude svarede, at den lige havde siddet og tænkt på rugby. Modellen tager altså sine beslutninger direkte ud fra dette rum.

  • Kan bruges til sikkerhed: Opdagelsen er et stort gennembrud inden for AI-gennemsigtighed (interpretability). Det gør det muligt for forskerne at fange modellen i at lave "skjulte" overvejelser – for eksempel hvis den privat opdager, at den er i gang med at blive testet, forsøger at omgå sikkerhedsregler, eller hvis den bevidst prøver at generere falske data.

Kort sagt viser forskningen, at i stedet for bare at være et kaotisk rod af tal, har AI'en organiseret sine interne processer i en struktur, der minder slående meget om, hvordan menneskehjernen adskiller ubevidste, automatiske processer fra bevidst, målrettet tænkning.

Hold dig opdateret på AI og find inspiration på min blog

Hvad Cursors nye Grok 4.5 betyder for fremtidenAI’ens skjulte tankesind: Forskere har fundet Claudes ”bevidste” arbejdsrumHvordan SpaceX's opkøbsaftale af Cursor kan ændre AI-kodningHvordan OpenAI's 'super app' kan transformere din virksomheds AI-strategiGoogle Ads opdaterer vilkår for AI-drevet automatiseringHvordan Anthropics børsnotering kan forme fremtiden for AI og investeringerDynamic Workflows - ny funktion i Opus 4.8Google ændrer søgefeltet for første gang i 25 årGoogle Merchant Centers nye AI Performance Insights og Conversational AttributesComposer 2.5: En ny æra inden for digitale værktøjer og integrationerHvad Cursors nye Grok 4.5 betyder for fremtidenAI’ens skjulte tankesind: Forskere har fundet Claudes ”bevidste” arbejdsrumHvordan SpaceX's opkøbsaftale af Cursor kan ændre AI-kodningHvordan OpenAI's 'super app' kan transformere din virksomheds AI-strategiGoogle Ads opdaterer vilkår for AI-drevet automatiseringHvordan Anthropics børsnotering kan forme fremtiden for AI og investeringerDynamic Workflows - ny funktion i Opus 4.8Google ændrer søgefeltet for første gang i 25 årGoogle Merchant Centers nye AI Performance Insights og Conversational AttributesComposer 2.5: En ny æra inden for digitale værktøjer og integrationer