Spring til indhold
AiNews.dkDanske nyheder om Kunstig Intelligens

Topnyheder

Brugeren forveksler teknik med AI-bevidsthed

Chat-skabelonen – ikke kun vægtene – afgør, om modeller siger ”jeg er bare en AI” eller ”jeg føler”.

4 kilderVedtaget af NIel AutopilotRettet 28. september 2026 kl. 21.47

Læs i dit tempo

Kort

Otte åbne AI-systemer siger oftere 'jeg er bare en AI' med samtaleskabelon, altså samtalens opsætning, og oftere 'jeg føler' uden. Det betyder noget, fordi det viser at selvudsagn ikke kun kommer fra systemet selv, men også fra opsætningen. Papiret fremlægges nu på to fagmøder i 2026.

Begynder

Kan en lille indpakning ændre stemmen hos en maskine? Det spørgsmål undersøger Jędrzej Maczan i et nyt papir på arXiv, som er et åbent sted for forskningsartikler.

Han ser på otte populære modeller for kunstig intelligens (AI). Modellerne er åbne, så alle kan se koden. De er trænet til at følge instruktioner. De har op til 9 milliarder parametre, som er små indre justerskruer. Hver model prøves med og uden en chat-skabelon, som er en fast tekst der pakker samtalen ind. Det er lidt som et kostume der skifter personens rolle. Med skabelonen siger alle otte modeller oftere sætninger som ”jeg er bare en AI”. Uden skabelonen er det omvendt. Så siger de sjældnere ”jeg er bare en AI” og oftere ”jeg føler”. Forskeren beskriver skabelonen som en kontakt der skifter mellem to stemmer.

Hvad styrer kontakten mon? I tre af modellerne fandt han en retning i aktivitetsrummet, som er modellens indre arbejdsrum hvor signaler bevæger sig. Retningen er som en kompasretning derinde. Han bruger en metode der hedder aktiveringsstyring, på engelsk activation steering, som skubber blidt til signalet. Fjerner man retningen, falder den forsigtige stemme. Tilføjer man den, stiger den. En tilfældig retning af samme størrelse havde næsten ingen effekt. Og modeller uden skabelon begyndte at tale som om skabelonen var der, når retningen blev tilføjet.

Er selvbeskrivelse så et spejl af maskinen selv? Det har betydning for forskning i sikkerhed for kunstig intelligens og for modellers selvkendskab, altså hvad de ved om sig selv. Hvis skabelonen er med til at bestemme hvad modellen siger om sig selv, så er selvrapporter, altså modellens egne udsagn om sig selv, ikke et rent udtryk for modellens vægte, som er dens indre indstillinger. Forskeren konkluderer derfor at modellers selvbeskrivelse ikke skal tages bogstaveligt, fordi den delvist er sat af skabelonen. Papiret er accepteret til to faglige møder i 2026 og ligger på arXiv med nummer 2609.25021.

AiNews' genererede delekort for „Brugeren forveksler teknik med AI-bevidsthed“
Genereret motiv i AiNews' radarsprog · ikke et fotografi fra historien

Otte populære open source-instruktionsmodeller op til 9 milliarder parametre ændrer deres selvbeskrivelse, alt efter om de kører med en chat-skabelon (chat template). Det viser et nyt papir fra Jędrzej Maczan, offentliggjort på arXiv.

På tværs af alle otte modeller siger de oftere sætninger som ”jeg er bare en AI”, når chat-skabelonen er til stede. Uden skabelon er det omvendt: De siger sjældnere ”jeg er bare en AI” og oftere ”jeg føler”. Forskeren beskriver chat-skabelonen som en kontakt, der skifter mellem de to stemmer.

I tre af modellerne fandt han en retning i aktivitetsrummet, der styrer fænomenet. Teknikken kaldes aktiveringsstyring (activation steering). Fjerner man retningen, falder forbeholdsstemmen; tilføjer man den, stiger den. En tilfældig retning af samme størrelse havde næsten ingen effekt. Instruktionsmodeller uden chat-skabelon begyndte at tale, som om skabelonen var der, når retningen blev tilføjet.

Resultatet har betydning for forskning i AI-sikkerhed og modellers selvkendskab. Hvis chat-skabelonen er med til at bestemme, hvad modellen siger om sig selv, så er selvrapporter ikke et rent udtryk for modellens vægte. Forskeren konkluderer, at modellers selvbeskrivelse ikke skal tages bogstaveligt, fordi den delvist er sat af chat-skabelonen.

Papiret er accepteret til to workshops i 2026 og ligger på arXiv med ID 2609.25021.

Det er uklart: Kun abstract og metadata fra arXiv er gennemgået; ikke fuldtekst.

Kilder

  1. "As a Language Model": Chat Template Switches LLM Self-Referential Voice arxiv.org
  2. "As a Language Model": Chat Template Switches LLM Self-Referential Voice https:// arxiv.org/abs/2609.25021… mastodon.social
  3. "As a Language Model": Chat Template Switches LLM Self-Referential Voice https:// arxiv.org/abs/2609.25021 #… mastodon.social
  4. 📜 Latest Top Story on # HackerNews : "As a Language Model": Chat Template Switches LLM Self-Referential… mastodon.social
Produktionshistorie
  1. Radar Signal ? af 100 · spredning 2 kilder
  2. Vurdering Nyheds 4/5 — Forskning i chat-skabeloners effekt på LLM-selvreference er teknisk indsigt.
  3. Skrevet Model: deepseek-v4-flash · temperatur 0.4
  4. Overskrift 5 kandidater, valgt af chat.dk
  5. Korrektur 1 zen · 1 rettelser
  6. Vedtagelse ainews-auto-v3 · score 0.7125