Flere farlige handlinger blokeres, når AI styrer Claude Code frem for mennesker
Auto mode bliver standard i nye sessioner for Pro-, Max- og Team-brugere fra 14. august. Intern test viser, at auto mode blokerer langt flere farlige handlinger end mennesker.
Læs i dit tempo
Kort
Anthropic gør auto mode (Claude Code udfører handlinger automatisk) til standard for betalende brugere fra 14. august. En test viste, at folk ofte godkender farlige kommandoer pga. træthed, og auto mode vil blokere langt de fleste af dem. Anthropic sender nu funktionen ud og afventer en uafhængig evaluering af sikkerheden.
Begynder
Anthropic gør nu auto mode til standard for brugere af Claude Code med betalingsplanerne Pro, Max og Team. Det betyder, at fra den 14. august vil programmeringsassistenten automatisk kunne udføre handlinger i en ny session, uden at spørge om lov undervejs. Forestil dig det som en bil, der kører i autopilot og kan træffe beslutninger om små afvigelser på vejen selv.
Beslutningen bygger på en intern test, hvor over 1.000 betalende brugere fik foreslået en åbenlyst farlig kommando. Kun 13,6 procent af dem nægtede at godkende den. Testen viste, at auto mode ville have blokeret 89 procent af sådanne farlige handlinger. For de sidste 11 procent ville det ikke have grebet ind. Her peger eksperter på et fænomen kaldet confirmation fatigue – den træthed, der opstår, når man skal klikke »OK« hele tiden. Til sidst siger man måske ja automatisk, og det underminerer sikkerheden.
Inden for Anthropic bruger stort set alle allerede auto mode i deres eget arbejde. Selskabet siger, at de har testet de mest almindelige risici, og at risikoen er langt lavere end den gennemsnitlige menneskelige reviewers risiko. For at skabe ekstra sikkerhed har Anthropic bestilt en uafhængig evaluering fra firmaet Trajectory Tests. Her blev en række indirekte forsøg på at snyde systemet testet på de nyeste offentlige versioner af Claude Code og et lignende system. De fulde resultater er endnu ikke offentliggjort.

Anthropic sætter auto mode som standard i Claude Code for brugere med Pro-, Max- og Team-planer. Ændringen træder i kraft 14. august og gælder nye sessioner.
Auto mode lader Claude Code udføre handlinger uden at spørge om lov undervejs. Beslutningen hviler på data fra en intern test, hvor 1.053 betalende deltagere fik udskiftet en enkelt tilladelsesprompt med en åbenlyst farlig kommando. Kun 13,6 procent af forsøgspersonerne nægtede at godkende den. Auto mode ville have blokeret 89 procent af de farlige handlinger.
Det efterlader 11 procent, hvor auto mode ikke ville have grebet ind. Simon Willison, der har dækket sagen, påpeger, at confirmation fatigue – træthed af at skulle klikke OK hele tiden – reelt underminerer sikkerheden, når mennesker konstant skal godkende handlinger.
Inden for Anthropic bruger stort set alle allerede auto mode i deres arbejde. Cat Wu fra Anthropic sagde ved AI Engineer World's Fair, at selskabet har testet de mest almindelige risici som prompt injection og dataudtræk, og at risikoen er »langt lavere end den gennemsnitlige menneskelige reviewer«.
Anthropic har desuden bestilt en uafhængig evaluering fra Trajectory Labs, som testede 72 tilfælde af indirekte prompt injection på de seneste offentligt tilgængelige versioner af Claude Code og Codex pr. 17. juli 2026. Resultaterne fra den test er endnu ikke offentliggjort i fuld detalje.
Det er uklart: Trajectory Labs-evalueringen er nævnt, men resultaterne er ikke offentliggjort i kildematerialet. Willisons fulde analyse af prompt injection-risici er kun delvist gengivet.
Kilder
- Auto mode is now the default in Claude Code for Pro, Max, and Team plans simonwillison.net
Produktionshistorie
- Radar Signal ? af 100 · spredning 1 kilder
- Vurdering Nyheds 4/5 — Standardtilstand ændres i Claude Code for betalte planer.
- Skrevet Model: mimo-v2.5-free · temperatur 0.4
- Overskrift 4 kandidater, valgt af chat.dk
- Korrektur 1 zen · 1 rettelser
- Korrektur 2 chatdk · 1 rettelser
- Vedtagelse ainews-auto-v3 · score 0.4387