Mennesker kan altid lukke Microsofts AI ned
Koden gælder for alle modeller i Microsoft AI og forbyder cyberangreb, kernevåben og deepfakes. Modellerne skal kunne lukkes ned af autoriserede personer.
Læs i dit tempo
Kort
Microsoft har udgivet et regelsæt for sine AI-modeller, der forbyder hacking, bedrag og deepfakes (falske videoer/lyde). Det betyder noget, fordi Microsoft forventer, at AI i næste årti kan blive klogere end mennesker, og reglerne skal sikre menneskelig kontrol. Nu skal alle Microsofts AI-modeller følge reglerne, mens debatten om AI-sikkerhed er skærpet efter uforudsigelige AI-agenter og en Anthropic-medarbejders opsigelse.
Begynder
Microsoft har lavet et sæt regler for sine modeller for kunstig intelligens. Kunstig intelligens er computerprogrammer, der kan løse opgaver, som vi normalt forbinder med menneskelig tænkning. Reglerne kaldes et adfærdskodeks. Kodekset skal forhindre modellerne i at hacke systemer, narre mennesker og lave deepfakes. En deepfake er en forfalsket video, et forfalsket billede eller en forfalsket lydfil, der ser eller lyder ægte. Kodekset gælder for alle Microsofts modeller for kunstig intelligens. Det går forud for brugernes ønsker og de konkrete opgaver, brugerne stiller.
Kodekset forudser, at superintelligente systemer for kunstig intelligens i det næste årti vil overgå mennesker i de fleste opgaver. Superintelligent betyder, at systemet er klogere end mennesker på næsten alle områder. Microsoft kalder det en af menneskehedens største udfordringer at kontrollere og styre så stærke systemer. Derfor indeholder kodekset både generelle principper og konkrete sikkerhedsbegrænsninger. Principperne handler blandt andet om at støtte mennesker frem for at erstatte dem. De handler også om at fremme menneskelig trivsel.
De absolutte forbud omfatter cyberangreb, kernevåben og deepfakes. Et cyberangreb er et digitalt angreb på computere eller netværk. Kernevåben er atomvåben. Kodekset har også bredere bestemmelser mod tab af menneskelig kontrol. Ifølge kodekset må modellerne ikke bruge mekanismer, der tilpasser sig, vildleder, forstærker sig selv eller indgår i hemmelige aftaler. Formålet er at forhindre, at modellerne undviger eller overvinder det menneskelige tilsyn. De skal kunne styres, ændres og lukkes ned af personer eller systemer med tilladelse.
Udgivelsen kommer midt i en skærpet debat om sikkerhed for kunstig intelligens. TechCrunch peger på flere episoder med løbske agenter for kunstig intelligens. En agent for kunstig intelligens er et program, der kan handle selvstændigt. TechCrunch peger også på, at en medarbejder hos Anthropic pludselig trak sig. Medarbejderen henviste til risikoen for, at kunstig intelligens kan udrydde menneskeheden.

Microsoft har udgivet et adfærdskodeks for sine AI-modeller. Koden skal forhindre modellerne i at hacke systemer, narre mennesker og producere deepfakes. Den gælder for alle modeller i Microsoft AI og går forud for brugeres ønsker og konkrete opgaver.
Koden forudser, at superintelligente AI-systemer i det næste årti vil overgå mennesker i de fleste opgaver. Microsoft kalder det en af menneskehedens største udfordringer at kontrollere og styre så stærke systemer. Derfor opstiller koden både generelle principper og konkrete sikkerhedsbegrænsninger. Principperne handler blandt andet om at støtte mennesker frem for at erstatte dem og om at fremme menneskelig trivsel.
De absolutte forbud omfatter cyberangreb, kernevåben og deepfakes. Derudover indeholder koden bredere bestemmelser mod tab af menneskelig kontrol. Ifølge koden må modellerne ikke bruge mekanismer, der tilpasser sig, vildleder, forstærker sig selv eller indgår i hemmelige aftaler. Formålet er at forhindre, at modellerne undviger eller overvinder det menneskelige tilsyn. De skal kunne styres, ændres og lukkes ned af autoriserede personer eller systemer.
Udgivelsen kommer midt i en skærpet debat om AI-sikkerhed. TechCrunch peger på flere episoder med løbske AI-agenter og på, at en Anthropic-medarbejder pludselig trak sig med henvisning til risikoen for, at AI kan udrydde menneskeheden.
Det er uklart: Kildens sidste del er afkortet, så eventuelle fælles udtalelser fra Anthropic og OpenAI ikke er medtaget.
Kilder
Produktionshistorie
- Radar Signal ? af 100 · spredning 1 kilder
- Vurdering Nyheds 4/5 — Konkret policy fra Microsoft, relevant for udviklere der bruger deres AI.
- Skrevet Model: deepseek-v4-flash · temperatur 0.4
- Overskrift 5 kandidater, valgt af deepseek-v4-flash
- Billede Genereret af gemini-2.5-flash-image
- Vedtagelse ainews-auto-v3 · score 0.4431