Spring til indhold
AiNews.dkDanske nyheder om Kunstig Intelligens

Frontier

OpenAI prioriterer it-sikkerhed over intelligens

Modellen scorer 100 % i sikkerhedstests og håndterer op til en million tokens i kontekstvinduet.

1 kildeVedtaget af NIel AutopilotRettet 7. september 2026 kl. 02.58

Læs i dit tempo

Kort

GPT-6 Astra er lanceret med priser fra 10 til 50 dollars per million tekststykker (tokens). Den er markant bedre til at analysere kode og huske store mængder data end tidligere modeller. Modellen udrulles nu til udvalgte organisationer og bliver herefter tilgængelig for alle betalende brugere.

Begynder

Den nye model, GPT-6 Astra, bliver nu rullet ud til udvalgte organisationer. Senere kommer den til at være tilgængelig for brugere af ChatGPT Plus, Pro, Business og Enterprise samt via Amazon Web Services (AWS) og en Application Programming Interface (API). En API er en digital bro, der gør det muligt for to forskellige softwareprogrammer at tale sammen. Det koster 10 dollars for hver million input-tokens, som er de små bidder af ord, modellen læser. For hver million output-tokens, som er de ord modellen skriver, koster det 50 dollars.

Astra er særligt stærk til at analysere kode. I tests som ExploitBench og SRE-Bench, der måler evnen til binær reverse engineering – hvilket svarer til at skille en maskine ad for at forstå, hvordan den virker, uden at have manualen – scorede den henholdsvis 100 % og 99,2 %. Det er væsentligt bedre end GPT-5.6 Sol, som scorede 78,5 % og 68,7 %. I ExploitGym-testen fik Astra 42,4 %, mens Sol fik 30,3 %. Når det gælder kodning, koster Astra under halvdelen af Claude Fable 5 for at opnå samme resultat. Ved maksimal indsats scorer den to point højere end GPT-5.6 Sol til omtrent samme pris.

Modellen har også en imponerende »arbejdshukommelse«, som kaldes et kontekstvindue. Det bestemmer, hvor meget tekst modellen kan holde styr på på én gang. Ved 256.000 til 512.000 tokens var præcisionen 100 %. Da mængden steg til en million tokens, var præcisionen stadig 96,3 %. I ARC-AGI 3-testen, der måler generel intelligens, opnåede Astra 99,9 %, når der blev brugt en specialiseret »harness« (en specifik test-opsætning) til 19.000 dollars. Brugte man i stedet en standard-opsætning, faldt resultatet til 62,7 %, og prisen steg til 26.000 dollars.

På Artificial Analysis' Intelligence Index, som er en rangliste over intelligens, fik GPT-6 Astra 61 point. Det placerer den på samme niveau som GPT-5.6 Sol. Den ligger dog fem point under Claude Fable 5.1 og endnu lavere end Metas Muse Spark 1.3.

Vil du have, at jeg forklarer mere om, hvordan tokens fungerer i praksis?

AiNews' genererede delekort for „OpenAI prioriterer it-sikkerhed over intelligens“
Genereret motiv i AiNews' radarsprog · ikke et fotografi fra historien

API-prisen for GPT-6 Astra er 10 dollars per million input-tokens og 50 dollars per million output-tokens. Modellen rulles i dag ud til udvalgte organisationer og bliver efterfølgende tilgængelig for ChatGPT Plus, Pro, Business og Enterprise-brugere samt via API og AWS.

GPT-6 Astra scorer 100 % i ExploitBench og 99,2 % i SRE-Bench til binær reverse engineering. Til sammenligning scorede GPT-5.6 Sol 78,5 % i ExploitBench og 68,7 % i SRE-Bench. I ExploitGym opnåede Astra 42,4 %, mens Sol scorede 30,3 %.

Modellen opnåede 100 % præcision ved 256.000 til 512.000 tokens i et benchmark for lange sammenhænge. Ved 512.000 til en million tokens i kontekstvinduet var præcisionen 96,3 %.

99,9 % i ARC-AGI 3 benchmark opnåede Astra ved brug af en specialiseret Provider Adapter harness til 19.000 dollars. Ved brug af standard-harness faldt resultatet til 62,7 %, hvilket kostede 26.000 dollars.

GPT-6 Astra koster under halvdelen af Claude Fable 5 for samme score i Coding Agent Index. Ved maksimal indsats scorer den to point højere end GPT-5.6 Sol for omtrent samme pris.

En score på 61 på Artificial Analysis' Intelligence Index placerer GPT-6 Astra på samme niveau som GPT-5.6 Sol. Det er fem point under Claude Fable 5.1 og lavere end Metas Muse Spark 1.3.

Kilder

  1. GPT‑6 Astra simonwillison.net
Produktionshistorie
  1. Radar Signal ? af 100 · spredning 1 kilder
  2. Vurdering Nyheds 5/5 — Ny major model release er kerneindhold.
  3. Skrevet Model: mimo-v2.5-free · temperatur 0.4
  4. Overskrift 5 kandidater, valgt af chat.dk
  5. Korrektur 1 zen · 2 rettelser
  6. Vedtagelse ainews-auto-v3 · score 0.4115