Spring til indhold
AiNews.dkDanske nyheder om Kunstig Intelligens
← Til ranglisten
ModelradarenHentet 1. oktober 2026 kl. 18.30
AnthropicLukket model

Claude Fable-5.1

Nr. 2 på modelradaren.

Model og dokumentation ↗

Hvad bygger scoren på?

Råtal, relativ placering og dokumentation.

AA Long Context Reasoning v1.1

Indgår i scoren · 131 sammenligningsmodeller · max with fallback

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · Artificial Analysis Intelligence Index v4.3.2 · version 4.3.2 · kildens dato 2026-09-30

Se det oprindelige resultat ↗

85,3målt · skala 0–100Percentil 98,5

ARC-AGI-1

Indgår i scoren · 57 sammenligningsmodeller

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · ARC Prize verified leaderboard · kildens dato 2026-09-30

Se det oprindelige resultat ↗

97,5målt · skala 0–100Percentil 87,5

ARC-AGI-2

Indgår i scoren · 57 sammenligningsmodeller

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · ARC Prize verified leaderboard · kildens dato 2026-09-30

Se det oprindelige resultat ↗

90,0målt · skala 0–100Percentil 91,1

BullshitBench v2

Indgår i scoren · 79 sammenligningsmodeller

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · BullshitBench v2 · kildens dato 2026-09-30

Se det oprindelige resultat ↗

64,0målt · skala 0–100Percentil 84,0

CritPt

Indgår i scoren · 136 sammenligningsmodeller · max with fallback

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · Artificial Analysis Intelligence Index v4.3.2 · version 4.3.2 · kildens dato 2026-09-30

Se det oprindelige resultat ↗

29,7målt · skala 0–100Percentil 94,8

FrontierMath Tier 1-3

Indgår i scoren · 74 sammenligningsmodeller

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · Epoch AI FrontierMath Tiers 1-3 v2 · kildens dato 2026-09-30

Se det oprindelige resultat ↗

90,2målt · skala 0–100Percentil 97,3

FrontierMath Tier 4

Indgår i scoren · 62 sammenligningsmodeller

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · Epoch AI FrontierMath Tier 4 v2 · kildens dato 2026-09-30

Se det oprindelige resultat ↗

87,8målt · skala 0–100Percentil 93,4

GPQA Diamond

Indgår i scoren · 156 sammenligningsmodeller · max with fallback

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · Artificial Analysis Intelligence Index v4.3.2 · version 4.3.2 · kildens dato 2026-09-30

Se det oprindelige resultat ↗

93,7målt · skala 0–100Percentil 93,5

Humanity's Last Exam

Indgår i scoren · 146 sammenligningsmodeller · max with fallback

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · Artificial Analysis Intelligence Index v4.3.2 · version 4.3.2 · kildens dato 2026-09-30

Se det oprindelige resultat ↗

59,1målt · skala 0–100Percentil 99,3

IOI V2

Indgår i scoren · 35 sammenligningsmodeller

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · Vals.ai IOI V2 · kildens dato 2026-09-30

Se det oprindelige resultat ↗

90,8målt · skala 0–100Percentil 88,2

LiveCodeBench

Indgår i scoren · 61 sammenligningsmodeller

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · Vals.ai LiveCodeBench · kildens dato 2026-08-04

Se det oprindelige resultat ↗

90,5målt · skala 0–100Percentil 96,7

MathArena

Indgår i scoren · 57 sammenligningsmodeller

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · MathArena Models · kildens dato 2026-09-30

Se det oprindelige resultat ↗

82,6målt · skala 0–100Percentil 92,9

MCP Atlas

Indgår i scoren · 32 sammenligningsmodeller

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · Scale Labs MCP Atlas · kildens dato 2026-09-30

Se det oprindelige resultat ↗

87,2målt · skala 0–100Percentil 96,8

MMLU-Pro

Indgår i scoren · 140 sammenligningsmodeller

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · TIGER-Lab MMLU-Pro leaderboard (missing rows only) · kildens dato 2026-09-22

Se det oprindelige resultat ↗

92,4målt · skala 0–100Percentil 100,0

MMMU-Pro

Indgår i scoren · 83 sammenligningsmodeller

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · Artificial Analysis model leaderboard · kildens dato 2026-09-06

Se det oprindelige resultat ↗

90,6målt · skala 0–100Percentil 100,0

ProgramBench

Indgår i scoren · 51 sammenligningsmodeller

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · Vals.ai ProgramBench · kildens dato 2026-09-30

Se det oprindelige resultat ↗

53,5målt · skala 0–100Percentil 98,0

ProofBench 1.1

Indgår i scoren · 39 sammenligningsmodeller

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · ProofBench 1.1 · kildens dato 2026-09-30

Se det oprindelige resultat ↗

100,0målt · skala 0–100Percentil 97,4

SciCode

Indgår i scoren · 144 sammenligningsmodeller · max with fallback

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · Artificial Analysis Intelligence Index v4.3.2 · version 4.3.2 · kildens dato 2026-09-30

Se det oprindelige resultat ↗

63,1målt · skala 0–100Percentil 99,3

SimpleQA Verified

Indgår i scoren · 71 sammenligningsmodeller

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · Epoch AI SimpleQA Verified · kildens dato 2026-09-30

Se det oprindelige resultat ↗

70,8målt · skala 0–100Percentil 94,3

Terminal-Bench 4.0

Indgår i scoren · 84 sammenligningsmodeller · max with fallback / high with fallback

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 1. oktober 2026 kl. 18.30.

Via AI IQ · Artificial Analysis Intelligence Index v4.3.2 · version 4.3.2 · kildens dato 2026-09-30

Se det oprindelige resultat ↗

52,0målt · skala 0–100Percentil 95,2

Model og testopsætning

Reasoning-niveauer tæller ikke som forskellige modeller.

low with fallback

Claude Fable 5.1 (low with fallback)

Benchmarkkilde ↗Kildens dato: 2026-09-30

medium with fallback

Claude Fable 5.1 (medium with fallback)

Benchmarkkilde ↗Kildens dato: 2026-09-30

max with fallback

Claude Fable 5.1 (max with fallback)

Benchmarkkilde ↗Kildens dato: 2026-09-30

xhigh with fallback

Claude Fable 5.1 (xhigh with fallback)

Benchmarkkilde ↗Kildens dato: 2026-09-30

high with fallback

Claude Fable 5.1 (high with fallback)

Benchmarkkilde ↗Kildens dato: 2026-09-30

Vores nyheder

Fra AiNews.dk’s arkiv om Claude Fable-5.1.

  1. 01
  2. 02
  3. 03
  4. 04
  5. 05
    Astra slår mennesker i dronekontrol
  6. 06
  7. 07
  8. 08
  9. 09
  10. 10
  11. 11
  12. 12
  13. 13
Hvad betyder scoren?

Scoren er gennemsnittet af modellens percentilplaceringer i dokumenterede benchmarks: 100 er øverst, 50 er midten. Resultater sammenlignes inden for samme benchmark, før gennemsnittet beregnes. Mindst seks benchmarks med mindst fem sammenligningsmodeller kræves for rangering. Selvindberettede modelkort indgår som dokumentation, men ikke i rangeringen. Manglende tal estimeres ikke. Forskellig dækning og testopsætning giver fortsat usikkerhed.

Scoren er en relativ placering, ikke procent rigtige svar. 90 betyder en høj gennemsnitlig placering blandt de målte modeller. Benchmarkdækning, reasoning-niveau og brug af værktøjer kan variere. De faktiske resultater og opsætninger står på profilen.

Vi fylder aldrig manglende målinger ud for at nå 100 modeller.