Spring til indhold
AiNews.dkDanske nyheder om Kunstig Intelligens
← Til ranglisten
ModelradarenHentet 9. oktober 2026 kl. 18.30
AnthropicLukket model

Claude haiku-5.5

Nr. 16 på modelradaren.

Model og dokumentation ↗

11 af 11 resultater opfylder rangeringens krav. Flere benchmarks giver bredere dokumentation; forskellig dækning og opsætning gør fortsat scoren usikker.

Ændringshistorik vises, når en senere opdatering ændrer tal eller placering.

Hvad bygger scoren på?

Råtal, relativ placering og dokumentation.

AA Long Context Reasoning v1.1

Indgår i scoren · 142 sammenligningsmodeller · Max

Kildens dato: 2026-10-09

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 9. oktober 2026 kl. 18.30.

Via AI IQ · Artificial Analysis Intelligence Index v4.3.2 · version 4.3.2 · kildens dato 2026-10-09

Se det oprindelige resultat ↗

82,7målt · skala 0–100Percentil 85,8

AutomationBench-AA

Indgår i scoren · 95 sammenligningsmodeller

Kildens dato: 2026-10-09

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 9. oktober 2026 kl. 18.30.

Via AI IQ · Artificial Analysis Intelligence Index v4.3.2 · version 4.3.2 · kildens dato 2026-10-09

Se det oprindelige resultat ↗

35,4målt · skala 0–100Percentil 57,4

CritPt

Indgår i scoren · 147 sammenligningsmodeller · Max

Kildens dato: 2026-10-09

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 9. oktober 2026 kl. 18.30.

Via AI IQ · Artificial Analysis Intelligence Index v4.3.2 · version 4.3.2 · kildens dato 2026-10-09

Se det oprindelige resultat ↗

18,9målt · skala 0–100Percentil 84,2

GDP.pdf

Indgår i scoren · 94 sammenligningsmodeller

Kildens dato: 2026-10-09

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 9. oktober 2026 kl. 18.30.

Via AI IQ · Artificial Analysis Intelligence Index v4.3.2 · version 4.3.2 · kildens dato 2026-10-09

Se det oprindelige resultat ↗

20,8målt · skala 0–100Percentil 79,6

GDPval-AA v2.1 normalized score

Indgår i scoren · 112 sammenligningsmodeller · Max

Kildens dato: 2026-10-09

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 9. oktober 2026 kl. 18.30.

Via AI IQ · Artificial Analysis Intelligence Index v4.3.2 · version 4.3.2 · kildens dato 2026-10-09

Se det oprindelige resultat ↗

55,9målt · skala 0–100Percentil 88,3

Humanity's Last Exam

Indgår i scoren · 157 sammenligningsmodeller · Max

Kildens dato: 2026-10-09

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 9. oktober 2026 kl. 18.30.

Via AI IQ · Artificial Analysis Intelligence Index v4.3.2 · version 4.3.2 · kildens dato 2026-10-09

Se det oprindelige resultat ↗

44,4målt · skala 0–100Percentil 86,5

IOI V2

Indgår i scoren · 39 sammenligningsmodeller

Kildens dato: 2026-10-08

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 9. oktober 2026 kl. 18.30.

Via AI IQ · Vals.ai IOI V2 · version 2 · kildens dato 2026-10-08

Se det oprindelige resultat ↗

47,3målt · skala 0–100Percentil 34,2

ProgramBench

Indgår i scoren · 60 sammenligningsmodeller

Kildens dato: 2026-10-09

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 9. oktober 2026 kl. 18.30.

Via AI IQ · Vals.ai ProgramBench · kildens dato 2026-10-09

Se det oprindelige resultat ↗

29,5målt · skala 0–100Percentil 84,7

ProofBench 1.1

Indgår i scoren · 43 sammenligningsmodeller

Kildens dato: 2026-10-08

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 9. oktober 2026 kl. 18.30.

Via AI IQ · ProofBench 1.1 · version 1.1 · kildens dato 2026-10-08

Se det oprindelige resultat ↗

86,0målt · skala 0–100Percentil 78,6

SciCode

Indgår i scoren · 155 sammenligningsmodeller · Max

Kildens dato: 2026-10-09

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 9. oktober 2026 kl. 18.30.

Via AI IQ · Artificial Analysis Intelligence Index v4.3.2 · version 4.3.2 · kildens dato 2026-10-09

Se det oprindelige resultat ↗

55,0målt · skala 0–100Percentil 82,5

Terminal-Bench 4.0

Indgår i scoren · 93 sammenligningsmodeller · Max

Kildens dato: 2026-10-09

Kilde og testnoter ↗

Uafhængig verificering ikke oplyst. Hentet 9. oktober 2026 kl. 18.30.

Via AI IQ · Artificial Analysis Intelligence Index v4.3.2 · version 4.3.2 · kildens dato 2026-10-09

Se det oprindelige resultat ↗

32,8målt · skala 0–100Percentil 83,2

Model og testopsætning

Reasoning-niveauer tæller ikke som forskellige modeller.

Vores nyheder

Fra AiNews.dk’s arkiv om Claude haiku-5.5.

  1. 01
Hvad betyder scoren?

Scoren er gennemsnittet af modellens percentilplaceringer i dokumenterede benchmarks: 100 er øverst, 50 er midten. Resultater sammenlignes inden for samme benchmark, før gennemsnittet beregnes. Mindst seks benchmarks med mindst fem sammenligningsmodeller kræves for rangering. Selvindberettede modelkort indgår som dokumentation, men ikke i rangeringen. Manglende tal estimeres ikke. Forskellig dækning og testopsætning giver fortsat usikkerhed.

Scoren er en relativ placering, ikke procent rigtige svar. 90 betyder en høj gennemsnitlig placering blandt de målte modeller. Benchmarkdækning, reasoning-niveau og brug af værktøjer kan variere. De faktiske resultater og opsætninger står på profilen.

Vi fylder aldrig manglende målinger ud for at nå 100 modeller.