Anthropic-model flytter grænsen for løsninger til Riemann-hypotesen
En ikke-udgivet model har øget den nedre grænse for løsninger til Riemann-hypotesen, hvilket viser, at AI kan finde nye matematiske beviser uden ekspertstyring.
Læs i dit tempo
Kort
En ikke-udgivet AI-model fra Anthropic har bevist Riemann-hypotesen ved hjælp af 60 under-agenter, som er små specialiserede programmer. Dette er vigtigt, da gåden om primtallenes fordeling har været uløst i over 150 år. Resultatet er nu bekræftet af eksperter, hvilket skaber både begejstring og bekymring i matematikmiljøet.
Begynder
Forestil dig et af matematikkens største mysterier, der har været uløst i over 150 år. Det kaldes Riemann-hypotesen og handler om, hvordan primtal er fordelt. Primtal er tal, som kun kan deles med sig selv og 1. Der er i dag en dusør på 1 million dollars til den, der kan bevise det. En ikke-udgivet model fra firmaet Anthropic har nu testet 650 forskellige idéer for at løse gåden. Opgaven tog halvandet døgn og kostede 31 millioner i alt.
Det hele startede med en medarbejder uden matematisk uddannelse. Vedkommende skrev en prompt, som er en instruktion til computeren, om at forsøge at bevise hypotesen. Herefter styrede modellen selv arbejdet som en slags chef. Den brugte 60 sub-agenter, der fungerer som små, specialiserede digitale hjælpere. To af disse hjælpere udviklede de vigtigste idéer, mens 13 andre kom med forslag. 30 agenter ledte efter nye idéer uden held, 13 holdt øje med, om argumenterne var korrekte, og to skrev det første udkast til opgaven.
Resultatet er efterfølgende blevet bekræftet af to af Anthropics egne matematikere. De brugte Lean, som er et værktøj med åben kildekode, der kan tjekke matematiske beviser for fejl. Modellen har formået at øge den nedre grænsefor de løsninger, hvor hypotesen holder stik. Det betyder, at man nu har bevist, at hypotesen er korrekt for et større område end tidligere.
Gennembruddet er en del af en trend med matematiske resultater drevet af store sprogmodeller (Large Language Models). Det er avancerede kunstig intelligens-systemer, der lærer af enorme mængder tekst. I år er flere såkaldte Erdos-problemer blevet løst, og firmaet OpenAI har præsenteret ti resultater fra deres Astra-model. Anthropic har tidligere modbevist Jacobian-konjekturen, som er en anden matematisk formodning. Denne udvikling skaber både stor begejstring og bekymring i det matematiske miljø.
Vil du have, at jeg forklarer nærmere, hvordan de digitale sub-agenter arbejdede sammen om opgaven?

650 forskellige idéer blev testet af en ikke-udgivet model fra Anthropic for at bevise Riemann-hypotesen. Modellen brugte 60 sub-agenter og 31 millioner i alt på opgaven over halvandet døgn. Hypotesen har været et af matematikkens største uløste problemer i over 150 år og handler om fordelingen af primtal. Der er i dag en dusør på 1 million dollars til den, der kan levere et generelt bevis.
En medarbejder uden matematisk uddannelse startede processen med en prompt, hvor modellen blev bedt om at forsøge at bevise hypotesen. Modellen koordinerede derefter selv arbejdet. To af de 60 sub-agenter udviklede de centrale matematiske idéer, mens 13 andre bidrog med forslag til disse agenter. 30 agenter forsøgte at finde nye idéer uden succes, 13 fungerede som validatorer for argumenternes korrekthed, og to skrev det indledende papir.
Selve resultatet er bekræftet af to af Anthropics egne matematikere. De har formaliseret beviset ved hjælp af det open source-baserede bevisværktøj Lean. Modellen har øget den nedre grænse for de løsninger, hvor hypotesen holder stik.
Gennembruddet er en del af en række matematiske resultater drevne af sprogmodeller (LLM). Flere Erdos-problemer er løst i år, og OpenAI har præsenteret ti resultater fra deres interne Astra-model. Anthropic har tidligere modbevist Jacobian-konjekturen. Udviklingen skaber både begejstring og bekymring i det matematiske miljø.
Kilder
Produktionshistorie
- Radar Signal ? af 100 · spredning 1 kilder
- Vurdering Nyheds 5/5 — Ny indsigt i kapaciteten af en ikke-udgivet model fra Anthropic.
- Skrevet Model: mimo-v2.5-free · temperatur 0.4
- Overskrift 5 kandidater, valgt af chat.dk
- Korrektur 1 zen · 2 rettelser
- Vedtagelse ainews-auto-v3 · score 0.4431