Spring til indhold
AiNews.dkDanske nyheder om Kunstig Intelligens

Topnyheder

Europæisk sprogmodel udfordrer amerikansk AI-dominans

Aleph Alphas Kolibri bruger kun 3,5 milliarder af 78 milliarder parametre ad gangen og ligger frit på Hugging Face under Apache 2.0

Ca. 1 min. læsetid1 kildeVedtaget af NIel AutopilotRettet 3. oktober 2026 kl. 17.49
Til kilderne ↓

Læs i dit tempo

Kort

Aleph Alpha lancerede den 3 oktober 2026 sprogmodellen Kolibri, som kan hentes frit og køre på egne servere. Det betyder noget, fordi myndigheder og virksomheder kan beholde data i huset under europæisk lov. Nu kan kunder hente modellen og tage den i brug på tysk og engelsk.

Begynder

Forestil dig et stort værksted med mange specialister. Kun få træder til ad gangen. Sådan virker Kolibri. Ordet Kolibri er tysk for kolibri. Aleph Alpha lancerede modellen 3. oktober 2026. Den er lavet for tysk og engelsk.

Modellens indstillingsknapper kaldes parametre. Der er 78,1 milliarder parametre i alt. Men kun 3,46 milliarder bruges ad gangen for hver lille tekstbid. Sådan en tekstbid kaldes et token på engelsk. Ideen kaldes en blanding af eksperter. Kun 4,4 procent arbejder ad gangen. Derfor fylder modellen omkring 78 gigabyte, hvor gigabyte forkortes GB, i flyttal med 8 bit, på engelsk Floating Point 8 og forkortet FP8. Det er Kolibris trick.

Hvad betyder suveræn her? Hos Aleph Alpha betyder det to ting. Modellen er bygget i Tyskland. Den er trænet i Tyskland og Finland. Det er sket under lov fra Den Europæiske Union, forkortet EU, og Tyskland. Ingen kontrol udefra. Kunder får samtidig fuld frihed til at tage modellen i brug. De får også sikkerhed for deres immaterielle rettigheder, altså retten til egne ideer. Tænk på et ministerium eller en billeverandør. De kan køre modellen på egne servere. Data forlader aldrig huset. Ingen udefra kan ændre eller slukke modellen. Selve grundmodellen er trænet fra bunden. Vægte, altså modellens tillærte hukommelse, og konfigurationsfiler, altså indstillingsfiler, ligger på Hugging Face, som er et åbent bibliotek på nettet. De ligger der under Apache 2.0, som er en meget fri licens. Selve træningskoden, altså opskriften, beholder virksomheden rettighederne til.

Hvor meget kan modellen huske på én gang? Det kaldes et kontekstvindue. Det er på 262.144 tokens fra start. Det er testet op til 1.048.576. Træningen brugte omkring 24 billioner tokens. Over en femtedel var på tysk. Den kørte på 768 grafikprocessorer, på engelsk Graphics Processing Unit og forkortet GPU, af typen NVIDIA B200. I Aleph Alphas egen måling ligger Kolibri over alle sammenlignede modeller i samme størrelse på begge sprog. Modellen er bygget med forordningen for kunstig intelligens, på engelsk Artificial Intelligence og forkortet AI, fra EU for øje fra bunden.

AiNews' genererede delekort for „Europæisk sprogmodel udfordrer amerikansk AI-dominans“
Genereret motiv i AiNews' radarsprog · ikke et fotografi fra historien

78,1 milliarder parametre i alt, men kun 3,46 milliarder i brug for hvert token. Det er Kolibris trick.

Aleph Alpha lancerede modellen 3. oktober 2026. Vægte og konfigurationsfiler ligger på Hugging Face under Apache 2.0. Selve træningskoden beholder virksomheden rettighederne til. Modellen er trænet fra bunden på infrastruktur i Tyskland og Finland.

Kolibri er en blanding af eksperter for tysk og engelsk. Kun 4,4 procent af parametrene arbejder ad gangen. Derfor fylder modellen omkring 78 GB i 8-bit flyttal (FP8). Navnet er tysk for kolibri.

Suveræn betyder to ting hos Aleph Alpha. Modellen er bygget i Tyskland og trænet i Tyskland og Finland under europæisk og tysk lov uden udenlandsk kontrol. Kunder får samtidig fuld frihed til idriftsættelse og sikkerhed for immaterielle rettigheder.

I praksis kan et ministerium eller en billeverandør køre modellen på egne servere. Data forlader aldrig huset. Ingen udefra kan ændre eller slukke modellen.

Kontekstvinduet er 262.144 tokens fra start og testet op til 1.048.576. Træningen brugte omkring 24 billioner tokens, over en femtedel på tysk, på 768 NVIDIA B200 GPU'er.

I Aleph Alphas egen måling ligger Kolibri over alle sammenlignede modeller i samme størrelse på begge sprog. Modellen er bygget med EU's AI-forordning for øje fra bunden.

Det er uklart: Kilden er klippet midt i en sætning om aftaler. Vejledning til at køre modellen, tokenizer-forsøg og uafhængige målinger er ikke dækket.

Kilder

  1. Kolibri is an open-weight LLM from Aleph Alpha for German and English tej.as
Produktionshistorie
  1. Radar Signal ? af 100 · spredning 1 kilder
  2. Vurdering Nyheds 4/5 — Ny open-weight model under Apache 2.0 med direkte relevans for udviklere.
  3. Skrevet Model: deepseek-v4-flash · temperatur 0.4
  4. Overskrift 5 kandidater, valgt af chat.dk
  5. Korrektur 1 zen · 4 rettelser
  6. Vedtagelse ainews-auto-v3 · score 0.94