Spring til indhold
AiNews.dkDanske nyheder om Kunstig Intelligens

Topnyheder

Alibaba udgiver open weights-model med 2,4 billioner parametre

Qwen3.8-Max kan håndtere en million tokens i kontekst og kører med over 350 tokens i sekundet per bruger på NVIDIA GB300 NVL72.

1 kildeVedtaget af NIel AutopilotRettet 12. august 2026 kl. 20.41

Læs i dit tempo

Kort

Alibaba har lanceret Qwen3.8-Max, en kæmpestor AI-model, der kan behandle enorme mængder data effektivt. Det giver mulighed for avanceret problemløsning og analyse af meget lange dokumenter med høj hastighed. NVIDIA samarbejder nu med udviklere om at gøre modellen endnu hurtigere gennem tekniske optimeringer.

Redaktionel illustration til „Alibaba udgiver open weights-model med 2,4 billioner parametre“
Genereret illustration · ikke et fotografi fra historien

2,4 billioner parametre udgør den samlede størrelse af Alibabas nye open weights-model, Qwen3.8-2.4T-A95B (Qwen3.8-Max). Modellen aktiverer 95 milliarder parametre per token. Den er designet til komplekst ræsonnement og agent-arbejdsgange.

Over 350 tokens i sekundet per bruger opnås på NVIDIA GB300 NVL72 i FP8-præcision. Per GPU er hastigheden over 4.000 tokens i sekundet. NVIDIA samarbejder med open source-miljøet om at optimere idriftsættelsen gennem specifikke kernels, inferens-runtimes og serving-opskrifter. Yderligere optimeringer med NVFP4-præcision forventes at øge hastigheden over tid.

En million tokens er det maksimale kontekstvindue. Modellen bruger en hybrid arkitektur med både fuld og lineær attention. I lag med fuld attention er alle tokens forbundet, mens den lineære attention erstatter KV-cachen med en begrænset rekurrent tilstand. Dette holder hukommelsen og beregningerne på et fast niveau, når mængden af data vokser.

128.000 tokens kan modellen generere som output. Den bruger en finkornet Mixture of Experts (MoE) arkitektur, som gør det praktisk at køre en model i denne skala. Løsningen er målrettet opgaver som omfattende dokumentanalyse, kodning og workflows i flere trin.

Kilder

  1. Serve Qwen3.8-2.4T-A95B, a 2.4T-Parameter Model, with Configurable Reasoning on NVIDIA GB300 NVL72 developer.nvidia.com
Produktionshistorie
  1. Radar Signal ? af 100 · spredning 1 kilder
  2. Vurdering Nyheds 5/5 — Ny model med massive parametre og specifik hardware-konfiguration er yderst relevant for buildere.
  3. Skrevet Model: mimo-v2.5-free · temperatur 0.4
  4. Overskrift 5 kandidater, valgt af chat.dk
  5. Korrektur 1 zen · 3 rettelser
  6. Billede Genereret af gemini-3.6-flash-medium
  7. Vedtagelse ainews-auto-v3 · score 0.4431