Spring til indhold
AiNews.dkDanske nyheder om Kunstig Intelligens

Topnyheder

NVIDIA lancerer Nemotron 3.5 Lightning til hurtigere AI-agenter

Nemotron 3.5 Lightning er en open source-model med 30 mia. parametre, der er optimeret til hurtig udførelse af opgaver i agent-workflows.

1 kildeVedtaget af NIel AutopilotRettet 11. august 2026 kl. 18.08

Læs i dit tempo

Kort

NVIDIA har udgivet Nemotron 3.5 Lightning, som er en ny og meget hurtig AI-model. Den gør AI-agenter billigere og hurtigere ved at udføre praktiske opgaver uden brug af tunge hovedmodeller. Modellen er nu frit tilgængelig, så udviklere selv kan tilpasse og optimere den.

Begynder

Nemotron 3.5 Lightning er en ny kunstig intelligens, der kan arbejde op til fire gange hurtigere end lignende modeller. Den er bygget som en såkaldt Mixture-of-Experts (en blanding af eksperter). Forestil dig en stor virksomhed med 30 milliarder medarbejdere, som i tekniske termer kaldes parametre. Det er modellens små videnspunkter. I stedet for at alle skal svare på alt, aktiveres kun 3 milliarder af dem ad gangen. Det svarer til, at man kun sender opgaven videre til den ekspert, der rent faktisk ved noget om emnet, hvilket gør processen meget mere effektiv.

NVIDIA har skabt modellen til at håndtere selve udførelsen af opgaver i digitale assistenter, også kaldet kunstig intelligens-agenter. Den tager sig af det praktiske arbejde, hvilket kaldes eksekveringslaget. Det indebærer at bruge værktøjer, tjekke om resultaterne er korrekte og give opgaver videre til mindre under-assistenter. Fordi modellen er så hurtig, mindskes ventetiden – også kaldet latenstid – og omkostningerne falder. Man behøver nemlig ikke at bruge en stor og tung »frontmodel« til hvert eneste lille trin i processen.

For at opnå denne fart bruger modellen smarte teknikker. Den kan gætte på det næste ord for at spare tid, hvilket kaldes speculativ afkodning. Derudover bruger den kvantisering via NVFP4 og BF16 checkpoints. Kvantisering betyder her, at man forenkler tallene i modellen, så den fylder mindre og kører hurtigere. Modellen kan bruges både på ens egen hardware og i store datacentre. Med systemet NVIDIA NeMo Switchyard kan man dirigere opgaverne, så en stor model som Nemotron 3 Ultra lægger planen, mens Nemotron 3.5 Lightning udfører det praktiske arbejde.

Modellen er udgivet som »open source«, hvilket betyder, at koden er åben for alle under tilladende licenser. NVIDIA deler både vægte, data og opskrifter, så andre kan tilpasse modellen til egne behov. Den understøtter værktøjer som OpenClaw og Hermes Agent gennem sikkerhedssystemet NemoClaw.

Vil du have, at jeg forklarer mere om, hvordan »blandingen af eksperter« gør modellen hurtigere i praksis?

AiNews' genererede delekort for „NVIDIA lancerer Nemotron 3.5 Lightning til hurtigere AI-agenter“
Genereret motiv i AiNews' radarsprog · ikke et fotografi fra historien

Nemotron 3.5 Lightning kører op til fire gange hurtigere end lignende modeller. Den er en open Mixture-of-Experts (MoE)-model med 30 mia. parametre, hvoraf 3 mia. er aktive. NVIDIA har optimeret modellen til høj volumen og lav latenstid i AI-agenter og agent-workflows.

Modellen håndterer eksekveringslaget i AI-agenter. Dette lag består primært af værktøjskald, resultatvalidering og uddelegering til underagenter. Det sænker omkostninger og ventetid, da man ikke behøver bruge en frontmodel til hvert enkelt trin.

Fire tekniske tiltag sikrer hastigheden og præcisionen. Der er tale om speculativ afkodning, optimeret træning samt kvantisering via NVFP4 og BF16 checkpoints. Modellen fungerer på både lokal hardware og i datacentre.

NVIDIA NeMo Switchyard kan dirigere opgaver mellem forskellige modeller. I dette setup står en frontmodel som Nemotron 3 Ultra for planlægning og orkestrering, mens Nemotron 3.5 Lightning varetager selve udførelsen.

Udgivelsen er open source med permissive licenser. NVIDIA frigiver vægte, data og opskrifter, så modellen kan tilpasses. Den understøtter værktøjer som OpenClaw og Hermes Agent via sikkerhedsstakken NemoClaw.

Kilder

  1. NVIDIA Nemotron 3.5 Lightning Delivers Fast, Accurate Specialized Task Execution for Long-Running Agents developer.nvidia.com
Produktionshistorie
  1. Radar Signal ? af 100 · spredning 1 kilder
  2. Vurdering Nyheds 5/5 — Ny NVIDIA model til langvarige agenter
  3. Skrevet Model: mimo-v2.5-free · temperatur 0.4
  4. Overskrift 5 kandidater, valgt af chat.dk
  5. Korrektur 1 zen · 1 rettelser
  6. Korrektur 2 chatdk · 1 rettelser
  7. Vedtagelse ainews-auto-v3 · score 0.4297