Meta lancerer en sprogmodel til agenter – ikke til chat
Muse Glimmer er en dense model med 120K kontekstvindue, der kører 20.000 tokens per sekund på én GPU og er designet til langvarige, flertrins workflows fremfor chat.
Læs i dit tempo
Kort
Meta har udgivet Muse Glimmer, en sprogmodel bygget til langvarige agentopgaver med mange værktøjskald i træk. Den kører med alle parametre aktiveret ad gangen, hvilket gør den mere pålidelig i komplekse workflows end modeller, der vælger dele af sig selv fra. Modellen er open-weight og kan køre lokalt på NVIDIA GPU'er, så virksomheder kan automatisere opgaver uden at sende data til skyen.
Begynder
Forestil dig en chatbot. Den svarer spørgsmål, én sætning ad gangen, hurtigt og enkelt. Muse Glimmer er bygget til noget andet – mere som en personlig assistent, der modtager en lang række opgaver, bruger forskellige redskaber til at løse dem og hele tiden husker, hvad der er sket før. Over tid skal den navigere i komplicerede instruktioner og holde styr på store mængder information, som en medarbejder der jonglerer med mange bolde på én gang.
Modellen fungerer ved at bruge alle sine parametre – groft sagt, alle sine hjerneceller – til hvert eneste ord, den genererer. Det svarer til et orkester, hvor alle musikerne spiller på hver eneste node. Det står i kontrast til en anden type arkitektur kaldet »Mixture of Experts«, hvor modellen først skal beslutge, hvilke dele af hjernen den skal bruge til hvert enkelt ord, som om den først skulle finde de rigtige specialister på forskellige kontorer. Ifølge Meta giver den tætte tilgang mere pålidelig opfølgning på instruktioner, mere forudsigelig hastighed og færre fejl i komplekse arbejdsgange.
En anden vigtig ting er, at Muse Glimmer kan køre helt på din egen computer med et Nvidia-grafikkort – blandt andet modellen GeForce RTX 5090 og lignende enheder. Med en hastighed på 20.000 ord per sekund på ét grafikkort er den designet til altid aktive assistenter, der behandler data lokalt. Det betyder, at sensitive dokumenter eller automatiseringsopgaver ikke behøver at sendes ud til en ekstern tjeneste. Endelig stiller Meta modellen til rådighed som open-weight – det vil sige med den fulde opskrift inkluderet, ikke kun det færdige resultat – så virksomheder kan tilpasse og køre den gennem forskellige platforme som NIM-containere fra Nvidia, SGLang eller vLLM.

Bygget til agenter, ikke samtaler
De fleste sprogmodeller er optimeret til chat med fokus på hurtigt første token og enkel interaktion. Muse Glimmer er designet til en anden opgave: langvarige agent-sessioner, hvor modellen udfører flere værktøjskald i træk, følger komplicerede instruktioner og skal holde styr på store sammenhænge over tid.
Dense arkitektur uden routing-overhead
Muse Glimmer bruger en dense arkitektur, der aktiverer alle parametre for hvert token. Det adskiller den fra mixture-of-experts-modeller (MoE), hvor der sker en routing-proces for hvert token. Den tætte arkitektur giver ifølge Meta mere pålidelig instruktionsefterlevelse, forudsigelig latens og færre fejltilstande i komplekse workflows.
Kører lokalt på en række NVIDIA GPU'er
Modellen kan køre fuldt ud på enheden på GeForce RTX 5090, DGX Spark, DGX Station og Jetson. Med 20.000 tokens per sekund på én GPU er den sat til at understøtte altid-aktive agenter, der behandler data lokalt. Det gør den relevant for use cases som softwareautomatisering og håndtering af private dokumenter, hvor data ikke skal sendes til en ekstern API.
Flere idriftsætningsmuligheder
Meta stiller modellen som open-weight til rådighed. Den kan idriftsættes gennem NVIDIA NIM-containere, SGLang eller vLLM.
Det er uklart: Kilden er NVIDIAs egen blog og er afbrudt midt i teksten. Præstationstallene (20K tokens/sec) er NVIDIAs egne mål, ikke uafhængige benchmarks. Der foreligger ingen information om træningsdata, licensvilkår eller sammenligning med eksisterende modeller.
Kilder
- Run Local Agentic AI Workflows with Meta’s Muse Glimmer on NVIDIA developer.nvidia.com
Produktionshistorie
- Radar Signal ? af 100 · spredning 1 kilder
- Vurdering Nyheds 4/5 — Konkret guide til lokal kørsel af Meta's Muse Glimmer på NVIDIA, relevant for udviklere.
- Skrevet Model: mimo-v2.5-free · temperatur 0.4
- Overskrift 5 kandidater, valgt af chat.dk
- Korrektur 1 zen · 1 rettelser
- Korrektur 2 chatdk · 5 rettelser
- Vedtagelse ainews-auto-v3 · score 0.4431