
Danske Odin-modeller kan nu testes mod Claude og ChatGPT på AI-Arenaen
Ordbogen A/S har fået sine danske sprogmodeller Odin Large og Odin Medium med på AI-Arenaen, hvor man kan stemme på svarene side om side med de internationale assistenter.

Ordbogen A/S har fået sine danske sprogmodeller Odin Large og Odin Medium med på AI-Arenaen, hvor man kan stemme på svarene side om side med de internationale assistenter.
Praktiske produkter og workflows, der løser noget konkret.
UK's AI-sikkerhedsinstitut rapporterer, at agenter under test med deaktiverede sikkerhedsfiltre udførte angreb, herunder phishing og forsøg på supply-chain-infiltration. Ingen skade blev registreret.
Meta har udgivet Muse Code i beta. Det er en AI-agent til terminalen, der kan håndtere komplekse opgaver i store kodebaser. Værktøjet bruger modellen Muse Spark og kan køre flere under-agenter parallelt i isolerede miljøer uden at ændre i brugerens arbejdskopi.
En udvikler beskriver et personligt workflow, hvor han bruger kodeassistenter til at generere kode i chatten, men manuelt indtaster alle ændringer selv. Metoden skal forebygge 'kognitiv gæld' og holde udvikleren i kontrol over projektet, selv når de kedelige dele uddelegeres til en LLM.
En fejl i Cursor cloud-agenter får fil-læsningsværktøjet til at vise indhold fra et forældet snapshot af standardgrenen i de første 5-15 sekunder af en session. Fejlen er rapporteret og reproduceret fem gange. Terminalkommandoer er korrekte fra starten, hvilket gør fejlen svær at opdage, indtil den retter sig selv.
#1
#1
#1UK's AI-sikkerhedsinstitut rapporterer, at agenter under test med deaktiverede sikkerhedsfiltre udførte angreb, herunder phishing og forsøg på supply-chain-infiltration. Ingen skade blev registreret.
Meta har udgivet Muse Spark 1.2, en opdatering af deres kodningsmodel, sammen med Muse Code, en kodningsagent. Modellen sælges til to priser: $1,25/$4,25 per million token til almindelige kunder, men $0,10/$0,20 for dem, der accepterer, at Meta bruger deres data til produktudvikling.
Meta har udgivet Muse Code i beta. Det er en AI-agent til terminalen, der kan håndtere komplekse opgaver i store kodebaser. Værktøjet bruger modellen Muse Spark og kan køre flere under-agenter parallelt i isolerede miljøer uden at ændre i brugerens arbejdskopi.
Simon Willison har brugt Claude Fable 5 til at skabe spillet 'Raccoon Heist'. Ved at give modellen screenshots og tekst fra et gammelt koncept, lykkedes det at generere et færdigt spil i én arbejdsgang via Claude Code for web.
Boris Cherny, skaberen af Claude Code, anbefaler, at man sletter CLAUDE.md, skills og hooks hvert par måneder for at se, hvad modellen kan uden dem. Anthropic har selv skåret 80 procent af Claude Codes systembesked og siger, det forbedrede modellen. Videoen testede rådet på en rigtig kodebase og peger på nuancer.
Traycer Desktop kan opsætte Claude Fable 5 som en master-agent, der koordinerer andre, billigere modeller som Codex, GLM, Kimi og Qwen. Målet er at bevare høj kvalitet i kodningen, mens man bruger færre dyre tokens ved at uddelegere opgaverne.
En udvikler beskriver et personligt workflow, hvor han bruger kodeassistenter til at generere kode i chatten, men manuelt indtaster alle ændringer selv. Metoden skal forebygge 'kognitiv gæld' og holde udvikleren i kontrol over projektet, selv når de kedelige dele uddelegeres til en LLM.
Fem teams i Rust-projektet har indført regler for brug af store sprogmodeller (LLM) i deres monorepo. Formålet er at håndtere udfordringer med review-kapacitet og sikre, at nye bidragsydere kender reglerne, før de sender kode ind.
Zero-Mem er en ny metode til hukommelsesstyring for AI-agenter, der fjerner behovet for at bruge tokens eller ekstra LLM-kald til at organisere data. Systemet bruger grafer og hierarkier til at finde relevant information, hvilket gør processen hurtigere uden at gå på kompromis med resultaterne.
Homebench er et open source-værktøj til at måle hastighed, hukommelse og kvalitet på lokale sprogmodeller uden cloud eller API-nøgler. Det fungerer med Ollama, LM Studio og andre, og viser resultaterne i et live leaderboard i terminalen.
ExANS er en ny lossless codec til GPU'er, der komprimerer BF16 KV-cache. Ved at fokusere på eksponent-feltet opnår den en dekodningshastighed på 622 GB/s på en H100, hvilket kan forkorte svartiden (TTFT) i inferens-motorer.
En automatisk Microsoft-opdatering fra Statens IT koblede AI-værktøjet Copilot ulovligt til Sundhedsdatastyrelsens Outlook-system. Ifølge en aktindsigt kan det have betydet, at følsomme data er delt med Microsoft. Datatilsynet advarer om manglende kontrol med AI-systemer.
En fejl i Cursor cloud-agenter får fil-læsningsværktøjet til at vise indhold fra et forældet snapshot af standardgrenen i de første 5-15 sekunder af en session. Fejlen er rapporteret og reproduceret fem gange. Terminalkommandoer er korrekte fra starten, hvilket gør fejlen svær at opdage, indtil den retter sig selv.
En fejl i Cursors Agent Terminal får PowerShell-kommandoer, der returnerer objekter (som en tabel fra Get-Location), til at give tomt output til agenten. Fejlen er stille: agenten ser et tomt, succesfuldt svar og fortsætter. Alt, der udskrives efter den tabte kommando, mistes også.