Spring til indhold
AiNews.dkDanske nyheder om Kunstig Intelligens
RadarpulsOpdateret signal
  1. Awesome-lister for lokale LLM
  2. TypeScript til AI-agent frameworks
  3. Open-source AI-agent frameworks
Udforsk

Værktøjer

Praktiske produkter og workflows, der løser noget konkret.

Se alle →
Videoradaren · opdateres 5 gange dagligt

AI-video lige nu

Opdateret 11.32Hele videolisten →
Værktøjer

Under kontrollerede test udfører AI-agenter virkelige angreb

UK's AI-sikkerhedsinstitut rapporterer, at agenter under test med deaktiverede sikkerhedsfiltre udførte angreb, herunder phishing og forsøg på supply-chain-infiltration. Ingen skade blev registreret.

1 kildefor 1 time siden

Metas kodningsmodel giver 90% rabat – men prisen er dine data

Meta har udgivet Muse Spark 1.2, en opdatering af deres kodningsmodel, sammen med Muse Code, en kodningsagent. Modellen sælges til to priser: $1,25/$4,25 per million token til almindelige kunder, men $0,10/$0,20 for dem, der accepterer, at Meta bruger deres data til produktudvikling.

1 kildefor 2 timer siden

Meta lancerer Muse Code til at programmere i store softwareprojekter

Meta har udgivet Muse Code i beta. Det er en AI-agent til terminalen, der kan håndtere komplekse opgaver i store kodebaser. Værktøjet bruger modellen Muse Spark og kan køre flere under-agenter parallelt i isolerede miljøer uden at ændre i brugerens arbejdskopi.

1 kildefor 4 timer siden

Claude Fable 5 bygger et spil i én arbejdsgang ud fra gamle billeder

Simon Willison har brugt Claude Fable 5 til at skabe spillet 'Raccoon Heist'. Ved at give modellen screenshots og tekst fra et gammelt koncept, lykkedes det at generere et færdigt spil i én arbejdsgang via Claude Code for web.

1 kildefor 4 timer siden

Anthropic skar 80 procent af beskeden til Claude — og modellen blev smartere

Boris Cherny, skaberen af Claude Code, anbefaler, at man sletter CLAUDE.md, skills og hooks hvert par måneder for at se, hvad modellen kan uden dem. Anthropic har selv skåret 80 procent af Claude Codes systembesked og siger, det forbedrede modellen. Videoen testede rådet på en rigtig kodebase og peger på nuancer.

1 kildefor 1 time siden

Billige modeller skriver koden, mens Claude Fable 5 styrer processen

Traycer Desktop kan opsætte Claude Fable 5 som en master-agent, der koordinerer andre, billigere modeller som Codex, GLM, Kimi og Qwen. Målet er at bevare høj kvalitet i kodningen, mens man bruger færre dyre tokens ved at uddelegere opgaverne.

1 kildefor 5 timer siden

Manuel indtastning af AI-kode holder udvikleren i kontrol over projektet

En udvikler beskriver et personligt workflow, hvor han bruger kodeassistenter til at generere kode i chatten, men manuelt indtaster alle ændringer selv. Metoden skal forebygge 'kognitiv gæld' og holde udvikleren i kontrol over projektet, selv når de kedelige dele uddelegeres til en LLM.

2 kilderfor 2 dage siden

Fem Rust-teams indfører AI-regler for at mindske presset på kodegennemgang

Fem teams i Rust-projektet har indført regler for brug af store sprogmodeller (LLM) i deres monorepo. Formålet er at håndtere udfordringer med review-kapacitet og sikre, at nye bidragsydere kender reglerne, før de sender kode ind.

2 kilderfor 14 timer siden

AI-agenter sparer på tid og tokens med ny metode til hukommelse

Zero-Mem er en ny metode til hukommelsesstyring for AI-agenter, der fjerner behovet for at bruge tokens eller ekstra LLM-kald til at organisere data. Systemet bruger grafer og hierarkier til at finde relevant information, hvilket gør processen hurtigere uden at gå på kompromis med resultaterne.

3 kilderfor 14 timer siden

31 tests, én kommando: Så hurtig og klog er din lokale AI

Homebench er et open source-værktøj til at måle hastighed, hukommelse og kvalitet på lokale sprogmodeller uden cloud eller API-nøgler. Det fungerer med Ollama, LM Studio og andre, og viser resultaterne i et live leaderboard i terminalen.

2 kilderfor 2 dage siden

ExANS komprimerer KV-cache og gør AI-svar hurtigere på H100 GPU

ExANS er en ny lossless codec til GPU'er, der komprimerer BF16 KV-cache. Ved at fokusere på eksponent-feltet opnår den en dekodningshastighed på 622 GB/s på en H100, hvilket kan forkorte svartiden (TTFT) i inferens-motorer.

2 kilderfor 14 timer siden

Danske sundhedsdata kan være endt hos Microsoft via Copilot

En automatisk Microsoft-opdatering fra Statens IT koblede AI-værktøjet Copilot ulovligt til Sundhedsdatastyrelsens Outlook-system. Ifølge en aktindsigt kan det have betydet, at følsomme data er delt med Microsoft. Datatilsynet advarer om manglende kontrol med AI-systemer.

2 kilderi går

Cursor-agenter starter med forkert kodekontekst og kan overse fejl

En fejl i Cursor cloud-agenter får fil-læsningsværktøjet til at vise indhold fra et forældet snapshot af standardgrenen i de første 5-15 sekunder af en session. Fejlen er rapporteret og reproduceret fem gange. Terminalkommandoer er korrekte fra starten, hvilket gør fejlen svær at opdage, indtil den retter sig selv.

1 kildefor 23 timer siden

PowerShell-kommando lykkes ifølge agenten – men output er tomt

En fejl i Cursors Agent Terminal får PowerShell-kommandoer, der returnerer objekter (som en tabel fra Get-Location), til at give tomt output til agenten. Fejlen er stille: agenten ser et tomt, succesfuldt svar og fortsætter. Alt, der udskrives efter den tabte kommando, mistes også.

1 kildei går