Spring til indhold
AiNews.dkDanske nyheder om Kunstig Intelligens

Lokal LLM

Rapid-MLX: Ny lokal AI-motor til Apple Silicon er 4,2x hurtigere end Ollama

Den nye open source-motor Rapid-MLX leverer lynhurtig lokal AI-afvikling på Apple Silicon med understøttelse af værktøjer som Claude Code, Cursor og Aider.

1 kildeVedtaget af NIel Autopilot
AiNews' genererede delekort for „Rapid-MLX: Ny lokal AI-motor til Apple Silicon er 4,2x hurtigere end Ollama“
Genereret motiv i AiNews' radarsprog · ikke et fotografi fra historien

Udviklere, der ønsker at afvikle kunstig intelligens lokalt på Mac, har fået et nyt og markant hurtigere alternativ. Open source-projektet Rapid-MLX af raullenchai beskrives som den hurtigste lokale AI-motor til Apple Silicon, og målinger viser en ydelse, der er op til 4,2 gange hurtigere end den populære løsning Ollama.

Motoren er udviklet i programmeringssproget Python og er bygget til at fungere som en direkte erstatning (»drop-in replacement«) for OpenAI's API. Det gør det muligt ubesværet at integrere motoren i eksisterende workflows og udviklingsværktøjer såsom Claude Code, Cursor og Aider.

En af de mest fremtrædende funktioner ved Rapid-MLX er ydeevnen ved genanvendelse af prompts. Projektet opnår en såkaldt cached Time To First Token (TTFT) på blot 0,08 sekunder. Derudover tilbyder motoren 100 procent tool calling understøttet af 17 forskellige tool parsers, hvilket sikrer præcis håndtering af eksterne værktøjer og instruktioner.

Rapid-MLX indeholder ligeledes funktioner som prompt cache, separation af resonering (reasoning separation) og cloud routing, der kan videresende forespørgsler efter behov. Motoren benytter teknologier som FastAPI og har relation til emner som DeepSeek og inference på Apple Silicon.

Projektet har opnået stor opmærksomhed på GitHub, hvor det har samlet 3.390 stjerner og er blevet forket 387 gange. For udviklere på Apple-platformen repræsenterer Rapid-MLX dermed en effektiv og højtydende løsning til lokal afvikling af store sprogmodeller.

Kilder

  1. raullenchai/Rapid-MLX — The fastest local AI engine for Apple Silicon. 4.2x faster than Ollama, 0.08s cached TTFT, 100% tool calling. 17 tool parsers, prompt cache, reasoning separation, cloud routing. Drop-in OpenAI replacement. Works with Claude Code, Cursor, Aider. github.com