Nativ: åpen MLX-app som kjører lokale modeller på Apple Silicon
Kjør åpne modeller lokalt på Apple Silicon med Nativ, en MIT-lisensiert macOS-app bygget på MLX som gir både chat og en localhost API-server.
Der LM Studio holder grensesnittet lukket bak en proprietær skallapp, er Nativ åpen hele veien ned. Simon Willison omtalte appen 21. juli: den er laget av Prince Canuma, utvikleren bak MLX-VLM-biblioteket for å kjøre vision-modeller med MLX på Mac. Nativ pakker MLX inn i en full macOS desktop-app for Apple Silicon (M1 og nyere), ifølge prosjektsiden tunet for M-seriens unified memory og Metal uten oversettelseslag.
Du får et chat-grensesnitt og en localhost API-server, samme form som LM Studio. Prosjektsiden lister et kuratert modellbibliotek med blant annet Gemma 4 E2B fra Google (10,28 GB), North Mini Code fra Cohere (19,38 GB, 500K kontekst) og LFM2.5-VL fra Liquid AI (3,20 GB). Telemetrien viser tokens/sek, minnetrykk, termisk tilstand og time-to-first-token mens modellen jobber, og appen dekker tekst, bilde, video, kode og lyd.
«Jeg er virkelig begeistret for det nye prosjektet hans, som pakker MLX inn i en full macOS-app. Det ligner i form på LM Studio.» — Simon Willison
Det praktiske poenget for deg som bygger: localhost-endepunktet kan kodeagenter peke mot, deriblant Claude Code, Codex og OpenCode, så du kjører agent-loopene mot en lokal modell uten sky. Willison merket seg at Nativ automatisk plukket opp MLX-modeller han allerede hadde i Hugging Face-cachen. Hele appen er MIT-lisensiert, uten konto eller abonnement, noe som skiller den fra de lukkede alternativene som bygger på åpne motorer de selv ikke deler.
Hva bør du gjøre?
- Last ned macOS-bygget fra Nativ-prosjektsiden. Du trenger Apple Silicon (M1 eller nyere).
- Har du allerede MLX-modeller i Hugging Face-cachen, dukker de opp i appen uten ekstra nedlasting.
- Pek Claude Code eller en annen kodeagent mot localhost-endepunktet for å kjøre inferens lokalt.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.