Ollama 0.32.12 kjører Qwen3.8 27B, og MLX-varianten er bygget for Apple Silicon
Oppgrader til Ollama 0.32.12 hvis du vil kjøre Qwen3.8 27B lokalt, særlig på en Mac med Apple Silicon.
Ollama la ut versjon 0.32.12 fredag ettermiddag, og hele utgivelsesnotatet handler om én ting: støtte for Qwen3.8 27B. For Apple Silicon skriver Ollama at de har optimalisert spesielt for maksimal ytelse og utdatakvalitet, og peker eksplisitt på gjentakende oppgaver og kodeagenter som bruksområdet. Det er en uvanlig konkret formulering fra et prosjekt som ellers pleier å liste modellstøtte uten å si hva den er ment for.
På Ollamas modellside står 27B-varianten oppført på 18 GB med et kontekstvindu på 256K, og den tar både tekst og bilder. Biblioteket lister tolv bygg av modellen, blant dem en egen MLX-variant med samme størrelse og kontekst. MLX er Apples rammeverk for maskinlæring på egen maskinvare, og en egen MLX-bygg betyr at modellen kjører gjennom Apples eget lag i stedet for et generisk. Vekttallet er poenget for deg som vurderer maskinvare: 18 GB betyr at en Mac med 24 GB delt minne er trang, mens 32 GB gir rom for kontekst i tillegg til vektene.
Modellsiden beskriver også hva Alibaba selv fremhever ved Qwen3.8. Tenkemodus er på som standard og kan slås av per forespørsel, dybden styres med reasoning_effort, og resonneringen fra tidligere meldinger kan beholdes med preserve_thinking. Modellen har innebygd bilde- og videoforståelse, fra STEM-diagrammer og dokumenter til timelange videoer, og Alibaba oppgir bedre autonom planlegging og håndtering av tilbakemeldinger fra omgivelsene, som er den delen som avgjør om en agent fullfører en oppgave uten hjelp.
Den praktiske nyheten ligger i oppstartskommandoene Ollama lister for modellen. I tillegg til ollama run qwen3.8 kan du starte Claude Code, OpenCode, Hermes Agent og OpenClaw direkte mot den lokale modellen med ollama launch claude --model qwen3.8 og tilsvarende for de tre andre. Det fjerner mellomleddet der du selv måtte peke kodeagenten mot et OpenAI-kompatibelt endepunkt på port 11434 og håndtere konfigurasjonen manuelt.
Tallene fra Alibaba om at Qwen3.8 gir betydelige løft innen koding, profesjonelt arbeid, forskning og langhorisont-agentoppgaver er selskapets egne, uten uavhengig reproduksjon i denne utgivelsen. Vurder dem deretter, og mål mot modellen du kjører i dag før du bytter.
Hva bør du gjøre?
- Sjekk minnet før du laster ned. 18 GB vekter pluss kontekst betyr i praksis 32 GB delt minne på en Mac hvis du vil bruke noe i nærheten av 256K.
- Velg
qwen3.8:27b-mlxpå Apple Silicon. Det er den varianten Ollama har optimalisert for i denne utgivelsen. - Test
ollama launch claude --model qwen3.8mot et lite, ekte repo før du flytter noe arbeid dit. Lokal 27B og en skybasert frontmodell løser ikke de samme oppgavene like godt.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.