Xiaomi slipper MiMo-V2.6 med 1 million tokens kontekst under MIT-lisens
Legg MiMo-V2.6 til lista over åpne modeller du kan bygge på, for Xiaomi gir ut både Pro og Flash under MIT-lisens med 1 million tokens kontekst.
89,9 mot 89,1. Det er Terminal Bench 2.1-skårene til Xiaomis nye MiMo-V2.6-Pro-RL og Claude Opus 5, slik Xiaomi selv rapporterer dem i modellkortet som ble lagt ut på Hugging Face 21. september. Serien består av en Pro- og en Flash-variant, begge med åpne vekter under MIT-lisens.
Pro-varianten er en sparsom MoE på 1,02 billioner parametere totalt, med 42 milliarder aktive per token og 8 av 384 rutede eksperter i bruk om gangen. Flash er 309 milliarder totalt og 15 milliarder aktive. Begge har 1 million tokens kontekst, og begge tar tekst, bilde, video og lyd inn i én og samme modell. Xiaomi beskriver treningen som «You Only RL Once»: én blandet forsterkningslæringskjøring på tvers av koding, generelle agentoppgaver, visuelle oppgaver og cybersikkerhet, i stedet for separate løp per domene.
Tallene er Xiaomis egne, og de viser også tydelig hvor modellen taper. På Terminal Bench 4.0 står Pro med 34,9 mot Claude Opus 5 sine 49,0, og på OSWorld-Verified med 82,0 mot Claude Fable 5 sine 86,0. Teller du opp hele tabellen, ligger Claude Opus 5 foran på 10 av de 14 benchmarkene der Xiaomi oppgir tall for begge modellene.
For deg som bygger er det lisensen som betyr mest. 42 milliarder aktive parametere gjør ikke Pro kjørbar på en hjemmemaskin, og Xiaomis egen SGLang-oppskrift fordeler modellen over 16 GPU-er på to noder. MIT-lisensen betyr likevel at vektene kan finjusteres og hostes uten bruksbegrensninger, og Xiaomi oppgir at modellen også er tilgjengelig via OpenRouter og selskapets eget API.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.