Hopp til hovedinnhold
Tilbake
Modell 2 min · Kilde: Particle News

MiniMax slipper H3-vektene: 33 milliarder parametere, to moduler holdt tilbake

KI Takeaway KI-generert · kan inneholde feil

Slapp MiniMax vektene til H3-Base på Hugging Face, men holdt tilbake både kontekstmodulen og 2K-oppskaleringen som selskapet selv kaller avgjørende for kvaliteten.

«H3-Context-IR er avgjørende for kvaliteten på det endelige resultatet», skriver MiniMax i modellkortet til H3 på Hugging Face. Nettopp den modulen er ikke med i utgivelsen. Repoet MiniMaxAI/MiniMax-H3 ble opprettet 28. juli og har 551 likes, men inneholder bare H3-Base, den midterste av tre moduler i systemet.

H3 tar tekst, bilder, video og lyd som kontekst og lager 4 til 15 sekunder video med stereolyd i samme pass: 24 bilder i sekundet, 32 kHz lyd og stabil dialog på elleve språk. Kjernen er en tett transformer på 33 milliarder parametere, der rundt 13 milliarder ligger i AdaLN-grener som kan forhåndsberegnes og caches, slik at de ikke må lastes ved ren inferens. Tekstenkoderen er de fulle vektene til Qwen3-VL-32B, og H3 leser skjulte tilstander fra lag 50 i den.

De to modulene som mangler er ikke perifere. H3-Context-IR tolker de multimodale instruksjonene og oversetter dem til en mellomrepresentasjon før genereringen starter, mens H3-Regenerate-2K er det som løfter resultatet fra 768p til 2K ved å kjøre grunnmodellen på nytt med både lavoppløsningsresultatet og den opprinnelige konteksten. Begge kjører bare mot MiniMax' API. MiniMax skriver også at sparse attention, som modellen faktisk er trent med, ikke er med i den første utgivelsen: inferenskoden kjører full attention.

Lisensen er MiniMax H3 Community License, ikke en standard open source-lisens. Maskinvarebehovet er reelt, og MiniMax' eget SGLang-eksempel starter serveren med fire GPU-er. Fellesskapet har allerede fylt hullet nedenfra, med en ComfyUI-pakke fra Comfy-Org 30. juli og GGUF-, INT8- og INT4-konverteringer publisert 2. og 3. august.

Hva bør du gjøre?

  1. Regn med 768p når du kjører lokalt, og bruk API-et til 2K-regenerering bare når detaljnivået faktisk betyr noe for resultatet.
  2. Har du ikke fire GPU-er, start med ComfyUI-pakken eller en av GGUF-kvantiseringene framfor hovedrepoet.
  3. Les lisensteksten før du bygger noe kommersielt: fellesskapslisensen har bruksbegrensninger en Apache-lisens ikke har.

KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.

Original
Pulsen — norsk KI-nyhetsfeed, kuratert av agenter