H3 Max lager fem sekunder video på under tre sekunder
Genererer fem sekunder video på under tre sekunder, rundt 35 ganger gjennomstrømningen til MiniMax' eget H3-endepunkt.
«MiniMax H3 Max fra fal leverer kvaliteten til MiniMax H3 i mer enn 50 ganger hastigheten, ifølge Design Arenas uavhengige måling, og etablerer en ny Pareto-front mellom hastighet og preferanse» — Design Arena
Det er tredjeparten som beskriver modellen fal lanserte 27. august. H3 Max er en etterlært utgave av MiniMax H3, en videomodell med åpne vekter, bygget av fal Research og optimalisert av fals eget inferens-team. Regnestykket fal selv oppgir er fem sekunder video på under tre sekunder, altså raskere enn sanntid, og i snitt 15 ganger raskere enn alt annet med sammenlignbar kvalitet.
Hastighet alene er ikke nytt i generativ video. Det uvanlige er at fal hevder å ha fått den uten å gi fra seg kvalitet. I selskapets egne preferansetester rangerer H3 Max som nummer én på helhetsinntrykk, promptforståelse og estetikk mot tolv ledende videomodeller, blant dem MiniMax' offisielle H3-endepunkt, Gemini Omni Flash, Wan 3.0, Seedance 2.5, Kling 3 og Veo 3.1. Sammenligningene er aggregert som bayesianske Elo-vurderinger med 95 prosents konfidensintervall. De uavhengige målingene fra Artificial Analysis og Design Arena plasserer modellen på topp de også.
«H3 Max kombinerer videokvalitet på toppnivå med et sprang i genereringshastighet, som gjør høykvalitets videogenerering praktisk over et mye bredere spekter av virkelige bruksområder» — MiniMax H3-teamet
Metoden er den interessante delen for deg som bygger. fal startet fra de åpne MiniMax H3-vektene og la inn nye data i etterlæringen, med vekt på promptfølging og visuell kvalitet. Samtidig jobbet inferens-teamet på modellen mens den fortsatt var under utvikling, slik at valg i treningen og valg i serveringsstakken kunne påvirke hverandre. Regelen de sier de fulgte er at en optimalisering bare overlevde hvis modellen holdt plassen sin i de interne kvalitetstestene etterpå. De vanlige snarveiene i videomodeller, lavere presisjon, færre samplingssteg og tilnærmede operasjoner, gir fart nettopp ved å ofre litt av det motsatte.
Maskinvaren er verdt å merke seg i seg selv: H3 Max er både trent og servert utelukkende på NVIDIA GB200 NVL72-systemer, og fal oppgir opptil dobbel ytelse per brikke mot forrige generasjon akseleratorer de brukte. Det er en påminnelse om hvor mye av «modellfremgangen» i generativ media som nå ligger i serveringslaget.
Modellen kjøres via fals Playground, fal Agent eller API-et, og fal ga 50 prosent rabatt den første uka etter lansering. Vektene til H3 Max selv er ikke sluppet, så du kjøper hastigheten som en tjeneste, ikke som noe du kan flytte til egen maskin. Basemodellen MiniMax H3 har derimot åpne vekter.
For norske utviklere som bygger noe med video, flytter dette grensen for hva som kan skje mens brukeren venter. Når fem sekunder video tar under tre sekunder, blir video en ting du kan generere inne i en forespørsel i stedet for i en kø med varsling etterpå.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.