Xiaomi viser fram AI Cube: kjører 120 milliarder parametere lokalt
Viste fram AI Cube, en prototyp mini-PC på tre egenutviklede brikker som kjører modeller opp til 120 milliarder parametere lokalt.
Xiaomi har de siste årene bygget opp en egen portefølje av språk-, kode- og stemmemodeller. På XRING Chip Technology Communication Conference mandag viste selskapet fram maskinen som skal kjøre dem: AI Cube, som ifølge Gizmochina er en prototyp mini-PC bygget rundt tre brikker Xiaomi har utviklet selv.
XRING O3 er hoved-SoC-en, med en CPU på ti kjerner der alle er store, en 16-kjerners G2-Ultra NX GPU og en strømgjerrig NPU på 200 TOPS. XRING O100 er en akseleratorbrikke produsert på 6 nanometer med 3D-stabling på wafernivå, og den oppgis å ha 28 672 effektive datalinjer og nå 1,22 TB/s båndbredde for beregning nær minnet. Den tredje brikken, XRING D100 på 3 nanometer, er laget for selvkjøringsoppgaver og støtter opptil 160 GB minne.
Kabinettet er frest ut av ett aluminiumsstykke av romfartskvalitet med 33 874 CNC-kutt, og er spesifisert for 150 watt vedvarende effekt. Xiaomi oppgir at maskinen kjører modeller fra 3 til 120 milliarder parametere, med en bryter som veksler mellom en rask og en langsom systemmodus avhengig av oppgaven.
Forbeholdet er stort. Gizmochina skriver at AI Cube fortsatt er en prototyp, at Xiaomi verken har oppgitt pris eller lanseringsdato, og at det er uklart om maskinen blir et faktisk produkt eller forblir en teknisk demonstrasjon.
Hva bør du gjøre?
- Se på båndbredden før du ser på TOPS-tallet. For generering med en modell i 120-milliardersklassen er det minnebåndbredden, her oppgitt til 1,22 TB/s, som setter taket på hvor mange tokens du får ut per sekund.
- Hold av vurderingen til det kommer en pris. Uten pris og lanseringsdato er AI Cube et spesifikasjonsark, ikke et alternativ til maskinvaren du kan kjøpe i dag.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.