ByteDance slipper Seedance 2.5: 30 sekunder video med lyd i én generering
Slipper ByteDance videomodellen Seedance 2.5, som lager opptil 30 sekunder video med lyd i samme generering.
30 sekunder i én generering, med bilde og lyd ut av samme pass, og mulighet til å forlenge klippet i flere runder etterpå. Det er hovedtallet i Seedance 2.5, som ByteDance Seed lanserte 31. juli. Forgjengeren måtte sy sammen kortere biter for å komme like langt.
Modellen tar imot bilder, videoklipp og lydfiler som referansemateriale i samme forespørsel, slik at flere karakterer og kameravinkler kan holdes konsistente gjennom en scene. Til sammenligning stopper Googles Gemini Omni Flash rundt 10 sekunder per klipp, skriver The Decoder. ByteDance viser fram resultatet i kortfilmen «The Missing Pair», laget utelukkende med Seedance 2.5.
For deg som vil bygge noe på dette er tilgangen problemet. Seedance 2.5 kjører foreløpig bare i ByteDances egne apper Jimeng AI og Doubao Pro, API-tilgang gjennom BytePlus ModelArk er varslet som «kommer snart» uten dato, og vektene er ikke sluppet. Forrige versjon, Seedance 2.0, ligger ifølge The Decoder på topp blant modeller med lyd på Artificial Analysis sin image-to-video-liste, og ble brukt av regissøren Neill Blomkamp til den 13 minutter lange kortfilmen «Nightborne».
Inntil API-et åpner er dette en modell du kan se resultatene av, ikke en du kan legge inn i en pipeline.
KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.