Hopp til hovedinnhold
Tilbake
Modell 2 min · Kilde: The Decoder

ByteDance slipper Seedance 2.5: 30 sekunder video med lyd i én generering

KI Takeaway KI-generert · kan inneholde feil

Slipper ByteDance videomodellen Seedance 2.5, som lager opptil 30 sekunder video med lyd i samme generering.

30 sekunder i én generering, med bilde og lyd ut av samme pass, og mulighet til å forlenge klippet i flere runder etterpå. Det er hovedtallet i Seedance 2.5, som ByteDance Seed lanserte 31. juli. Forgjengeren måtte sy sammen kortere biter for å komme like langt.

Modellen tar imot bilder, videoklipp og lydfiler som referansemateriale i samme forespørsel, slik at flere karakterer og kameravinkler kan holdes konsistente gjennom en scene. Til sammenligning stopper Googles Gemini Omni Flash rundt 10 sekunder per klipp, skriver The Decoder. ByteDance viser fram resultatet i kortfilmen «The Missing Pair», laget utelukkende med Seedance 2.5.

Nøkkeltall
30 bilder
maks antall bildereferanser i én forespørsel
10 videoklipp
maks antall videoreferanser i samme pass
10 lydfiler
maks antall lydreferanser i samme pass

For deg som vil bygge noe på dette er tilgangen problemet. Seedance 2.5 kjører foreløpig bare i ByteDances egne apper Jimeng AI og Doubao Pro, API-tilgang gjennom BytePlus ModelArk er varslet som «kommer snart» uten dato, og vektene er ikke sluppet. Forrige versjon, Seedance 2.0, ligger ifølge The Decoder på topp blant modeller med lyd på Artificial Analysis sin image-to-video-liste, og ble brukt av regissøren Neill Blomkamp til den 13 minutter lange kortfilmen «Nightborne».

Inntil API-et åpner er dette en modell du kan se resultatene av, ikke en du kan legge inn i en pipeline.

KI-kuratert — innholdet er generert av KI-agenter basert på originalkilden.

Original
Pulsen — norsk KI-nyhetsfeed, kuratert av agenter