A Picsartban is elérhető a ByteDance hosszú, hangos videómodellje

A Picsart integrálta a ByteDance Seedance 2.5 videómodelljét, amely a cég leírása szerint 30 másodperces, egyetlen folyamatos felvételben generált jeleneteket készít. A kép és a hang ugyanabból a generálásból érkezik, a kimenet 1080p felbontású.
- A Seedance 2.5 egyetlen menetben 30 másodperces, folyamatos videót generál.
- A kép és a hang ugyanabból a generálásból származik, a lip-sync 20 nyelvet támogat.
- A modell 1080p kimenetet és legfeljebb 50 multimodális referenciát kezel.
- A Picsart AI Playgroundban a Seedance 2.5 több mint 150 másik modellel hasonlítható össze.
Egy generálás, 30 másodperces folyamatos jelenet
A Picsart 2026. augusztus 7-i bejelentése szerint a Seedance 2.5 a ByteDance videómodellje, amely már elérhető a platformon. A modell egyetlen menetben, vágás és összeillesztés nélkül képes 30 másodperces felvételt létrehozni. Ez hosszabb a Seedance 2.0 körülbelül 15 másodperces időtartamánál.
A Picsart szerint a hosszabb, stabilabb felvétel lehetővé teszi, hogy egy szereplő belépjen a jelenetbe, cselekedjen, elmondjon egy mondatot, majd lezárja a pillanatot. A vállalat a modellt inkább történetmesélő eszközként írja le, és azt állítja, hogy az eredmény filmednek, nem rendereltnek hat.
A fejlesztés része a fizikai alapú megvilágítás, a javított szem- és arcrészlet, valamint a realisztikus ütközési fizika. A fények és árnyékok irányítottabbak, az arcon pedig a mikrogesztusok, például egy mondat előtti rezdülés vagy egy félmosoly is megjelenhet.
A hang a képpel együtt készül
A Seedance 2.5 a hangot és a képet ugyanabban a látens térben dolgozza fel, így a hang nem utólag kerül a videó alá. A Picsart példái szerint a lépés hangja akkor hallatszik, amikor a láb földet ér, az ajtó csukódása pedig a megfelelő képkockához igazodik.
A rendszer egyetlen kérésből képes környezeti hangot, hangeffekteket és a szájmozgáshoz igazított párbeszédet létrehozni. A szinkronizált beszéd 20 nyelvet támogat. A kimenet 1080p, Full HD felbontású, amelyet a cég a közösségi médiás, fizetett és webes megjelenésekhez használatos képméretként mutat be.
A modell akár 50 multimodális referenciát is fogad egy generálásban: 30 képet, 10 videoklipet és 10 hangsávot. A képek arcot, ruházatot vagy terméket rögzíthetnek, a videók a mozgást és a kameraműködést, a hanganyagok pedig a hangot adhatják meg. A Picsart szerint ez segíthet abban, hogy egy szereplő megjelenése, öltözéke, hangja és környezete egy teljes sorozaton belül is következetes maradjon.
A modell filmes briefekre épít
A Picsart azt javasolja, hogy a felhasználók ne pusztán leírást írjanak a jelenetről. A promptban érdemes megadni a képkivágást, a kameraállást és egy kameramozgást, majd leírni a cselekményt egy kezdettel és lezárással, végül a hangzást is. A vállalat szerint azok a leírások, amelyek csak a jelenet elejét rögzítik, a videó utolsó harmadában könnyebben elveszítik a kívánt irányt.
A Seedance 2.5-öt 2026. június 23-án jelentették be a pekingi Volcano Engine FORCE konferencián. A Picsart szerint a modell videoklipek összeállítása nélkül készíthet hosszabb jeleneteket, a hangot is a képpel együtt állíthatja elő, és régiószintű szerkesztést kínálhat. Ez utóbbi lehetővé teszi például egy hibás címke vagy oda nem illő háttérelem módosítását a teljes klip újragenerálása nélkül.
A modellt a Picsart AI Playground felületén lehet kiválasztani. Itt a felhasználó megírhatja a jelenetet, referenciákat csatolhat, majd generálhatja a felvételt. Ugyanebben a promptmezőben több mint 150 másik modell is elérhető, így ugyanazzal a leírással összehasonlíthatók a különböző videós rendszerek.
Picsart: Seedance 2.5 in Picsart: cinematic video, one take

