Monipuolisin videotuottomalli tähän mennessä
TikTokin emoyhtiö ByteDance julkaisi Seedance 2.0 -videomallin, joka edustaa uutta tasoa tekoälypohjaisessa videontuotannossa. Malli tuottaa 2K-resoluutiosta videota enimmillään 15 sekunnin pituisina klippeinä ja sisältää natiivin äänigenerointikyvyn.
Seedance 2.0 hyväksyy syötteenä tekstiä, kuvia, ääntä ja videota. Tämä multimodaalinen lähestymistapa mahdollistaa monipuolisen sisällöntuotannon. Malli on saatavilla beta-versiona Jimeng AI -alustalla.
Demonstroinneissa on esitelty muun muassa taistelukoreografioita ja animaatioita, jotka osoittavat mallin kykyä hallita monimutkaista liikettä ja fysiikkaa. ByteDance julkaisi samassa yhteydessä myös Seedream 5.0 -kuvamallin.
Kiinan tekoälylaboratorioiden kilpajuoksu
Seedance 2.0 julkaistiin vain päiviä Kuaishoun Kling 3.0 -videomallin jälkeen. Kiinalaiset tekoälyyhtiöt tuottavat tällä hetkellä videotuottomalleja nopeassa tahdissa, ja laatu on noussut merkittävästi viimeisen vuoden aikana.
Kilpailu ei rajoitu Kiinaan. Googlen Veo ja muut amerikkalaiset videomallit kilpailevat samasta markkinasta. Kiinan etuna on kuitenkin valtava sisämarkkina ja se, että kiinalaiset yhtiöt voivat hyödyntää TikTokin ja muiden alustojen massiivisia videoaineistoja harjoituksessa.
Alan asiantuntijat ovat kuvanneet kiinalaisten laboratorioiden tuotoksia todella tehokkaiksi. Teknologinen ero Yhdysvaltojen ja Kiinan välillä on kaventunut huomattavasti videontuotannon alalla. Joillain mittareilla kiinalaiset mallit ovat jo edellä.
Käytännön sovellukset ja rajoitukset
Tekoälyvideoiden laatu on parantunut nopeasti, mutta käytännön sovellukset ovat vielä rajallisia. 15 sekunnin klipit soveltuvat sosiaaliseen mediaan ja mainontaan, mutta pidemmän sisällön tuotanto vaatii edelleen merkittävää ihmistyötä.
Tyypillisiä ongelmia ovat edelleen epäjohdonmukaisuudet pitkissä leikkauksissa, hahmojen fyysinen jatkuvuus ja yksityiskohtien tarkkuus. Natiivin äänen lisääminen on kuitenkin merkittävä edistysaskel, sillä aiemmin ääni on pitänyt luoda erikseen.
Videomallien kehitys herättää myös kysymyksiä tekijänoikeuksista ja harjoitusaineistoista. ByteDance ei ole julkistanut tietoja siitä, millä aineistolla malli on harjoitettu. Tämä on erityisen merkittävä kysymys videoalalla, jossa olemassa olevan sisällön oikeudet ovat tiukasti suojattuja.
Seedance 2.0 on joka tapauksessa osoitus siitä, että tekoälypohjainen videontuotanto kehittyy nopeammin kuin monet ennakoivat. Seuraava merkittävä virstanpylväs on minuutin mittaisten, koherenttien videoiden tuottaminen, johon voi päästä jo tämän vuoden aikana.



