AI-mallit ja alustat
Vidu julkaisee Q4 Preview -seuraavan sukupolven lippulaiva‑AI‑videomallin

ShengShu Technology lanseerasi Vidu Q4 Preview -mallin 7. lokakuuta 2026, ensimmäisen julkisen ennakkoesittelyn seuraavan sukupolven lippulaivamallilleen, joka on suunniteltu ilmeikkääseen ääneen ja videoon. Julkaisuhinta alkaa 0,014 $ per sekunti, ja ennakko on saatavilla Vidu‑verkkotuotteen ja API‑alustan kautta.
Malli tukee enintään 15 kuvasidosta ja enintään kolmea äänisidosta, ja sen lähtö on 2K‑ tai 4K‑resoluutiolla sekä 10‑bitin värisyvyydellä. Yritys kertoi, että ennakko on suunnattu itsenäisille tekijöille, pienille studiolille ja tuotantotiimeille, jotka työskentelevät sekä kertomuksellisissa että kaupallisissa projekteissa.
Hahmon suorituskyky, kameratyö ja visuaaliset tehosteet
ShengShu Technology kertoi, että Q4 Preview on rakennettu paremmin koordinoimaan kasvonilmeitä, tunteita, kehon liikkeitä ja ääntä, mikä tuottaa hienovaraisempia ilmeitä, selkeämpiä tunnelukemia ja luonnollisempaa liikettä. Enintään kolme äänisidosta auttavat pitämään hahmon äänen johdonmukaisena ja sen esityksen tunnelinjassa, kun taas jopa 15 kuvasidosta voivat määrittää hahmot, asut, rekvisiitat, tuotteet ja ympäristöt yhdessä luovassa asetelmassa. Yritys sanoi, että nämä ohjaimet on suunniteltu pitämään visuaaliset ja äänelliset valinnat yhdessä koko kohtauksen ajan ja antamaan kertomuksellisille projekteille tarkempaa hallintaa lavastukseen ja esitykseen.
Ilmoituksessa kuvataan tiiviimpää koordinointia kameraliikkeiden, leikkausten ja ruudulla tapahtuvan toiminnan välillä: nopeissa sekvensseissä, kuten taisteluissa ja takaa‑ajoissa, kamera on suunniteltu pysymään toiminnan mukana johdonmukaisemmin, ja efektit kuten räjähdykset, ilotulitus ja hiukkaset sulautuvat luonnollisemmin ympäristöönsä. 2K‑ ja 4K‑tilat tulevat parempien valaistusten ja yleisen estetiikan kera, ja laajempi resoluutiovalikoima palvelee sekä varhaisen luovan testauksen että lopullisen korkean resoluution tuotannon tarpeita.
“Edistyneiden videomallien tulisi osoittaa kykynsä yli huolellisesti valittujen demoiden. Jokainen tehokkuuden parannus tulisi lopulta antaa tekijöille vapauden kokeilla vielä yhtä otosta tai tehdä vielä yksi versio,” sanoi Yihang Luo, ShengShu Technologyn perustaja ja toimitusjohtaja, lanseerausjulkaisussa.
Hinnoittelu ja suunniteltu käyttö
Lähtövaihtoehdot kattavat 540p, 720p, 1080p, 2K‑ ja 4K‑resoluutiot. ShengShu Technology kertoi, että kun lähtömääritykset ja laskutusehdot ovat verrattavissa, Q4 Preview tuottaa jopa viisi kertaa enemmän samaan budjettiin nähden. Yritys liitti hinnoittelun iteraation todellisuuksiin: tuotantokelpoinen otos vaatii tyypillisesti useamman kuin yhden yrityksen, olipa kyse sitten hahmon ilmeen säätämisestä, vaihtoehtoisten kamerakulmien arvioinnista tai erilaisten aloitusten kokeilemisesta. Esimerkkeinä suunnitellusta käytöstä se mainitsi mainostiimit, jotka arvioivat luovia konsepteja ja aloituskohtia, verkkokauppatiimit, jotka luovat variaatioita eri tuotteille ja yleisöille, sekä elokuvantekijät, jotka testaavat esityksiä, storyboardeja ja tempoa ennen lisäinvestointeja tuotantoon.
Ilmoitus huomauttaa, että lopullinen hinnoittelu, tuetut resoluutiot, ominaisuuksien saatavuus ja käyttöehdot voivat vaihdella suunnitelman ja alueen mukaan, ja täydelliset hintatiedot sekä kampanjakohdat on julkaistu Vidu‑verkkosivustolla.
Tuotemoodit ja API‑määritykset
Vidu‑virallinen tuotesivu listaa Q4:n Image-to-Video‑ ja Reference-to-Video‑tilat: Image-to-Video animoi yhden ladatun kuvan tekstikehotteesta, kun taas Reference-to-Video yhdistää yhdestä 15 kuva‑sidokseen nollasta kolmeen äänisidokseen pitääkseen kohteet ja äänet johdonmukaisina. Tuotesivulla Reference-to-Video on ilmoitettu kestoksi 1–16 sekuntia ja Image-to-Video 3–16 sekuntia, ja sivun kohokohdat sisältävät 4K‑maksimiresoluution ja 16 sekunnin maksimivideopituuden. Lähdöt säilyttävät ladatun materiaalin alkuperäisen kuvasuhteen, ja sivu nimeää AI‑sarjan, mainonnan, sosiaalisen sisällön ja elokuvatuotannon skenaarioiksi, joihin malli on suunniteltu.
Kehittäjille image-to-video-dokumentaatio listaa mallin nimellä viduq4-preview osoitteessa POST https://api.vidu.com/ent/v2/img2video. Päätepiste ottaa yhden aloitusruudun kuvan png-, jpeg-, jpg- tai webp-muodossa, enintään 50 MB, kehotteen, jonka enimmäispituus on 20 000 merkkiä, kestot 3–16 sekuntia oletuksena 5 sekuntia, ja resoluutiot 540p‑stä 4K:een oletuksena 720p. Ääni‑parametri on oletuksena true, jolloin video tuotetaan äänellä, joka voi sisältää dialogia ja äänitehosteita, ja dokumentaatiossa todetaan, että malli tukee ääni‑video‑synkronointia ja automaattista kameran vaihtoa.
reference-to-video-dokumentaatio listaa POST https://api.vidu.com/ent/v2/reference2video, joka hyväksyy 1–15 kuvaa ja nollasta kolmeen mp3‑äänisidokseen, joiden kesto on 3–12 sekuntia kukin, ja tarjoaa kuvasuhdevaihtoehdot 1:1, 9:16, 16:9, 3:4 ja 4:3 oletuksena 16:9. Kehotteet voivat sisältää tunnisteita referenssiaiheille, ja dokumentaatiossa todetaan, että malli tukee videon tuottamista referenssiäänellä, älykästä kameran vaihtoa, johdonmukaisuutta useiden kamerapositioiden välillä sekä äänen ja videon samanaikaista ulostuloa. Palautetut luonti‑URL‑osoitteet pysyvät voimassa 24 tunnin ajan.
Vidu julkaisee Q4 Preview -mallin ennen täyttä Q4‑mallia, jotta tekijät voivat käyttää sitä todellisissa projekteissa, ja ShengShu Technology kertoi, että palautteet suorituskyvystä, luovasta hallinnasta ja päivittäisistä tuotantotarpeista muokkaavat lopullista julkaisua.












