Modele și platforme AI
Vidu lansează Q4 Preview al modelului video AI emblematic de generație următoare

ShengShu Technology a lansat Vidu Q4 Preview pe 7 octombrie 2026, prima previzualizare publică a modelului său emblematic de generație următoare pentru audio și video expresiv. Prețul de lansare începe de la $0.014 pe secundă, iar previzualizarea este disponibilă prin produsul web și platforma API a Vidu.
Modelul acceptă până la 15 referințe de imagini și până la trei referințe audio, cu ieșire la rezoluție 2K sau 4K și adâncime de culoare de 10 biți. Compania a declarat că previzualizarea vizează creatorii independenți, studiourile mici și echipele de producție care acoperă atât lucrări narative, cât și comerciale.
Performanța personajelor, munca camerei și efectele vizuale
ShengShu Technology a declarat că Q4 Preview este conceput pentru a coordona mai bine expresia facială, emoția, mișcarea corpului și vocea, oferind expresii mai subtile, interpretări emoționale mai clare și mișcări mai naturale. Până la trei clipuri audio de referință ajută la menținerea unei voci constante a personajului și a livrării sale aliniate emoțional, în timp ce până la 15 imagini de referință pot fixa personajele, vestimentația, recuzita, produsele și mediile într-o singură configurare creativă. Compania a precizat că aceste controale au scopul de a menține alegerile vizuale și vocale împreună pe parcursul unei scene și de a oferi proiectelor narative un control mai deliberat asupra decorului și performanței.
Anunțul descrie o coordonare mai strânsă între mișcările camerei, tăieturile și acțiunea de pe ecran: în secvențe rapide, cum ar fi luptele și urmărirea, camera este proiectată să rămână aliniată cu acțiunea într-un mod mai coerent, iar efecte precum explozii, artificii și particule se îmbină mai natural cu mediul înconjurător. Modurile 2K și 4K sosesc alături de iluminare îmbunătățită și estetică generală, gama extinsă de rezoluții servind atât testele creative din stadiile incipiente, cât și ieșirea finală de înaltă rezoluție.
“Modelele video avansate ar trebui să se dovedească dincolo de demonstrațiile atent selectate. Fiecare îmbunătățire a eficienței ar trebui în final să ofere creatorilor libertatea de a încerca o altă încercare sau de a realiza o versiune suplimentară,” a declarat Yihang Luo, co-fondator și CEO al ShengShu Technology, în anunțul de lansare.
Prețuri și utilizare prevăzută
Opțiunile de ieșire acoperă 540p, 720p, 1080p, 2K și 4K. ShengShu Technology a declarat că, atunci când specificațiile de ieșire și condițiile de facturare sunt comparabile, Q4 Preview oferă până la de cinci ori mai multă producție pentru același buget. Compania a legat prețul de realitățile iterării: obținerea unei imagini gata de producție necesită de obicei mai mult de o încercare, fie că înseamnă ajustarea expresiei unui personaj, evaluarea unghiurilor alternative ale camerei sau experimentarea cu diferite deschideri. Ca exemple de utilizare prevăzută, a menționat echipele de publicitate care evaluează concepte creative și secvențe de deschidere, echipele de comerț electronic care creează variații pentru produse și audiențe diferite și realizatorii de filme care testează performanțe, storyboard-uri și ritmul înainte de a se angaja în producție.
Anunțul menționează că prețurile finale, rezoluțiile suportate, disponibilitatea funcțiilor și termenii de utilizare pot varia în funcție de plan și regiune, iar detaliile complete ale prețurilor și termenii promoționali sunt publicate pe site-ul Vidu.
Moduri de produs și specificații API
Pagina oficială a produsului a Vidu enumeră modurile Image-to-Video și Reference-to-Video pentru Q4: Image-to-Video animează o singură imagine încărcată dintr-un prompt text, în timp ce Reference-to-Video combină de la una la 15 referințe de imagini cu zero până la trei referințe audio pentru a menține subiectele și vocile consecvente. Pe pagina produsului, Reference-to-Video este listat cu durate de la 1 la 16 secunde, iar Image-to-Video cu 3 la 16 secunde, iar evidențierile paginii includ o rezoluție maximă de 4K și o lungime maximă a videoclipului de 16 secunde. Ieșirea păstrează raportul de aspect original al materialului încărcat, iar pagina numește AI series, advertising, social content și cinematic production ca scenarii pentru care modelul este conceput.
Pentru dezvoltatori, documentația image-to-video enumeră modelul sub numele viduq4-preview la POST https://api.vidu.com/ent/v2/img2video. Endpointul acceptă o singură imagine de cadru inițial în format png, jpeg, jpg sau webp de până la 50 MB, un prompt de până la 20 000 de caractere, durate de la 3 la 16 secunde cu o valoare implicită de 5 și rezoluții de la 540p până la 4K cu o rezoluție implicită de 720p. Un parametru audio are valoarea implicită true, producând video cu sunet care poate include dialog și efecte sonore, iar documentația afirmă că modelul suportă sincronizare audio-video și comutare automată a camerei.
documentația reference-to-video enumeratează POST https://api.vidu.com/ent/v2/reference2video, care acceptă de la una la 15 imagini și de la zero la trei referințe audio mp3 de la 3 la 12 secunde fiecare, cu opțiuni de raport de aspect 1:1, 9:16, 16:9, 3:4 și 4:3 și o valoare implicită de 16:9. Prompturile pot include etichete pentru subiectele de referință, iar documentația afirmă că modelul suportă generarea de video cu sunet de referință, comutare inteligentă a camerei, coerență între multiple poziții ale camerei și ieșire simultană audio și video. URL-urile de creație returnate rămân valabile timp de 24 de ore.
Vidu lansează Q4 Preview înainte de modelul complet Q4, pentru ca creatorii să îl poată utiliza în proiecte reale, iar ShengShu Technology a declarat că feedback-ul privind performanța, controlul creativ și nevoile de producție de zi cu zi va modela versiunea finală.












