AI-modellen en platforms
Vidu brengt Q4 Preview van het volgende-generatie vlaggenschip AI‑videomodel uit

ShengShu Technology lanceerde Vidu Q4 Preview op 7 oktober 2026, de eerste openbare preview van haar volgende-generatie vlaggenschipmodel voor expressieve audio en video. De lanceringsprijs begint bij $0.014 per seconde, en de preview is beschikbaar via het webproduct en het API‑platform van Vidu.
Het model ondersteunt tot 15 afbeeldingsreferenties en tot drie audioreferenties, met output in 2K- of 4K-resolutie en 10‑bit kleurdiepte. Het bedrijf zei dat de preview gericht is op onafhankelijke makers, kleine studio’s en productieteams die zowel narratieve als commerciële projecten omvatten.
Karakterprestaties, Camerawerk en Visuele Effecten
ShengShu Technology zei dat Q4 Preview is gebouwd om gezichtsuitdrukkingen, emotie, lichaamsbeweging en stem beter op elkaar af te stemmen, wat resulteert in subtielere uitdrukkingen, duidelijkere emotionele interpretaties en natuurlijkere bewegingen. Tot drie referentie‑audioclips kunnen de stem van een karakter consistent houden en de levering emotioneel op één lijn brengen, terwijl tot 15 referentie‑afbeeldingen karakters, kleding, rekwisieten, producten en omgevingen binnen één creatieve opzet kunnen vastleggen. Het bedrijf verklaarde dat deze besturingen bedoeld zijn om visuele en vocale keuzes samen te houden gedurende een scène en om narratieve projecten meer bewuste controle over regie en uitvoering te geven.
De aankondiging beschrijft een strakkere coördinatie tussen camerabewegingen, overgangen en actie op het scherm: in snelle sequenties zoals gevechten en achtervolgingen is de camera ontworpen om coherenter met de actie mee te bewegen, en effecten zoals explosies, vuurwerk en deeltjes vloeien natuurlijker in hun omgeving. De 2K- en 4K-modi komen samen met verbeterde verlichting en algehele esthetiek, waarbij het bredere resolutiebereik zowel vroegtijdige creatieve tests als uiteindelijke output met hoge resolutie dient.
“Geavanceerde videomodellen moeten zich bewijzen buiten zorgvuldig geselecteerde demo’s. Elke verbetering in efficiëntie moet uiteindelijk creators de vrijheid geven om nog een poging te doen of nog een versie te maken,” zei Yihang Luo, mede-oprichter en CEO van ShengShu Technology, in de lanceringsaankondiging.
Prijsstelling en Toepassing
Uitvoeropties omvatten 540p, 720p, 1080p, 2K en 4K. ShengShu Technology zei dat wanneer uitvoerspecificaties en factureringscondities vergelijkbaar zijn, Q4 Preview tot vijf keer zoveel output levert voor hetzelfde budget. Het bedrijf koppelde de prijsstelling aan de realiteit van iteratie: het verkrijgen van een productieklaar shot vereist doorgaans meer dan één poging, of dat nu betekent dat een karakteruitdrukking wordt aangepast, alternatieve camerahoeken worden geëvalueerd of met verschillende openingen wordt geëxperimenteerd. Als voorbeelden van beoogde toepassingen verwees het naar reclameteams die creatieve concepten en openingssequenties afwegen, e‑commerceteams die variaties voor verschillende producten en doelgroepen bouwen, en filmmakers die prestaties, storyboards en tempo testen voordat ze verder investeren in productie.
De aankondiging merkt op dat de uiteindelijke prijsstelling, ondersteunde resoluties, beschikbaarheid van functies en gebruiksvoorwaarden kunnen variëren per abonnement en regio, met volledige prijsdetails en promotievoorwaarden gepubliceerd op de website van Vidu.
Productmodi en API‑specificaties
Vidu’s officiële productpagina vermeldt Image-to-Video- en Reference-to-Video-modi voor Q4: Image-to-Video animeert een enkele geüploade afbeelding vanuit een tekstprompt, terwijl Reference-to-Video één tot 15 afbeeldingsreferenties combineert met nul tot drie audioreferenties om onderwerpen en stemmen consistent te houden. Op de productpagina wordt Reference-to-Video vermeld met duur van 1 tot 16 seconden en Image-to-Video met 3 tot 16 seconden, en de hoogtepunten van de pagina omvatten een maximale resolutie van 4K en een maximale videolengte van 16 seconden. De output behoudt de oorspronkelijke beeldverhouding van het geüploade materiaal, en de pagina noemt AI series, reclame, sociale content en cinematoproductie als de scenario’s waarvoor het model is ontworpen.
Voor ontwikkelaars vermeldt de image-to-video documentation het model onder de naam viduq4-preview op POST https://api.vidu.com/ent/v2/img2video. De endpoint accepteert een enkel start‑frame‑beeld in png-, jpeg-, jpg- of webp‑formaat tot 50 MB, een prompt van maximaal 20.000 tekens, duur van 3 tot 16 seconden met een standaardwaarde van 5, en resoluties van 540p tot 4K met een standaardwaarde van 720p. Een audio‑parameter staat standaard op true, waardoor video met geluid wordt geproduceerd dat dialoog en geluidseffecten kan bevatten, en de documentatie stelt dat het model audio‑video‑synchronisatie en automatische camerawisseling ondersteunt.
De reference-to-video documentation vermeldt POST https://api.vidu.com/ent/v2/reference2video, die één tot 15 afbeeldingen en nul tot drie mp3‑audioreferenties van elk 3 tot 12 seconden accepteert, met beeldverhoudingopties van 1:1, 9:16, 16:9, 3:4 en 4:3 en een standaard van 16:9. Prompts kunnen tags voor de referentiesubjecten bevatten, en de documentatie stelt dat het model video kan genereren met referentie‑geluid, intelligente camerawisseling, consistentie over meerdere cameraposities en gelijktijdige audio‑ en video‑output. Geretourneerde creatie‑URL’s blijven 24 uur geldig.
Vidu brengt Q4 Preview uit vóór het volledige Q4‑model zodat makers het in echte projecten kunnen toepassen, en ShengShu Technology zei dat feedback over prestaties, creatieve controle en dagelijkse productiebehoeften de uiteindelijke release zal vormgeven.












