Finanțare
ShengShu Technology atrage peste 86 de milioane de dolari în runda de finanțare Seria A+ pentru a extinde granițele inteligenței artificiale multimodale

ShengShu Technology a finalizat o rundă de finanțare Seria A+ care depășește 600 de milioane de RMB (aproximativ 86 de milioane de dolari americani), marcând un moment important pentru companie pe măsură ce își extinde modelele de bază multimodale pentru aplicații atât digitale, cât și fizice. Runda a fost condusă de Zhongguancun Science City și LINK-X CAPITAL, cu participarea strategică a Wondershare, Visual China Group și TRS. Mai mulți investitori existenți au crescut, de asemenea, angajamentul lor, subliniind încrederea continuă în direcția tehnică și progresul comercial al ShengShu.
Noul capital sosește într-un moment în care sistemele de inteligență artificială multimodală trec de la unelte experimentale la infrastructura care stă la baza producției din lumea reală. Traiectoria ShengShu reflectă această schimbare, cu înaintări în cercetare care se traduc din ce în ce mai mult în produse implementate utilizate în diverse industrii.
De la cercetarea timpurie la modele comerciale
ShengShu Technology a fost printre primele echipe la nivel global care s-au concentrat pe algoritmi generativi multimodali ca direcție principală de cercetare. În 2022, compania a introdus arhitectura U-ViT, ajutând la stabilirea unei fundații tehnice pentru modele capabile să raționeze pe baza textului, imaginilor și videourilor. Acest abordaj axat pe cercetare a pregătit terenul pentru lansarea Vidu în mijlocul anului 2024.
Vidu a intrat pe piață cu o capacitate de referință la video care a depășit generarea convențională de text la video sau imagine la video. În loc de a trata fiecare cadru ca o ieșire izolată, sistemul a fost proiectat pentru a păstra consistența multi-entitate pe scenă, abordând o provocare de lungă durată în generarea de video comercială. De la lansare, ShengShu a iterat rapid, lansând versiuni succesive care au îmbunătățit înțelegerea semantică, stabilitatea mișcării, coerența vizuală și viteza de inferență.
Ultima lansare, Vidu Q3, reflectă o focalizare deliberată pe povestire. Modelul susține generarea sincronizată de audio și video până la 16 secunde, ieșire nativă 1080p, tranziții precise de cadru, renderizare de text multilingv și ieșire multilingvă. Aceste capacități plasează sistemul mai aproape de fluxurile de producție, mai degrabă decât de clipuri experimentale scurte.
Performanță, viteză și inovare deschisă
Dincolo de calitatea ieșirii, ShengShu a subliniat eficiența ca un diferențiator competitiv. La sfârșitul anului 2025, compania a deschis codul sursă al framework-ului TurboDiffusion, o mișcare care a redus semnificativ latența generării de video. Cu acest cadru, un video de cinci secunde poate fi generat în mai puțin de două secunde pe un singur GPU de înaltă performanță, reprezentând câștiguri de ordinul de mărime față de abordările anterioare.
Acest accent pe viteză nu este doar un benchmark tehnic. Latența și cerințele de calcul mai mici afectează direct fezabilitatea implementării modelelor multimodale la scară, în special pentru aplicații interactive și unelte creative în timp real. Prin reducerea costului și timpului necesar pentru generarea de video de înaltă calitate, ShengShu împinge inteligența artificială multimodală mai aproape de utilizarea de zi cu zi în medii profesionale.
Extinderea adoptării pe piața creativă și de întreprinderi
ShengShu a construit un ecosistem de produse larg în jurul Vidu, cuprinzând servicii gestionate, oferte SaaS, aplicații și unelte bazate pe agenți. Aceste produse deservesc acum creatori, studiouri și întreprinderi din peste 200 de țări și regiuni. În 2025, compania a raportat o creștere de peste zece ori a numărului de utilizatori și a veniturilor, indicând o adoptare accelerată.
În industria filmului și a divertismentului, Vidu este utilizat în animație, producție de scurtmetraj și fluxuri de lucru pentru lungmetraje, cu implicare în rândul deținătorilor de conținut, furnizorilor de unelte și studiourilor de producție. În paralel, platformele de internet și companiile de hardware inteligent aplică tehnologia pentru crearea de active de marketing, conținut interactiv și inovare de produs.
Publicitatea și jocurile au apărut ca domenii suplimentare de atracție. Mărcile și agențiile utilizează Vidu pentru a scala producția de video pentru campanii, în timp ce dezvoltatorii de jocuri îl utilizează pentru conținut publicitar și generare de scene. La nivel internațional, platforma câștigă teren printre dezvoltatorii de unelte creative și utilizatorii din întreprinderi, cu aplicații care se extind în educație, radiodifuziune și turism cultural.
Implicațiile mai largi ale inteligenței artificiale multimodale
Progresul modelelor de bază multimodale are implicații care depășesc cu mult crearea de video. Prin integrarea textului, imaginilor, audio și mișcării în sisteme unificate, aceste modele permit mașinilor să interpreteze contextul într-un mod care se apropie mai mult de percepția umană. Pentru industrii, acest lucru înseamnă cicluri de producție mai rapide, bariere de intrare mai mici pentru conținut de înaltă calitate și forme noi de interacțiune între oameni și software.
În același timp, maturizarea inteligenței artificiale multimodale ridică întrebări importante despre autenticitate, proprietate intelectuală și implementare responsabilă. Pe măsură ce videoul generat devine din ce în ce mai realist, măsuri tehnice de securitate și cadre de guvernanță vor fi esențiale pentru menținerea încrederii în mass-media digitală.
Privind spre viitor, modelele multimodale sunt susceptibile de a juca un rol nu numai în fluxurile de lucru digitale, ci și în sistemele fizice, de la robotică și simulare la medii inteligente. Runda recentă de finanțare a ShengShu Technology o poziționează pentru a participa la această tranziție, pe măsură ce inteligența artificială multimodală trece de la o noutate creativă la un strat fundamental al productivității de generație următoare.












