Rahoitus
ShengShu Teknologia kerää yli 86 miljoonaa dollaria A+ -sarjan rahoituskierroksella monimodaalisen älytekniikan rajojen venyttämiseksi

ShengShu Teknologia on suorittanut A+ -sarjan rahoituskierroksen, joka ylittää 600 miljoonan RMB:n (noin 86 miljoonan Yhdysvaltain dollarin) merkittävän merkkipaaluksen yritykselle, joka laajentaa monimodaalisia perusmalleja sekä digitaalisiin että fyysisten maailman sovelluksiin. Kierroksen johtajat olivat Zhongguancun Science City ja LINK-X CAPITAL, ja strategiseen osallistumiseen osallistuivat Wondershare, Visual China Group ja TRS. Useat olemassa olevat sijoittajat myös lisäsivät sitoutumistaan, korostaen jatkuvaa luottamusta ShengShun tekniseen suuntaan ja kaupalliseen edistymiseen.
Uusi pääoma saapuu hetkellä, jolloin monimodaaliset älytekniikkajärjestelmät siirtyvät kokeellisista työkaluista tuotantoon, joka perustuu todellisiin tuotantoon. ShengShun ura heijastaa sitä muutosta, jossa tutkimusläpimurrot ovat yhä useammin käännetty käyttöön otetuiksi tuotteiksi, joita käytetään eri teollisuusaloilla.
Varhaisesta tutkimuksesta kaupallisiin malleihin
ShengShu Teknologia oli yksi ensimmäisistä tiimeistä maailmanlaajuisesti, joka keskittyi monimodaalisiin generatiivisiin algoritmeihin keskeisenä tutkimussuunnana. Vuonna 2022 yritys esitteli U-ViT -arkkitehtuurin, joka auttoi perustamaan teknisen perustan malleille, jotka voivat tehdä päätelmiä tekstistä, kuvasta ja videosta. Tämä tutkimuksen ensisijainen lähestymistapa loi pohjan Vidu:n julkaisulle kesäkuussa 2024.
Vidu tuli markkinoille Viite-Video -ominaisuudella, joka siirtyi perinteisestä teksti-video- tai kuva-video -luomista. Sen sijaan, että jokainen kehys kohdeltiin erillisenä tuloksena, järjestelmä suunniteltiin säilyttämään monienkohteiden johdonmukaisuutta eri kohtauksissa, mikä on ollut pitkään olemassa oleva haaste kaupallisen videon luomisessa. Julkaisun jälkeen ShengShu on iteroinut nopeasti, julkaisemalla peräkkäisiä versioita, jotka paransivat semanttista ymmärtämistä, liikkeen vakautta, visuaalista yhtenäisyyttä ja johtuvuuden nopeutta.
Viimeisin julkaisu, Vidu Q3, heijastaa tietoista painotusta kerrontaan. Malli tukee synkronoituja audio-video -luomisia jopa 16 sekunnin ajaksi, alkuperäistä 1080p -tulostetta, tarkkaa leikkausta, monikielisiä tekstien renderöintiä ja monikielistä tulostetta. Nämä ominaisuudet asettavat järjestelmän lähemmäs tuotantoprosesseja, eikä niinkään lyhytaikaisia kokeellisia klippejä.
Suorituskyky, nopeus ja avoin innovaatio
ShengShun lisäksi laadun, on yritys korostanut tehokkuutta kilpailukykyisenä erottimena. Loppuvuonna 2025 yritys avasi TurboDiffusion -kehyksensä, jolla merkittävästi laskettiin videon luomisen viive. Tämän kehyksen avulla viiden sekunnin video voidaan luoda alle kahdessa sekunnissa yhdellä korkean suorituskyvyn GPU:lla, mikä edustaa useita kertaluokkia suurempia parannuksia aiempiin lähestymistapoihin verrattuna.
Tämä nopeuden painopiste ei ole ainoastaan tekninen mittapuuluokka. Alempi viive ja laskennan vaatimukset vaikuttavat suoraan monimodaalisten mallien käyttöönoton toteuttamiskelpoisuuteen, erityisesti interaktiivisissa sovelluksissa ja reaaliaikaisissa luovissa työkaluissa. Vähentämällä korkealaatuisen videon luomiseen tarvittavaa aikaa ja kustannuksia, ShengShu vie monimodaalista älytekniikkaa lähemmäs arkipäivän käyttöä ammattimaisissa ympäristöissä.
<h2-Laajentuminen luovien ja yritysmarkkinoiden yli
ShengShu on rakentanut laajan tuoteekosysteemin Vidu:n ympärille, joka kattaa hallitut palvelut, SaaS -tarjontaa, sovellukset ja agenttipohjaiset työkalut. Nämä tuotteet palvelevat luovia, studioita ja yrityksiä yli 200 maassa ja alueella. Vuonna 2025 yritys ilmoitti yli kymmenkertaista kasvua sekä käyttäjien että tuottojen osalta, mikä osoittaa nopeutuvaa omaksumista.
Elokuva- ja viihdeala, Vidu käytetään animaatioissa, lyhytelokuva- ja pitkien elokuvien työprosesseissa, ja sitoutuminen kattaa sisällön omistajat, työkalujen tarjoajat ja tuotantostudiot. Samanaikaisesti internet-alustat ja älykkäät laitteet soveltavat teknologiaa markkinointivarojen luomiseen, interaktiiviseen sisältöön ja tuoteinnovaatioon.
Mainonta ja pelit ovat nousseet lisäalueiksi. Brändit ja mainostoimistot käyttävät Vidu:a videotuotannon skaalaukseen kampanjoissa, kun taas pelinkehittäjät käyttävät sitä mainossisällön ja kohtauksen luomiseen. Kansainvälisesti, alusta saa jalansijaa luovien työkalujen kehittäjien ja yritysten keskuudessa, ja sovellukset ulottuvat koulutukseen, lähetykseen ja kulttuurimatkailuun.
Monimodaalisen älytekniikan laajemmat vaikutukset
Monimodaalisten perusmallien edistyminen on vaikutuksia, jotka ulottuvat videon luomisen ulkopuolelle. Tekstien, kuvien, äänen ja liikkeen yhdistäminen yhdenmukaisiin järjestelmiin mahdollistaa koneiden tulkita asiayhteyksiä tavalla, joka muistuttaa enemmän ihmisen havainnointia. Teollisuuden näkökulmasta tämä tarkoittaa nopeampia tuotantokierroksia, matalampia kynnyksiä korkealaatuisen sisällön tuottamiseen ja uusia muotoja ihmisen ja ohjelmiston väliselle vuorovaikutukselle.
Samaan aikaan monimodaalisen älytekniikan kypsyminen herättää tärkeitä kysymyksiä aitous, immateriaalioikeuksien ja vastuullisen käytön ympärillä. Koska luodut videot muuttuvat yhä realistisimmiksi, tekniset turvallisuusjärjestelmät ja hallintorakenteet ovat olennaisia digitaalisen median luottamuksen ylläpitämiseksi.
Eteenpäin katsoen monimodaaliset mallit todennäköisesti tulevat pelaamaan roolia ei ainoastaan digitaalisissa työprosesseissa, vaan myös fyysisten maailman järjestelmissä, kuten robotti- ja simulaatioteknologiassa sekä älykkäissä ympäristöissä. ShengShu Teknologian uusin rahoituskierros asemoi sen osallistumaan tähän siirtymään, kun monimodaalinen älytekniikka siirtyy luovasta uutuudesta seuraavan sukupolven tuottavuuden perustavanlaatuiseksi kerroksiksi.












