Finansiering

ShengShu Technology henter over 86 millioner dollar i serie A+-finansiering for å utvide grensene for multimodalt AI

mm
Legg til Unite.AI blant dine foretrukne kilder på Google

ShengShu Technology har fullført en serie A+-finansieringsrunde som overstiger 600 millioner RMB (omtrent 86 millioner dollar), og markerer et viktig milepæl for selskapet mens det skalerer sine multimodale grunnmodeller for både digitale og fysiske verden-applikasjoner. Runden ble ledet av Zhongguancun Science City og LINK-X CAPITAL, med strategisk deltakelse fra Wondershare, Visual China Group og TRS. Flere eksisterende investorer økte også sine forpliktelser, og understreker fortsatt tillit til ShengShus tekniske retning og kommersiell fremgang.

Den nye kapitalen ankommer i et øyeblikk når multimodale AI-systemer beveger seg fra eksperimentelle verktøy til infrastruktur som understøtter virkelige produksjonsmiljøer. ShengShus trajektorie reflekterer denne skiftet, med gjennombrudd i forskningen som stadig oftere oversettes til utviklede produkter som brukes over hele industrien.

Fra tidlig forskning til kommersielle modeller

ShengShu Technology var blant de første teamene globalt som fokuserte på multimodale generative algoritmer som en core forskningsretning. I 2022 introduserte selskapet U-ViT-arkitekturen, og hjalp med å etablere en teknisk grunn for modeller som kunne resonere over tekst, bilde og video. Denne forskningsbaserte tilnærmingen satte scenen for lanseringen av Vidu i midten av 2024.

Vidu kom inn på markedet med en Reference-to-Video-funksjon som gikk utenfor konvensjonelle tekst-til-video eller bilde-til-video-generering. I stedet for å behandle hver ramme som en isolert utgang, var systemet designet for å bevare multi-entitet-konsistens over scener, og løste en langvarig utfordring i kommersiell video-generering. Siden lanseringen har ShengShu iterert raskt, og har lansert påfølgende versjoner som forbedret semantisk forståelse, bevegelsesstabilitet, visuell kohesjon og inferenshastighet.

Den siste utgaven, Vidu Q3, reflekterer en bevisst fokus på fortelling. Modellen støtter synkronisert audio-video-generering opptil 16 sekunder, native 1080p-utgang, presise skift overgang, flerspråklig tekst-gjengivelse og flerspråklig utgang. Disse funksjonene plasserer systemet nærmere produksjonsarbeidsflyter, snarere enn kortform-eksperimentelle klipp.

Ytelse, hastighet og åpen innovasjon

Utenom utgangskvalitet har ShengShu betonet effektivitet som en konkurranseforskjell. I slutten av 2025 åpnet selskapet sin TurboDiffusion-ramme, en bevegelse som betydelig reduerte video-genereringsforsinkelse. Med denne rammen kan en fem-sekunders video genereres på under to sekunder på en enkelt høykvalitets-GPU, og representerer flere størrelsesordrer av forbedringer sammenlignet med tidligere tilnærming.

Dette fokuset på hastighet er ikke bare et teknisk benchmark. Lavere forsinkelse og beregningskrav påvirker direkte muligheten for å deployere multimodale modeller i stor skala, spesielt for interaktive applikasjoner og sanntids-kreative verktøy. Ved å redusere kostnaden og tiden som kreves for å generere høykvalitetsvideo, skyver ShengShu multimodalt AI nærmere hverdagsbruk i profesjonelle miljøer.

Utvidelse av adopsjon over kreative og bedriftsmarkeder

ShengShu har bygget en bredt produktøkosystem rundt Vidu, som omfatter managed services, SaaS-tilbud, applikasjoner og agent-baserte verktøy. Disse produktene betjener nå kreatører, studioer og bedrifter over mer enn 200 land og regioner. I 2025 rapporterte selskapet en mer enn ti-doblet vekst i både brukere og inntekter, og indikerer en akselererende adopsjon.

I film og underholdning brukes Vidu over animasjon, kortform-produksjon og feature-arbeidsflyter, med engasjement over innholdseiere, verktøyleverandører og produksjonsstudioer. Samtidig anvender internett-plattformene og smarte hardware-selskapene teknologien for å lage markedsføringsaktiver, interaktive innhold og produktinnovasjon.

Reklame og spill har også vært områder med tiltak. Merker og byråer bruker Vidu for å skalerer video-produksjon for kampanjer, mens spillutviklere deployer det for reklameinnhold og scene-generering. Internasjonalt vinner plattformen tiltak blant kreative verktøy-utviklere og bedriftsbrukere, med applikasjoner som strekker seg inn i utdanning, kringkasting og kulturturisme.

De bredere implikasjonene av multimodalt AI

Fremgangen i multimodale grunnmodeller har implikasjoner langt utenfor video-oppsett. Ved å integrere tekst, bilde, lyd og bevegelse i enhetlige systemer, muliggjør disse modellene maskiner å tolke kontekst på en måte som ligner mer på menneskelig persepsjon. For industrier betyr dette raskere produksjons-sykluser, lavere barrierer for inngang til høykvalitetsinnhold og nye former for interaksjon mellom mennesker og programvare.

Samtidig reiser moden av multimodalt AI viktige spørsmål omkring autentisitet, immaterielle rettigheter og ansvarlig deployering. Ettersom generert video blir stadig mer realistisk, vil tekniske sikkerhetstiltak og styringsrammer være essensielle for å opprettholde tillit til digital media.

I fremtiden er det sannsynlig at multimodale modeller vil spille en rolle ikke bare i digitale arbeidsflyter, men også i fysiske verden-systemer, fra robotikk og simulering til smarte miljøer. ShengShu Technology’s siste finansieringsrunde stiller dem i stand til å delta i denne overgangen, ettersom multimodalt AI skifter fra en kreativ nyskaping til en grunnleggende lag av neste-generasjons produktivitet.

Antoine er en visjonær leder og medgrunnlegger av Unite.AI, drevet av en urokkelig lidenskap for å forme og fremme fremtiden for AI og robotikk. En serial entrepreneur, han tror at AI vil være like disruptiv for samfunnet som elektrisitet, og blir ofte fanget i å prise potensialet for disruptive teknologier og AGI.

Som en futurist, er han dedikert til å utforske hvordan disse innovasjonene vil forme vår verden. I tillegg er han grunnlegger av Securities.io, en plattform som fokuserer på å investere i banebrytende teknologier som definerer fremtiden og omformer hele sektorer.