Finansiering

ShengShu Technology hæver over 586 millioner kroner i serie A+-finansiering for at udvide grænserne for multimodal AI

mm
Føj Unite.AI til dine foretrukne kilder på Google

ShengShu Technology har gennemført en serie A+-finansieringsrunde på over 600 millioner RMB (cirka 586 millioner kroner), hvilket markerer en stor milepæl for virksomheden, da den skalerer sine multimodale grundmodeller til både digitale og fysisk-verdenens anvendelser. Runden blev co-ledet af Zhongguancun Science City og LINK-X CAPITAL, med strategisk deltagelse fra Wondershare, Visual China Group og TRS. Flere eksisterende investorer øgede også deres engagement, hvilket understreger den fortsatte tillid til ShengShus tekniske retning og kommercielle fremgang.

Den nye kapital ankommer i et øjeblik, hvor multimodale AI-systemer bevæger sig fra eksperimentelle værktøjer til infrastruktur, der understøtter rigtige produktionsmiljøer. ShengShus trajektori reflekterer denne ændring, med gennembrud i forskningen, der mere og mere oversættes til udviklede produkter, der anvendes på tværs af industrier.

Fra tidlig forskning til kommercielle modeller

ShengShu Technology var blandt de første hold globalt, der fokuserede på multimodale generative algoritmer som en kerneforskningsretning. I 2022 introducerede virksomheden U-ViT-arkitekturen, hvilket hjalp med at etablere en teknisk grundlag for modeller, der kan resonere på tværs af tekst, billeder og video. Denne forskningsbaserede tilgang lagde grunden for lanceringen af Vidu i midten af 2024.

Vidu trådte ind på markedet med en Reference-to-Video-funktion, der gik ud over konventionel tekst-til-video eller billede-til-video-generering. I stedet for at behandle hver ramme som en isoleret output, var systemet designed til at bevare multi-entitets-konsistens på tværs af scener, hvilket adresse en langvarig udfordring i kommerciel video-generering. Siden lanceringen har ShengShu itereret hurtigt, udgivet succesive versioner, der forbedrede semantisk forståelse, bevægelsesstabilitet, visuel kohærens og inferenshastighed.

Den seneste udgave, Vidu Q3, reflekterer en bevidst fokus på fortælling. Modellen understøtter synkroniseret audio-video-generering op til 16 sekunder, native 1080p-udgang, præcise skift mellem scener, multilingval tekst-rendering og multi-sprog-udgang. Disse funktioner placerer systemet tættere på produktions-workflows end kortform-eksperimentelle klip.

Ydelse, hastighed og åben innovation

Ud over output-kvalitet har ShengShu lagt vægt på effektivitet som en konkurrencemæssig differentiator. I slutningen af 2025 åbnede virksomheden sin TurboDiffusion-rammeværk, en bevægelse, der betydeligt reducerede video-genererings-latence. Med dette rammeværk kan en fem-sekunders-video genereres på under to sekunder på en enkelt højendeholdende GPU, hvilket repræsenterer ordrer-af-størrelses-gain i forhold til tidligere tilgange.

Denne fokus på hastighed er ikke kun et teknisk benchmark. Lavere latence og beregningskrav påvirker direkte muligheden for at udvikle multimodale modeller i stor skala, især for interaktive anvendelser og realtids-kreative værktøjer. Ved at reducere omkostningerne og tiden, der kræves for at generere højkvalitets-video, skyder ShengShu multimodal AI tættere på hverdagsbrug i professionelle miljøer.

Udvidelse af anvendelse på tværs af kreative og virksomheds-markeder

ShengShu har bygget et bredt produktsystem omkring Vidu, der omfatter managed services, SaaS-tilbud, programmer og agent-baserede værktøjer. Disse produkter betjener nu skabere, studier og virksomheder på tværs af over 200 lande og regioner. I 2025 rapporterede virksomheden en mere end ti-dobling af både brugere og omsætning, hvilket indikerer en accelererende anvendelse.

I film- og underholdningsindustrien anvendes Vidu på tværs af animation, kortform-produktion og feature-workflows, med engagement på tværs af indholdsejere, værktøjsudbydere og produktionsstudier. Samtidig anvender internet-platforme og smarte hardware-virksomheder teknologien til markedsførings-aktiver, interaktive indhold og produkt-innovation.

Reklame og spil er også nye områder med trækkraft. Mærker og agenturer anvender Vidu til at skale video-produktion for kampagner, mens spiludviklere anvender det til reklame-indhold og scene-generering. Internationalt er platformen ved at vinde trækkraft blandt kreative værktøjsudviklere og virksomhedsbrugere, med anvendelser, der strækker sig ind i uddannelse, broadcasting og kulturel turisme.

De bredere implikationer af multimodal AI

Fremgangen i multimodale grundmodeller har implikationer langt ud over video-skabelse. Ved at integrere tekst, billeder, lyd og bevægelse i samlede systemer, gør disse modeller det muligt for maskiner at fortolke kontekst på en måde, der minder mere om menneskeligt perception. For industrier betyder dette hurtigere produktionscykler, lavere barrierer for adgang til højkvalitets-indhold og nye former for interaktion mellem mennesker og software.

Samtidig rejser modningen af multimodal AI vigtige spørgsmål omkring ægthed, immaterielle rettigheder og ansvarlig udvikling. Da genereret video bliver mere og mere realistisk, vil tekniske sikkerhedsforanstaltninger og styre-rammer være essentielle for at opretholde tillid til digitale medier.

Set fremad er multimodale modeller sandsynligvis til at spille en rolle, ikke kun i digitale workflows, men også i fysisk-verdenens systemer, fra robotteknologi og simulation til smarte miljøer. ShengShu Technologies seneste finansieringsrunde positionerer det til at deltage i denne overgang, da multimodal AI skifter fra en kreativ nyskabelse til et grundlæggende lag af næste-generations-produktivitet.

Antoine er en visionær leder og medstifter af Unite.AI, drevet af en urokkelig passion for at forme og fremme fremtiden for AI og robotteknologi. En serieiværksætter, han tror, at AI vil være lige så omvæltende for samfundet som elektricitet, og han bliver ofte fanget i at tale om potentialet for omvæltende teknologier og AGI.

Som en futurist, er han dedikeret til at udforske, hvordan disse innovationer vil forme vores verden. Derudover er han grundlægger af Securities.io, en platform, der fokuserer på at investere i skarp teknologi, der gendefinerer fremtiden og omformer hele sektorer.