Finanzierung

ShengShu Technology erhält über 86 Millionen US-Dollar in Series-A+-Finanzierungsrunde, um die Grenzen von Multimodal-AI zu erweitern

mm
Unite.AI zu deinen bevorzugten Quellen auf Google hinzufügen

ShengShu Technology hat eine Series-A+-Finanzierungsrunde abgeschlossen, die über 600 Millionen RMB (etwa 86 Millionen US-Dollar) beträgt, was einen wichtigen Meilenstein für das Unternehmen darstellt, da es seine multimodalen Grundmodelltechnologien für digitale und physische Anwendungen skaliert. Die Runde wurde von Zhongguancun Science City und LINK-X CAPITAL gemeinsam geleitet, mit strategischer Beteiligung von Wondershare, Visual China Group und TRS. Mehrere bestehende Investoren haben ihre Verpflichtungen auch erhöht, was das anhaltende Vertrauen in ShengShus technische Richtung und kommerziellen Fortschritt unterstreicht.

Die neue Kapitalzuführung erfolgt zu einem Zeitpunkt, an dem multimodale KI-Systeme von experimentellen Werkzeugen zu Infrastrukturen übergehen, die die reale Produktion tragen. ShengShus Entwicklung spiegelt diesen Wandel wider, da Forschungsdurchbrüche zunehmend in eingesetzte Produkte umgesetzt werden, die in verschiedenen Branchen eingesetzt werden.

Von der frühen Forschung zu kommerziellen Modellen

ShengShu Technology war eines der ersten Teams weltweit, das sich auf multimodale generative Algorithmen als Kernforschungsrichtung konzentrierte. Im Jahr 2022 stellte das Unternehmen die U-ViT-Architektur vor, die eine technische Grundlage für Modelle schuf, die in der Lage sind, über Text, Bild und Video zu argumentieren. Dieser forschungsorientierte Ansatz bereitete den Weg für den Launch von Vidu im Sommer 2024.

Vidu trat mit einer Reference-to-Video-Fähigkeit auf den Markt, die über die herkömmliche Text-zu-Video- oder Bild-zu-Video-Generierung hinausging. Anstatt jedes Frame als isolierten Ausgang zu behandeln, wurde das System so konzipiert, dass es die Konsistenz mehrerer Entitäten über Szenen hinweg bewahrt, was eine langjährige Herausforderung in der kommerziellen Videogenerierung darstellt. Seit dem Launch hat ShengShu schnell iteriert und aufeinanderfolgende Versionen veröffentlicht, die das semantische Verständnis, die Bewegungsstabilität, die visuelle Kohärenz und die Inferenzgeschwindigkeit verbesserten.

Die neueste Veröffentlichung, Vidu Q3, spiegelt eine bewusste Konzentration auf Erzählungen wider. Das Modell unterstützt die synchronisierte Audio-Video-Generierung bis zu 16 Sekunden, native 1080p-Ausgabe, präzise Schnittübergänge, multilinguale Textrendering und multilinguale Ausgabe. Diese Fähigkeiten bringen das System näher an die Produktionsworkflows heran, anstatt an kurze experimentelle Clips.

Leistung, Geschwindigkeit und offene Innovation

ShengShu hat neben der Ausgabequalität auch die Effizienz als Wettbewerbsvorteil betont. Ende 2025 veröffentlichte das Unternehmen sein TurboDiffusion-Framework als Open Source, was die Latenzzeit der Videogenerierung erheblich reduzierte. Mit diesem Framework kann ein fünfsekündiges Video in weniger als zwei Sekunden auf einem einzelnen High-End-GPU generiert werden, was gegenüber früheren Ansätzen eine Verbesserung um Größenordnungen darstellt.

Diese Konzentration auf Geschwindigkeit ist nicht nur ein technischer Benchmark. Eine geringere Latenz und geringere Rechenanforderungen wirken sich direkt auf die Machbarkeit der Bereitstellung multimodaler Modelle im großen Maßstab aus, insbesondere für interaktive Anwendungen und Echtzeit-Creativtools. Indem ShengShu die Kosten und die Zeit reduziert, die für die Generierung hochwertiger Videos erforderlich sind, bringt es die multimodale KI näher an den täglichen Einsatz in professionellen Umgebungen.

Erweiterung der Akzeptanz in kreativen und Unternehmensmärkten

ShengShu hat um Vidu herum ein breites Produktökosystem aufgebaut, das Managed Services, SaaS-Angebote, Anwendungen und agentenbasierte Tools umfasst. Diese Produkte kommen nun Kreativen, Studios und Unternehmen in über 200 Ländern und Regionen zugute. Im Jahr 2025 verzeichnete das Unternehmen ein mehr als zehnfaches Wachstum bei Benutzern und Umsatz, was auf eine beschleunigte Akzeptanz hinweist.

In der Film- und Unterhaltungsbranche wird Vidu in der Animation, der Kurzfilmproduktion und den Feature-Workflows eingesetzt, mit Engagement von Content-Eignern, Tool-Anbietern und Produktionsstudios. Parallel dazu wenden Internet-Plattformen und Smart-Hardware-Unternehmen die Technologie auf die Erstellung von Marketing-Assets, interaktiven Inhalten und Produktinnovationen an.

Die Werbung und das Gaming sind weitere Bereiche, in denen Vidu Anklang findet. Marken und Agenturen nutzen Vidu, um die Videoproduktion für Kampagnen zu skalieren, während Spieleentwickler es für Werbeinhalte und Szenengenerierung einsetzen. International gewinnt die Plattform unter kreativen Tool-Entwicklern und Unternehmensanwendern an Boden, mit Anwendungen, die sich auf Bildung, Rundfunk und kulturellen Tourismus erstrecken.

Die breiteren Auswirkungen der Multimodal-AI

Der Fortschritt der multimodalen Grundmodelle hat Auswirkungen, die weit über die Videogenerierung hinausgehen. Durch die Integration von Text, Bild, Audio und Bewegung in einheitliche Systeme ermöglichen diese Modelle es Maschinen, den Kontext auf eine Weise zu interpretieren, die der menschlichen Wahrnehmung näher kommt. Für Branchen bedeutet dies schnellere Produktionszyklen, niedrigere Eintrittsbarrieren für hochwertigen Inhalt und neue Formen der Interaktion zwischen Menschen und Software.

Gleichzeitig wirft die Reife der Multimodal-AI wichtige Fragen über Authentizität, geistiges Eigentum und verantwortungsvolle Bereitstellung auf. Da generierte Videos immer realistischer werden, werden technische Sicherheitsvorkehrungen und Regulierungsrahmen unerlässlich sein, um das Vertrauen in digitale Medien aufrechtzuerhalten.

Auf lange Sicht werden multimodale Modelle wahrscheinlich nicht nur in digitalen Workflows, sondern auch in physischen Systemen, von Robotik und Simulation bis hin zu intelligenten Umgebungen, eine Rolle spielen. ShengShu Technology’s neueste Finanzierungsrunde positioniert es, um an diesem Übergang teilzunehmen, da die Multimodal-AI von einer kreativen Neuheit zu einer grundlegenden Schicht der Produktivität der nächsten Generation wird.

Antoine ist ein visionärer Leiter und Gründungspartner von Unite.AI, getrieben von einer unerschütterlichen Leidenschaft für die Gestaltung und Förderung der Zukunft von KI und Robotik. Als Serienunternehmer glaubt er, dass KI für die Gesellschaft so disruptiv sein wird wie Elektrizität, und er wird oft dabei erwischt, wie er über das Potenzial disruptiver Technologien und AGI schwärmt.

Als Futurist ist er darauf bedacht, zu erforschen, wie diese Innovationen unsere Welt prägen werden. Darüber hinaus ist er der Gründer von Securities.io, einer Plattform, die sich auf Investitionen in bahnbrechende Technologien konzentriert, die die Zukunft neu definieren und ganze Branchen umgestalten.