資金調達

ShengShu Technology、シリーズA+ラウンドで86億円超を調達、多モーダルAIの境界を拡大

mm
Unite.AI を Google の優先ソースに追加

ShengShu Technologyは、シリーズA+ラウンドで約600億円(約86億円相当)を調達し、デジタルワークフローと物理システムの両方で多モーダル基礎モデルを拡大するための重要なマイルストーンを達成しました。このラウンドは、Zhongguancun Science CityとLINK-X CAPITALが共同で牽引し、Wondershare、Visual China Group、TRSが戦略的に参加しました。既存の投資家もコミットメントを増やし、ShengShuの技術的な方向性と商業的な進歩に対する信頼を示しました。

新しい資本は、多モーダルAIシステムが実験ツールから実際の生産を支えるインフラストラクチャーへの移行を遂げている時期に到来しました。ShengShuの軌道はこの変化を反映しており、研究のブレークスルーがますますデプロイされた製品に変わり、業界全体で使用されています。

初期研究から商用グレードモデルの開発

ShengShu Technologyは、世界で最初に多モーダル生成アルゴリズムに焦点を当てたチームの一つでした。2022年、会社はU-ViTアーキテクチャを導入し、テキスト、画像、ビデオをまたいだ推論が可能なモデルを技術的に基礎づけることができました。この研究第一のアプローチにより、2024年中期にViduを立ち上げることができました。

Viduは、従来のテキストからビデオや画像への生成を超えた、リファレンスからビデオへの機能で市場に参入しました。各フレームを個別の出力として扱うのではなく、システムはシーン全体にわたる多エンティティの一貫性を保持するように設計され、商業ビデオ生成における長年の課題に対処しました。立ち上げ以降、ShengShuは急速に進化し、意味の理解、モーションの安定性、視覚的な一貫性、推論速度を改善したバージョンをリリースしました。

最新のリリースであるVidu Q3は、物語の創作に意図的に焦点を当てています。モデルは、16秒までの同期されたオーディオビデオ生成、ネイティブの1080p出力、正確なショット遷移、多言語テキストレンダリング、多言語出力をサポートします。これらの機能により、システムは生産ワークフローに近づき、短い実験的なクリップではなく、実用的なツールになっています。

パフォーマンス、スピード、オープンイノベーション

出力の品質だけでなく、ShengShuは効率を競争的な差別化要因として強調しています。2025年後期、会社はTurboDiffusionフレームワークをオープンソース化し、ビデオ生成の待ち時間を大幅に短縮しました。このフレームワークにより、5秒のビデオを1つの高性能GPUで2秒未満で生成できます。以前のアプローチと比較して、数桁の改善を達成しました。

スピードへの焦点は、技術的な基準だけではありません。待ち時間と計算要件の低減は、特にインタラクティブなアプリケーションやリアルタイムのクリエイティブツールの場合、多モーダルモデルを大規模にデプロイするための実現可能性に直接影響します。ShengShuは、高品質のビデオを生成するために必要な時間とコストを削減することで、多モーダルAIを日常のプロフェッショナル環境での使用に近づけています。

クリエイティブおよびエンタープライズ市場への展開

ShengShuは、Viduを中心とした幅広い製品エコシステムを構築しました。管理サービス、SaaSオファリング、アプリケーション、エージェントベースのツールなど、200以上の国や地域のクリエイター、スタジオ、エンタープライズにサービスを提供しています。2025年、会社はユーザーと収益において10倍以上の成長を報告し、採用の加速を示しています。

映画やエンターテインメント業界では、Viduはアニメーション、短編制作、フィーチャー制作のワークフローで使用されています。コンテンツ所有者、ツールプロバイダー、制作スタジオなど、幅広い関係者が関与しています。同時に、インターネットプラットフォームやスマートハードウェア会社は、マーケティング資産の作成、インタラクティブコンテンツ、製品イノベーションにテクノロジーを適用しています。

広告やゲームも新たな分野として浮上しています。ブランドやエージェンシーは、キャンペーン用のビデオ制作を拡大するためにViduを使用し、ゲーム開発者は広告コンテンツやシーン生成にデプロイしています。国際的に、プラットフォームはクリエイティブツール開発者やエンタープライズユーザーの中で支持を拡大し、教育、放送、文化ツーリズムへの応用が拡大しています。

多モーダルAIのより広い影響

多モーダル基礎モデルの進歩は、ビデオ作成を超えた広範な影響を及ぼします。テキスト、画像、オーディオ、モーションを統一されたシステムに統合することで、これらのモデルは人間の認識に近い方法でコンテキストを解釈できるようになります。業界にとって、これは生産サイクルの高速化、ハイクオリティコンテンツへの参入障壁の低減、新しい人間とソフトウェアのインタラクション形式を意味します。

同時に、多モーダルAIの成熟は、真実性、知的財産、責任ある展開に関する重要な質問を提起します。生成されたビデオがますますリアルなものになるにつれて、デジタルメディアの信頼を維持するために技術的なセーフガードとガバナンスフレームワークが不可欠になります。

今後、多モーダルモデルは、デジタルワークフローだけでなく、ロボティクス、シミュレーション、スマート環境などの物理システムでも役割を果たす可能性があります。ShengShu Technologyの最新の資金調達ラウンドは、多モーダルAIがクリエイティブな新規性から次世代の生産性の基礎層への移行において、会社が参加できるように位置付けられています。

アントワーヌは、Unite.AIのビジョナリーレーダーであり共同創設者です。彼は、AIとロボティクスの未来を形作り、推進するための不屈の情熱に駆り立てられています。シリアルエントレプレナーである彼は、AIが電気と同様に社会に大きな変革をもたらすと信じており、破壊的な技術とAGIの可能性について語ることがよくあります。

彼はフューチャリストとして、これらのイノベーションが私たちの世界をどのように形作るかを探求することに尽力しています。さらに、彼はSecurities.ioの創設者であり、未来を再定義し、全セクターを再構築する最先端技術への投資に焦点を当てたプラットフォームです。