Фінансування

Компанія ShengShu Technology залучила понад 86 мільйонів доларів у рамках раунду фінансування A+, щоб розширити межі багатомодальної штучної інтелектуальної системи

mm
Додайте Unite.AI до бажаних джерел у Google

Компанія ShengShu Technology завершила раунд фінансування A+ на суму понад 600 мільйонів юанів (приблизно 86 мільйонів доларів США), що стало важливим етапом для компанії на шляху розширення її багатомодальних фундаментальних моделей для застосування як у цифровому, так і у фізичному світі. Раунд був спільно очолений Науковим містом Zhongguancun та LINK-X CAPITAL, з участю Wondershare, Visual China Group та TRS. Деякі існуючі інвестори також збільшували свої зобов’язання, що свідчить про продовжуючу довіру до технічного напрямку та комерційного прогресу ShengShu.

Нові кошти надходять у момент, коли багатомодальні системи штучної інтелектуальної системи переходять від експериментальних інструментів до інфраструктури, яка підтримує реальне виробництво. Траєкторія ShengShu відображає цей перехід, коли дослідницькі прориви все частіше перекладаються у впроваджені продукти, які застосовуються у різних галузях.

Від ранніх досліджень до комерційних моделей

Компанія ShengShu Technology була однією з перших команд у світі, яка зосередилася на багатомодальних генеративних алгоритмах як на основному напрямку досліджень. У 2022 році компанія представила архітектуру U-ViT, яка допомогла створити технічну основу для моделей, здатних розрізняти текст, зображення та відео. Цей підхід, орієнтований на дослідження, створив основу для запуску Vidu в середині 2024 року.

Vidu увійшла на ринок з можливістю посилання на відео, яка перейшла за межі традиційного тексту на відео або зображення на відео. Натомість ніж розглядати кожний кадр як ізольований вихід, система була розроблена для збереження багатомодальної консистентності між сценами, що вирішує давню проблему у комерційному відеовиробництві. З моменту запуску ShengShu швидко оновлювала систему, випускаючи послідовні версії, які покращували семантичне розуміння, стабільність руху, візуальну узгодженість та швидкість висновку.

Останнє оновлення, Vidu Q3, відображає свідоме звернення до оповідання. Модель підтримує синхронізоване аудіо-відео генерацію до 16 секунд, вихід у форматі 1080p, точні переходи між кадрами, багатомовне текстове відображення та багатомовний вихід. Ці можливості позиціюють систему ближче до виробничих робочих процесів, а не коротких експериментальних кліпів.

Продуктивність, швидкість та відкрита інновація

Поза якістю виходу, ShengShu підкреслила ефективність як конкурентну перевагу. У кінці 2025 року компанія відкрила свій фреймворк TurboDiffusion, що суттєво зменшило затримку генерації відео. З цим фреймворком п’ятисекундне відео можна згенерувати менш ніж за дві секунди на одному високопродуктивному GPU, що представляє собою порядок величини порівняно з попередніми підходами.

Цей акцент на швидкості не лише технічний бенчмарк. Нижча затримка та вимоги до обчислень безпосередньо впливають на можливість розгортання багатомодальних моделей у великому масштабі, особливо для інтерактивних застосунків та інструментів реального часу. Знижуючи вартість та час, необхідні для генерації високоякісного відео, ShengShu сприяє наближенню багатомодальної штучної інтелектуальної системи до повсякденного використання у професійних середовищах.

Розширення прийняття на творчих та корпоративних ринках

ShengShu створила широкий екосистему продуктів навколо Vidu, що охоплює керовані послуги, пропозиції SaaS, застосунки та інструменти на основі агентів. Ці продукти зараз обслуговують творців, студії та підприємства у понад 200 країнах та регіонах. У 2025 році компанія повідомила про більш ніж десятикратний ріст кількості користувачів та доходу, що свідчить про прискорене прийняття.

У сфері кіно та розваг Vidu використовується у сфері анімації, короткометражного виробництва та робочих процесів повнометражних фільмів, із залученням власників контенту, постачальників інструментів та виробничих студій. Паралельно, інтернет-платформи та компанії, що займаються розумними пристроями, застосовують цю технологію для створення маркетингових активів, інтерактивного контенту та інновацій продуктів.

Реклама та ігри також виявилися додатковими сферами застосування. Бренди та агентства використовують Vidu для масштабування виробництва відео для кампаній, тоді як розробники ігор розгортають її для рекламного контенту та генерації сцен. Міжнародно, платформа набуває популярності серед розробників творчих інструментів та корпоративних користувачів, із застосуванням, що поширюється на освіту, мовлення та культурний туризм.

Ширші наслідки багатомодальної штучної інтелектуальної системи

Прогрес багатомодальних фундаментальних моделей має наслідки, що виходять далеко за межі створення відео. Інтегруючи текст, зображення, аудіо та рух у єдині системи, ці моделі дозволяють машинам інтерпретувати контекст чином, що більше нагадує людське сприйняття. Для галузей це означає швидші цикли виробництва, нижчі бар’єри для входу на ринок високоякісного контенту та нові форми взаємодії між людьми та програмним забезпеченням.

Одночасно, дозрівання багатомодальної штучної інтелектуальної системи піднімає важливі питання щодо автентичності, інтелектуальної власності та відповідальної реалізації. Коли згенероване відео стає дедалі більш реалістичним, технічні засоби захисту та кадри управління будуть суттєво важливими для підтримання довіри до цифрових медіа.

Оглядаючи майбутнє, багатомодальні моделі, ймовірно, відіграватимуть роль не лише у цифрових робочих процесах, але й у фізичних системах, від робототехніки та симуляції до розумних середовищ. Останній раунд фінансування компанії ShengShu Technology позиціонує її для участі у цьому переході, коли багатомодальна штучна інтелектова система переходить від творчої новинки до фундаментального шару наступної генерації продуктивності.

Антуан є видним лідером і засновником Unite.AI, який рухається незмінною пристрастю до формування та просування майбутнього штучного інтелекту та робототехніки. Як серійний підприємець, він вважає, що штучний інтелект буде таким же революційним для суспільства, як і електрика, і часто захоплюється потенціалом революційних технологій і штучного інтелекту загального призначення.

Як футуролог, він присвячений вивченню того, як ці інновації будуть формувати наш світ. Крім того, він є засновником Securities.io, платформи, орієнтованої на інвестиції в передові технології, які переінакшують майбутнє і змінюють цілі сектори.