펀딩

ShengShu Technology, 멀티모달 AI 경계 확장 위해 860만 달러 이상의 시리즈 A+ 투자 유치

mm
Unite.AI를 Google의 선호 소스에 추가

ShengShu Technology시리즈 A+ 투자 라운드에서 600만 달러 이상(약 860만 달러)의 투자를 유치하여 디지털 및 물리적 세계 응용 프로그램을 위한 멀티모달 기초 모델을 확장하는 데 중요한 이정표를 달성했습니다. 이 라운드는 Zhongguancun Science City와 LINK-X CAPITAL이 공동으로 주도했으며, Wondershare, Visual China Group, 및 TRS의 전략적 참여가 있었습니다. 기존 투자자 중 몇 명은 또한 их 투자 금액을 증가시켜 ShengShu의 기술 방향과 상업적 진보에 대한 지속적인 신뢰를 보여주었습니다.

새로운 자본은 멀티모달 AI 시스템이 실험 도구에서 실제 생산을 지원하는 인프라로 전환하는 시점에 도착했습니다. ShengShu의 궤도는 이러한 전환을 반영하며, 연구 성과가 점점 더 많이 배포되는 제품으로 번역되고 있습니다.

초기 연구에서 상업용 모델까지

ShengShu Technology는 멀티모달 생성 알고리즘을 핵심 연구 방향으로 초점을 둔 세계 최초의 팀 중 하나였습니다. 2022년, 회사는 U-ViT 아키텍처를 도입하여 텍스트, 이미지, 비디오를Reasoning할 수 있는 모델을 위한 기술적 기초를 마련했습니다. 이 연구 중심 접근 방식은 2024년 중반에 Vidu를 출시하는 단계를 마련했습니다.

Vidu는 전통적인 텍스트-비디오 또는 이미지-비디오 생성을 넘어서는 참조-비디오 기능으로 시장에 진입했습니다. 각 프레임을 분리된 출력으로 처리하는 대신, 시스템은 장면 전반에 걸쳐 다중 엔티티 일관성을 유지하도록 설계되었습니다. 이는 상업용 비디오 생성의 오랜 도전을 해결했습니다. 출시 이후, ShengShu는 빠르게 반복하여, 의미적 이해, 모션 안정성, 시각적 일관성, 추론 속도를 개선한 연속적인 버전을发布했습니다.

최근 버전인 Vidu Q3는 故事 구성을 중점적으로 다루고 있습니다. 모델은 최대 16초의 동기화된 오디오-비디오 생성, 네이티브 1080p 출력, 精确한 샷 전환, 다국어 텍스트 렌더링, 다중 언어 출력을 지원합니다. 이러한 기능은 시스템을 생산 워크플로우에 더 가깝게 위치시키고, 실험용 클립이 아닌 실제 비디오 생성을 가능하게 합니다.

성능, 속도, 오픈 혁신

출력 품질을 넘어서, ShengShu는 효율성을 경쟁력 있는 차별점으로 강조했습니다. 2025년 말, 회사는 TurboDiffusion 프레임워크를 오픈 소스로 공개했습니다. 이 움직임은 비디오 생성 latency를 크게 줄였습니다. 이 프레임워크를 사용하면 5초짜리 비디오를 단일 고성능 GPU에서 2초 미만으로 생성할 수 있으며, 이는 이전 접근 방식과 비교하여 수준의 차이를 나타냅니다.

이 속도에 대한 중점은 단순한 기술적 벤치마크가 아닙니다. 낮은 latency와 컴퓨팅 요구 사항은 대규모 배포 및 실시간 창의적 도구에 대한 멀티모달 모델의 적용 가능성을 직접적으로影响합니다. 높은 품질의 비디오를 생성하는 데 필요한 시간과 비용을 줄임으로써, ShengShu는 멀티모달 AI를 전문 환경에서 일상적으로 사용할 수 있도록 다가가고 있습니다.

창의적 및 기업 시장에서의 확장

ShengShu는 Vidu를 중심으로 광범위한 제품 생태계를 구축했습니다. 이는 관리형 서비스, SaaS 제품, 애플리케이션, 에이전트 기반 도구를 포함합니다. 이러한 제품은 현재 200개 이상의 국가와 지역에서 창의자, 스튜디오, 기업을 지원합니다. 2025년에, 회사는 사용자와 수익에서 10배 이상의 성장을 보고했으며, 이는 채택이 가속화되고 있음을 나타냅니다.

영화 및 엔터테인먼트 분야에서, Vidu는 애니메이션, 단편 제작, 특징 워크플로우에서 사용되며, 콘텐츠 소유자, 도구 제공업체, 제작 스튜디오와의 참여가 있습니다. 동시에, 인터넷 플랫폼 및 스마트 하드웨어 회사는 마케팅 자산 생성, 상호작용 콘텐츠, 제품 혁신에 기술을 적용하고 있습니다.

광고 및 게임도 추가적인 영역으로 나타났습니다. 브랜드와 광고 대행사들은 Vidu를 사용하여 캠페인용 비디오 생산을 확장하고, 게임 개발자는 광고 콘텐츠 및 장면 생성을 위해 이를 배포합니다. 국제적으로, 플랫폼은 창의적 도구 개발자 및 기업 사용자에게서 인정을 받고 있으며, 교육, 방송, 문화 관광 등에 대한 적용이 확장되고 있습니다.

멀티모달 AI의 더 넓은 의미

멀티모달 기초 모델의 진행은 비디오 생성을 넘어서는 daleko한 의미를 가지고 있습니다. 텍스트, 이미지, 오디오, 모션을 통합한 시스템은 기계가 인간과 유사한 방식으로 상황을 해석할 수 있도록 합니다. 이는 산업계에 빠른 생산 주기, 높은 품질 콘텐츠에 대한 진입 장벽 감소, 인간과 소프트웨어 간의 새로운 상호작용 형태를 의미합니다.

동시에, 멀티모달 AI의 성숙은 진실성, 지적 재산권, 책임 있는 배포와 관련된 중요한 질문을 제기합니다. 생성된 비디오가 점점 더 현실적으로 되는 경우, 디지털 미디어의 신뢰를 유지하기 위한 기술적 안전 장치와 거버넌스 프레임워크가 필수적입니다.

향후, 멀티모달 모델은 디지털 워크플로우뿐만 아니라 로봇공학, 시뮬레이션, 스마트 환경과 같은 물리적 세계 시스템에서도 역할을 할 것입니다. ShengShu Technology의 최신 투자 라운드는 이 전환에 참여할 수 있는 위치에 있으며, 멀티모달 AI는 창의적인 нов기능에서 다음 세대의 생산성의 기초층으로 전환하고 있습니다.

앙투안은 유나이트.AI의 비전적인 리더이자 공동 설립자로서 AI와 로봇공학의 미래를 형성하고 촉진하는 데 대한 불변의 열정을 가지고 있습니다. 연속적인 기업가로서, 그는 AI가 사회에 전기와 같은 변화를 가져올 것이라고 믿으며, 종종 파괴적인 기술과 AGI의 잠재력에 대해 열광합니다.

作为 미래학자로서, 그는 이러한 혁신이 우리 세계를 어떻게 형성할지 탐구하는 데 헌신하고 있습니다. 또한, 그는 Securities.io의 설립자로서, 미래를 재정의하고 전체 부문을 재구성하는 최첨단 기술에 투자하는 플랫폼을 운영하고 있습니다.