Financiamento

A ShengShu Technology Arrecada Mais de $86 Milhões em Financiamento Série A+ para Empurrar os Limites da IA Multimodal

mm
Adicione Unite.AI às suas fontes preferidas no Google

ShengShu Technology completou uma rodada de financiamento Série A+ que excedeu RMB 600 milhões (aproximadamente $86 milhões USD), marcando um marco importante para a empresa à medida que escala seus modelos de fundação multimodal para aplicações digitais e do mundo físico. A rodada foi co-liderada por Zhongguancun Science City e LINK-X CAPITAL, com participação estratégica da Wondershare, Visual China Group e TRS. Vários investidores existentes também aumentaram seus compromissos, destacando a confiança contínua na direção técnica e no progresso comercial da ShengShu.

O novo capital chega num momento em que os sistemas de IA multimodal estão se movendo de ferramentas experimentais para infraestrutura que sustenta a produção do mundo real. A trajetória da ShengShu reflete essa mudança, com avanços de pesquisa se traduzindo cada vez mais em produtos implantados usados em várias indústrias.

Desde a Pesquisa Inicial aos Modelos Comerciais

A ShengShu Technology foi uma das primeiras equipes globais a se concentrar em algoritmos gerativos multimodais como uma direção de pesquisa central. Em 2022, a empresa introduziu a arquitetura U-ViT, ajudando a estabelecer uma base técnica para modelos capazes de raciocinar sobre texto, imagem e vídeo. Essa abordagem de pesquisa em primeiro lugar preparou o terreno para o lançamento do Vidu em meados de 2024.

Vidu entrou no mercado com uma capacidade de Referência-para-Vídeo que foi além da geração convencional de texto-para-vídeo ou imagem-para-vídeo. Em vez de tratar cada quadro como uma saída isolada, o sistema foi projetado para preservar a consistência multi-entidade em cenas, abordando um desafio de longa data na geração de vídeo comercial. Desde o lançamento, a ShengShu iterou rapidamente, lançando versões sucessivas que melhoraram a compreensão semântica, a estabilidade de movimento, a coerência visual e a velocidade de inferência.

O lançamento mais recente, Vidu Q3, reflete uma ênfase deliberada na narrativa. O modelo suporta geração de áudio-vídeo sincronizada de até 16 segundos, saída nativa 1080p, transições de tom precisas, renderização de texto multilíngue e saída multilíngue. Essas capacidades posicionam o sistema mais próximo dos fluxos de trabalho de produção, em vez de clipes experimentais de curto prazo.

Desempenho, Velocidade e Inovação Aberta

Além da qualidade de saída, a ShengShu enfatizou a eficiência como um diferenciador competitivo. No final de 2025, a empresa abriu o código-fonte de sua estrutura TurboDiffusion, uma movimentação que reduziu significativamente a latência de geração de vídeo. Com essa estrutura, um vídeo de cinco segundos pode ser gerado em menos de dois segundos em uma única GPU de alta qualidade, representando ganhos de magnitude em comparação com as abordagens anteriores.

Essa ênfase na velocidade não é apenas um benchmark técnico. Latência e requisitos de computação mais baixos afetam diretamente a viabilidade de implantar modelos multimodais em escala, especialmente para aplicações interativas e ferramentas criativas em tempo real. Ao reduzir o custo e o tempo necessário para gerar vídeo de alta qualidade, a ShengShu está empurrando a IA multimodal mais próxima do uso diário em ambientes profissionais.

Expansão da Adoção em Mercados Criativos e Empresariais

A ShengShu construiu um amplo ecossistema de produtos em torno do Vidu, abrangendo serviços gerenciados, ofertas SaaS, aplicações e ferramentas baseadas em agentes. Esses produtos agora atendem criadores, estúdios e empresas em mais de 200 países e regiões. Em 2025, a empresa relatou um crescimento superior a dez vezes tanto em usuários quanto em receita, indicando uma adoção acelerada.

No cinema e entretenimento, o Vidu é usado em animação, produção de curto prazo e fluxos de trabalho de recursos, com engajamento em proprietários de conteúdo, fornecedores de ferramentas e estúdios de produção. Em paralelo, plataformas de internet e empresas de hardware inteligente aplicam a tecnologia à criação de ativos de marketing, conteúdo interativo e inovação de produtos.

Publicidade e jogos emergiram como áreas adicionais de tração. Marcas e agências usam o Vidu para dimensionar a produção de vídeo para campanhas, enquanto desenvolvedores de jogos o implantam para conteúdo publicitário e geração de cenas. Internacionalmente, a plataforma está ganhando tração entre desenvolvedores de ferramentas criativas e usuários empresariais, com aplicações se estendendo à educação, radiodifusão e turismo cultural.

As Implicações Mais Amplas da IA Multimodal

O progresso dos modelos de fundação multimodal tem implicações muito além da criação de vídeo. Ao integrar texto, imagem, áudio e movimento em sistemas unificados, esses modelos permitem que as máquinas interpretem o contexto de uma maneira que se assemelha mais à percepção humana. Para as indústrias, isso significa ciclos de produção mais rápidos, barreiras de entrada mais baixas para conteúdo de alta qualidade e novas formas de interação entre humanos e software.

Ao mesmo tempo, a maturação da IA multimodal levanta questões importantes sobre autenticidade, propriedade intelectual e implantação responsável. À medida que o vídeo gerado se torna cada vez mais realista, salvaguardas técnicas e estruturas de governança serão essenciais para manter a confiança na mídia digital.

Olhando para o futuro, os modelos multimodais provavelmente desempenharão um papel não apenas nos fluxos de trabalho digitais, mas também em sistemas do mundo físico, desde robótica e simulação até ambientes inteligentes. A rodada de financiamento mais recente da ShengShu Technology a posiciona para participar dessa transição, à medida que a IA multimodal se move de uma novidade criativa para uma camada fundamental da produtividade de próxima geração.

Antoine é um líder visionário e sócio-fundador da Unite.AI, impulsionado por uma paixão inabalável por moldar e promover o futuro da IA e da robótica. Um empreendedor serial, ele acredita que a IA será tão disruptiva para a sociedade quanto a eletricidade, e é frequentemente pego falando sobre o potencial das tecnologias disruptivas e da AGI.

Como um futurista, ele está dedicado a explorar como essas inovações moldarão nosso mundo. Além disso, ele é o fundador da Securities.io, uma plataforma focada em investir em tecnologias de ponta que estão redefinindo o futuro e remodelando setores inteiros.