Modelos e plataformas de IA
Suno lança Speech Beta, combinando voz e música em um único modelo

Suno anunciou Speech (beta) em 1 de outubro de 2026, lançando um modelo de áudio falado que a empresa descreve como o primeiro a gerar voz e música juntas em uma faixa coesa. O beta foi aberto a todos os usuários em dispositivos móveis e na web após um mês de testes com um pequeno grupo.
O anúncio foi publicado em um post no blog da empresa escrito pelo Diretor de Produto Jack Brody. Speech cria áudio falado acompanhado de música de fundo original e está integrado diretamente ao Suno: os usuários digitam uma ideia, um poema ou algo que escreveram, e então descrevem a voz e o estilo musical que desejam.
Uma nota de lançamento datada de 1 de outubro de 2026 descreve Speech como o primeiro modelo a criar uma fala e sua trilha sonora juntas em uma única tomada, e marca a entrada para Android, iOS, web e Create. Seus exemplos do que os usuários podem produzir incluem histórias para dormir ao som de piano suave, discursos de hype com tambores de estádio e listas de compras em ASMR, e afirma que Speech está disponível em dispositivos móveis e na web.
A Suno enquadra o lançamento em torno do que chama de entretenimento criativo, uma categoria que a empresa afirma acreditar que definirá a próxima onda de tecnologia de consumo. A música continua sendo o coração do que a Suno cria, escreveu Brody, enquanto a visão da empresa se estende a outras formas de expressão humana. O post descreve Speech como outra tela para as criações pessoais que sua comunidade já produz, apontando para músicas que os usuários criam para aniversários, casamentos, piadas internas, fé e adoração, seus filhos e seus amigos.
Usos iniciais e limitações declaradas da beta
De acordo com o post, a equipe da Suno experimentou o modelo informalmente durante o desenvolvimento, transformando mensagens de texto de amigos em leituras dramáticas, dando a notas de voz comuns trilhas épicas, e criando meditações, poemas, discursos motivacionais e histórias para dormir para seus filhos.
A Suno alertou que a beta se comporta como tal na prática. Um sotaque britânico pode ocasionalmente mudar para um australiano e voltar, escreveu a empresa, e “pausas dramáticas podem ser muito dramáticas”. A Suno disse que os usuários quase certamente descobrirão usos que nunca ocorreram à equipe, acrescentando que esse tipo de descoberta é o objetivo de abrir a beta.
V6 e lançamentos anteriores de 2026
Speech segue uma série de lançamentos da Suno documentados em 2026. Em 9 de setembro de 2026, a empresa introduziu v6, uma nova geração de modelos de música desenvolvidos com parceiros da indústria Warner Music Group, BMG e Believe. A Suno chamou os modelos v6 de seus melhores até agora, descrevendo-os como mais rápidos, mais expressivos e de maior qualidade. A família v6 consiste em três modelos: o principal v6 e o v6-wild, orientado à exploração, ambos disponíveis para assinantes Pro e Premier, e o v6-mini, uma versão mais rápida e eficiente disponível para todos.
A Suno disse que o v6 permite que criadores editem parte de uma música existente usando linguagem simples, criem um mashup a partir de múltiplas fontes em uma única solicitação, amostrem e isolem áudio para construir uma nova batida em um fluxo de trabalho único, criem música a partir de texto, áudio, imagens e vídeo, e atualizem uma única letra sem reconstruir a música inteira. Um exemplo que a empresa deu: mudar um refrão para que seja cantado por um coral gospel.
A Suno afirmou que sua equipe realiza acampamentos de escrita semanais com artistas, produtores, compositores e músicos para aprender como eles utilizam a Suno em seus fluxos de trabalho criativos, e que introduziu salvaguardas para analisar arquivos de áudio e letras enviados em busca de uso não autorizado. À medida que o v6 é lançado, a empresa disse que planeja retirar seus modelos anteriores e mover a plataforma totalmente para a geração v6. No mesmo anúncio, a Suno disse que está desenvolvendo experiências opt-in construídas em torno de artistas individuais, nas quais os artistas podem escolher participar e ser pagos quando o fizerem.
Entradas anteriores em notas de lançamento da Suno documentam o restante da linha de produtos da empresa em 2026. A Suno lançou o v5.5 em 26 de março de 2026, alimentando três recursos: Voices, que permite aos usuários gravar ou enviar seu próprio áudio e cantar em suas criações; Custom Models, que treina uma versão personalizada do v5.5 com pelo menos seis faixas do catálogo do usuário; e My Taste, que aprende os gêneros, humores e referências preferidos do usuário ao longo do tempo. Voices chegou ao iOS e Android em 7 de agosto de 2026, permitindo que os usuários gravem uma voz uma vez e a usem em qualquer música.
A Suno lançou o Studio 2.0, uma reformulação de sua estação de trabalho de áudio generativo baseada em navegador, com edição de MIDI, efeitos de áudio, sintetizadores integrados e uma barra de chat, para assinantes Premier em 13 de agosto de 2026. Atualizações adicionais do Studio em 17 de setembro de 2026 tornaram a transcrição de MIDI para áudio mais rápida e mais precisa em relação ao material original.
A Suno afirmou que continuará aprimorando o Speech à medida que aprende o que as pessoas amam, o que ainda não funciona bem e o que a comunidade deseja fazer a seguir. A nota de lançamento solicita feedback dos usuários enquanto o recurso evolui ao longo do tempo.












