Modelos y plataformas de IA

Suno lanza Speech Beta, combinando voz y música en un solo modelo

mm
Añade Unite.AI a tus fuentes preferidas en Google

Suno anunció Speech (beta) el 1 de octubre de 2026, lanzando un modelo de audio hablado que la empresa describe como el primero en generar voz y música juntas como una pista cohesiva. La beta se abrió a todos los usuarios en móvil y web después de un mes de pruebas con un grupo reducido.

El anuncio apareció en una publicación del blog de la empresa escrita por el Director de Producto Jack Brody. Speech crea audio hablado con música de fondo original y está integrado directamente en Suno: los usuarios escriben una idea, un poema o cualquier texto que hayan creado, y luego describen la voz y el estilo musical que tienen en mente.

Una nota de lanzamiento con fecha 1 de octubre de 2026 describe Speech como el primer modelo que crea un discurso y su banda sonora juntos en una sola toma, y etiqueta la entrada para Android, iOS, web y Create. Sus ejemplos de lo que los usuarios podrían crear incluyen cuentos para dormir con piano suave, discursos motivacionales con tambores de estadio y listas de la compra ASMR, y afirma que Speech está disponible en móvil y web.

Suno presenta el lanzamiento alrededor de lo que llama entretenimiento creativo, una categoría que la empresa dice que definirá la próxima ola de tecnología de consumo. La música sigue siendo el corazón de lo que Suno construye, escribió Brody, mientras la visión de la empresa se extiende a otras formas de expresión humana. La publicación describe Speech como otro lienzo para las creaciones personales que su comunidad ya realiza, señalando canciones que los usuarios producen para cumpleaños, bodas, bromas internas, fe y adoración, sus hijos y sus amigos.

Usos iniciales y limitaciones declaradas de la beta

Según la publicación, el equipo de Suno experimentó con el modelo de forma informal durante el desarrollo, convirtiendo los mensajes de texto de amigos en lecturas dramáticas, dando a notas de voz ordinarias bandas sonoras épicas, y creando meditaciones, poemas, charlas motivacionales y cuentos para dormir para sus hijos.

Suno advirtió que la beta se comporta como tal en la práctica. Un acento británico puede ocasionalmente pasar a uno australiano y volver, escribió la empresa, y “las pausas dramáticas pueden ser muy dramáticas”. Suno dijo que los usuarios casi con certeza descubrirán usos que nunca se les ocurrieron al equipo, añadiendo que este tipo de descubrimiento es el objetivo de abrir la beta.

V6 y lanzamientos anteriores de 2026

Speech sigue una serie de lanzamientos de Suno documentados en 2026. El 9 de septiembre de 2026, la empresa presentó v6, una nueva generación de modelos de música desarrollada con socios de la industria Warner Music Group, BMG y Believe. Suno describió los modelos v6 como los mejores hasta la fecha, señalando que son más rápidos, más expresivos y de mayor calidad. La familia v6 consta de tres modelos: el modelo insignia v6 y el orientado a la exploración v6-wild, ambos disponibles para suscriptores Pro y Premier, y v6-mini, una versión más rápida y eficiente disponible para todos.

Suno dijo que v6 permite a los creadores editar una parte de una canción existente usando lenguaje natural, crear un mashup a partir de múltiples fuentes en una sola solicitud, muestrear y aislar audio para construir un nuevo ritmo en un flujo de trabajo único, crear música a partir de texto, audio, imágenes y video, y actualizar una sola letra sin reconstruir la canción completa. Un ejemplo que la empresa dio: cambiar un coro para que sea cantado por un coro gospel.

Suno dijo que su equipo organiza campamentos de escritura semanales con artistas, productores, compositores y músicos para aprender cómo utilizan Suno en sus flujos de trabajo creativos, y que ha introducido salvaguardas para examinar los archivos de audio y letras cargados en busca de usos no autorizados. A medida que v6 se despliega, la empresa dijo que planea retirar sus modelos anteriores y trasladar la plataforma completamente a la generación v6. En el mismo anuncio, Suno afirmó que está desarrollando experiencias opt‑in centradas en artistas individuales, en las que los artistas pueden elegir participar y recibir pago cuando lo hagan.

Entradas anteriores en las notas de lanzamiento de Suno documentan el resto de la línea de productos de la empresa en 2026. Suno lanzó v5.5 el 26 de marzo de 2026, impulsando tres funciones: Voices, que permite a los usuarios grabar o cargar su propio audio y cantar en sus creaciones; Custom Models, que entrena una versión personalizada de v5.5 con al menos seis pistas del catálogo del usuario; y My Taste, que aprende los géneros, estados de ánimo y referencias favoritos del usuario con el tiempo. Voices llegó a iOS y Android el 7 de agosto de 2026, permitiendo a los usuarios grabar una voz una vez y usarla en cualquier canción.

Suno lanzó Studio 2.0, una renovación de su estación de trabajo de audio generativo basada en navegador con edición MIDI, efectos de audio, sintetizadores integrados y una barra de chat, para suscriptores Premier el 13 de agosto de 2026. Actualizaciones adicionales de Studio el 17 de septiembre de 2026 hicieron que la transcripción de MIDI a audio fuera más rápida y más precisa respecto al material original.

Suno dijo que seguirá mejorando Speech a medida que aprenda lo que la gente ama, lo que aún no funciona del todo y lo que la comunidad desea hacer a continuación. La nota de lanzamiento solicita a los usuarios comentarios mientras la función mejora con el tiempo.

Luca Ren es un analista generado por IA en Unite.AI, que cubre la inteligencia artificial en entretenimiento, medios y narración digital. Su trabajo explora cómo los sistemas de IA seleccionan contenido, influyen en la producción de cine, televisión, música y videojuegos, y personalizan las experiencias mediáticas para audiencias globales.

Con una perspectiva creativa y consciente de las tendencias, Luca examina cómo los motores de recomendación, las herramientas generativas y el análisis de audiencias están remodelando los flujos de trabajo creativos y los modelos de distribución. Le interesa especialmente cómo la IA afecta la estructura narrativa, la autonomía del creador y el equilibrio entre la optimización basada en datos y la expresión artística en los ecosistemas mediáticos modernos.

Los artículos escritos por Luca Ren son generados por IA y revisados por el equipo editorial de Unite.AI para garantizar precisión, contexto cultural y una cobertura responsable del papel evolutivo de la IA en el entretenimiento y los medios.