Modelos y plataformas de IA
Google lleva la generación musical Lyria 3.5 a la aplicación Gemini y a la API

Google, el 4 de septiembre de 2026, puso a disposición Lyria 3.5, su modelo de generación musical, en la aplicación Gemini y en la API Gemini, ampliando el modelo más allá de la herramienta Google Flow Music, donde debutó a principios de este año. El modelo está disponible para todos los usuarios de Gemini a nivel mundial en la web y en la aplicación móvil, según anunció la compañía en su anuncio en The Keyword.
Google describe a Lyria 3.5 como su modelo de generación musical de mejor sonido y afirma que ofrece voces más expresivas y arreglos musicales más ricos que las versiones anteriores, produciendo pistas con mayor fidelidad. El modelo se lanzó por primera vez en Google Flow Music el 29 de julio de 2026, cuando Google indicó que aportaba mejoras en musicalidad, letras y calidad vocal.
Nuevos controles de creación en la aplicación Gemini
La versión de Lyria 3.5 para la aplicación Gemini incorpora un conjunto de funciones guiadas de creación. Los usuarios pueden seleccionar o describir un género y elegir entre estilos vocales o instrumentales. Nuevas plantillas están diseñadas para iniciar proyectos que van desde música de fondo hasta pistas de cumpleaños personalizadas, y ahora los usuarios pueden elegir entre pistas cortas o más largas.
Google afirmó que la función está dirigida a casos de uso como pistas de acompañamiento personalizadas para video, jingles de marca y tonos de llamada personalizados. Más allá de la aplicación, Lyria 3.5 está disponible para artistas y creadores de IA en Google Flow Music, y para desarrolladores y tecnólogos a través de Google AI Studio y Google Vids.
La página del modelo de la familia Lyria de Google DeepMind describe el modelo como compatible con longitudes de canción variables de hasta tres minutos, con la capacidad de generar pistas cohesivas que coincidan con una duración solicitada, desde un clip de 60 segundos hasta una canción completa de tres minutos. La página indica que los usuarios pueden escribir sus propias letras o generarlas en torno a temas o asuntos específicos, y pueden definir estilos vocales y preferencias acústicas. También describe la composición con imágenes: los usuarios pueden subir una imagen y hacer que el modelo la transforme en una pista.
Acceso para desarrolladores a través de la API Gemini
Según la documentación para desarrolladores sobre generación musical de Google, actualizada el 4 de septiembre de 2026, Lyria 3.5 genera audio estéreo de 44,1 kHz a partir de indicaciones de texto o imágenes, con coherencia estructural que incluye voces, letras sincronizadas y arreglos instrumentales completos. La documentación enumera dos modelos: Lyria 3 Clip, con el ID de modelo lyria-3-clip-preview, que siempre produce clips de 30 segundos para bucles y vistas previas, y Lyria 3.5, con el ID de modelo lyria-3.5, que genera canciones de larga duración con versos, coros y puentes que duran un par de minutos.
Ambos modelos se acceden a través de la API Interactions de Google y generan audio MP3 por defecto, con salida WAV disponible para Lyria 3.5. La documentación indica que los desarrolladores pueden proporcionar hasta 10 imágenes junto a una indicación de texto, y el modelo compondrá música inspirada en el contenido visual. También pueden suministrar letras personalizadas usando etiquetas de sección como Verse, Chorus y Bridge, y utilizar marcas de tiempo para especificar lo que ocurre en momentos concretos de una canción, como la entrada de instrumentos. Según la documentación, solicitar en un idioma determinado produce letras en ese idioma, con el modelo adaptando el estilo vocal y la pronunciación para que coincidan. Antes de generar el audio, el modelo razona sobre la estructura musical basándose en la indicación.
Limitaciones declaradas y marcas de agua
La documentación para desarrolladores enumera varias limitaciones. Todas las indicaciones pasan por filtros de seguridad, y se bloquean las solicitudes de voces de artistas específicos o la generación de letras con derechos de autor. La generación musical es un proceso de un solo turno, por lo que la edición iterativa de un clip generado mediante múltiples indicaciones no está soportada en la versión actual. Los resultados pueden variar entre llamadas incluso con la misma indicación.
Todo el audio generado lleva una marca de agua SynthID para identificación, que Google describe como imperceptible al oído humano. La página del modelo de DeepMind indica que todas las pistas están marcadas de forma imperceptible con SynthID, de modo que los oyentes y plataformas pueden detectar si la música fue creada o editada mediante IA, y que Google emplea un amplio filtrado y etiquetado de datos para reducir contenido dañino en los conjuntos de entrenamiento y la probabilidad de letras nocivas. La página añade que Google sigue trabajando en mejorar capacidades clave y aconseja a los usuarios verificar que las pistas generadas se ajusten a su visión.
La página de DeepMind también señala que la línea Lyria se desarrolló con la participación de productores y músicos, y enumera experimentos anteriores de artistas con las herramientas musicales de Google, incluido el trabajo del productor Wyclef Jean con Music AI Sandbox y el uso de Lyria por parte de Yung Spielburg para la banda sonora del cortometraje animado Dear Upstairs Neighbors. Lyria 3.5 está disponible a través de la aplicación Gemini, Google Flow Music, Google AI Studio y Google Vids a partir del 4 de septiembre de 2026.












