Моделі та платформи ШІ
Google додає генерацію музики Lyria 3.5 до додатку Gemini та API

Google 4 вересня 2026 року зробив модель генерації музики Lyria 3.5 доступною в додатку Gemini та через Gemini API, розширивши її використання поза інструментом Google Flow Music, де вона вперше з’явилася на початку цього року. За словами компанії, модель доступна всім користувачам Gemini у всьому світі через веб‑версію та мобільний додаток, про що повідомлялося у оголошенні на The Keyword.
Google описує Lyria 3.5 як найкращу за звучанням модель генерації музики та зазначає, що вона забезпечує більш виразні вокали та багатші музичні аранжування порівняно з попередніми версіями, створюючи треки з вищою якістю. Модель вперше була запущена в Google Flow Music 29 липня 2026 року, коли Google повідомив про покращення у музикальності, текстах та якості вокалу.
Нові інструменти створення в додатку Gemini
У версії Lyria 3.5 для додатку Gemini додано набір керованих функцій створення. Користувачі можуть вибрати або описати жанр і обрати між вокальними та інструментальними стилями. Нові шаблони призначені для запуску проєктів — від фонового музичного супроводу до індивідуальних композицій на день народження, і тепер користувачі можуть обирати короткі або довші треки.
Google зазначив, що ця функція орієнтована на такі випадки використання, як індивідуальні супровідні треки для відео, брендові джингли та персоналізовані рінгтони. Поза додатком Lyria 3.5 доступна для художників і AI‑творців у Google Flow Music, а також для розробників і технологів через Google AI Studio та Google Vids.
Сторінка моделі сімейства Lyria від Google DeepMind сторінка моделі сімейства Lyria описує, що модель підтримує змінну тривалість композицій до трьох хвилин, з можливістю генерувати цілісні треки, що відповідають заданій тривалості, від 60‑секундного кліпу до повної трьоххвилинної пісні. На сторінці зазначено, що користувачі можуть писати власні тексти або генерувати їх за певними темами чи сюжетами, а також визначати вокальні стилі та акустичні уподобання. Також описується створення музики за допомогою зображень: користувачі можуть завантажити зображення, і модель перетворить його у трек.
Доступ розробників через Gemini API
Згідно з документацією для розробників щодо генерації музики, оновленою 4 вересня 2026 року, Lyria 3.5 генерує стерео‑аудіо 44,1 кГц за текстовими підказками або зображеннями, забезпечуючи структурну послідовність, що включає вокали, синхронізовані тексти та повні інструментальні аранжування. У документації перераховано дві моделі: Lyria 3 Clip (ідентифікатор моделі lyria-3-clip-preview), яка завжди створює 30‑секундні кліпи для лупів і прев’ю, та Lyria 3.5 (ідентифікатор lyria-3.5), яка генерує повноцінні пісні з куплетами, приспівами та мостами тривалістю кілька хвилин.
Обидві моделі доступні через Interactions API від Google і за замовчуванням виводять аудіо у форматі MP3, при цьому для Lyria 3.5 доступний також вихід у форматі WAV. У документації зазначено, що розробники можуть надати до 10 зображень разом із текстовою підказкою, і модель створить музику, натхненну візуальним контентом. Вони також можуть надати власні тексти, використовуючи тегові розділи, такі як Verse, Chorus і Bridge, а також застосовувати мітки часу, щоб вказати, що відбувається у певні моменти пісні, наприклад, коли входять інструменти. За допомогою підказки на певній мові модель генерує тексти цією мовою, повідомляє документація, адаптуючи вокальний стиль і вимову. Перед генерацією аудіо модель аналізує музичну структуру на основі підказки.
Зазначені обмеження та водяний знак
У документації для розробників перераховано кілька обмежень. Усі підказки проходять через фільтри безпеки, а запити на використання голосу конкретного виконавця або генерацію захищених авторським правом текстів блокуються. Генерація музики здійснюється в один крок, тому ітеративне редагування згенерованого кліпу за допомогою кількох підказок не підтримується у поточній версії. Результати можуть відрізнятись між викликами навіть при однаковій підказці.
Усе згенероване аудіо містить водяний знак SynthID для ідентифікації, який, за словами Google, є непомітним для людського вуха. На сторінці моделі DeepMind зазначено, що всі треки непомітно маркуються SynthID, щоб слухачі та платформи могли визначити, чи була музика створена або відредагована за допомогою ШІ, і що Google застосовує широкі фільтри та маркування даних, щоб зменшити шкідливий контент у навчальних наборах і ймовірність появи небезпечних текстів. Сторінка додає, що Google продовжує працювати над покращенням ключових можливостей і радить користувачам переконатися, що згенеровані треки відповідають їхньому баченню.
На сторінці DeepMind також зазначено, що лінійка Lyria була розроблена за участю продюсерів і музикантів, і наведено попередні експерименти художників з музичними інструментами Google, включаючи роботу продюсера Wyclef Jean у Music AI Sandbox та використання Yung Spielburg Lyria для створення музики до анімаційного короткометражного фільму Dear Upstairs Neighbors. Lyria 3.5 доступна через додаток Gemini, Google Flow Music, Google AI Studio та Google Vids станом на 4 вересня 2026 року.












