Modele i platformy AI
Google wprowadza generowanie muzyki Lyria 3.5 do aplikacji Gemini i API

Google 4 września 2026 r. udostępniło Lyria 3.5, swój model generowania muzyki, w aplikacji Gemini oraz w interfejsie Gemini API, rozszerzając go poza narzędzie Google Flow Music, w którym zadebiutował wcześniej w tym roku. Model jest dostępny dla wszystkich użytkowników Gemini na całym świecie w wersji internetowej i w aplikacji mobilnej, jak podała firma w swoim ogłoszeniu na its announcement on The Keyword.
Google opisuje Lyria 3.5 jako najbrzmiący model generowania muzyki i twierdzi, że zapewnia bardziej ekspresyjne wokale oraz bogatsze aranżacje muzyczne niż wcześniejsze wersje, tworząc utwory o wyższej jakości dźwięku. Model po raz pierwszy został uruchomiony w Google Flow Music 29 lipca 2026 r., kiedy Google poinformowało o wprowadzeniu ulepszeń w zakresie muzyczności, tekstów i jakości wokalu.
Nowe kontrolki tworzenia w aplikacji Gemini
Wersja Lyria 3.5 w aplikacji Gemini dodaje zestaw funkcji prowadzonego tworzenia. Użytkownicy mogą wybrać lub opisać gatunek oraz zdecydować się na styl wokalny lub instrumentalny. Nowe szablony są przeznaczone do rozpoczynania projektów, od muzyki tła po spersonalizowane utwory urodzinowe, a użytkownicy mogą teraz wybierać pomiędzy krótkimi a dłuższymi utworami.
Google podało, że funkcja jest przeznaczona do zastosowań takich jak niestandardowe podkłady muzyczne do wideo, jingles firmowe oraz spersonalizowane dzwonki. Poza aplikacją Lyria 3.5 jest dostępna dla artystów i twórców AI w Google Flow Music oraz dla programistów i techników za pośrednictwem Google AI Studio i Google Vids.
Strona modelu rodziny Lyria na stronie Google DeepMind model page for the Lyria family opisuje model jako obsługujący zmienne długości utworów do trzech minut, z możliwością generowania spójnych ścieżek dopasowanych do żądanej długości, od 60‑sekundowego klipu po pełny, trzyminutowy utwór. Strona informuje, że użytkownicy mogą pisać własne teksty lub generować je wokół konkretnych tematów czy motywów oraz definiować style wokalne i preferencje akustyczne. Opisuje także komponowanie przy użyciu obrazów: użytkownicy mogą przesłać obraz, a model przekształci go w ścieżkę.
Dostęp dla programistów poprzez Gemini API
Zgodnie z dokumentacją deweloperską Google dotyczącą generowania muzyki, zaktualizowaną 4 września 2026 r., Lyria 3.5 generuje dźwięk stereo 44,1 kHz na podstawie poleceń tekstowych lub obrazów, zachowując spójność strukturalną, która obejmuje wokale, zsynchronizowane teksty oraz pełne aranżacje instrumentalne. Dokumentacja wymienia dwa modele: Lyria 3 Clip, o identyfikatorze modelu lyria-3-clip-preview, który zawsze tworzy 30‑sekundowe klipy do pętli i podglądów, oraz Lyria 3.5, o identyfikatorze modelu lyria-3.5, który generuje pełne utwory z zwrotkami, refrenami i mostkami trwające kilka minut.
Oba modele są dostępne poprzez Interactions API Google i domyślnie zwracają dźwięk w formacie MP3, przy czym dla Lyria 3.5 dostępny jest także format WAV. Dokumentacja stwierdza, że programiści mogą dostarczyć do 10 obrazów wraz z poleceniem tekstowym, a model skomponuje muzykę inspirowaną treścią wizualną. Mogą również podać własne teksty, używając znaczników sekcji takich jak Verse, Chorus i Bridge, oraz stosować znaczniki czasu, aby określić, co dzieje się w konkretnych momentach utworu, np. kiedy wchodzą instrumenty. Wprowadzanie poleceń w danym języku generuje teksty w tym języku, jak podaje dokumentacja, przy czym model dostosowuje styl wokalny i wymowę. Przed wygenerowaniem dźwięku model analizuje strukturę muzyczną na podstawie polecenia.
Wymienione ograniczenia i znakowanie wodne
Dokumentacja deweloperska wymienia kilka ograniczeń. Wszystkie polecenia przechodzą przez filtry bezpieczeństwa, a żądania dotyczące konkretnych głosów artystów lub generowania chronionych prawem tekstów są blokowane. Generowanie muzyki jest procesem jednorazowym, więc iteracyjne edytowanie wygenerowanego klipu przy użyciu wielu poleceń nie jest obsługiwane w bieżącej wersji. Wyniki mogą się różnić pomiędzy wywołaniami, nawet przy tym samym poleceniu.
Cały wygenerowany dźwięk zawiera znak wodny SynthID służący identyfikacji, który Google opisuje jako niedostrzegalny dla ludzkiego ucha. Strona modelu DeepMind stwierdza, że wszystkie ścieżki są subtelnie znakowane SynthID, aby słuchacze i platformy mogły wykryć, czy muzyka została stworzona lub edytowana przy użyciu AI, oraz że Google stosuje rozbudowane filtrowanie i etykietowanie danych, aby ograniczyć szkodliwe treści w zestawach treningowych i zmniejszyć ryzyko nieodpowiednich tekstów. Strona dodaje, że Google nadal pracuje nad ulepszaniem kluczowych możliwości i zaleca użytkownikom sprawdzenie, czy wygenerowane utwory odpowiadają ich wizji.
Strona DeepMind zauważa również, że linia Lyria została opracowana we współpracy z producentami i muzykami, oraz wymienia wcześniejsze eksperymenty artystów z narzędziami muzycznymi Google, w tym pracę producenta Wyclef Jean w Music AI Sandbox oraz wykorzystanie Lyria przez Yung Spielburg przy tworzeniu ścieżki dźwiękowej do animowanego krótkiego filmu Dear Upstairs Neighbors. Lyria 3.5 jest dostępna poprzez aplikację Gemini, Google Flow Music, Google AI Studio i Google Vids od 4 września 2026 r.












