Modely a platformy AI

Google přináší generování hudby Lyria 3.5 do aplikace Gemini a API

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Google 4. září 2026 zpřístupnil Lyria 3.5, svůj model pro generování hudby, v aplikaci Gemini i v rozhraní Gemini API, čímž model rozšířil mimo nástroj Google Flow Music, kde byl představen dříve v letošním roce. Model je k dispozici všem uživatelům Gemini po celém světě na webu i v mobilní aplikaci, uvedla společnost ve svém oznámení na The Keyword.

Google popisuje Lyria 3.5 jako svůj nejznělejší model pro generování hudby a uvádí, že přináší výraznější vokály a bohatší hudební aranže než předchozí verze, přičemž vytváří skladby ve vyšší věrnosti. Model byl poprvé uveden v Google Flow Music 29. července 2026, kdy Google oznámil vylepšení v oblasti hudebnosti, textů a kvality vokálu.

Nové ovládací prvky tvorby v aplikaci Gemini

Verze Lyria 3.5 v aplikaci Gemini přidává sadu vedených funkcí tvorby. Uživatelé mohou vybrat nebo popsat žánr a zvolit vokální nebo instrumentální styl. Nové šablony jsou navrženy pro zahájení projektů od podkladové hudby po zakázkové narozeninové skladby a uživatelé nyní mohou volit mezi krátkými a delšími skladbami.

Google uvedl, že funkce cílí na případy použití, jako jsou zakázkové podkladové skladby pro videa, firemní jingly a osobní vyzváněcí tóny. Mimo aplikaci je Lyria 3.5 k dispozici umělcům a tvůrcům AI v Google Flow Music a vývojářům a technikům prostřednictvím Google AI Studio a Google Vids.

Google DeepMind’s stránka modelu pro rodinu Lyria uvádí, že model podporuje proměnlivé délky skladeb až do tří minut a dokáže generovat soudržné skladby odpovídající požadované délce, od 60‑sekundového úryvku po plnou tříminutovou skladbu. Stránka uvádí, že uživatelé mohou psát vlastní texty nebo je generovat na základě konkrétních témat či motivů a mohou definovat vokální styly a akustické preference. Také popisuje skládání s obrázky: uživatelé mohou nahrát obrázek a nechat model přeměnit jej na skladbu.

Přístup vývojářů přes Gemini API

Podle vývojářské dokumentace pro generování hudby, aktualizované 4. září 2026, Lyria 3.5 generuje stereo zvuk 44,1 kHz z textových výzev nebo obrázků, s strukturální koherencí zahrnující vokály, načasované texty a kompletní instrumentální aranže. Dokumentace uvádí dva modely: Lyria 3 Clip s ID modelu lyria-3-clip-preview, který vždy vytváří 30‑sekundové úryvky pro smyčky a ukázky, a Lyria 3.5 s ID modelu lyria-3.5, který generuje skladby plné délky s verši, refrény a mosty trvajícími několik minut.

Oba modely jsou přístupné přes Interactions API od Googlu a ve výchozím nastavení poskytují audio ve formátu MP3, přičemž pro Lyria 3.5 je k dispozici výstup ve formátu WAV. Dokumentace uvádí, že vývojáři mohou k textové výzvě připojit až 10 obrázků a model na základě vizuálního obsahu složí hudbu. Mohou také zadat vlastní texty pomocí značek sekcí, jako jsou Verse, Chorus a Bridge, a použít časové značky k určení, co se v konkrétních okamžicích skladby děje, například kdy vstoupí nástroje. Výzva v daném jazyce vytváří texty v tomto jazyce, uvádí dokumentace, přičemž model přizpůsobí vokální styl a výslovnost. Před generováním audia model rozebere hudební strukturu na základě výzvy.

Uvedená omezení a vodoznakování

Vývojářská dokumentace uvádí několik omezení. Všechny výzvy procházejí bezpečnostními filtry a požadavky na specifické hlasové projevy umělců nebo generování chráněných textů jsou blokovány. Generování hudby je jednorázový proces, takže iterativní úpravy vygenerovaného úryvku napříč více výzvami nejsou v současné verzi podporovány. Výsledky se mohou mezi jednotlivými voláními lišit i při stejné výzvě.

Veškeré vygenerované audio nese vodoznak SynthID pro identifikaci, který Google popisuje jako nepostřehnutelný pro lidské ucho. Stránka modelu od DeepMind uvádí, že všechny skladby jsou nepostřehnutě opatřeny vodoznakem SynthID, aby posluchači a platformy mohli zjistit, zda byla hudba vytvořena nebo upravena pomocí AI, a že Google používá rozsáhlé filtrování a označování dat k omezení škodlivého obsahu ve výcvikových souborech a pravděpodobnosti škodlivých textů. Stránka dále uvádí, že Google stále pracuje na zlepšení klíčových schopností a doporučuje uživatelům ověřit, že vygenerované skladby odpovídají jejich představě.

Stránka DeepMind také poznamenává, že řada Lyria byla vyvinuta za spolupráce producentů a hudebníků, a uvádí dřívější experimenty umělců s hudebními nástroji Googlu, včetně práce producenta Wyclef Jeana s Music AI Sandbox a využití Lyrie Yungem Spielburgem při skládání animovaného krátkého filmu Dear Upstairs Neighbors. Lyria 3.5 je k dispozici prostřednictvím aplikace Gemini, Google Flow Music, Google AI Studio a Google Vids od 4. září 2026.

Luca Ren je analytik generovaný AI ve Unite.AI, který se zabývá umělou inteligencí v zábavě, médiích a digitálním vyprávění. Jeho práce zkoumá, jak systémy AI kurátorují obsah, ovlivňují výrobu filmů, televize, hudby a her a personalizují mediální zážitky pro globální publikum.

S kreativním a trendově uvědomělým pohledem Luca zkoumá, jak doporučovací algoritmy, generativní nástroje a analytika publika přetvářejí kreativní pracovní postupy a distribuční modely. Zvláště ho zajímá, jak AI ovlivňuje strukturu narativu, autonomii tvůrců a rovnováhu mezi optimalizací řízenou daty a uměleckým vyjádřením v moderních mediálních ekosystémech.

Články, které napsal Luca Ren, jsou generovány AI a jsou recenzovány redakčním týmem Unite.AI, aby byla zajištěna přesnost, kulturní kontext a zodpovědné pokrytí vývoje role AI v zábavě a médiích.