AI-modeller och plattformar

Google introducerar Lyria 3.5 musikgenerering i Gemini-appen och API:t

mm
Lägg till Unite.AI bland dina föredragna källor på Google

Google gjorde den 4 september 2026 Lyria 3.5, sin musikgenereringsmodell, tillgänglig i Gemini-appen och Gemini API, vilket utökade modellen bortom Google Flow Music-verktyget där den debuterade tidigare i år. Modellen är tillgänglig för alla Gemini-användare globalt på webben och i mobilappen, enligt företagets dess meddelande på The Keyword.

Google beskriver Lyria 3.5 som sin mest ljudmässigt tilltalande musikgenereringsmodell och säger att den erbjuder mer uttrycksfulla sånginsatser och rikare musikarrangemang än tidigare versioner, vilket ger spår med högre upplösning. Modellen lanserades först i Google Flow Music den 29 juli 2026, då Google meddelade att den levererade förbättringar inom musikalitet, texter och sångkvalitet.

New Creation Controls in the Gemini App

Gemini-appens version av Lyria 3.5 lägger till en uppsättning guidade skapandefunktioner. Användare kan välja eller beskriva en genre och välja mellan sång- eller instrumentstilar. Nya mallar är utformade för att starta projekt som sträcker sig från bakgrundsmusik till skräddarsydda födelsedagsspår, och användare kan nu välja mellan korta eller längre spår.

Google säger att funktionen är avsedd för användningsområden såsom anpassade bakgrundsspår för video, varumärkesjingles och personliga ringsignaler. Utanför appen är Lyria 3.5 tillgänglig för artister och AI‑kreatörer i Google Flow Music, samt för utvecklare och teknologer via Google AI Studio och Google Vids.

Google DeepMinds modellsida för Lyria-familjen beskriver modellen som stödjer variabel låtlängd upp till tre minuter, med möjlighet att generera sammanhängande spår som matchar en begärd varaktighet, från ett 60‑sekundersklipp till en hel treminuterslåt. Sidan säger att användare kan skriva egna texter eller generera dem kring specifika ämnen eller teman, och kan definiera sångstilar och akustiska preferenser. Den beskriver också komposition med bilder: användare kan ladda upp en bild och låta modellen omvandla den till ett spår.

Developer Access Through the Gemini API

Enligt Googles utvecklardokumentation för musikgenerering, uppdaterad den 4 september 2026, genererar Lyria 3.5 44,1 kHz stereoljud från textpromptar eller bilder, med strukturell sammanhang som inkluderar sång, tidsbestämda texter och fullständiga instrumentarrangemang. Dokumentationen listar två modeller: Lyria 3 Clip, med modell-ID lyria-3-clip-preview, som alltid producerar 30‑sekundersklipp för loopar och förhandsvisningar, och Lyria 3.5, med modell-ID lyria-3.5, som genererar fullängdslåtar med verser, refränger och bryggor som varar i några minuter.

Båda modellerna nås via Googles Interactions API och levererar MP3‑ljud som standard, med WAV‑utgång tillgänglig för Lyria 3.5. Dokumentationen anger att utvecklare kan tillhandahålla upp till 10 bilder tillsammans med en textprompt, och att modellen då komponera musik inspirerad av det visuella innehållet. De kan också leverera anpassade texter med avsnittstaggar såsom Verse, Chorus och Bridge, samt använda tidsstämplar för att specificera vad som händer vid specifika ögonblick i en låt, till exempel när instrument träder in. Att ge en prompt på ett visst språk producerar texter på det språket, enligt dokumentationen, där modellen anpassar sångstil och uttal för att matcha. Innan ljudet genereras resonnerar modellen kring den musikaliska strukturen baserat på prompten.

Stated Limitations and Watermarking

Utvecklardokumentationen listar flera begränsningar. Alla promptar passerar genom säkerhetsfilter, och förfrågningar om specifika artiströster eller generering av upphovsrättsskyddade texter blockeras. Musikgenerering är en engångsprocess, så iterativ redigering av ett genererat klipp över flera promptar stöds inte i den nuvarande versionen. Resultaten kan variera mellan anrop även med samma prompt.

Allt genererat ljud bär en SynthID‑vattenstämpel för identifiering, som Google beskriver som omärksam för det mänskliga örat. DeepMinds modellsida uppger att alla spår är omärkligt vattenmärkta med SynthID så att lyssnare och plattformar kan upptäcka om musiken skapats eller redigerats med AI, och att Google använder omfattande filtrering och datamärkning för att minska skadligt innehåll i träningsdatamängder och sannolikheten för skadliga texter. Sidan tillägger att Google fortfarande arbetar med att förbättra nyckelfunktioner och råder användare att kontrollera att de genererade spåren motsvarar deras vision.

DeepMinds sida noterar också att Lyria-serien utvecklades med input från producenter och musiker, och den listar tidigare artistexperiment med Googles musikverktyg, inklusive producenten Wyclef Jeans arbete med Music AI Sandbox och Yung Spielburgs användning av Lyria för att komponera musik till den animerade kortfilmen Dear Upstairs Neighbors. Lyria 3.5 är tillgänglig via Gemini-appen, Google Flow Music, Google AI Studio och Google Vids från och med den 4 september 2026.

Luca Ren är en AI‑genererad analytiker på Unite.AI, som täcker artificiell intelligens inom underhållning, media och digitalt berättande. Hans arbete undersöker hur AI‑system kuraterar innehåll, påverkar film‑, tv‑, musik‑ och spelproduktion samt skräddarsyr medieupplevelser för globala publiker.

Med ett kreativt och trendmedvetet perspektiv granskar Luca hur rekommendationsmotorer, generativa verktyg och publik‑analys omformar kreativa arbetsflöden och distributionsmodeller. Han är särskilt intresserad av hur AI påverkar narrativ struktur, skaparnas autonomi och balansen mellan datadriven optimering och konstnärligt uttryck i moderna medieekosystem.

Artiklar skrivna av Luca Ren är AI‑genererade och granskas av Unite.AI:s redaktionsteam för att säkerställa noggrannhet, kulturell kontext och ett ansvarsfullt bevakning av AIs utvecklande roll inom underhållning och media.