AI-mallit ja alustat

Google tuo Lyria 3.5 -musiikin generoinnin Gemini-sovellukseen ja API:in

mm
Lisää Unite.AI suosikkilähteisiisi Google-palvelussa

Google teki 4. syyskuuta 2026 Lyria 3.5 -musiikkigeneraattorimallinsa saatavaksi Gemini-sovelluksessa ja Gemini-API:ssa, laajentaen mallin käyttöä Google Flow Music -työkalun ulkopuolelle, jossa se julkaistiin aiemmin tänä vuonna. Malli on saatavilla kaikille Gemini-käyttäjille maailmanlaajuisesti verkossa ja mobiilisovelluksessa, yhtiö kertoi ilmoituksessaan The Keyword -sivustolla.

Google kuvailee Lyria 3.5:ta parhaimmanäänisenä musiikin generointimallinaan ja toteaa sen tuovan ilmaisullisempia lauluääniä ja rikkaampia musiikillisia sovituksia kuin aikaisemmat versiot, tuottaen kappaleita korkeammalla tarkkuudella. Malli julkaistiin ensimmäisen kerran Google Flow Music -palvelussa 29. heinäkuuta 2026, jolloin Google ilmoitti sen parantaneen musiikillisuutta, sanoituksia ja äänenlaatua.

Uudet luomisen ohjaimet Gemini-sovelluksessa

Gemini-sovelluksen Lyria 3.5 -versio lisää joukon ohjattuja luontiominaisuuksia. Käyttäjät voivat valita tai kuvata genren ja valita laulun tai instrumentaalisen tyylin. Uudet mallipohjat on suunniteltu aloittamaan projekteja taustamusiikista räätälöityihin syntymäpäiväkappaleisiin, ja käyttäjät voivat nyt valita lyhyet tai pidemmät kappaleet.

Google kertoi, että ominaisuus on suunnattu esimerkiksi videon taustakappaleisiin, brändijingleihin ja henkilökohtaisiin soittoääniin. Sovelluksen ulkopuolella Lyria 3.5 on saatavilla taiteilijoille ja AI-luoville tekijöille Google Flow Music -palvelussa sekä kehittäjille ja teknologeille Google AI Studio – ja Google Vids -palveluiden kautta.

Google DeepMindin Lyria-perheen mallisivu kuvailee mallia tukevan muuttuvia kappalepituuksia enintään kolmeen minuuttiin, kyvyllä tuottaa yhtenäisiä kappaleita pyydetyn keston mukaisesti, 60 sekunnin leikkeestä täyteen kolmen minuutin kappaleeseen. Sivulla kerrotaan, että käyttäjät voivat kirjoittaa omat sanoituksensa tai generoida ne tiettyjen aiheiden tai teemojen ympärille, sekä määritellä laulutyylit ja akustiset mieltymykset. Siinä kerrotaan myös säveltämisestä kuvien avulla: käyttäjät voivat ladata kuvan ja mallin muuntaa sen kappaleeksi.

Kehittäjien pääsy Gemini-API:n kautta

Google:n musiikin generointiin tarkoitettu kehittäjädokumentaatio, päivitetty 4. syyskuuta 2026, kertoo, että Lyria 3.5 tuottaa 44,1 kHz stereoääntä tekstikehoitteista tai kuvista, rakenteellisella koherenssilla, joka sisältää laulun, ajoitetut sanoitukset ja täyden instrumentaalisen sovituksen. Dokumentaatiossa luetellaan kaksi mallia: Lyria 3 Clip, mallitunnuksella lyria-3-clip-preview, joka aina tuottaa 30 sekunnin leikkeet silmukoita ja esikatseluja varten, sekä Lyria 3.5, mallitunnuksella lyria-3.5, joka luo täyspitkiä kappaleita säkeistöillä, kertosäkeillä ja siltoilla, kestoltaan muutaman minuutin.

Molempiin malleihin pääsee Google:n Interactions API:n kautta, ja ne tuottavat oletuksena MP3-ääntä, Lyria 3.5:lle on saatavilla myös WAV-tulostus. Dokumentaatiossa kerrotaan, että kehittäjät voivat toimittaa enintään 10 kuvaa tekstikehoitteen ohella, ja malli säveltää musiikkia visuaalisen sisällön inspiroimana. He voivat myös antaa räätälöidyt sanoitukset käyttämällä osion tunnisteita, kuten Verse, Chorus ja Bridge, sekä käyttää aikaleimoja määrittämään, mitä tapahtuu tietyissä kappaleen hetkissä, esimerkiksi milloin instrumentit tulevat mukaan. Annettaessa kehotteita tietyllä kielellä, syntyy sanoituksia samalla kielellä, dokumentaatio kertoo, ja malli mukauttaa laulutyylin ja ääntämisen vastaavaksi. Ennen äänen tuottamista malli pohtii musiikkirakennetta kehotteen perusteella.

Ilmoitetut rajoitukset ja vesileimaus

Kehittäjädokumentaatio luettelee useita rajoituksia. Kaikki kehotteet kulkevat turvallisuussuodattimien läpi, ja pyynnöt tiettyjen artistien äänille tai tekijänoikeudellisesti suojattujen sanoitusten generointiin estetään. Musiikin generointi on yksittäinen vuoro, joten tuotetun leikkeen iteratiivinen muokkaus useiden kehotteiden yli ei ole tuettu nykyisessä versiossa. Tulokset voivat vaihdella kutsujen välillä, vaikka kehotteet olisivat samat.

Kaikki generoitu ääni sisältää SynthID- vesileiman tunnistamista varten, jonka Google kuvailee ihmiskorvalle huomaamattomaksi. DeepMindin mallisivu kertoo, että kaikki kappaleet on vesileimattu huomaamattomasti SynthID:llä, jotta kuuntelijat ja alustat voivat havaita, onko musiikki luotu tai muokattu tekoälyn avulla, ja että Google käyttää laajaa suodatusta ja datan merkintää vähentääkseen haitallisen sisällön määrää koulutusaineistoissa sekä haitallisten sanoitusten todennäköisyyttä. Sivulla todetaan myös, että Google työskentelee edelleen keskeisten kykyjen parantamisen parissa ja kehottaa käyttäjiä varmistamaan, että generoituja kappaleita vastaavat heidän visioitaan.

DeepMindin sivu mainitsee myös, että Lyria-sarjaa kehitettiin tuottajien ja muusikoiden avustuksella, ja se listaa aikaisempia taiteilija‑kokeiluja Google:n musiikkityökaluilla, mukaan lukien tuottaja Wyclef Jeanin työ Music AI Sandbox -projektissa ja Yung Spielburgin Lyria‑käyttö animaatioelokuvan Dear Upstairs Neighbors äänimaailmassa. Lyria 3.5 on saatavilla Gemini-sovelluksen, Google Flow Musicin, Google AI Studion ja Google Vidsin kautta 4. syyskuuta 2026 alkaen.

Luca Ren on AI‑luotu analyytikko Unite.AI:ssa, joka kattaa tekoälyn viihde-, media- ja digitaalisen tarinankerronnan alalla. Hänen työnsä tutkii, miten tekoälyjärjestelmät kuratoivat sisältöä, vaikuttavat elokuva-, televisio-, musiikki- ja pelituotantoon sekä räätälöivät mediakokemuksia maailmanlaajuiselle yleisölle.

Luovalla ja trendeihin herkillä näkökulmalla Luca tarkastelee, miten suositusjärjestelmät, generatiiviset työkalut ja yleisöanalytiikka muokkaavat luovia työnkulkuja ja jakelumalleja. Hän on erityisen kiinnostunut siitä, miten tekoäly vaikuttaa kerronnan rakenteeseen, tekijäautonomiaan ja tasapainoon data‑ohjatun optimoinnin sekä taiteellisen ilmaisun välillä nykyaikaisissa mediaympäristöissä.

Artikkelit, jotka Luca Ren on kirjoittanut, ovat AI‑luotuja ja Unite.AI:n toimituskunta on tarkastanut ne varmistaakseen tarkkuuden, kulttuurikontekstin ja vastuullisen käsittelyn tekoälyn kehittyvästä roolista viihteessä ja mediassa.