Modele și platforme AI
Google aduce generarea de muzică Lyria 3.5 în aplicația Gemini și API

Google, pe 4 septembrie 2026, a pus la dispoziție Lyria 3.5, modelul său de generare muzicală, în aplicația Gemini și în API-ul Gemini, extinzând modelul dincolo de instrumentul Google Flow Music, unde a debutat la începutul acestui an. Modelul este disponibil pentru toți utilizatorii Gemini la nivel global, atât pe web, cât și în aplicația mobilă, a precizat compania în anunțul său pe The Keyword.
Google descrie Lyria 3.5 ca fiind cel mai bine sunător model de generare muzicală și afirmă că aduce voci mai expresive și aranjamente muzicale mai bogate decât versiunile anterioare, producând piese cu fidelitate superioară. Modelul a fost lansat inițial în Google Flow Music pe 29 iulie 2026, când Google a declarat că aduce îmbunătățiri în ceea ce privește muzicalitatea, versurile și calitatea vocală.
Noi controale de creare în aplicația Gemini
Versiunea Lyria 3.5 din aplicația Gemini adaugă un set de funcții de creare ghidată. Utilizatorii pot selecta sau descrie un gen și pot alege între stiluri vocale sau instrumentale. Noile șabloane sunt concepute pentru a porni proiecte care variază de la muzică de fundal la piese personalizate pentru aniversări, iar utilizatorii pot acum alege între piese scurte sau mai lungi.
Google a declarat că funcția este destinată unor cazuri de utilizare precum piese de acompaniament personalizate pentru video, jingles de brand și sonerii personalizate. În afara aplicației, Lyria 3.5 este disponibilă pentru artiști și creatori AI în Google Flow Music și pentru dezvoltatori și tehnologi prin Google AI Studio și Google Vids.
Pagina de model pentru familia Lyria descrie modelul ca suportând lungimi variabile ale pieselor de până la trei minute, cu capacitatea de a genera piese coerente care să corespundă duratei solicitate, de la un clip de 60 de secunde până la o piesă completă de trei minute. Pagina afirmă că utilizatorii pot scrie propriile versuri sau le pot genera în jurul unor subiecte sau teme specifice și pot defini stiluri vocale și preferințe acustice. De asemenea, descrie compunerea cu imagini: utilizatorii pot încărca o imagine și modelul o transformă într-o piesă.
Acces pentru dezvoltatori prin API-ul Gemini
Conform documentației pentru dezvoltatori privind generarea muzicii, actualizată pe 4 septembrie 2026, Lyria 3.5 generează audio stereo de 44,1 kHz din solicitări text sau imagini, cu coerență structurală ce include voci, versuri sincronizate și aranjamente instrumentale complete. Documentația enumeră două modele: Lyria 3 Clip, cu ID-ul de model lyria-3-clip-preview, care produce întotdeauna clipuri de 30 de secunde pentru bucle și previzualizări, și Lyria 3.5, cu ID-ul de model lyria-3.5, care generează cântece de lungime completă cu versuri, refrene și poduri ce durează câteva minute.
Ambele modele sunt accesate prin API-ul Interacțiuni al Google și livrează în mod implicit audio MP3, cu ieșire WAV disponibilă pentru Lyria 3.5. Documentația precizează că dezvoltatorii pot furniza până la 10 imagini alături de o solicitare text, iar modelul va compune muzică inspirată de conținutul vizual. De asemenea, pot furniza versuri personalizate utilizând etichete de secțiune precum Verse, Chorus și Bridge și pot folosi marcaje temporale pentru a specifica ce se întâmplă în anumite momente ale piesei, cum ar fi intrarea instrumentelor. Solicitarea într-o anumită limbă produce versuri în acea limbă, conform documentației, modelul adaptând stilul vocal și pronunția pentru a se potrivi. Înainte de generarea audio, modelul analizează structura muzicală pe baza solicitării.
Limitări declarate și marcaj de apă
Documentația pentru dezvoltatori enumeră mai multe limitări. Toate solicitările trec prin filtre de siguranță, iar cererile pentru voci specifice de artiști sau generarea de versuri protejate prin drepturi de autor sunt blocate. Generarea muzicii este un proces de un singur pas, astfel că editarea iterativă a unui clip generat prin multiple solicitări nu este suportată în versiunea curentă. Rezultatele pot varia între apeluri chiar și pentru aceeași solicitare.
Tot audio-ul generat conține un marcaj de apă SynthID pentru identificare, pe care Google îl descrie ca fiind imperceptibil pentru urechea umană. Pagina de model a DeepMind afirmă că toate piesele sunt marcate imperceptibil cu SynthID, astfel încât ascultătorii și platformele să poată detecta dacă muzica a fost creată sau editată cu ajutorul AI, și că Google folosește filtrare extinsă și etichetare a datelor pentru a reduce conținutul nociv în seturile de antrenament și probabilitatea apariției de versuri dăunătoare. Pagina adaugă că Google lucrează în continuare la îmbunătățirea capabilităților cheie și sfătuiește utilizatorii să verifice dacă piesele generate corespund viziunii lor.
Pagina DeepMind menționează, de asemenea, că linia Lyria a fost dezvoltată cu contribuții de la producători și muzicieni și enumeră experimentele anterioare ale artiștilor cu instrumentele muzicale ale Google, inclusiv munca producătorului Wyclef Jean cu Music AI Sandbox și utilizarea Lyria de către Yung Spielburg pentru coloana sonoră a scurtmetrajului animat Dear Upstairs Neighbors. Lyria 3.5 este disponibilă prin aplicația Gemini, Google Flow Music, Google AI Studio și Google Vids începând cu 4 septembrie 2026.












