एआई मॉडल और प्लेटफ़ॉर्म
Google ने Gemini ऐप और API में Lyria 3.5 संगीत निर्माण लाया

Google ने 4 सितंबर, 2026 को अपना संगीत निर्माण मॉडल Lyria 3.5 को Gemini ऐप और Gemini API में उपलब्ध कराया, जिससे मॉडल को Google Flow Music टूल से आगे बढ़ाया गया, जहाँ यह साल की शुरुआत में पहली बार पेश हुआ था। कंपनी ने The Keyword पर उसकी घोषणा में कहा कि यह मॉडल वेब और मोबाइल ऐप में सभी Gemini उपयोगकर्ताओं के लिए विश्व स्तर पर उपलब्ध है।
Google ने Lyria 3.5 को अपना सबसे सुरीला संगीत निर्माण मॉडल बताया है और कहा है कि यह पहले के संस्करणों की तुलना में अधिक अभिव्यक्तिपूर्ण आवाज़ें और समृद्ध संगीत व्यवस्था लाता है, जिससे ट्रैक उच्च फ़िडेलिटी पर बनते हैं। यह मॉडल पहली बार 29 जुलाई, 2026 को Google Flow Music में लॉन्च हुआ, जब Google ने कहा कि इसने संगीतात्मकता, गीतों और आवाज़ की गुणवत्ता में सुधार किया है।
Gemini ऐप में नई निर्माण नियंत्रण
Gemini ऐप में Lyria 3.5 संस्करण में एक सेट मार्गदर्शित निर्माण सुविधाएँ जोड़ी गई हैं। उपयोगकर्ता एक शैली चुन या वर्णन कर सकते हैं और वोकल या इंस्ट्रुमेंटल शैलियों में से चयन कर सकते हैं। नई टेम्प्लेट्स को बैकग्राउंड संगीत से लेकर कस्टम जन्मदिन ट्रैक्स तक के प्रोजेक्ट शुरू करने के लिए डिजाइन किया गया है, और उपयोगकर्ता अब छोटे या लंबे ट्रैक्स में से चयन कर सकते हैं।
Google ने कहा कि यह सुविधा वीडियो के लिए कस्टम बैकिंग ट्रैक्स, ब्रांड जिंगल्स और व्यक्तिगत रिंगटोन जैसी उपयोग मामलों को लक्षित करती है। ऐप के बाहर, Lyria 3.5 कलाकारों और AI रचनाकारों के लिए Google Flow Music में उपलब्ध है, और डेवलपर्स एवं तकनीशियनों के लिए Google AI Studio और Google Vids के माध्यम से उपलब्ध है।
Google DeepMind की Lyria परिवार के मॉडल पेज मॉडल को अधिकतम तीन मिनट तक की विविध गीत लंबाई का समर्थन करने वाला बताता है, जिसमें अनुरोधित अवधि के अनुरूप सुसंगत ट्रैक्स उत्पन्न करने की क्षमता है, 60 सेकंड के क्लिप से लेकर पूर्ण तीन मिनट के गीत तक। पेज कहता है कि उपयोगकर्ता अपने स्वयं के गीत लिख सकते हैं या विशिष्ट विषयों या थीमों के आसपास उन्हें उत्पन्न कर सकते हैं, और वोकल शैलियों और ध्वनिक प्राथमिकताओं को परिभाषित कर सकते हैं। यह छवियों के साथ रचना का भी वर्णन करता है: उपयोगकर्ता एक छवि अपलोड कर सकते हैं और मॉडल उसे एक ट्रैक में बदल देता है।
Gemini API के माध्यम से डेवलपर एक्सेस
Google के संगीत निर्माण के लिए डेवलपर दस्तावेज़ के अनुसार, जो 4 सितंबर, 2026 को अपडेट किया गया था, Lyria 3.5 टेक्स्ट प्रॉम्प्ट या छवियों से 44.1 kHz स्टीरियो ऑडियो उत्पन्न करता है, जिसमें वोकल, समयबद्ध गीत और पूर्ण इंस्ट्रुमेंटल अरेंजमेंट शामिल हैं। दस्तावेज़ दो मॉडल सूचीबद्ध करता है: Lyria 3 Clip, मॉडल ID lyria-3-clip-preview के तहत, जो हमेशा लूप और प्रीव्यू के लिए 30 सेकंड के क्लिप बनाता है, और Lyria 3.5, मॉडल ID lyria-3.5 के तहत, जो कुछ मिनटों तक चलने वाले पद्य, कोरस और ब्रिज वाले पूर्ण लंबाई के गीत उत्पन्न करता है।
दोनों मॉडल Google की Interactions API के माध्यम से एक्सेस किए जाते हैं और डिफ़ॉल्ट रूप से MP3 ऑडियो आउटपुट देते हैं, जबकि Lyria 3.5 के लिए WAV आउटपुट उपलब्ध है। दस्तावेज़ कहता है कि डेवलपर्स टेक्स्ट प्रॉम्प्ट के साथ अधिकतम 10 छवियां प्रदान कर सकते हैं, और मॉडल दृश्य सामग्री से प्रेरित संगीत रचना करेगा। वे Verse, Chorus, और Bridge जैसे सेक्शन टैग का उपयोग करके कस्टम गीत भी दे सकते हैं, और टाइमस्टैम्प का उपयोग करके गीत के विशेष क्षणों में क्या होता है, जैसे जब उपकरण प्रवेश करते हैं, निर्दिष्ट कर सकते हैं। दस्तावेज़ के अनुसार, किसी विशेष भाषा में प्रॉम्प्ट देने से उसी भाषा में गीत उत्पन्न होते हैं, मॉडल वोकल शैली और उच्चारण को उसी अनुसार अनुकूलित करता है। ऑडियो उत्पन्न होने से पहले, मॉडल प्रॉम्प्ट के आधार पर संगीत संरचना पर तर्क करता है।
बताई गई सीमाएँ और वॉटरमार्किंग
डेवलपर दस्तावेज़ कई सीमाओं की सूची देता है। सभी प्रॉम्प्ट सुरक्षा फ़िल्टरों से गुजरते हैं, और विशिष्ट कलाकार की आवाज़ों या कॉपीराइटेड गीतों की उत्पत्ति के अनुरोध ब्लॉक किए जाते हैं। संगीत निर्माण एक एकल-टर्न प्रक्रिया है, इसलिए कई प्रॉम्प्ट्स के माध्यम से उत्पन्न क्लिप का क्रमिक संपादन वर्तमान संस्करण में समर्थित नहीं है। समान प्रॉम्प्ट के साथ भी कॉल्स के बीच परिणाम भिन्न हो सकते हैं।
सभी उत्पन्न ऑडियो में पहचान के लिए SynthID वॉटरमार्क होता है, जिसे Google ने मानव कान के लिए अज्ञेय कहा है। DeepMind के मॉडल पेज पर कहा गया है कि सभी ट्रैक्स को अज्ञेय रूप से SynthID के साथ वॉटरमार्क किया जाता है ताकि श्रोताओं और प्लेटफ़ॉर्म यह पता लगा सकें कि संगीत AI द्वारा बनाया या संपादित किया गया है, और Google प्रशिक्षण डेटासेट में हानिकारक सामग्री और हानिकारक गीतों की संभावना को कम करने के लिए व्यापक फ़िल्टरिंग और डेटा लेबलिंग का उपयोग करता है। पेज यह भी जोड़ता है कि Google अभी भी मुख्य क्षमताओं को सुधारने पर काम कर रहा है और उपयोगकर्ताओं को सलाह देता है कि वे जांचें कि उत्पन्न ट्रैक्स उनकी दृष्टि के अनुरूप हैं या नहीं।
DeepMind का पेज यह भी बताता है कि Lyria श्रृंखला को प्रोड्यूसरों और संगीतकारों के इनपुट के साथ विकसित किया गया था, और यह Google के संगीत उपकरणों के साथ पहले के कलाकार प्रयोगों की सूची देता है, जिसमें प्रोड्यूसर Wyclef Jean का Music AI Sandbox के साथ काम और Yung Spielburg का Lyria का उपयोग एनीमेटेड शॉर्ट Dear Upstairs Neighbors के स्कोरिंग में शामिल है। Lyria 3.5 4 सितंबर, 2026 से Gemini ऐप, Google Flow Music, Google AI Studio, और Google Vids के माध्यम से उपलब्ध है।












