نماذج ومنصات الذكاء الاصطناعي

جوجل تُضيف نموذج توليد الموسيقى Lyria 3.5 إلى تطبيق Gemini وواجهة API

mm
أضف Unite.AI إلى مصادرك المفضلة على Google

أعلنت جوجل في 4 سبتمبر 2026 عن إتاحة نموذج Lyria 3.5 لتوليد الموسيقى في تطبيق Gemini وواجهة Gemini API، موسعةً النموذج خارج أداة Google Flow Music التي ظهر فيها في وقتٍ سابق من هذا العام. وأفادت الشركة أن النموذج متاح لجميع مستخدمي Gemini حول العالم عبر الويب وتطبيق الهاتف المحمول، في إعلانها على The Keyword.

تصف جوجل نموذج Lyria 3.5 بأنه أفضل نموذج لتوليد الموسيقى من حيث جودة الصوت، مشيرةً إلى أنه يقدم أصواتًا غنائية أكثر تعبيرًا وترتيبات موسيقية أغنى مقارنةً بالإصدارات السابقة، مع إنتاج مسارات ذات دقة أعلى. تم إطلاق النموذج لأول مرة في Google Flow Music في 29 يوليو 2026، عندما أعلنت جوجل عن تحسينات في الموسيقية والكلمات وجودة الغناء.

ضوابط الإنشاء الجديدة في تطبيق Gemini

يضيف الإصدار المتوفر في تطبيق Gemini من Lyria 3.5 مجموعة من ميزات الإنشاء الموجهة. يمكن للمستخدمين اختيار أو وصف نوع الموسيقى وتحديد ما إذا كانوا يفضلون الأسلوب الغنائي أو الآلي. صُممت القوالب الجديدة لبدء مشاريع تتراوح بين الموسيقى الخلفية إلى مسارات أعياد الميلاد المخصصة، ويمكن للمستخدمين الآن اختيار ما إذا كانوا يريدون مسارات قصيرة أو أطول.

قالت جوجل إن هذه الميزة تستهدف حالات استخدام مثل مسارات الدعم المخصصة للفيديو، والشعارات الإعلانية للعلامات التجارية، ورنات الهاتف الشخصية. خارج التطبيق، يتوفر Lyria 3.5 للفنانين والمبدعين باستخدام الذكاء الاصطناعي في Google Flow Music، وللمطورين والتقنيين عبر Google AI Studio وGoogle Vids.

تصف صفحة نموذج عائلة Lyria على موقع Google DeepMind model page for the Lyria family النموذج بأنه يدعم أطوالًا متغيرة للأغاني تصل إلى ثلاث دقائق، مع القدرة على توليد مسارات متماسكة تتطابق مع المدة المطلوبة، من مقطع 60 ثانية إلى أغنية كاملة مدتها ثلاث دقائق. تشير الصفحة إلى أن المستخدمين يمكنهم كتابة كلماتهم الخاصة أو توليدها حول مواضيع أو موضوعات محددة، وتحديد أساليب الغناء وتفضيلات الصوتيات. كما تصف إمكانية التأليف باستخدام الصور: يمكن للمستخدمين رفع صورة ويحول النموذج تلك الصورة إلى مسار موسيقي.

الوصول للمطورين عبر Gemini API

وفقًا لتوثيق جوجل للمطورين حول توليد الموسيقى developer documentation for music generation، المحدث في 4 سبتمبر 2026، ينتج Lyria 3.5 صوتًا ستيريو بتردد 44.1 kHz من أوامر نصية أو صور، مع تماسك هيكلي يشمل الغناء، والكلمات المتزامنة، وترتيبات آلية كاملة. يسرد التوثيق نموذجين: Lyria 3 Clip، تحت معرف النموذج lyria-3-clip-preview، الذي ينتج دائمًا مقاطع 30 ثانية للتكرارات والمعاينات، وLyria 3.5، تحت معرف النموذج lyria-3.5، الذي يولد أغاني بطول كامل تشمل الأبيات، واللافتات، والجسور التي تستمر بضع دقائق.

يتم الوصول إلى كلا النموذجين عبر Interactions API الخاصة بجوجل، وتُصدر ملفات MP3 بشكلٍ افتراضي، مع إمكانية الحصول على إخراج WAV لنموذج Lyria 3.5. يوضح التوثيق أن المطورين يمكنهم تقديم ما يصل إلى 10 صور إلى جانب الأمر النصي، وسيقوم النموذج بتأليف موسيقى مستوحاة من المحتوى البصري. يمكنهم أيضًا توفير كلمات مخصصة باستخدام وسوم الأقسام مثل Verse وChorus وBridge، واستخدام الطوابع الزمنية لتحديد ما يحدث في لحظات معينة من الأغنية، مثل دخول الآلات. تقول الوثيقة إن الإدخال بلغة معينة ينتج كلمات بتلك اللغة، مع تعديل النموذج لأسلوب الغناء والنطق ليتناسب معها. قبل توليد الصوت، يقوم النموذج بتحليل بنية الموسيقى بناءً على الأمر المقدم.

القيود المعلنة وعلامة الماء

يسرد توثيق المطورين عدة قيود. تمر جميع الأوامر عبر مرشحات الأمان، وتُحظر الطلبات التي تتضمن أصوات فنانين محددين أو توليد كلمات محمية بحقوق الطبع والنشر. توليد الموسيقى هو عملية ذات خطوة واحدة، لذا لا يدعم الإصدار الحالي تعديل مقطع مُولد عبر أوامر متعددة. قد تختلف النتائج بين الاستدعاءات حتى مع تكرار نفس الأمر.

تحمل جميع الملفات الصوتية المُولدة علامة ماء SynthID للتعريف، وتصفها جوجل بأنها غير ملحوظة للأذن البشرية. تشير صفحة نموذج DeepMind إلى أن جميع المسارات تحمل علامة ماء SynthID غير ملحوظة بحيث يمكن للمستمعين والمنصات اكتشاف ما إذا كانت الموسيقى مُنشأة أو مُعدلة باستخدام الذكاء الاصطناعي، وأن جوجل تستخدم تصفية واسعة ووضع تسميات للبيانات لتقليل المحتوى الضار في مجموعات التدريب واحتمالية ظهور كلمات ضارة. تضيف الصفحة أن جوجل لا تزال تعمل على تحسين القدرات الأساسية وتُنصح المستخدمين بالتأكد من أن المسارات المُولدة تتوافق مع رؤيتهم.

تشير صفحة DeepMind أيضًا إلى أن خط Lyria تم تطويره بمشاركة منتجين وموسيقيين، وتستعرض تجارب فنانين سابقة مع أدوات الموسيقى من جوجل، بما في ذلك عمل المنتج وايسلف جين مع Music AI Sandbox واستخدام يونغ شبيلبورغ لـ Lyria في تأليف الموسيقى القصيرة المتحركة Dear Upstairs Neighbors. يتوفر Lyria 3.5 عبر تطبيق Gemini، وGoogle Flow Music، وGoogle AI Studio، وGoogle Vids اعتبارًا من 4 سبتمبر 2026.

Luca Ren هو محلل مُنشأ بواسطة الذكاء الاصطناعي في Unite.AI، يغطي الذكاء الاصطناعي في الترفيه والإعلام والسرد الرقمي. يستكشف عمله كيف تقوم أنظمة الذكاء الاصطناعي بانتقاء المحتوى، وتأثيرها على إنتاج الأفلام والتلفزيون والموسيقى والألعاب، وتخصيص تجارب الإعلام للجماهير العالمية.

من منظور إبداعي ومُتابع للاتجاهات، يفحص لوكا كيف تُعيد محركات التوصية والأدوات التوليدية وتحليلات الجمهور تشكيل سير العمل الإبداعي ونماذج التوزيع. وهو مهتم بشكل خاص بكيفية تأثير الذكاء الاصطناعي على بنية السرد، واستقلالية المبدعين، والتوازن بين التحسين القائم على البيانات والتعبير الفني في أنظمة الإعلام الحديثة.

المقالات التي يكتبها Luca Ren مُنشأة بواسطة الذكاء الاصطناعي وتُراجع من قبل فريق التحرير في Unite.AI لضمان الدقة والسياق الثقافي والتغطية المسؤولة لدور الذكاء الاصطناعي المتطور في الترفيه والإعلام.