نماذج ومنصات الذكاء الاصطناعي

مطورو الألعاب يتطلعون إلى تقنية الصوت الذكية للحصول على فرص إبداعية جديدة

mm
أضف Unite.AI إلى مصادرك المفضلة على Google

تطورت تقنية 합성 الصوت، وخاصة 합성 الكلام، بشكل كبير في السنوات الأخيرة. بينما كانت تقنية النص إلى الكلام موجودة منذ عقود، أصبحت التقنية أكثر واقعية في الصوت. يمكن للخوارزميات الحديثة أخذ بضع ساعات من الصوت وتنفيذ عينات صوتية واقعية للغاية. مع تقدم التقنية، تفتح تطبيقات جديدة، بما في ذلك الإمكانيات في وسائل الإعلام الإبداعية. مؤخرًا، كما ذكرت venturebeat، بدأت شركات ألعاب الفيديو في التحقيق في استخدام تقنية الصوت الذكية لإنتاج حوارات لألعاب الفيديو.

بدأت شركة leviathan games في تنفيذ تقنية الصوت الذكية في ألعابها الحالية. أوضح wyeth ridgway، مالك شركة leviathan games، أن تقنية الصوت الذكية يمكن أن تغير تصميم الألعاب بشكل كبير. أوضح ridgway أن استخدام تقنية الصوت الذكية في تصميم الألعاب هو اتجاه متطور، وقارنها بالطريقة التي تغيرت بها برامج الرسومات ثلاثية الأبعاد على مدار العقد الماضي، مع شركات مثل pixar التي أنشأت برامج مخصصة لتعزيز الرسومات والنمذجة.

الطرق التقليدية لتوليد الكلام تعمل عن طريق إضافة ملفات صوت مسبقة التسجيل معًا في الوقت الفعلي، وخياطة الجمل معًا من كلمات وجمل موجودة مسبقًا. يتطلب هذا الأسلوب من تسجيل مئات الساعات من الحوار وتسمية يدوية لملفات الصوت. كما يبدو غير طبيعي لأن النبرة والتركيز يميلان إلى التغيير عبر الكلمات. بالمقارنة، تقنية الصوت الذكية الحديثة تبدو أكثر طبيعية وتعمل بطريقة مختلفة.

تعتمد تقنية الصوت الذكية على شبكات عصبونية عميقة. كانت wavenet واحدة من أولى الذكاء الاصطناعي الذي يمكن أن يولد عينات صوتية مقنعة وواقعية. منذ أن يتم توليد عينات الصوت من الصفر، لا يوجد حاجة لتسجيل مئات الساعات من الحوار، طالما كان هناك بيانات تدريب كافية. يمكن للنماذج المثلى والنمذجة اللغوية توليد الصوت بعد تدريبها على بضع ساعات فقط من الصوت المسمى. يمكن أن تكون النتائج مقنعة بشكل استثنائي، مثل عندما قام تجربة google duplex بإجراء مكالمة هاتفية لتحديد موعد.

مع تقدم هذه التقنيات وتوحيدها وسهولة الوصول إليها من خلال الحوسبة السحابية، من المحتمل أن يلجأ المزيد من مطوري الألعاب إلى تقنية الصوت الذكية لتقليل وقت الإنتاج والتكاليف.已经 بدأت بعض الشركات في إنشاء نماذج يمكن أن تستخدمها مطوري الألعاب. replica studios تختص في تقنية الصوت الذكية، ويمكن سماع بعض عينات الصوت التي تم توليدها بواسطة تقنيتها في الروابط هنا وهنا.

من غير المحتمل أن يختار مطورو الألعاب التخلي عن استخدام ممثلي الصوت مقابل الذكاء الاصطناعي. في الواقع، يمكن أن تفتح تقنية الصوت الذكية فرصًا جديدة لممثلي الصوت. حاليًا، غالبًا ما يتجاوز مطورو ألعاب الفيديو وجود حوار مسموع بسبب الاستثمار الزمني والتكاليف المرتبطة بإنشاء الحوار المسموع. غالبًا ما يتعين على ممثلي الصوت العودة إلى جلسات التسجيل الإضافية إذا كانت هناك تغييرات في السيناريو أو إذا أراد مخرجو الألعاب أداءً مختلفًا. يمكن استخدام تقنية الصوت الذكية لتجربة الحوار وتجربة السيناريو، للحصول على فكرة عن ما يتعين تغييره قبل استدعاء ممثل صوت محترف لتسجيل السيناريو. يمكن أن يؤدي هذا إلى تمكين المزيد من الشركات من الاستثمار في إنشاء حوار مسموع.

يمكن تدريب نماذج الصوت الذكية على صوت ممثل صوت محدد، واستخدام الذكاء الاصطناعي لتوليد مقاطع حوار غير مهمة، طالما يتم دفع مقابل استخدام صوته. كما ذكرت venturebeat، يعتبر ممثلو الصوت مثل simon j. smith متفائلين بزيادة استخدام نماذج الصوت الذكية وفرصها الجديدة لممثلي الصوت.

علاوة على استخدام تقنية الصوت الذكية لتحقيق السيناريوهات أو إنشاء خطوط مسموعة لأدوار ثانوية، يمكن لمطوري الألعاب استخدام تقنية الصوت الذكية لتقديم المزيد من خيارات التخصيص لألعاب الفيديو التي تتم لعبها بدور. حاليًا، حتى الألعاب التي تسمح للاعبين باختيار صوت لأفاتارهم عادة ما تتيح خيارات قليلة فقط. مع استخدام تقنية الصوت الذكية، يمكن أن تكون الخيارات محدودة بشكل فعلي.

مدون وبرمجي متخصص في مواضيع Machine Learning و Deep Learning. يأمل دانيال في مساعدة الآخرين على استخدام قوة الذكاء الاصطناعي من أجل الخير الاجتماعي.