نماذج ومنصات الذكاء الاصطناعي

Suno تطلق نسخة بيتا من Speech، تجمع بين الصوت والموسيقى في نموذج واحد

mm
أضف Unite.AI إلى مصادرك المفضلة على Google

Suno أعلن عن Speech (beta) في 1 أكتوبر 2026، مطلقًا نموذجًا صوتيًا منطوق تصفه الشركة بأنه الأول الذي يولد الصوت والموسيقى معًا في مسار موحد. تم فتح النسخة التجريبية لجميع المستخدمين على الهواتف المحمولة والويب بعد شهر من الاختبار مع مجموعة صغيرة.

جاء الإعلان في منشور مدونة الشركة كتبه كبير مسؤولي المنتجات جاك برودي. يُنشئ Speech صوتًا منطوقًا مُرفقًا بموسيقى خلفية أصلية ومُدمج مباشرةً في Suno: يكتب المستخدمون فكرة أو قصيدة أو أي شيء كتبوه، ثم يصفون الصوت والنمط الموسيقي الذي يتخيلونه.

تُصِف ملاحظة الإصدار المؤرخة في 1 أكتوبر 2026، Speech بأنه النموذج الأول الذي يُنشئ الكلام والموسيقى التصويرية معًا في لقطة واحدة، وتُصنّف الإدخال لأندرويد، iOS، الويب وCreate. تشمل أمثلتها ما قد يُنشئه المستخدمون مثل قصص ما قبل النوم على بيانو هادئ، وخطابات حماسية على طبول الملعب، وقوائم البقالة بنمط ASMR، وتُشير إلى أن Speech متاح على الهواتف المحمولة والويب.

تُؤطر Suno الإطلاق حول ما تسميه «الترفيه الإبداعي»، وهو فئة تقول الشركة إنّها تعتقد أنها ستحدد الموجة التالية من تكنولوجيا المستهلك. لا يزال الموسيقى في صميم ما تبنيه Suno، كتب برودي، بينما تمتد رؤية الشركة إلى أشكال أخرى من التعبير البشري. يصف المنشور Speech كقماش آخر للإبداعات الشخصية التي ينتجها مجتمعها بالفعل، مشيرًا إلى الأغاني التي ينتجها المستخدمون لأعياد الميلاد، والزيجات، والنكات الداخلية، والإيمان والعبادة، وأطفالهم وأصدقائهم.

الاستخدامات المبكرة والقيود المعلنة للنسخة التجريبية

وفقًا للمنشور، جرب فريق Suno النموذج بشكل غير رسمي خلال التطوير، حيث حوّل رسائل الأصدقاء النصية إلى قراءات درامية، ومنح الملاحظات الصوتية العادية مقاطع موسيقية ملحمية، وصنع تأملات، وقصائد، وخطابات تحفيزية، وقصص ما قبل النوم لأطفالهم.

حذرت Suno من أن النسخة التجريبية تتصرف كنسخة فعلية في الممارسة. يمكن أن يتحول اللهجة البريطانية أحيانًا إلى أسترالية ثم تعود، كتب الشركة، و”قد تكون الوقفات الدرامية درامية للغاية”. وقالت Suno إن المستخدمين من المرجح أن يكتشفوا استخدامات لم تخطر على بال الفريق، مضيفةً أن هذا النوع من الاكتشاف هو هدف فتح النسخة التجريبية.

إصدارات V6 وما قبلها في عام 2026

يتبع Speech سلسلة من إصدارات Suno الموثقة في عام 2026. في 9 سبتمبر 2026، قامت الشركة قدمت v6، جيلًا جديدًا من نماذج الموسيقى تم تطويره مع شركاء الصناعة Warner Music Group, BMG and Believe. وصفت Suno نماذج v6 بأنها الأفضل حتى الآن، معتبرةً إياها أسرع وأكثر تعبيرًا وجودة أعلى. تتألف عائلة v6 من ثلاثة نماذج: النموذج الرائد v6 والنموذج الموجه للاستكشاف v6-wild، كلاهما متاح للمشتركين في Pro وPremier، وv6-mini، نسخة أسرع وأكثر كفاءة متاحة للجميع.

قالت Suno إن v6 يتيح للمبدعين تعديل جزء من أغنية موجودة باستخدام لغة بسيطة، وبناء مزيج من مصادر متعددة في طلب واحد، وعينة وعزل الصوت لبناء إيقاع جديد في سير عمل واحد، وإنشاء موسيقى من النص، والصوت، والصور، والفيديو، وتحديث كلمة واحدة دون إعادة بناء الأغنية بالكامل. أحد الأمثلة التي قدمتها الشركة: تغيير الجوقة لتُغنى بواسطة جوقة غوسبل.

قالت Suno إن فريقها يعقد معسكرات كتابة أسبوعية مع الفنانين والمنتجين وكتاب الأغاني والموسيقيين لتعلم كيفية استخدامهم لـ Suno في سير عملهم الإبداعي، وأنها أدخلت تدابير أمان لفحص ملفات الصوت والكلمات المرفوعة للتأكد من عدم استخدامها غير المصرح به. ومع إطلاق v6، صرّحت الشركة بأنها تخطط لإيقاف نماذجها السابقة ونقل المنصة بالكامل إلى جيل v6. في نفس الإعلان، قالت Suno إنها تطور تجارب اختيارية مبنية حول فنانين فرديين، يمكن للفنانين فيها اختيار المشاركة والحصول على أجر عندما يشاركون.

توثّق الإدخالات السابقة في ملاحظات إصدار Suno باقي خط إنتاج الشركة لعام 2026. أطلقت Suno النسخة v5.5 في 26 مارس 2026، مدعومة بثلاث ميزات: Voices، التي تتيح للمستخدمين تسجيل أو رفع صوتهم الخاص والغناء على إبداعاتهم؛ Custom Models، التي تدرب نسخة مخصصة من v5.5 على ما لا يقل عن ست مسارات من كتالوج المستخدم؛ وMy Taste، التي تتعلم الأنواع الموسيقية، والمزاجات، والمرجعيات المفضلة للمستخدم مع مرور الوقت. وصلت ميزة Voices إلى iOS وAndroid في 7 أغسطس 2026، مما يسمح للمستخدمين بتسجيل صوت مرة واحدة واستخدامه في أي أغنية.

أصدرت Suno Studio 2.0، تجديدًا كاملًا لبيئة العمل الصوتية التوليدية المستندة إلى المتصفح مع تحرير MIDI، وتأثيرات صوتية، ومُركّبات داخلية وشريط دردشة، للمشتركين في Premier في 13 أغسطس 2026. أدت تحديثات إضافية لـ Studio في 17 سبتمبر 2026 إلى جعل تحويل MIDI إلى صوت أسرع وأكثر دقة مقارنة بالمادة الأصلية.

قالت Suno إنها ستستمر في تحسين Speech مع تعلّمها ما يحبه الناس، وما لا يعمل بشكل كامل بعد، وما ترغب المجتمع في القيام به لاحقًا. تطلب ملاحظة الإصدار من المستخدمين تقديم ملاحظاتهم بينما يتحسن الميزة مع مرور الوقت.

Luca Ren هو محلل مُنشأ بواسطة الذكاء الاصطناعي في Unite.AI، يغطي الذكاء الاصطناعي في الترفيه والإعلام والسرد الرقمي. يستكشف عمله كيف تقوم أنظمة الذكاء الاصطناعي بانتقاء المحتوى، وتأثيرها على إنتاج الأفلام والتلفزيون والموسيقى والألعاب، وتخصيص تجارب الإعلام للجماهير العالمية.

من منظور إبداعي ومُتابع للاتجاهات، يفحص لوكا كيف تُعيد محركات التوصية والأدوات التوليدية وتحليلات الجمهور تشكيل سير العمل الإبداعي ونماذج التوزيع. وهو مهتم بشكل خاص بكيفية تأثير الذكاء الاصطناعي على بنية السرد، واستقلالية المبدعين، والتوازن بين التحسين القائم على البيانات والتعبير الفني في أنظمة الإعلام الحديثة.

المقالات التي يكتبها Luca Ren مُنشأة بواسطة الذكاء الاصطناعي وتُراجع من قبل فريق التحرير في Unite.AI لضمان الدقة والسياق الثقافي والتغطية المسؤولة لدور الذكاء الاصطناعي المتطور في الترفيه والإعلام.