نماذج ومنصات الذكاء الاصطناعي
نموذج Muse Image الوكيل من ميتا يتوفر على Fal للمطورين

fal في 1 سبتمبر 2026 أطلقت وصول المطورين والمؤسسات إلى Muse Image، نموذج توليد وتحرير الصور الوكيل من Meta Superintelligence Labs، المقدم عبر Meta Model API على منصة fal. صرّح fal أن النموذج يخطط لكل طلب، يستدعي الأدوات، ويُراجع مخرجاته قبل إرجاعها، وتُظهر صفحة النموذج على fal أن تكلفة الطلب هي $0.01 لكل صورة.
Muse Image هو أول نموذج لتوليد الصور من Meta Superintelligence Labs. معظم نماذج الصور تحول النص مباشرة إلى بكسلات في خطوة واحدة؛ وذكر fal أن هذا النهج يعمل مع المطالبات البسيطة لكنه قد يتعطل مع المتطلبات المعقدة، مما يدفع فرق الإنتاج إلى دمج عدة نماذج وإجراء جولات من التنظيف اليدوي. كما صرّح fal أن أسعار الجبهة الأمامية جعلت أحمال العمل ذات الحجم العالي، بما في ذلك توليد متغيّرات الإعلانات، صور الكتالوج، وتخصيص لكل مستخدم، غير اقتصادية على المستوى الذي تكون فيه ذات أهمية قصوى.
استخدام الأدوات وإعادة الصقل الذاتي
وفقًا لإعلان fal، يستخدم Muse Image بنية مخطط‑موزع مع استدعاءات الأدوات وإعادة الصقل داخل سلسلة تفكير واحدة. يبحث النموذج على الويب عن مراجع حقيقية، وهو ما ذكره fal أنه يحسّن بشكل ملحوظ الدقة الواقعية في المطالبات المعتمدة على المعرفة: شعارات دقيقة، أماكن حقيقية، مخططات عاملة، ورموز QR قابلة للمسح. يكتب ويُنفّذ الشيفرة للعناصر البصرية الدقيقة، ويتحقق من المخرجات ويصحّحها قبل إرجاعها، وهي خطوة تحقق صرّح fal بأنها تُحسّن الدقة في المتطلبات المتعددة الأجزاء.
المقال التقني الصادر عن ميتا في 7 يوليو 2026 يصف نفس التصميم الوكيل من منظور المختبر: يستدعي النموذج أدوات البحث والبرمجة لتحسين الدقة، يعيد صقل توليداته ذاتيًا، ويتحسن عبر توسيع الحوسبة أثناء الاختبار. خلال التعلم التعزيزي، تعلم Muse Image كتابة وتنفيذ شيفرة تُنتج مخططات دقيقة ورموز QR، والاعتماد على الأشكال المرسومة. يمكن أن يتخذ إعادة الصقل الذاتي شكل تعديل محلي عندما يكون هناك تفصيل صغير غير صحيح، أو توليد جديد عندما تكون الأجزاء الأكبر خاطئة، أو استدعاء أداة للحصول على أساس واقعي أكثر. صرّح ميتا أن هذا السلوك ظهر خلال التدريب لأن إعادة الصقل الذاتي أنتجت صورًا أفضل وبالتالي مكافأة أعلى، دون أن تكون مصممة عمدًا.
كما أفادت ميتا أن Muse Image يتحسن كلما استغرق وقتًا أطول في الاستدلال: مع زيادة الحوسبة أثناء الاختبار، يزداد استدلال النموذج، ويستخدم المزيد من استدعاءات الأدوات، ويطبق خطوات صقل ذاتية أكثر، مع ارتفاع درجات Elo المفضلة لدى البشر في علاقة تقريبية لوغاريتمية‑خطية. تغطي هذه الحوسبة رموز النص للاستدلال ورموز بصرية للتوليد، حيث تكون الجودة دالة على المجموع الكلي. وجدت ميتا أن أخذ عينات أفضل‑من‑N، حيث يولد النموذج عدة صور ويحتفظ بالأفضل، يحسّن الجودة في المراحل الأولى لكنه يتشبع بسرعة، بينما إنفاق نفس الحوسبة على الاستدلال المتعمد يحقق توسعًا أفضل بكثير.
التوليد، التحرير، والتركيب
صرّح fal أن نموذج Muse Image الواحد يغطي ثلاث سير عمل عادةً ما تحصل عليها فرق الإنتاج من بائعين منفصلين. الأول يجمع بين التوليد والتحرير الدقيق: يُنشئ المستخدم تصميمًا، ثم يغيّر عنصرًا واحدًا بينما يبقى باقي الصورة دون تغيير، في استدعاء واحد. الثاني هو صقل حواري متعدد الجولات، يبني أصلًا واحدًا عبر عدة جولات دون فقدان الجودة. الثالث هو تركيب مدفوع بالمرجع، حيث تُزوّد الفريق مجموعة علامة تجارية وعينات من الأصول وتولد أعمالًا جديدة متوافقة مع العلامة من حيث الأسلوب والموضوع عبر الأشخاص والمنتجات والبيئات.
كما يشارك Muse Image الأدوات والخطط مع Muse Spark، نموذج المساعد من ميتا، بحيث يمكن لاستدعاء واحد إرجاع صور GIF متحركة، مواقع تحتوي على صور مدمجة، ومخرجات بصرية تفاعلية بدلاً من ملف ثابت، وفقًا لـ fal.
ترتيب Arena والتوافر
صرّح fal أن Muse Image يحتل ضمن الخمسة الأوائل على Arena في فئات النص إلى صورة، تحرير صورة واحدة، وتحرير صور متعددة. عندما قدمت ميتا النموذج، أفادت أن Muse Image كان يحتل المرتبة الثانية على Arena في جميع الفئات الثلاث وفقًا لتصنيفات Elo المفضلة لدى البشر اعتبارًا من 5 يوليو 2026. كما ذكرت ميتا أن Muse Video، النموذج المرافق المبني على نفس قاعدة التدريب المسبق، احتل المرتبة الثالثة في تصنيفات Elo المفضلة للبشر في النص إلى فيديو اعتبارًا من ذلك التاريخ.
النموذج متوفر على fal.ai عبر ساحة لعب تفاعلية وواجهة برمجة التطبيقات. تُدرج fal نقطتي نهاية، meta/muse-image/text-to-image وmeta/muse-image/edit، كلاهما مخصص للاستخدام التجاري وتكلفته $0.01 لكل صورة. تُبرز صفحة النص إلى صورة اتباع التعليمات بدقة وتوليد تفاصيل دقيقة مثل النصوص، المخططات، ورموز QR؛ وتصف صفحة التحرير تعديلات دقيقة تغير فقط ما يطلبه المستخدم، وتحافظ على التماسك عبر الجولات، وتُركّب من عدة صور مرجعية.
وصل Muse Image إلى المستهلكين لأول مرة في 7 يوليو 2026 عبر تطبيق Meta AI وmeta.ai، وInstagram Stories في الولايات المتحدة، وWhatsApp في دول محدودة. تحمل الصور التي يُنشئها Muse Image في تطبيق Meta AI وعلى meta.ai ختم المحتوى، نظام العلامة المائية غير المرئية الخاص بميتا، والذي صرّح ميتا أنه يبقى سليمًا عبر القص، الضغط، تغيير الحجم، واللقطات؛ وتقوم ميتا بمعاينة أداة كشف تتحقق مما إذا كانت الصورة تحمل العلامة المائية.
تصف fal نفسها بأنها منصة وسائط توليدية تقدم نماذج الصور والفيديو والصوت عبر واجهة برمجة تطبيقات موحدة، مع وحدات معالجة رسومية خالية من الخوادم حسب الطلب ومجموعات حوسبة مخصصة، وتقول إن أكثر من 2.5 مليون مطور يستخدمونها.












