نماذج ومنصات الذكاء الاصطناعي
النموذج الرائد الجديد من شاومي يتصدر تصنيفات الأوزان المفتوحة بدرجة 46

أعلنت شاومي في 22 سبتمبر 2026 عن إصدار ومفتوح المصدر لسلسلة MiMo-V2.6، بقيادة نموذج رائد يحصل على درجة 46 في مؤشر الذكاء وفقًا لمالك المعيار Artificial Analysis، وهو أعلى نتيجة للأوزان المفتوحة على ذلك اللوحة.
تتضمن السلسلة نموذجين متعددين الوضعيات أصليين: MiMo-V2.6-Pro، الذي تصفه شاومي بأنه أكثر نموذج قدرة حتى الآن، وMiMo-V2.6-Flash، الذي تقول الشركة إنه يوازن بين الذكاء والكفاءة والتكلفة. أما المتغيّر الثالث، MiMo-V2.6-Pro-UltraSpeed، فيقدم إخراجًا أسرع حتى 20 مرة بنفس الجودة للمستخدمين الذين يحتاجون إلى سرعة توليد قصوى، وفقًا لشاومي.
تصنيف معيار Artificial Analysis
تسجل صفحة النموذج الخاصة بـ Artificial Analysis لـ MiMo-V2.6-Pro درجة 46 في مؤشر الذكاء الإصدار 4.3.2، وهو مزيج من 10 تقييمات تشمل AA‑Briefcase v1.1، GDPval‑AA v2.1، AutomationBench‑AA، Terminal‑Bench 4.0، SciCode، وHumanity’s Last Exam. تُظهر مقارنة النماذج المفتوحة المصدر الخاصة بالمقيم أن MiMo-V2.6-Pro يتصدر بين نماذج الأوزان المفتوحة، متفوقًا على GLM‑5.3 (max) من Z AI بدرجة 45 وKimi K3 (max) بدرجة 44، وتصف MiMo‑V2.6‑Pro وGLM‑5.3 (max) كأعلى نماذج الذكاء المفتوحة المصدر.
بين الأنظمة المملوكة، تُدرج الصفحة الخاصة بـ Grok 4.7 (xhigh) من Artificial Analysis نموذج SpaceXAI بنفس الدرجة 46. تشير إعلان شاومي إلى 46.32 في المؤشر وتصف MiMo-V2.6-Pro بأنه “أقوى نموذج مفتوح المصدر حتى الآن”، قائلة إنه يتفوق على Kimi K3 وQwen3.8 Max. تُحدد Artificial Analysis تكلفة النموذج بـ 0.13 دولار لكل مهمة في مؤشر الذكاء وتُبلغ أن تقييمه على المؤشر كلف 206.66 دولار. تقول شاومي إن السلسلة تحافظ على تسعير واجهة برمجة التطبيقات لسلسلة V2.5، والتي تصفها بأنها تدفع حدود باريتو بين الذكاء والتكلفة إلى الخارج.
تُدرج Artificial Analysis تاريخ إصدار النموذج في 21 سبتمبر 2026؛ وتاريخ منشور إعلان شاومي هو 22 سبتمبر 2026.
معمارية MoE المتناثرة والأوزان المرخصة برخصة MIT
وفقًا لـ بطاقة النموذج التي نشرتها فريق Xiaomi MiMo، فإن نقطة تفتيش النموذج الرائد MiMo-V2.6-Pro-RL هي نموذج مزيج خبراء متناثر يحتوي على 1.02 تريليون معامل إجمالي و42 مليار مُفعَّل لكل رمز، وطول سياق قدره 1 مليون رمز، ومدخلات نصية، وصورية، وفيديو، وصوت مع مخرجات نصية. تُدرج مواصفات Artificial Analysis نفس عدد المعاملات، نافذة السياق، والوسائط، وتُسجل رخصة MIT التي تسمح بالاستخدام التجاري.
توضح البطاقة بنية أساسية مكوّنة من 70 طبقة، و60 طبقة انتباه بنظام النافذة المتحركة متداخلة مع 10 طبقات انتباه عالمي، مع 384 خبيرًا موجهًا يُنشّط ثمانية منهم لكل رمز. يتعامل MiMo ViT الذي يضم 681 مليون معامل مع الرؤية، ويتعامل AudioTokenizer الذي يضم 308 مليون معامل ومُشفّر قطع الصوت الذي يضم 127 مليون معامل مع الصوت، ويُتوقع مُفكك تخيلي من خمس طبقات لتنبؤ متعدد الرموز سبعة رموز لاحقة لكل تمريرة أمامية.
تم نشر أوزان MiMo-V2.6-Pro-RL وMiMo-V2.6-Flash-RL على Hugging Face، مع توفرها على ModelScope عند الإصدار. صرّحت شاومي بأنها تفتح أيضًا المصدر للتقرير الفني الكامل، وبيئات التدريب، وكود RL حتى يتمكن الباحثون من إعادة إنتاج النتائج والتحقق منها.
تشغيل تعلم التعزيز المبثوث مباشرة
قالت شاومي إنها بثت تشغيل تعلم التعزيز الإنتاجي مباشرةً أثناء حدوثه. خلال أقل من ستة أيام، أكمل كل من MiMo-V2.6-Flash وMiMo-V2.6-Pro 30 خطوة تعلم تعزيز على نحو تقريبًا 750,000 مسار، بتكلفة تقارير تبلغ حوالي 0.85 مليون دولار و2.62 مليون دولار على التوالي. ارتفعت نسبة النجاح المتوسطة في مهام التدريب بنسبة 25% و12% نسبيًا، وعلى معيار DeepSWE v1.1، وهو معيار هندسة برمجيات طويل الأمد محتفظ به، ارتفعت الدرجات من 48.8 إلى 65.68 لـ Flash ومن 58.4 إلى 72.57 لـ Pro، وفقًا لتقارير شاومي.
قالت الشركة إنها وسعت حسابات تعلم التعزيز على ثلاثة محاور: دفعات أكبر على بنية غير متزامنة بالكامل مع 1,568 عينة لكل تحديث، وتدريب بطول سياق يصل إلى 1 مليون رمز و3.5 إلى 3.7 مليار رمز لكل خطوة؛ مجموعة مهام متعددة تشمل الترميز، الوكلاء العامين، المهام البصرية، والمهام السيبرانية مختلطة عبر عدة أطر؛ ومزيد من حسابات المقيِّم، باستخدام المقارنة النسبية داخل كل مجموعة لإنتاج إشارات مكافأة أكثر دقة.
تحدد بطاقة النموذج تحسين السياسة النسبية الجماعية غير المتزامن بالكامل عند 1,568 مطالبة مع 16 تجربة لكل خطوة، وتوليف المكافأة الجماعية لبناء قواعد تقييم خاصة بالمهام بشكل غير متصل من التجارب المتضادة، وإعادة توزيع الميزة الجماعية لترتيب المسارات الناجحة عبر الإنترنت. تلي مرحلة تقطير على السياسة مع معلمين متعددين ومتعددين البادئات تُسمى MOPD2 تشغيل تعلم التعزيز المختلط، وتصف شاومي دفاعات ضد اختراق المكافأة التي تشمل تصميم المكافأة، التقييم العدائي، اكتشاف الشذوذ، والتحقق المتبادل بين المدققين.
التسعير، التوافر، والاستخدامات المُثبتة
في جداول الاختبار الخاصة بشاومي، يحصل MiMo-V2.6-Pro على 71.9 في DeepSWE v1.1 مقابل 67.9 لـ Flash و19.0 لـ MiMo-V2.5-Pro، متأخراً عن DeepSeek V4.1 Flash (74.2) وClaude Opus 5 (74.0) وGPT 6 Astra (74.0). تسجل شاومي Pro عند 1,673 في GDPVal 2.1، وهو تصنيف إيلو أوردته Artificial Analysis، خلف Claude Fable 5.1 (1,735) وClaude Opus 5 (1,708). تشمل النتائج الأخرى المبلغ عنها لـ Pro 76.9 في Toolathlon-verified، و53.1 في Automation Bench v1.0.6، و34.9 في Terminal Bench 4.0، و94.0 في CyberGym، حيث يسجل Flash 95.1 مقابل 84.5 لـ GLM 5.3.
يتوفر النموذجان في AI Studio وMiMo Code وMiMo Desktop، وكذلك عبر منصة MiMo API وOpenRouter. يترك MiMo Desktop مرحلة الوصول المبكر مع الإصدار الرسمي الأول، مع تضمين Pro وFlash، وذكرت شاومي أن برنامج UltraSpeed للوصول المبكر سيستمر أسبوعاً آخر، وطُلب من المستخدمين الحاليين التحويل إلى أسماء النماذج الجديدة.
لم يتغير تسعير واجهة البرمجة التطبيقية عن سلسلة V2.5: لكل مليون رمز، تكلف MiMo-V2.6-Pro 0.0036 دولار لمدخلات الضربة المخزنة، و0.435 دولار لمدخلات الضربة غير المخزنة، و0.87 دولار للمخرجات؛ وتكلف MiMo-V2.6-Flash 0.0028 دولار، و0.14 دولار، و0.28 دولار؛ وتكلف MiMo-V2.6-Pro-UltraSpeed 0.036 دولار، و4.35 دولار، و8.70 دولار في الفئات الثلاث نفسها. قيست Artificial Analysis 129.7 رمز مخرج في الثانية ووقت 2.17 ثانية للوصول إلى الرمز الأول عبر واجهة شاومي البرمجية.
تشمل عروض شاومي تطوير ألعاب متعددة الوكلاء، ونمذجة ثلاثية الأبعاد باستخدام Blender، والتحكم في حلقة مغلقة لذراع روبوتية Franka Panda من خلال تدفقات كاميرات متعددة الزوايا، وتصميم الواجهة الأمامية والعروض التقديمية، وإنشاء فيديو من البداية إلى النهاية، وتأليف موسيقى، بما في ذلك قطعة أوركسترالية تسمى Night Road قام النموذج بتأليفها وتحويلها إلى MIDI بنفسه. في حالتين بحثيتين أبلغت عنهما الشركة، صمم MiMo-V2.6-Pro مرشحات إطارات عضوية معدنية لامتصاص مركبات PFAS بالتعاون مع خبراء المواد في شاومي، وأنتج صياغة Lean 4 لنظرية “الفترة الثالثة تعني الفوضى” لـ Li وYorke تجاوزت 6,000 سطر من الشيفرة، وتأكد منها نواة Lean دون أي نواقص في البرهان.












