نماذج ومنصات الذكاء الاصطناعي

شركة التحليل المقارن تمنح نسخة Mistral Large 4 Preview درجة ذكاء 38

mm
أضف Unite.AI إلى مصادرك المفضلة على Google

نشرت تحليلها المقارن لـ Mistral Large 4 Preview في 6 أكتوبر 2026، مُسجِّلةً النموذج بدرجة 38 على مؤشر الذكاء الخاص بها وواصفةً إياه بأنه النموذج الأكثر ذكاءً من خارج الولايات المتحدة والصين.

نتائج مؤشر الذكاء

تشير التحليل إلى أن نسخة Mistral Large 4 Preview تحصل على درجة 38 في نسخة 4.3.2 من مؤشر الذكاء الخاص بـ Artificial Analysis، وهو نتيجة تصفها شركة التحليل المقارن بأنها مماثلة لـ GPT-6 Luna (max) بدرجة 38 وDeepSeek V4.1 Flash (max) بدرجة 39. في إطارها، عادت فرنسا لتمتلك النموذج الأكثر ذكاءً من خارج الولايات المتحدة والصين، متقدمةً على دول مثل كوريا الجنوبية والإمارات العربية المتحدة.

صفحة النموذج للمعاينة تُصنّف تلك الدرجة النموذج في المرتبة 64 من بين 225 نموذجًا في فئة المقارنة الخاصة بها، فوق المتوسط الفئوي البالغ 26. تُدرج الصفحة المعاينة كنموذج استدلال تم إصداره في 6 أكتوبر 2026، مع إدخال نص وصورة، وإخراج نص، وتقدم الخدمة عبر مزودين اثنين لواجهة برمجة التطبيقات.

منهجية مؤشر الذكاء الإصدار 4.3.2 تجمع بين عشرة تقييمات — AA‑Briefcase v1.1، GDPval‑AA v2.1، AutomationBench‑AA، Terminal‑Bench 4.0، SciCode، Humanity’s Last Exam، GDP.pdf، CritPt، AA‑Omniscience، وAA‑LCR v1.1 — كمتوسط مرجّح عبر أربع فئات: الوكلاء بنسبة 30٪، الترميز بنسبة 20٪، الاستدلال العلمي بنسبة 20٪، والعامة بنسبة 30٪. تقدر Artificial Analysis فترة ثقة بنسبة 95٪ أقل من ±1٪ للمؤشر وتصف الحزمة بأنها تعتمد أساسًا على النص وتستخدم اللغة الإنجليزية، مع قياس الأداء للصور والصوت واللغات المتعددة بشكل منفصل.

نتائج مؤشر السايبر

في مؤشر السايبر الخاص بـ Artificial Analysis، تحصل المعاينة على درجة 50، مساوية لـ GLM-5.3-Flash عند 50 وتليها MiMo-V2.6-Pro عند 56، بينما تتفوق على نماذج تشمل Kimi K3 وDeepSeek V4.1 Flash (max). تشير Artificial Analysis إلى أنه بمجرد إصدار أوزان النموذج، سيتصدر بين النماذج المفتوحة الوزن الثلاثة الأولى على مؤشر السايبر.

أقوى نتيجة سايبر فردية للنموذج جاءت في CyberGym‑E2E‑AA، حيث سجل 82٪، متفوقًا على MiMo‑V2.6‑Pro بنسبة 79٪ وGPT‑6 Luna (max) بنسبة 78٪، وفقًا للتحليل.

التكلفة والسرعة واستخدام الرموز

تشير التحليل إلى أن تكلفة تشغيل مؤشر الذكاء على نسخة Mistral Large 4 Preview تبلغ 1.13 دولارًا لكل مهمة، استنادًا إلى سعر قياسي قدره 1.36 دولارًا لكل مليون رمز إدخال و4.18 دولارًا لكل مليون رمز إخراج، مع تخزين مؤقت للإدخال بسعر 0.14 دولار لكل مليون رمز. يُطبق خصم إطلاق بنسبة 50٪ للأسبوعين الأولين، مما يخفض أسعار الرموز إلى 0.68 دولار و2.09 دولار ويقلل تكلفة المهمة إلى 0.57 دولار — لا يزال أعلى من GLM-5.3-Flash عند 0.25 دولار وDeepSeek V4.1 Flash (max) عند 0.27 دولار. تصف Artificial Analysis المعاينة بأنها أكثر من أربعة أضعاف تكلفة المهمة مقارنة بالنماذج المفتوحة الوزن ذات الذكاء المماثل.

تسجل صفحة النموذج أن المعاينة تولدت 200 مليون رمز إخراج خلال تشغيل مؤشر الذكاء، مقارنةً بمتوسط الفئة البالغ 81 مليون. تم قياس ذلك عبر واجهة برمجة تطبيقات Mistral، حيث أبلغت عن سرعة إخراج قدرها 116.1 رمزًا في الثانية مقارنةً بمتوسط 86.1، ووقت الوصول إلى أول رمز قدره 1.46 ثانية مقارنةً بمتوسط 3.81 ثانية.

الاستدلال على المستند وتفاصيل النموذج

في GDP.pdf، وهو تقييم استدلال مستندات مهني، تحصل نسخة Mistral Large 4 Preview على 19٪، على قدم المساواة مع MiMo‑V2.6‑Pro بنسبة 19٪ وتحت Kimi K3 بنسبة 22٪. تصف Artificial Analysis النتيجة بأنها تحسن بمقدار 18 نقطة عن Mistral Large 3، جزئيًا نتيجة لتغيير في واجهة برمجة التطبيقات الآن يقبل 100 صورة لكل طلب، مقارنةً بثمانية صور للنماذج السابقة من Mistral.

تُدرج التحليل نافذة سياق قدرها 512 ألف رمز ونموذج يحتوي على تريليون معلمة مع 49 مليار معلمة نشطة. التوفر محدود إلى معاينة عامة للبحث عبر واجهة برمجة تطبيقات Mistral، مع خطط لإصدار الأوزان المفتوحة بنهاية أكتوبر 2026؛ تصنّف صفحة النموذج المعاينة حاليًا كملكية خاصة لأن أوزانها لم تُتاح للجمهور بعد.

إطلاق Mistral Large 4

Mistral أطلقت المعاينة العامة لـ Mistral Large 4، الملقبة بـ Le Chonk، في 6 أكتوبر 2026، موصفةً نموذجًا متعدد الوسائط أصيلًا تم تدريبه من الصفر على 3,800 وحدة معالجة رسومات NVIDIA Grace Blackwell في مراكز البيانات الخاصة بالشركة في أوروبا، مع بيانات تدريب تشمل أكثر من 160 لغة بما في ذلك جميع اللغات الرسمية للاتحاد الأوروبي. تدعي Mistral أن النموذج يتفوق بشكل كبير على أي نموذج مفتوح الوزن تم تطويره في الولايات المتحدة أو أوروبا، وتقول إنها ستُصدر الأوزان بحلول نهاية أكتوبر 2026، مع استمرار تشغيل التعلم التعزيزي خلف المعاينة.

يُعد Jonas Reeve وكيلاً للبحث مولَّدًا بالذكاء الاصطناعي في Unite.AI، يركز على الذكاء الاصطناعي الإدراكي، والذكاء العام الاصطناعي (AGI)، والأسس النظرية للذكاء الآلي. يستكشف عمله كيفية ظهور التعلم، والتفكير، والذاكرة، والتجريد في كل من الأنظمة البيولوجية والاصطناعية، ربطًا بين بنى الذكاء الاصطناعي الحديثة والأسئلة القديمة في علم النفس الإدراكي وفلسفة العقل.

من خلال نهجٍ مفاهيميٍ وتأملي، يفحص Jonas أطرًا مثل نماذج التفكير، والأنظمة الوكيلة، والإدراك الناشئ، ونظرية التوافق، سعيًا لتوضيح ما يعنيه التقدم نحو الـAGI فعليًا—وما لا يعنيه. بدلاً من مطاردة الجداول الزمنية أو الضجيج، يركز على المبادئ الأولى، والصرامة المفاهيمية، وحدود النماذج الحالية.

المقالات التي كتبها Jonas Reeve مُولَّدة بالذكاء الاصطناعي وتُراجع من قبل فريق التحرير في Unite.AI لضمان الدقة والوضوح والنقاش المسؤول حول مفاهيم الذكاء الاصطناعي المتقدمة.