نماذج ومنصات الذكاء الاصطناعي

GLM-5.3 يحصل على 60 في مؤشر الذكاء الاصطناعي من Artificial Analysis، مساويًا لـ Kimi K3

mm
أضف Unite.AI إلى مصادرك المفضلة على Google

تم تقييمه من قبل Artificial Analysis على مقياس الذكاء الخاص به وحصل على 60، وفقًا لتقرير المُقَيِّم المستقل الصادر في 18 أغسطس 2026، مما يضع نموذج التفكير الأحدث للمختبر الصيني على نفس مستوى Kimi K3 من Moonshot AI وعلى بعد ثلاث نقاط من Claude Opus 5 من Anthropic، القائد الحالي الذي يحصل على 63.

تشمل الدرجة تشغيل GLM-5.3 بأقصى جهد تفكير، وهو الإعداد الذي توصي به Z.ai لأعمال الترميز. وبدرجة 60، يتفوق كثيرًا على المتوسط البالغ 35 من بين 181 نموذجًا في فئة المقارنة، ويحتل المرتبة الثامنة في الفئة ككل.

هذه النتيجة هي أول قراءة مستقلة لنموذج أطلقته Z.ai في 14 أغسطس 2026 بتصميم غير عادي: يستخدم GLM-5.3 نفس النموذج الأساسي كما في GLM-5.2، وجميع تحسينات القدرات تأتي من التدريب اللاحق بدلاً من تشغيل تدريب مسبق جديد.

كيف وصل GLM-5.3 إلى هنا

تصف منشور إصدار Z.ai شهرًا من توسيع التعلم التعزيزي على بيئات مهام طويلة الأمد: المزيد من البيئات، ومهام أكثر تنوعًا، ومزيدًا من الحوسبة، كل ذلك على بنية التدريب التي بنها المختبر لـ GLM-5.2. وأفادت الشركة أن هذا النهج رفع مستوى Terminal-Bench 3.0 من 4.6 إلى 28.3 وDeepSWE v1.1 من 46.2 إلى 66.9، كما يوثق منشورها الخاص مجموعة من النتائج عبر الترميز، والأمن السيبراني، ومعايير الوكيل مقارنةً بـ Kimi K3، وClaude Opus 4.8، وClaude Fable 5، وGPT-5.6 Sol. غطى Unite.AI الإطلاق ونتائجه الأمنية الناشئة بالتفصيل عندما تم شحن النموذج الأسبوع الماضي.

تحمل قيمة Artificial Analysis وزنًا مختلفًا عن تلك الجداول التي تُبلغها البائعون، لأن المُقَيِّم يُجري مجموعته الخاصة بنفسه. يجمع مؤشر الذكاء الإصدار 4.1.1 تسع تقييمات تشمل مهام عمل واقعية للوكيل، واستخدام أدوات الوكيل، والترميز الطرفي، والتفكير العلمي والمعرفة، وأسئلة العلوم على مستوى الدراسات العليا، وتفكير الفيزياء، وموثوقية المعرفة والهلوسة، وتفكير السياق الطويل. إن 60 التي حصل عليها GLM-5.3 هي مركبة نتائجه عبر تلك السلسلة، بتكلفة تقييم إجمالية قدرها $1,238.50 على واجهة برمجة تطبيقات Z.ai.

أين يضع GLM-5.3 نفسه على لوحة الصدارة

المساواة مع Kimi K3 هي المقارنة الرئيسية. Kimi K3، صُدر في 16 يوليو 2026، وحصل على نفس الدرجة 60 في المؤشر ولا يزال النموذج المفتوح الوزن الأعلى تصنيفًا في تصنيفات Artificial Analysis، وهو موقع يشاركه الآن GLM-5.3 من حيث النتيجة إذا لم يكن من حيث الترخيص. فتحت أوزان Kimi K3 تحت ترخيص مبني على الإيرادات في يوليو 2026؛ ويُصنَّف GLM-5.3 حاليًا كملكي، مع تسجيل Artificial Analysis 753 مليار معلمة لهذا النموذج.

Claude Opus 5، صُدر في 24 يوليو 2026 لا يزال يتصدر المؤشر بـ 63. الفجوة ذات الثلاث نقاط بين GLM-5.3 والقائد هي المسافة التي لم يغلقها دورة تدريب لاحقة سريعة، مقابل جبهة تطورت نفسها منذ الربيع.

السعر هو المجال الذي يختلف فيه النموذجان الحاصلان على 60 بشكل حاد. يكلف GLM-5.3 1.40 دولار لكل مليون رمز مدخل و4.40 دولار لكل مليون رمز مخرج على واجهة برمجة تطبيقات Z.ai، مقارنةً بـ 3.00 دولار و15.00 دولار لـ Kimi K3 على منصة Moonshot. لكل مهمة في مؤشر الذكاء، ينتج ذلك تكلفة 0.68 دولار لـ GLM-5.3 مقابل 0.84 دولار لـ Kimi K3 و2.34 دولار لـ Claude Opus 5. يصل GLM-5.3 إلى درجته بأقل تكلفة لكل مهمة من بين الثلاثة، رغم أنه الأكثر إطالة في المجموعة، حيث يولد 170 مليون رمز مخرج عبر مجموعة التقييم مقارنةً بمتوسط 72 مليون في فئته.

ما سيُطلق لاحقًا

يتوفر GLM-5.3 عبر واجهة برمجة تطبيقات Z.ai وتم طرحه لجميع مشتركي خطة ترميز GLM. يتطلب النموذج تفعيل خاصية التفكير، مع ثلاثة مستويات جهد، وتُحذّر Z.ai من أن التطبيقات التي لا تزال تستدعيه دون تمكين التفكير ستفشل حتى يتم ترحيلها.

الأوزان هي الجزء المتبقي. تعهدت Z.ai بإصدارها بعد أسبوعين من إطلاق 14 أغسطس 2026، بمجرد إكمال تقييم السلامة وتعزيز الأمان، مما سيضع GLM-5.3 جنبًا إلى جنب مع Kimi K3 كخيار أوزان مفتوحة عند علامة 60 في المؤشر، وبسعر تقريبًا نصف السعر لكل رمز.

جوناس ريف هو محلل منشأ بالذكاء الاصطناعي في Unite.AI، يركز على الذكاء الاصطناعي الإدراكي والذكاء الاصطناعي العام (AGI) والأسس النظرية للذكاء الآلي. يعمل على كيفية ظهور التعلم والاستدلال والذاكرة والاستخراج في الأنظمة البيولوجية والاصطناعية، ورسم الصلات بين هياكل الذكاء الاصطناعي الحديثة والأسئلة القديمة في العلوم الإدراكية وفلسفة العقل.
مع نهج概念ي واعٍ، يبحث جوناس في الإطارات مثل نماذج الاستدلال والأنظمة الوكيلية والاعتراف الناشئ ونظرية التوجيه، بهدف توضيح ما يعنيه التقدم نحو AGI بالفعل - وما لا يعنيه. بدلاً من مطاردة الجداول الزمنية أو الهياج، يؤكد على المبادئ الأولى والصقل المفاهيمي وحدود النماذج الحالية.
المقالات التي كتبها جوناس ريف هي منشأة بالذكاء الاصطناعي ومراجعة بواسطة فريق تحرير Unite.AI لضمان الدقة والوضوح والمناقشة المسؤولة للمفاهيم المتقدمة للذكاء الاصطناعي.