نماذج ومنصات الذكاء الاصطناعي
تشغيل Cerebras لنموذج OpenAI GPT-5.6 Sol بسرعة 750 رمزًا في الثانية في طبقة Ultrafast الجديدة

يُعد Cerebras الآن قائدًا لنموذج OpenAI الرائد بسرعة لم تتطابق معها أي سحابة GPU بشكل عام. في 13 أغسطس 2026 ، أعلنت شركة تصنيع الشريحة على الوفرة أنه يُقدم GPT-5.6 Sol على طبقة جديدة من خدمة OpenAI تسمى Ultrafast ، وتقدم ما يصل إلى 750 رمزًا للخروج في الثانية ، ووفقًا لما ذكره OpenAI ، تشغيل النموذج بسرعة تصل إلى 14 مرة أسرع من معالجة المعيار. تُطلق Ultrafast أولاً في واجهة برمجة تطبيقات OpenAI كتجربة محدودة لمجموعة مختارة من العملاء ، مع توسيع الوصول مع نمو السعة.
الادعاء في المركز هو ادعاء محدد: ذكاء الحدود بدون عقوبة السرعة. يُعد GPT-5.6 Sol نموذج OpenAI الأكثر قدرة ، وعلى سيليكون Cerebras ، يُنشئ الرموز بسرعة كافية لتكون داخل المنتجات في الوقت الفعلي بدلاً من وراء وظيفة الدفعة الليلية. يُطارح كلا الشركةين الطبقة لإزالة التبادل بين نموذج ذكي بما يكفي للعمل ذو مخاطر عالية وواحد سريع بما يكفي لاستخدامه أثناء حدوث العمل.
أرقام السرعة وراء Ultrafast
تُعد 750 رمزًا للخروج في الثانية هي العنوان الرئيسي ، ولكن المقارنات الأكثر إقناعًا هي التشغيلات المواجهة التي نشرتها Cerebras. ضد سرعات الإخراج التي أبلغ عنها Artificial Analysis ، تقول الشركة إن GPT-5.6 Sol على Ultrafast يُشغل بسرعة 11 مرة أسرع من Claude Fable 5 و 5 مرات أسرع من Opus 4.8 في وضع السرعة.
كما قامت Cerebras بتشغيل الطبقة خلال ممر كامل لامتحان Humanity’s Last Exam ، وهو معيار مقترح عند مستوى الدكتوراه. أجاب GPT-5.6 Sol على Ultrafast على جميع أسئلة الامتحان في 11 ساعة و 11 دقيقة ؛ احتاج Claude Fable 5 إلى 78 ساعة و 27 دقيقة للوصول إلى استنتاجات قابلة للمقارنة: أبطأ بنسبة 7 مرات ، وفقًا لما ذكره Cerebras. على GDP-Val ، وهو معيار للعمل المعرفي ذو القيمة الاقتصادية ، تقارن الشركة بسرعة 5.6 مرة في النهاية مع معالجة المعيار بدون تدهور في الجودة.
هذه هي التقييمات التي قامت بها الشركة ، و Cerebras صريحة بشأن ذلك: كانت المقارنة مع Humanity’s Last Exam مقياسًا بواسطة Cerebras في 10 يوليو و 13-15 يوليو 2026 ، و جاءت نسبة GDP-Val من اختبارها الخاص في 31 يوليو 2026. اعتبرها قياسات الشركة الخاصة ، وليس نتائج مستقلة.
لماذا تفوز الشريحة على الوفرة في التأخير
الآلية مهمة هنا ، لأنها تفسر لماذا شركة شريحة صغيرة نسبيًا تخدم نموذج OpenAI الأكبر بسرعات لم تتطابق معها الرائدين في GPU. يُعد الاستدلال السريع على نموذج كبير بشكل أساسي مشكلة في نقل البيانات: على GPUs ، يجب نقل أوزان النموذج بشكل متكرر بين الذاكرة على الشريحة وتخزين خارج الشريحة لإنشاء كل رمز متتالي ، وتصبح عرض النطاق الترددي للذاكرة الحاجز.
جاءت إجابة Cerebras بإزالة هذا النقل. يحتوي محرك الوفرة على 44 غيغابايت من ذاكرة الوصول العشوائي على شريحة واحدة بحجم الوفرة ، بحيث تبقى أوزان النموذج على الشريحة وتتدفق الرموز عبر الطبقات المخططة عبر الوفرة دون انقطاع. لأن الأوزان لا تترك السيليكون ، تتناسب هذه الطريقة مع حجم النموذج — وهو حجة الشركة أن ميزة السرعة تظل مع نمو نماذج الحدود. من أجل اقتصاد الاستدلال ، هذه هي اللعبة بأكملها: يُهيمن تكلفة تشغيل النموذج وتأخيره على كيفية تغذية الأوزان إلى الحوسبة ، والاحتفاظ ب 44 غيغابايت على شريحة واحدة يهاجم ذلك مباشرة.
شراكة بقيمة 10 مليارات دولار تصل إلى الرائد
تُعد Ultrafast أكثر المنتجات ظهورًا حتى الآن من العلاقة التي كانت قيد البناء لشهرين. قامت OpenAI باختيار Cerebras من أجل 10 مليارات دولار في حوسبة التأخير المنخفض في وقت سابق من عام 2026 ، وتضع هذه الإطلاق هذه السعة خلف نموذج الشركة الرائد بدلاً من نموذج أصغر أو متخصص. يصف OpenAI Ultrafast بأنه “الخطوة التالية” في الشراكة لجلب استدلال التأخير الفائق لل低 إلى منصته.
من أجل Cerebras ، تكون الموضع مهمة. لقد جادلت الشركة الناشئة منذ فترة طويلة بأن هيكلها على الوفرة هو الشكل الصحيح للاستدلال حتى مع وجود مركز الجاذبية في السوق مع موردي GPU — وهو صراع يحدث عبر أعمال التسريع مع تحرك الرائدين لدمج النماذج مباشرة في سيليكونهم. تمنح شركة Cerebras حسابًا إنتاجيًا مرجعيًا في الجزء العلوي من السوق بتموضع طبقة الخدمة لنموذج OpenAI الرائد. يُثبت النموذج نفسه خط GPT-5.6 الذي أطلقته OpenAI (Sol كنموذج رائد ، إلى جانب Terra المتوازن و Luna الكفء للتكلفة) ، بحيث ترتبط Ultrafast مع Cerebras في مقدمة هذا الترتيب.
من يحصل عليه وما هو من أجله
تُوجّه OpenAI الطبقة إلى عمل ذو مخاطر عالية وحساس للزمن: استجابة للحوادث أثناء استمرار انقطاع ، وأبحاث مالية أثناء حركة ظروف السوق ، ودعم العملاء في الوقت الفعلي والصوت والتجارة والبحث المباشر الذي كان يُجرى في وقت لاحق. تلقى الوصول المبكر إلى الشركات عبر الترميز والتجارة والمالية ، بما في ذلك Jane Street و Podium و Basis و Rogo.
> “الزيادة في السرعة التي جلبها Cerebras مثيرة للإعجاب” ، قال جون كريبزي ، مساعد الذكاء الاصطناعي في Jane Street ، في إعلان OpenAI. “إنه يُمكّن طرقًا مختلفة لاستخدام النماذج ، ويجعل من العملي للمطورين العمل بطريقة أكثر تركيزًا وإنتاجية إلى جانبهم.”
تُحافظ OpenAI على إطلاق محدود عمدًا. تقول الشركة إنها تستخدم فترة المعاينة للتعلم من حيث يُخلق تغيير سرعة من الرتبة بسرعة أكبر ، وستوسع الوصول مع نمو السعة. كلاً من OpenAI و Cerebras يقبلان التسجيلات للحصول على تحديثات مع توسيع المعاينة.
ماذا يحدث بعد ذلك
المرئية القريبة هي السعة ، وليس القدرة. تُعد Ultrafast معاينة محدودة ، وتربط كلا الشركتين أي توافر أوسع بنمو السعة بدلاً من تاريخ محدد — لذلك يكون معدل التوسع هو الشيء الذي يجب مراقبته. السؤال الأطول هو ما إذا كانت ميزة الذاكرة على الشريحة لشركة Cerebras تظل مع نمو نماذج OpenAI ، وهو بالضبط الرهان الذي بُني عليه هيكل الوفرة.












