نماذج ومنصات الذكاء الاصطناعي

كشفت Cerebras عن Qwen3‑235B: عصر جديد للسرعة وال规模 والتكلفة في مجال الذكاء الاصطناعي

mm
أضف Unite.AI إلى مصادرك المفضلة على Google

Cerebras Systems (CBRS ) أطلقت رسميًا Qwen3‑235B، وهو نموذج ذكاء اصطناعي متقدم مع دعم سياق كامل يصل إلى 131,000 رمز، مما يحدد معيارًا جديدًا للأداء في الاستدلال والتحليل والعمليات على مستوى الشركات. والآن متاح عبر سحابة الاستدلال من Cerebras، يقدم النموذج قدرات تتنافس مع الأنظمة الأكثر تقدمًا في السوق اليوم – مع تشغيل 30 مرة أسرع وبعشر مرات أقل من التكلفة مقارنة بالموديلات المغلقة الرائدة.

الاستدلال بالذكاء الاصطناعي في الوقت الفعلي يصل إلى سرعة كبرى

كان الاستدلال بالذكاء الاصطناعي تاريخيًا بطيئًا، حيث تتخذ النماذج الكبيرة دقيقة أو أكثر للاستجابة للاستفسارات المعقدة. تُقدم Cerebras حلًا لهذا العائق. مدعومًا بمحرك Wafer-Scale Engine 3 (WSE‑3) الخاص به، يصل Qwen3‑235B إلى 1500 رمز في الثانية، وهو رقم قياسي عالمي لاستدلال الذكاء الاصطناعي المتقدم.

مستوى الأداء هذا يغير تجربة المستخدم – حيث يقلل من التأخير من 60-120 ثانية إلى 0.6 ثانية فقط، حتى عند معالجة مهام استدلال متقدمة أو تشغيل عمليات متعددة مثل التوليد المعزز بالاسترجاع (RAG). وفقًا لنتائج الاختبار من Artificial Analysis، لا يوجد مورد آخر – مفتوح أو مغلق – يتطابق مع هذه السرعة لنموذج متقدم.

معيار جديد في السياق: 131K رمز للتطبيقات في العالم الحقيقي

بالتزامن مع هذا الإطلاق، وسعت Cerebras نافذة سياق نموذجها من 32K إلى 131K رمز الكامل المدعوم من Qwen3‑235B. هذا القفزة في حجم السياق تمكن النموذج من استهلاك وتنظيم كميات هائلة من البيانات – تشمل قواعد الشفرة الكاملة، ومستودعات الوثائق المتعددة، والمواد الفنية الطويلة.

في حين يسمح السياق 32K بمهام التوليد الأساسية، يفتح 131K الباب أمام التطوير على مستوى الإنتاج. يمكن للذكاء الاصطناعي الآن أن يعمل كشريك عميق في الكود، حيث يدمج عشرات الملفات ويدير التبعيات المعقدة في الوقت الفعلي – مما يجعله مثاليًا لاستخدامات الشركات في هندسة البرمجيات وتحليل الوثائق والحوسبة العلمية.

لماذا تختلف Cerebras: الأجهزة المصممة للذكاء الاصطناعي من الألف إلى الياء

تأسست Cerebras Systems من قبل فريق من المعماريين الحاسوبيين الرائدين وباحثي الذكاء الاصطناعي ومهندسي الأنظمة، وتبنت подходًا مختلفًا جذريًا لحل تحديات توسيع الذكاء الاصطناعي التوليدي. بدلاً من الاعتماد على مجموعات معالجات الرسومات، بنت Cerebras حاسوبًا فائقًا مخصصًا للذكاء الاصطناعي حول شريحةها الخاصة: Wafer-Scale Engine 3.

هذه الشريحة لا تشبه أي شيء في الصناعة. وهي تمتد إلى حجم صفيحة الطعام وتحتوي على مئات الآلاف من النواة المثلى للذكاء الاصطناعي مع ذاكرة على الشريحة تُقاس بالغيغابايت. هذا التصميم يسمح للمعالجة والذاكرة بالجلوس جنبًا إلى جنب – مما يلغي التأخير والقيود الناتجة عن عرض النطاق الترددي وتعقيد التأليف في حلول معالجات الرسومات التقليدية.

من خلال تجميع أنظمة CS-3، يمكن لـCerebras إنشاء حواسيب فائقة قادرة على تشغيل نماذج تصل إلى تريليونات المعاملات بسهولة، مع تجنب العبء الفني للحوسبة الموزعة. هذا النهج الموحد هو أساس السرعات القياسية للاستدلال والقدرات الجديدة ذات السياق العالي.

كفاءة MoE تمكن من خفض التكلفة بشكل كبير

تم بناء Qwen3‑235B باستخدام هيكل مزيج من الخبراء (MoE) – وهو تصميم نموذج يُنشط فقط جزءًا من الخبراء الداخليين حسب الإدخال، مما يؤدي إلى تحسين كبير في الكفاءة الحسابية.

بسبب ذلك، يمكن لـCerebras تقديم النموذج بسعر يقل بشكل كبير عن البدائل المغلقة. على وجه التحديد، يتوفر الاستدلال بسعر 0.60 دولار لكل مليون رمز إدخال و1.20 دولار لكل مليون رمز إخراج، مما يمثل تخفيضًا بنسبة أكثر من 90% في التكلفة مقارنة بالنماذج المملوكة من OpenAI وAnthropic وGoogle.

التكامل السلس مع Cline في VS Code

لإظهار سرعة Qwen3‑235B وتطبيقاته في العالم الحقيقي، قامت Cerebras بشراكة مع Cline، وهو وكيل الترميز الرائد داخل Microsoft Visual Studio Code، والذي تم تثبيته حاليًا بواسطة أكثر من 1.8 مليون مطور.

يمكن لمستخدمي Cline الوصول إلى Qwen3‑32B مع سياق 64K كجزء من الطبقة المجانية. مع هذا الإعلان، سيتوسع الدعم ليشمل Qwen3‑235B وسياقه الكامل البالغ 131K، مما يُمكن مستوىً من الاستدلال والتوليد داخل المحرر لم يكن ممكنًا في الوقت الفعلي من قبل.

سعود ريزوان، الرئيس التنفيذي لشركة Cline، أوضح، “مع استدلال Cerebras، يحصل مطورو Cline على نظرة على المستقبل، حيث يستدل Cline من خلال المشاكل ويتعامل مع قواعد الشفرة ويكتب الشفرة في الوقت الفعلي تقريبًا. كل شيء يحدث بسرعة لدرجة أن المطورين يبقون في تدفقهم، ويتكرر بسرعة الفكر. هذا النوع من الاستدلال السريع ليس فقط لطيفًا – إنه يُظهر لنا ما هو ممكن عندما يتوافق الذكاء الاصطناعي حقًا مع المطورين.“

بديل مفتوح للموديلات المغلقة

أداء Qwen3‑235B على قدم المساواة مع بعض النماذج الأكثر تطورًا في السوق اليوم، بما في ذلك Claude 4 Sonnet وGemini 2.5 Flash وDeepSeek R1، كما تم التحقق من ذلك من خلال الاختبارات المستقلة. ومع ذلك، تقدم Cerebras ذلك بصيغة مفتوحة، مع شفافية وتنقل يفتقدهما النماذج المغلقة.

يمنح هذا النهج المفتوح للموديل الشركات القدرة على:

  • تخصيص وتحسين النموذج على بيانات مملوكة
  • نشر الذكاء الاصطناعي على البنية التحتية الخاصة أو في بيئات السحابة الهجينة
  • تجنب قفل البائع والمخاطر المتعلقة بخصوصية البيانات

باستخدام منصة السحابة القابلة للتطوير من Cerebras وتنفيذ نظام CS-3 اختياريًا على الموقع، تكتسب المنظمات السيطرة الكاملة على كيفية تطبيق الذكاء الاصطناعي على المهام الحيوية.

ما يعنيه هذا للصناعة

يُشكل إطلاق Qwen3‑235B نقطة تحول. أعادت Cerebras تعريف الحدود لما هو ممكن مع نماذج اللغة الكبيرة من خلال الجمع بين الذكاء المتقدم والسرعة والكفاءة التكلفة.

من الآن فصاعدًا، من الممكن بناء أدوات ذكاء اصطناعي:

  • الاستجابة في الوقت الفعلي لاستفسارات المطورين
  • الاستدلال على وثائق كاملة أو قواعد المعرفة
  • توليد وتحليل شفرة على مستوى الإنتاج مباشرة داخل بيئة التطوير
  • توسيع نطاق استخدامات الشركات دون انتشار معالجات الرسومات أو فواتير الاستدلال الشهرية البالغة ستة أرقام

مع نمو الطلب على البنية التحتية للذكاء الاصطناعي، تُظهر Cerebras أنك لا تحتاج إلى التنازل بين الأداء والأسعار والانفتاح. تصميم الأجهزة والبرمجيات المشترك، من محرك Wafer-Scale إلى سحابة الاستدلال من Cerebras، يشير إلى نموذج جديد لتنفيذ الذكاء الاصطناعي – أسرع وأبسط وأكثر سهولة.

الفكرة النهائية

من خلال إطلاق Qwen3‑235B مع سياق 131K واستدلال فائق السرعة وتسعير الرموز بأسعار معقولة، وضعت Cerebras Systems نفسها كواحدة من المنافسين الحقيقيين للرائدين في سوق معالجات الرسومات. بالنسبة للشركات والباحثين والمطورين، هذا الإطلاق ليس فقط نموذجًا أسرع – إنه نقطة انعطاف تُجلب الذكاء الاصطناعي في الوقت الفعلي وعلى مستوى الإنتاج والمفتوح في متناول اليد.

أنطوان هو قائد رؤيوي وشريك مؤسس في Unite.AI، مدفوعًا برغبة لا تكل في تشكيل وتعزيز مستقبل الذكاء الاصطناعي والروبوتات. وهو رائد أعمال متسلسل، يعتقد أن الذكاء الاصطناعي سيكون مدمرًا للمجتمع مثل الكهرباء، وغالبًا ما يُقبض عليه وهو يثرثر عن إمكانات التكنولوجيا المثيرة للدهشة والذكاء الاصطناعي العام.

كما أنه مستقبلي، فهو مخصص لاستكشاف كيف ستشكل هذه الابتكارات العالم. بالإضافة إلى ذلك، فهو مؤسس Securities.io، وهي منصة تركز على الاستثمار في التكنولوجيا المتقدمة التي تعيد تعريف المستقبل وتعيد تشكيل القطاعات بأكملها.