نماذج ومنصات الذكاء الاصطناعي

إطلاق SpaceXAI لجروك 4.6 لأجهزة العميل الطويلة الأمد

mm
أضف Unite.AI إلى مصادرك المفضلة على Google

أعلنت شركة SpaceXAI، الشركة التي كانت تعرف سابقًا باسم xAI، عن إطلاق جروك 4.6 في 12 أغسطس 2026، وهو نموذج علمي جديد مبني على أجهزة العميل الطويلة الأمد والعمل التفاعلي والبصري الأكثر طموحًا. يتوفر النموذج في نفس اليوم في محرر Cursor و أداة بناء جروك الخاصة بالشركة، بالإضافة إلى من خلال واجهة برمجة التطبيقات، بسعر يبدأ من 2 دولار لكل مليون رمز إدخال و 6 دولارات لكل مليون رمز إخراج، وفقًا لبيان الشركة.

يستند جروك 4.6 على جروك 4.5 ويمتد لتحقيق تقدم الشركة في مجال الترميز العميلي والعمل المعرفي.

ما الذي يفعل جروك 4.6

تصف الشركة جروك 4.6 على أنه نموذج “يظل مع المهام المعقدة عبر العديد من الخطوات”، سواء كان ذلك البحث في موضوع أو العمل عبر قاعدة بيانات أو تحويل فكرة منتج واسعة إلى نسخة أولية تعمل من التطبيق. على المسارات الأطول، تقول الشركة إنها لاحظت المزيد من الاختبارات الذاتية والتحقق، حيث يقوم النموذج بفحص عمله الخاص قبل الانتقال، وتمريرات أولية أقوى على المشاريع التفاعلية والبصرية مقارنةً بجروك 4.5.

تستند المكاسب القدرة على جولة تدريب إضافية أطول من جروك 4.5. استخدمت SpaceXAI بيانات نموذجية معالجة لتحسين المفاهيم الفنية والتقنية، ومحسّنًا، و مسارات SFT معاد تدويرها بواسطة جروك 4.5 عبر مجهودات العقلانية، وأحزمة الوكلاء، والمناطق بما في ذلك STEM، و هندسة البرمجيات، والعمل المعرفي، مع تصفية التتبعات المشكلة بواسطة فحوصات نموذجية. ثم تم تدريب النموذج على مجموعة من مهام التعلم التعزيزي للوكيل، بما في ذلك بيئات محددة للنواة، وتطوير الويب، وتصميم الحاسوب.

سباق البenchmarks

تقرر SpaceXAI أن جروك 4.6 يتوافق مع GPT-5.6 Sol من OpenAI على دليل الذكاء التحليلي الاصطناعي، وهو مركب من تسعة اختبارات، مع حصول كلا النموذجين على 61، خلف Fable 5 Max من Anthropic عند 62، وأمام جروك 4.5 High عند 56. تظهر جدول التقييم الخاص بالشركة صورة أكثر تعقيدًا عبر الاختبارات الفردية.

على اختبار DeepSWE v1.1 للهندسة البرمجية، سجل جروك 4.6 65.9٪، بزيادة عن 54٪ لجروك 4.5، لكنه يأتي في المرتبة الثانية بعد GPT-5.6 Sol Max عند 73٪. على Terminal-Bench v3.0، بلغ 26٪، قفزة كبيرة من 15.7٪ لجروك 4.5، لكنه يأتي بعيدًا عن 34٪ تقريبًا التي سجلها GPT-5.6 Sol Max و Fable 5 Max. قاد الحقل على GDPVal-AA v2، وهو تقييم للعمل المعرفي، عند 1753، وسجل مكاسب على CursorBench و FrontierCode. الأرقام هي نتائج الشركة، مع نتائج النماذج الثالثة التي تم الحصول عليها من النتائج المعلنة أو المتاحة علنًا، ولم يتم تأكيد أي منها من قبل التقييم المستقل.

يأتي الإطلاق في جزء مزدحم من السوق. لقد كانت Anthropic تدفع خط Opus نحو الذكاء الحدودي بأسعار جريئة، و GPT-5.6 من OpenAI هو الهدف الحالي للترميز العميلي. استراتيجية SpaceXAI هي المنافسة على السعر والتوزيع بقدر القدرة الخام: عند 2 دولار لكل مليون رمز إدخال، يقلل جروك 4.6 من العديد من المنافسين الحدوديين، وتقدم الشركة ضعف الاستخدام المضمن في Grok Build و Cursor خلال الأسبوع الأول لجذب المطورين إلى النموذج. بخلاف Cursor و Grok Build، إنه متاح أيضًا من خلال الشركاء بما في ذلك OpenRouter، و Vercel، و Cloudflare.

شركة جديدة خلف النموذج

جروك 4.6 هو الإعلان الأكثر وضوحًا عن المنتج حتى الآن من شركة تم إعادة هيكلتها بالكامل خلال العام الماضي.

جروك 4.6 هو أول نموذج علمي يحمل اسم SpaceXAI من البداية، وتظهر أسعاره وتوزيع الشركاء والتركيز العميلي على وضع قسم جروك كمنصة مطور وشركات بدلاً من كونه ميزة من شبكة X الاجتماعية.

إيفان ميرسير هو مراسل مولد بالذكاء الاصطناعي في Unite.AI ، يغطي شركات الذكاء الاصطناعي الناشئة ، ورأس المال الاستثماري ، وديناميات التمويل التي تشكل الجيل التالي من الشركات التكنولوجية. يركز تقريره على الابتكار في مرحلة مبكرة ، وتدفقات رأس المال ، والقرارات الاستراتيجية التي يتخذها المؤسسون والمستثمرون عندما تتوسع شركات الذكاء الاصطناعي من مفهوم إلى تأثير عالمي.
مع عدسة استراتيجية وتحليلية ، يفحص إيفان جولات التمويل ، وتحديد المواقف في السوق ، والاتجاهات الناشئة عبر النظام الإيكولوجي لشركات الذكاء الاصطناعي الناشئة. يتابع كيف يتقاطع رأس المال الاستثماري ، والاستثمار الشركي ، والأسواق العامة مع الابتكارات في الذكاء الاصطناعي ، مفصلاً الإشارات المتينة عن الدعاية قصيرة الأمد.
المقالات التي كتبها إيفان ميرسير هي مولدة بالذكاء الاصطناعي ومراجعة من قبل فريق التحرير في Unite.AI لضمان الدقة والسياق والتغطية المسؤولة لمشهد الاستثمار العالمي في الذكاء الاصطناعي