شراكات
مختبر Thinking Machines Lab يوقع صفقة سنوية بقيمة $65M لخدمة Crusoe Cloud Inference

Crusoe وThinking Machines Lab أعلن عن اتفاقية سنوية بقيمة $65 مليون في 23 سبتمبر 2026، لتشغيل الاستدلال لنماذج المختبر المفتوحة على Crusoe Cloud، مع تشغيل أعباء العمل الإنتاجية على نشر مخصص لأنظمة NVIDIA HGX B200 عبر Crusoe Managed Inference.
البيان، المؤرخ في سان فرانسيسكو، يوضح أن Thinking Machines Lab سيقدم مجموعة من أعباء العمل الإنتاجية، بما في ذلك نماذج Inkling، وGLM 5.2 و5.3، والمتغيرات المُحسّنة الخاصة به، على نشر مخصص لأنظمة NVIDIA HGX B200 المتصلة بشبكة NVIDIA Quantum-2 InfiniBand. وصفت Crusoe هذا النشر بأنه مصمم لتقديم خدمة عالية الإنتاجية وفعّالة من حيث التكلفة على نطاق واسع.
ستقوم Crusoe بتشغيل ودعم العنقود مباشرةً كنشر مخصص، والذي يصفه البيان بأنه نقطة نهاية مخصصة، مُقَيَّمة، مدعومة باتفاقية مستوى الخدمة (SLA) تهدف إلى توفير أداء‑سعر لـ Thinking Machines Lab ومساحة للتوسع دون الحاجة لإدارة مجموعة الاستدلال الخاصة به. وفي البيان، تصف Crusoe نفسها بأنها أول مزود بنية تحتية للذكاء الاصطناعي مدمج عمودياً في الصناعة.
خيارات الاستدلال المُدار ومحرك MemoryAlloy
على صفحة منتج Managed Inference من Crusoe، تعرض الشركة النشرات المخصصة كأعلى مستوى من التحسين: يجلب العميل النموذج ويحدد المتطلبات بينما تتولى Crusoe الباقي، مع نقطة نهاية مخصصة ومُقَيَّة مخصصة للنماذج المملوكة، وتحسين استدلال مخصص، وأداء مدعوم باتفاقية مستوى الخدمة (SLA).
توضح الصفحة أيضاً الاستدلال بدون خادم (Serverless Inference)، الاستهلاك القائم على الاستخدام للنماذج مفتوحة المصدر عبر واجهة برمجة تطبيقات مُدارة بالكامل في Crusoe Intelligence Foundry، والنشرات ذاتية الخدمة (Self-Serve Deployments) المتاحة الآن للجميع، التي تشغّل النماذج في Foundry مع استدلال مُحسّن للإنتاجية أو الاستجابة، بما في ذلك النماذج المخصّصة بميزة الضبط الدقيق بدون خادم (Serverless Fine-Tuning) الخاصة بالشركة. يُقدَّم Foundry نفسه كمنصة للمطورين لاكتشاف النماذج، وإنشاء مفاتيح API، ومراقبة مقاييس الأداء، ونشر نقاط النهاية المُدارة.
تقول Crusoe إن محرك الاستدلال الخاص بها مدعوم بـ MemoryAlloy، وهو نسيج ذاكرة أصلي للمجموعة يستمر عبر العقد ويتيح توجيهًا ذكيًا لإلغاء حسابات الملء المكررة. وتفيد الشركة بأنها تحقق تسارعًا يصل إلى 9.9× في زمن الحصول على أول رمز، وإنتاجية أعلى بـ 5× باستخدام فك الترميز التخميني والتجميع الديناميكي، وهذه الأرقام تم اختبارها مقارنةً بـ vLLM الذي يخدم نموذج Llama-3.3-70B في نشر مكوّن من أربع عقد.
نماذج Inkling وGLM
تشمل أعباء العمل المذكورة في الاتفاقية عائلة Inkling الخاصة بالمختبر. أصدر Inkling في 15 يوليو 2026، واصفًا إياه بأنه محول Mixture-of-Experts ذو أوزان مفتوحة مع 975 مليار معامل إجمالي و41 مليار معامل نشط، يدعم نافذة سياق تصل إلى 1 مليون رمز. وفقًا للمختبر، تم تدريب Inkling مسبقًا على 45 تريليون رمز تشمل النصوص والصور والصوت والفيديو، وكانت هذه الجهود أول تشغيل تدريب رئيسي للمختبر، تم على أنظمة NVIDIA GB300 NVL72.
إلى جانب Inkling، قدم المختبر نسخة Inkling-Small، وهو نموذج Mixture-of-Experts أخف وزنًا بـ 276 مليار معامل مع 12 مليار معامل نشط يحمل مقايضات مختلفة بين الأداء والكمون. تم نشر الأوزان الكاملة لـ Inkling على Hugging Face، ككل من نقطة التحقق الأصلية ونقطة تحقق NVFP4 للاستدلال الفعال على أنظمة NVIDIA Blackwell، كما يتوفر النموذج للضبط الدقيق على Tinker، منصة تخصيص النماذج الخاصة بالمختبر، مع خيارات طول سياق 64K و256K.
كما يضع الاتفاق أيضًا GLM 5.2 و5.3 ضمن أعباء العمل الإنتاجية للمختبر على الخدمة. تُظهر مركز نماذج Managed Inference من Crusoe GLM 5.3 من Z.ai بـ 753 مليار معامل وسياق يبلغ 1,000,000 رمز، وGLM 5.3 Flash بـ 320 مليار معامل، كلاهما متاحان للاستدلال بدون خادم.
بيانات تنفيذية وخطط التوسع
“نقلنا Crusoe Managed Inference من مرحلة التقييم إلى الإنتاج بسرعة وتوافق مع المعايير التي نطبقها على أنظمتنا الخاصة، مما منحنا القدرة الاقتصادية والقدرة على التوسع لإعادة الاستثمار في البحث الذي يُعد جوهر عملنا”, قال Myle Ott، قائد البنية التحتية للذكاء الاصطناعي في Thinking Machines Lab.
قال Erwan Menard، نائب الرئيس الأول لإدارة المنتجات في Crusoe Cloud: إن Thinking Machines Lab يمتلك فريق هندسة متطور يتوقع من الشركاء الالتزام بمعاييره العالية مع توسعه. وأضاف أن Crusoe بنى Managed Inference لتقديم بنية تحتية موثوقة وفعّالة من حيث التكلفة، بالإضافة إلى استدلال وأدوات دورة حياة النموذج كخدمة، حتى تتمكن الشركات من تشغيل نماذجها المختارة في الإنتاج على نطاق واسع.
وأشارت الشركتان إلى أنهما تتطلعان أيضًا إلى التوسع في الاستدلال الدفعي لتوليد بيانات اصطناعية على نطاق واسع، وهو ما تصفه البيان بأنه تحويل الاستدلال إلى عجلة دائرية للبحث. وقالت Crusoe إن Thinking Machines Lab تنضم إلى قائمة العملاء الذين تجاوزت خدمة Crusoe Managed Inference فيها 100 مليون دولار من الإيرادات المتعاقد عليها (ARR) في أقل من عام من الإطلاق.












