نماذج ومنصات الذكاء الاصطناعي
Salesforce تُطلق نموذج كوا للتفكير لـ Agentforce، مُدرب على Nemotron

أعلنت Salesforce وNVIDIA في 15 سبتمبر 2026 عن كوا، نموذج التفكير لإدارة علاقات العملاء (CRM) لمنصة Agentforce الخاصة بـ Salesforce، تم بناؤه بعد التدريب باستخدام نموذج Nemotron 3 Super من NVIDIA على مجموعة بيانات اصطناعية مملوكة مستندة إلى معرفة المؤسسات من ما يقرب من ثلاثة عقود من عمليات نشر CRM.
صفت Salesforce كوا بأنه أول نموذج تفكير CRM لها، صُمم خصيصًا لمساعدة الوكلاء على التفكير عبر سير عمل معقد ومتعدد الخطوات واستخدام الأدوات المناسبة لإنجاز المهام. في الإعلان المشترك للشركات، قال رئيس مجلس إدارة Salesforce والرئيس التنفيذي مارك بينيوف: “أكثر شيء قيم بنته Salesforce ليس منصتنا — بل المعرفة المتراكمة حول كيفية عمل الأعمال المؤسسية فعليًا. مع كوا، تُوضع المعرفة داخل النموذج نفسه.” وقال جينسن هوانغ، مؤسس ورئيس NVIDIA التنفيذي، إن نماذج Nemotron المفتوحة وفرت لـ Salesforce الأساس لنموذج CRM يمكنه التفكير والعمل بأمان.
أعلنت Salesforce أنها تتحكم في أوزان نموذج كوا وتقوم بعملية ما بعد التدريب والاستدلال بالكامل داخل حدود الثقة الخاصة بها، بحيث لا تعبر أي بيانات للعميل تلك الحدود أثناء الاستدلال. يوفّر كوا للعملاء خيارًا متخصصًا مستضافًا من قبل Salesforce لتشغيل حالات استخدام Agentforce.
البيانات التدريبية الاصطناعية وطريقة ما بعد التدريب
وفقًا لـ Salesforce، لم تُستخدم أي بيانات للعميل في تدريب كوا. تم بناء مجموعة التدريب بالكامل من سيناريوهات اصطناعية تغطي مهارات التفكير واستخدام الأدوات واتخاذ القرار التي يطبقها وكلاء Agentforce عبر سير عمل CRM مثل توليد العملاء المحتملين، تأهيل الفرص، وحل حالات الخدمة.
صُممت السيناريوهات لمحاكاة سير عمل المؤسسات الواقعية عبر أكثر من 14 صناعة، من بينها التصنيع، الخدمات المالية، الرعاية الصحية، والسفر. في كل سيناريو، تم إقران شخصية بمجموعة من المهام، وتم تخطيط تسلسل الإجراءات واستدعاءات الأدوات المطلوبة لتنفيذها مسبقًا.
في مرحلة ما بعد التدريب، طبقت Salesforce التعلم الخاضع للإشراف والتعلم المعزز باستخدام تحسين السياسة النسبية الجماعية (Group Relative Policy Optimization – GRPO)، مستفيدة من أدوات NVIDIA NeMo RL وNeMo Gym وNeMo AutoModel. وقالت Salesforce إن التدريب على مجموعة مستهدفة من المهام المؤسسية ذات الأولوية منح النموذج خبرة أعمق، مما علمه الوصول إلى الهدف عبر تسلسل من الإجراءات الصحيحة بدلاً من التوقف عند إجابة صحيحة فقط.
ورقة البحث والنتائج المبلغ عنها
في ورقة بحثية قُدمت إلى arXiv في 14 سبتمبر 2026، وصف مطورو النموذج كوا بأنه نتيجة تطبيق تعلم التعزيز باستخدام تحسين السياسة النسبية الجماعية (GRPO) على نموذج الأساس Nemotron-3-Super-120B المفتوح الوزن، باستخدام بيانات عامة ومُولدة اصطناعيًا دون أي بيانات للعميل. حدد المؤلفون أن المكوّن المميز للنموذج هو خط أنابيب من المحاكاة إلى المكافأة الذي يحوّل مواصفات سير العمل إلى مهام متعددة الأدوار مخصصة للشخصية، مع مكافآت مرتبطة بحل كل مهمة عبر استخدام الأدوات بنجاح للطلبات المعتمدة على البيانات. بالنسبة للمجالات المؤسسية، تُكتب تلك المواصفات بلغة Agent Script، اللغة التصريحية لـ Salesforce لبناء وكلاء Agentforce؛ بالنسبة لمجالات الاستخدام العام للأدوات، تم توليد بنية سير العمل مباشرة، مع استخدام نفس آلية المحاكاة والمكافأة المرسخة لتوجيه GRPO في كلا الحالتين.
أفاد المؤلفون أن كوا يتحسن على أساسه المفتوح الوزن عبر معايير الاستخدام العام للأدوات، والتفكير الوكيل، وCRM المؤسسية، مع أبرز تحسيناته في استخدام الأدوات المتعددة الأدوار، ويتجاوز خط أساس قوي مملوك، لكنه يظل أقل من أقوى النماذج المتقدمة. واستنتجوا أن التعلم المعزز المدفوع بالمواصفات يوفر مسارًا عمليًا لتخصيص نماذج الأساس المفتوحة الوزن للعمل الوكيل في المؤسسات.
على نحو منفصل، صرّحت Salesforce أنه في معيار CRM الخاص بها، حيث تتضمن مجموعة من المهام الواقعية مثل تحديث فرصة، توجيه حالة، أو جدولة متابعة، يطابق كوا أو يتجاوز أداء النماذج الرائدة في إجراءات CRM مع ثلاثة أضعاف الأخطاء الأقل.
البرامج التجريبية، Missionforce، والتوافر
كوا مُستخدم بالفعل داخل Salesforce، بما في ذلك في وكيل Slack الذي يساعد الموظفين على العثور على المعلومات وإكمال المهام اليومية. تجري برامج تجريبية مع العملاء لدى 1-800Accountant، Baxter Credit Union، Engine، Formula 1، UChicago Medicine، وXero.
قال ريان تيبلز، الرئيس التنفيذي للاستراتيجية في 1-800Accountant، إن كوا يتيح لوكلاء الشركة التفكير خطوة بخطوة عبر قواعد الضرائب والبيانات المالية ومستندات العملاء. وقال جون ساهاجيان، نائب الرئيس الأول والرئيس التنفيذي للبيانات في Baxter Credit Union، إن النموذج يمكنه مساعدة الوكلاء الرقميين على وزن المعلومات والأدوات والسياسات وراء أهداف الأعضاء مثل شراء منزل. وقال إيليا والين، المؤسس والرئيس التنفيذي لشركة Engine، إن السفر التجاري يتضمن عددًا لا يحصى من الأجزاء المتحركة وأن فرقه تحتاج إلى نموذج قادر على التفكير بدقة عبر مشكلات متعددة الخطوات بدلاً من نموذج يكتفي بالظهور بثقة. وأضاف أندرو تشانغ، الرئيس التنفيذي للتسويق في UChicago Medicine، إن كوا يمكنه التعامل مع سير عمل تنسيق أطول ومتعدد الخطوات بحيث يحصل الفرق على مزيد من الوقت لرعاية المرضى.
إلى جانب Koa، تقوم الشركتان بإدخال نماذج مستندة إلى Nemotron والحوسبة المتسارعة إلى Missionforce للجهات الحكومية والمنظمات الخاضعة للرقابة. وفقًا للإعلان، يجب على العديد من هذه المنظمات التحكم في النموذج وبيانات التدريب ونشرها في بيئات متخصصة — سحابات خاصة، شبكات مصنفة، وأنظمة معزولة تمامًا عن الإنترنت — لا تتصل أبدًا بالبنية التحتية العامة.
ستُشغّل النماذج المدربة لاحقًا من NVIDIA الوكلاء لمنتج Missionforce Operations، وهو منتج يرقمن ويؤتمت سير عمل الحكومة بما في ذلك الشراء وإدارة الموردين واللوجستيات. تُدَرَّب النماذج على بيانات كل منظمة التشغيلية ومصطلحاتها بحيث يستطيع الوكلاء التعامل مع عمليات الخلفية واتخاذ إجراءات داخل بيئة العميل نفسها، بما في ذلك الشبكات المعزولة. وأشارت الشركتان إلى أنهما تعملان أيضًا على إدخال نماذج NVIDIA المدربة لاحقًا إلى قدرات Missionforce إضافية، مما سيسمح للعملاء ببناء وتشغيل النماذج على بنيتهم التحتية الخاصة لأعباء عمل متخصصة.
يتوفر Koa الآن لعملاء تجريبيين مختارين في Agentforce، ومن المتوقع إتاحة النسخة العامة في شتاء 2026 في المناطق الأمريكية. ويتوفر Missionforce Operations حاليًا بشكل عام في المناطق الأمريكية، وستتوفر نماذج NVIDIA المدربة لاحقًا لعملاء مختارين في أكتوبر 2026.












