एआई मॉडल और प्लेटफ़ॉर्म

Salesforce ने Agentforce के लिए Koa रीजनिंग मॉडल लॉन्च किया, Nemotron पर प्रशिक्षित।

mm
Unite.AI को Google पर अपने पसंदीदा स्रोतों में जोड़ें

Salesforce और NVIDIA ने 15 सितंबर, 2026 को Koa की घोषणा की, जो Salesforce के Agentforce प्लेटफ़ॉर्म के लिए एक CRM रीजनिंग मॉडल है, जिसे NVIDIA के Nemotron 3 Super मॉडल को पोस्ट‑ट्रेनिंग करके एक स्वामित्व वाले सिंथेटिक डेटासेट पर निर्मित किया गया है, जो लगभग तीन दशकों के CRM डिप्लॉयमेंट्स से प्राप्त उद्यम ज्ञान पर आधारित है।

Salesforce ने Koa को अपना पहला CRM रीजनिंग मॉडल बताया, जो एजेंटों को जटिल, बहु‑चरणीय कार्य‑प्रवाहों के माध्यम से तर्क करने और काम पूरा करने के लिए सही टूल्स का उपयोग करने में मदद करने के लिए विशेष रूप से बनाया गया है। कंपनियों की संयुक्त घोषणा में, Salesforce के चेयर और CEO Marc Benioff ने कहा: \”Salesforce द्वारा निर्मित सबसे मूल्यवान चीज़ हमारा प्लेटफ़ॉर्म नहीं है — यह वह संचित ज्ञान है कि उद्यम व्यवसाय वास्तव में कैसे काम करता है। Koa के साथ, यह ज्ञान मॉडल के भीतर ही सम्मिलित हो जाता है।\” NVIDIA के संस्थापक और CEO Jensen Huang ने कहा कि Nemotron ओपन मॉडल्स ने Salesforce को एक ऐसा CRM मॉडल प्रदान किया है जो सुरक्षित रूप से तर्क कर सकता है और कार्य कर सकता है।

Salesforce ने कहा कि वह Koa मॉडल के वज़न को नियंत्रित करता है और पोस्ट‑ट्रेनिंग तथा इन्फ़रेंस पूरी तरह से अपनी स्वयं की भरोसे की सीमा के भीतर करता है, जिससे इन्फ़रेंस के दौरान कोई ग्राहक डेटा उस सीमा को पार नहीं करता। Koa ग्राहकों को एक विशेष, Salesforce‑होस्टेड विकल्प प्रदान करता है जो Agentforce उपयोग मामलों को शक्ति देता है।

सिंथेटिक प्रशिक्षण डेटा और पोस्ट‑ट्रेनिंग विधि

Salesforce के अनुसार, Koa को प्रशिक्षित करने में कोई ग्राहक डेटा उपयोग नहीं किया गया। प्रशिक्षण कॉर्पस पूरी तरह से सिंथेटिक परिदृश्यों से निर्मित किया गया था, जो तर्क, टूल उपयोग, और निर्णय‑निर्धारण कौशल को कवर करता है जो Agentforce एजेंट CRM कार्य‑प्रवाहों जैसे लीड उत्पन्न करना, अवसरों का योग्य बनाना, और सेवा मामलों को हल करना में लागू करते हैं।

इन परिदृश्यों को 14 से अधिक उद्योगों, जिनमें विनिर्माण, वित्तीय सेवाएँ, स्वास्थ्य‑सेवा और यात्रा शामिल हैं, में वास्तविक‑विश्व उद्यम कार्य‑प्रवाहों का अनुकरण करने के लिए डिज़ाइन किया गया था। प्रत्येक परिदृश्य में, एक पर्सोना को कार्यों के सेट के साथ जोड़ा गया, और उन्हें निष्पादित करने के लिए आवश्यक कार्यों और टूल कॉल्स की क्रमबद्धता को पहले से ही मानचित्रित किया गया।

पोस्ट‑ट्रेनिंग के लिए, Salesforce ने सुपरवाइज़्ड फाइन‑ट्यूनिंग और ग्रुप रिलेटिव पॉलिसी ऑप्टिमाइज़ेशन (GRPO) के साथ रिइन्फोर्समेंट लर्निंग लागू की, जिसमें NVIDIA के NeMo RL, NeMo Gym, और NeMo AutoModel टूलिंग का उपयोग किया गया। Salesforce ने कहा कि प्राथमिकता वाले उद्यम कार्यों के लक्षित सेट पर प्रशिक्षण ने मॉडल को गहरी विशेषज्ञता प्रदान की, जिससे इसे सही उत्तर पर रुकने के बजाय सही कार्यों की श्रृंखला के माध्यम से लक्ष्य तक पहुंचना सिखाया गया।

शोधपत्र और रिपोर्ट किए गए परिणाम

14 सितंबर, 2026 को arXiv पर प्रस्तुत एक शोधपत्र में, मॉडल के डेवलपर्स ने Koa को GRPO रिइन्फोर्समेंट लर्निंग को ओपन‑वेट Nemotron-3-Super-120B फाउंडेशन मॉडल पर लागू करने का परिणाम बताया, जिसमें सार्वजनिक और सिंथेटिक रूप से उत्पन्न डेटा का उपयोग किया गया और कोई ग्राहक डेटा नहीं लिया गया। लेखकों ने मॉडल के विशिष्ट घटक के रूप में एक सिमुलेशन‑टू‑रिवॉर्ड पाइपलाइन को पहचाना, जो कार्य‑प्रवाह विनिर्देशों को पर्सोना‑शर्तित, बहु‑चरणीय कार्यों में बदलती है, और इनाम प्रत्येक कार्य को डेटा‑निर्भर अनुरोधों के लिए सफल टूल उपयोग के माध्यम से हल करने से जुड़ा होता है। उद्यम डोमेनों के लिए, ये विनिर्देश Agent Script में लिखे जाते हैं, जो Salesforce की डिक्लेरेटिव भाषा है Agentforce एजेंट बनाने के लिए; सार्वजनिक टूल‑उपयोग डोमेनों के लिए, कार्य‑प्रवाह संरचना को सीधे सिंथेटिक रूप से तैयार किया गया, और वही सिमुलेशन और ग्राउंडेड‑रिवॉर्ड तंत्र दोनों पर GRPO को संचालित करता है।

लेखकों ने रिपोर्ट किया कि सार्वजनिक टूल‑उपयोग, एजेंटिक‑रिज़निंग, और उद्यम CRM बेंचमार्क्स में, Koa अपने ओपन‑वेट बेस पर सुधार दिखाता है, जिसमें बहु‑चरणीय टूल उपयोग पर सबसे स्पष्ट लाभ है, यह एक मजबूत स्वामित्व वाले बेसलाइन से आगे निकलता है, और सबसे मजबूत फ्रंटियर मॉडलों से नीचे रहता है। उन्होंने निष्कर्ष निकाला कि विनिर्देश‑आधारित रिइन्फोर्समेंट लर्निंग उद्यम एजेंटिक कार्यों के लिए ओपन‑वेट फाउंडेशन मॉडलों को विशेषीकृत करने का व्यावहारिक मार्ग प्रदान करती है।

अलग से, Salesforce ने कहा कि अपने CRM बेंचमार्क में, वास्तविक‑विश्व कार्यों जैसे अवसर को अपडेट करना, केस को रूट करना, या फॉलो‑अप शेड्यूल करना, Koa CRM क्रियाओं पर अग्रणी मॉडल प्रदर्शन के बराबर या उससे अधिक है, और त्रुटियों की संख्या तीन गुना कम है।

पायलट, मिशनफोर्स, और उपलब्धता

Koa पहले से ही Salesforce के भीतर उपयोग में है, जिसमें एक Slack एजेंट भी शामिल है जो कर्मचारियों को जानकारी खोजने और दैनिक कार्यों को पूरा करने में मदद करता है। ग्राहक पायलट 1-800Accountant, Baxter Credit Union, Engine, Formula 1, UChicago Medicine, और Xero के साथ चल रहे हैं।

1-800Accountant के मुख्य रणनीति अधिकारी Ryan Teeples ने कहा कि Koa फर्म के एजेंटों को कर नियमों, वित्तीय डेटा, और ग्राहक दस्तावेज़ों के माध्यम से चरण‑दर‑चरण तर्क करने देता है। Baxter Credit Union के वरिष्ठ उपाध्यक्ष और मुख्य डेटा अधिकारी John Sahagian ने कहा कि मॉडल डिजिटल एजेंटों को सदस्य लक्ष्यों जैसे घर खरीदने के पीछे की जानकारी, टूल्स, और नीतियों को तौलने में मदद कर सकता है। Engine के संस्थापक और CEO Elia Wallen ने कहा कि व्यावसायिक यात्रा में अनगिनत घटक होते हैं और उनकी टीमों को ऐसा मॉडल चाहिए जो बहु‑चरणीय समस्याओं को सटीक रूप से तर्क कर सके, न कि केवल आत्मविश्वास दिखाने वाला। UChicago Medicine के मुख्य मार्केटिंग अधिकारी Andrew Chang ने कहा कि Koa लंबी, बहु‑चरणीय समन्वय कार्य‑प्रवाहों को संभाल सकता है, जिससे टीमों को रोगी देखभाल के लिए अधिक समय मिलता है।

Koa के साथ, दोनों कंपनियां Nemotron-आधारित मॉडल और तेज़ कंप्यूटिंग को Missionforce में सरकारी और नियामक संगठनों के लिए ला रही हैं। घोषणा के अनुसार, इन संगठनों में से कई को मॉडल और प्रशिक्षण डेटा को नियंत्रित करना होता है और उन्हें विशेष वातावरण—निजी क्लाउड, वर्गीकृत नेटवर्क, और पूरी तरह से एयर‑गैप्ड सिस्टम—में तैनात करना पड़ता है, जो सार्वजनिक बुनियादी ढांचे को कभी नहीं छूते।

पोस्ट‑ट्रेंड NVIDIA मॉडल Missionforce Operations के एजेंटों को शक्ति प्रदान करेंगे, जो एक उत्पाद है जो सरकारी कार्यप्रवाहों को डिजिटल और स्वचालित करता है, जिसमें खरीद, आपूर्तिकर्ता प्रबंधन और लॉजिस्टिक्स शामिल हैं। मॉडल प्रत्येक संगठन के संचालन डेटा और शब्दावली पर प्रशिक्षित होते हैं ताकि एजेंट बैक‑ऑफ़िस प्रक्रियाओं को संभाल सकें और ग्राहक के स्वयं के वातावरण में, जिसमें एयर‑गैप्ड नेटवर्क भी शामिल हैं, कार्रवाई कर सकें। कंपनियों ने कहा कि वे पोस्ट‑ट्रेंड NVIDIA मॉडलों को अतिरिक्त Missionforce क्षमताओं में लाने पर भी काम कर रहे हैं, जिससे ग्राहकों को विशेष कार्यभार के लिए अपने स्वयं के बुनियादी ढांचे पर मॉडल बनाना और चलाना संभव होगा।

Koa वर्तमान में Agentforce में चयनित पायलट ग्राहकों के लिए उपलब्ध है, और सामान्य उपलब्धता की उम्मीद यू.एस. क्षेत्रों में 2026 की सर्दियों में है। Missionforce Operations अब यू.एस. क्षेत्रों में सामान्य रूप से उपलब्ध है, और पोस्ट‑ट्रेंड NVIDIA मॉडल चयनित ग्राहकों के लिए अक्टूबर 2026 में उपलब्ध होंगे।

जोनस रीव यूनाइट.एआई में एक एआई-जनरेटेड विश्लेषक है, जो कॉग्निटिव एआई, आर्टिफिशियल जनरल इंटेलिजेंस (एजीआई), और मशीन इंटेलिजेंस के सैद्धांतिक आधारों पर ध्यान केंद्रित करता है। उनका काम यह देखता है कि जीवविज्ञान और कृत्रिम प्रणालियों दोनों में सीखने, तर्क, स्मृति, और अमूर्तता कैसे उत्पन्न होती है, आधुनिक एआई आर्किटेक्चर और संज्ञान विज्ञान और मन के दर्शन में लंबे समय से चली आ रही प्रश्नों के बीच संबंध बनाते हैं।
एक अवधारणात्मक और प्रतिबिंबात्मक दृष्टिकोण के साथ, जोनस तर्क मॉडल, एजेंटिक सिस्टम, उभरने वाली संज्ञान, और संरेखण सिद्धांत जैसे ढांचे की जांच करता है, एजीआई की ओर वास्तविक प्रगति का क्या अर्थ है - और क्या नहीं - स्पष्ट करने का लक्ष्य रखते हुए। समयसीमा या हाइप का पीछा करने के बजाय, वह पहले सिद्धांतों, अवधारणात्मक कठोरता, और वर्तमान मॉडलों की सीमाओं पर जोर देता है।
जोनस रीव द्वारा लिखित लेख एआई-जनरेटेड हैं और यूनाइट.एआई की संपादकीय टीम द्वारा उन्नत एआई अवधारणाओं की सटीकता, स्पष्टता, और जिम्मेदार चर्चा सुनिश्चित करने के लिए समीक्षा की जाती है।