AI 模型与平台
Salesforce 推出用于 Agentforce 的 Koa 推理模型,基于 Nemotron 进行训练

Salesforce 与 NVIDIA 于 2026 年 9 月 15 日宣布 Koa,这是一款面向 Salesforce Agentforce 平台的 CRM 推理模型,使用 NVIDIA 的 Nemotron 3 Super 模型经后训练后,基于专有的合成数据集构建,该数据集模拟了近三十年 CRM 部署所积累的企业知识。
Salesforce 将 Koa 描述为其首个 CRM 推理模型,专为帮助代理在复杂的多步骤工作流中进行推理并使用正确的工具完成工作而打造。在 公司联合公告 中,Salesforce 董事长兼首席执行官 Marc Benioff 说:”Salesforce 构建的最有价值的东西不是我们的平台——而是企业业务实际运作方式的累计知识。通过 Koa,这些知识被嵌入模型本身。” NVIDIA 创始人兼首席执行官 Jensen Huang 表示,Nemotron 开源模型为 Salesforce 提供了构建能够安全推理和行动的 CRM 模型的基础。
Salesforce 表示,它控制 Koa 模型的权重,并在其自身的信任边界内完成后训练和推理,从而在推理过程中没有客户数据跨越该边界。Koa 为客户提供了一种专门的、由 Salesforce 托管的选项,用于驱动 Agentforce 的使用场景。
合成训练数据与后训练方法
据 Salesforce 称,Koa 的训练未使用任何客户数据。训练语料库完全由合成场景构建,这些场景涵盖了 Agentforce 代理 在 CRM 工作流中(如生成潜在客户、确认商机和解决服务案例)所需的推理、工具使用和决策技能。
这些场景旨在模拟跨越 14 个以上行业的真实企业工作流,包括制造业、金融服务、医疗保健和旅游业等。在每个场景中,会为一个角色配备一系列任务,并提前映射完成这些任务所需的动作顺序和工具调用。
在后训练阶段,Salesforce 使用监督微调和基于 Group Relative Policy Optimization(GRPO)的强化学习,借助 NVIDIA 的 NeMo RL、NeMo Gym 和 NeMo AutoModel 工具。Salesforce 表示,对一组有针对性的优先企业任务进行训练,使模型获得更深入的专长,教会它通过一系列正确的操作来实现目标,而不是仅停留在正确答案上。
研究论文与报告结果
在 一篇研究论文 中,作者于 2026 年 9 月 14 日提交至 arXiv,描述 Koa 是将 GRPO 强化学习应用于开源权重 Nemotron-3-Super-120B 基础模型的结果,使用了公开的以及合成生成的数据,且未使用客户数据。作者指出模型的独特组件是一个从模拟到奖励的流水线,将工作流规范转化为基于角色的多轮任务,奖励与通过成功使用工具完成数据依赖请求的任务解决关联。对于企业领域,这些规范采用 Agent Script 编写,这是 Salesforce 用于构建 Agentforce 代理的声明式语言;对于公共工具使用领域,工作流结构直接合成,使用相同的模拟和基于奖励的机制驱动 GRPO。
作者报告称,在公共工具使用、代理推理和企业 CRM 基准测试中,Koa 相较于其开源权重基模型有所提升,尤其在多轮工具使用方面表现最为突出,超越了强大的专有基线,但仍低于最先进的前沿模型。他们总结道,基于规范的强化学习为将开源基础模型专用于企业代理工作提供了一条实用路径。
另据 Salesforce 称,在其 CRM 基准测试中,一套包括更新商机、分配案例或安排后续等真实任务的评估显示,Koa 在 CRM 操作上的表现与领先模型持平或超出,并且错误率降低了三倍。
试点、Missionforce 与可用性
Koa 已在 Salesforce 内部投入使用,包括一个帮助员工查找信息并完成日常任务的 Slack 代理。客户试点正在与 1-800Accountant、Baxter Credit Union、Engine、Formula 1、UChicago Medicine 和 Xero 进行中。
1-800Accountant 的首席策略官 Ryan Teeples 表示,Koa 使该公司代理能够逐步推理税务规则、财务数据和客户文件。Baxter Credit Union 的高级副总裁兼首席数据官 John Sahagian 称,该模型可以帮助数字代理在成员目标(如购房)背后权衡信息、工具和政策。Engine 的创始人兼 CEO Elia Wallen 说,商务旅行涉及无数环节,他们的团队需要一个能够精准推理多步骤问题的模型,而不是仅仅听起来自信的模型。UChicago Medicine 的首席营销官 Andrew Chang 表示,Koa 能处理更长的多步骤协作工作流,让团队有更多时间专注于患者护理。
与 Koa 同时,这两家公司正将基于 Nemotron 的模型和加速计算引入 Missionforce,以服务政府和受监管组织。公告称,这些组织中的许多必须控制模型和训练数据,并在专用环境——私有云、机密网络以及完全隔离的系统——中部署,这些环境从不接触公共基础设施。
经过后训练的 NVIDIA 模型将为 Missionforce Operations 提供动力,这是一款将政府工作流(包括采购、供应商管理和物流)数字化并自动化的产品。这些模型基于各组织的运营数据和术语进行训练,使代理能够在后台流程中工作,并在客户自己的环境(包括隔离网络)内采取行动。两家公司还表示,他们正致力于将后训练的 NVIDIA 模型引入更多 Missionforce 功能,这将使客户能够在自己的基础设施上构建和运行模型,以满足专用工作负载的需求。
Koa 目前已在 Agentforce 中向部分试点客户开放,预计将在 2026 年冬季在美国地区正式发布。Missionforce Operations 已在美国地区普遍可用,后训练的 NVIDIA 模型将在 2026 年 10 月向部分客户提供。












