AI 模型与平台
Moonshot 开源 Kimi K3 模型权重,采用分级许可证

Moonshot AI 于 2026 年 7 月 27 日发布了 Kimi K3 模型的完整权重,距离北京实验室将该模型作为托管服务推出仅仅 11 天。权重和 技术报告 一起在 Hugging Face 和 GitHub 上发布,采用了公司称为 Kimi K3 许可证的定制条款。
Kimi K3 是一个专家混合模型,总参数量为 2.8 万亿,其中 104 亿参数在任何给定令牌上激活。它具有 1 百万令牌的上下文窗口,通过 Moonshot 称为 MoonViT-V2 的视觉编码器本地处理文本和图像,并将每个令牌路由到 16 个专家中的 896 个专家。Moonshot 将其描述为世界上第一个 3 万亿参数级别的开源模型。
实验室的工作重点在于模型的架构。Kimi Delta Attention 处理模型的 93 层中的 69 层,伴随着 24 个门控潜在注意层和实验室称为注意力残差的机制,该机制有选择性地跨深度检索表示,而不是统一积累。Moonshot 报告称,这种组合,结合其稳定潜在 MoE 路由,相比 Kimi K2 提高了大约 2.5 倍的扩展效率。
许可证允许的内容
Kimi K3 许可证 在大部分内容上类似于 MIT 许可证。它授予任何人免费使用、复制、修改、分发、再许可和出售软件的权利,以及运行、部署、微调或从权重构建衍生作品的权利。
两个条件附加在收入线上:
- 以“模型即服务”业务方式运行的许可人,定义为为第三方提供具有对输入、参数或训练数据的有意义控制的推理或微调访问,必须在其收入和其关联方的收入超过 20 万美元的连续 12 个月后与 Moonshot 签订单独协议。
- 任何每月活跃用户超过 1 亿或每月收入超过 200 万美元的商业产品或服务必须在其界面中显著显示“Kimi K3”。
这两个条件都不适用于纯内部使用或通过 Moonshot 自身产品和其认证推理合作伙伴的访问。将模型嵌入特定功能或工具中的产品,或仅将请求转发到他人托管的模型的产品,均不在服务定义之内。
实际效果是按照业务模式而非用户数量进行划分。微调 K3 的团队无需承担任何义务。以大规模重新销售 K3 推理的云提供商在此之前需要与 Moonshot 签订合同。
发布也出现在华盛顿正在进行的辩论中。 Nvidia 和 Microsoft 于 2026 年 7 月 24 日在联合信中支持开源权重 AI (MSFT ) (NVDA ),OpenAI 的 Sam Altman 于同一天将公司的下一个模型家族带到了华盛顿的立法者和行政官员面前。来自中国实验室的 2.8 万亿参数模型现在是该辩论中的一个固定点。
评估结果
Artificial Analysis 在模型仍然是 API-only 时,将 Kimi K3 的 Intelligence Index 评为 57,排名第三,相当于 Claude Opus 4.8 和 GPT-5.5,仅次于 Claude Fable 5 和 GPT-5.6 Sol。同一指数上的最强开源权重替代品排名较低:GLM-5.2 为 51,DeepSeek V4 Pro 为 44。
代理数值是该评估的更强部分。Artificial Analysis 测量 K3 在 GDPval-AA v2 上的 Elo 为 1668,高于 Kimi K2.6 的 1190,并在 AutomationBench-AA 上排名第一,达到 53%。每任务成本为 0.94 美元,接近 GPT-5.6 Sol,约为 Opus 4.8 的一半价格。
Moonshot 自己的 基准表 报告了 93.5% 的 GPQA Diamond 和 91.2 的 BrowseComp 结果,脚注披露了不同模型在不同代理工具中运行的结果。实验室的发布帖子称,总体性能仍然落后于 Fable 5 和 GPT-5.6 Sol,并将用户体验差距视为一个限制。现在可以下载的检查点允许任何人重新运行这些数字,而不是仅仅接受供应商的结果。
运行所需条件
Moonshot 推荐在 64 个或更多加速器的超节点配置上部署 K3,并指出 vLLM、SGLang 和 TokenSpeed 为支持的推理引擎。由于 Kimi Delta Attention 破坏了传统的前缀缓存,实验室在发布时将自己的缓存实现贡献给了 vLLM 项目。权重以量化形式交付,量化感知训练从监督微调阶段开始应用。
一个部署细节比模型卡中显示的位置更重要。K3 是在 Moonshot 称为保留思考历史模式下训练的,这需要一个工具将模型的完整先前助手消息(包括推理内容和工具调用)传回对话中。丢弃此消息或在任务中途切换到另一个模型的团队应预计输出不稳定。
Moonshot 的托管 API 的价格为每百万输入令牌 3.00 美元和每百万输出令牌 15.00 美元,缓存输入为 0.30 美元。发布添加了一个替代计费方式:权重、许可证和模型训练报告现在公开,社区可以从模型本身开始复制 Kimi K3 的结果。












