AI 模型与平台
OpenAI 在 DevDay 发布 GPT-6.1 Sol,推出全新 Codex 和 ChatGPT 工具。

OpenAI 在 2026 年 9 月 29 日的 DevDay 2026 活动上推出了 GPT-6.1 Sol,这是一款对其 GPT-6 Sol 模型的升级,并在 API 中以每百万输入代币 2 美元、每百万输出代币 10 美元的价格发布。此次发布是公司在 DevDay 2026 recap 中详细列出的 20 多项公告之一,涵盖了 Codex 开发者工具、API、ChatGPT 协作功能、插件以及订阅计划。
根据 GPT-6.1 Sol 公告,该模型在代理式编码、计算机使用和专业工作方面几乎匹配 GPT-6 Astra 的智能,且其标准输入和输出代币价格仅为 Astra 的五分之一。OpenAI 表示,缓存输入费用为每百万代币 $0.10,该价格被描述为比标准输入定价低 95%,比 GPT-6 Sol 的缓存输入价格低 50%。
GPT-6.1 Sol 将于 2026 年 9 月 29 日起向 ChatGPT Work 和 Codex 中的所有 Plus、Pro、Business、Enterprise 以及 Edu 用户开放,开发者可通过 OpenAI API(标识为 gpt-6.1-sol)访问。该模型尚未在 Chat 中提供。OpenAI 表示,GPT-6.1 Sol Ultrafast 选项将在未来几天推出,其代币生成速度比 Codex 中模型的标准速度快至多八倍。公司称,这些公告将 ChatGPT 打造成一个人类与代理可以协作的共享平台,开发者能够在其上推出原生体验,面向其描述的约 12 亿每周活跃用户。
GPT-6.1 Sol 性能与安全性结果
在 DeepSWE v1.1——一个针对真实代码库中复杂软件工程任务的基准测试中,OpenAI 报告称 GPT-6.1 Sol 以约五分之一的成本匹配 GPT-6 Astra,并在得分上比 GPT-6 Sol 提高了 6.4 个百分点,同时推理工作量和成本更低。在 GDP.pdf——衡量模型使用复杂 PDF 文档回答专业问题的准确性——中,公司报告该模型的得分高于 Opus 5.5,且每任务的成本不到其一半,并且在成本约为五分之一的情况下接近 Astra 的性能。
在 AutomationBench——用于测试代理是否能正确完成多步骤业务工作流的基准中,OpenAI 报告 GPT-6.1 Sol 在中等推理力度下的得分比 Opus 5.5 高出 2.2 个百分点,且成本约为其三分之一;在相同条件下比 GPT-6 Sol 高出 4.8 个百分点。 在 OSWorld 2.0 的离线计算机使用工作流集合中,公司报告该模型在最大推理力度下比 GPT-6 Sol 高出七个百分点,并且在成本约为每任务七分之一的情况下,得分仅比 Astra 低 2.1 个百分点。
在 Terminal-Bench Science 0.1——涵盖数据分析、仿真和定理证明等科学工作流的基准中,OpenAI 报告 GPT-6.1 Sol 在最大推理力度下的得分是 GPT-6 Sol 的两倍多,平均每任务成本为 5.47 美元,而 Opus 5.5 为 23.21 美元,Astra 为 23.80 美元。公司指出,GPT-6 Astra 在受测模型中仍取得最高分,达 68.1%。OpenAI 表示,其自身模型的评估是在内部研究环境或通过 API 完成的,竞争模型的评估则取自公开报告。
在事实性方面,OpenAI 报告称,在低推理力度下,包含事实错误的回复比例从使用 GPT-6 Sol 时的 11.4% 降至使用 GPT-6.1 Sol 时的 7.7%,下降约 32%,且新模型的错误率在所有测试设置中均与 Astra 相差不超过 1.9 个百分点。公司指出,此评估使用的是已去标识化的对话,其中用户标记了早期模型的错误,并且这些刻意设置的困难提示并不代表典型使用情形。
OpenAI 还报告称,相较于 GPT-6 Sol,模型在对齐评估中的表现有所提升,具体体现在对破损工具的透明度、遵守明确限制以及在代理任务中避免未经授权的结果方面的失败率更低。在评估代理是否会披露破损搜索工具而非给出最佳猜测时,公司报告 GPT-6.1 Sol 在 2.1% 的案例中未披露问题,而 GPT-6 Sol 为 4.9%,Astra 为 1.5%,并称未观察到规避自动安全审查员的尝试。完整细节见 GPT-6.1 Sol 系统卡补编。
Codex 与 API 中的新开发者工具
Codex 现在可以在电脑上、本地手机远程或任何设备的云端运行,并提供可重复使用的开发环境,让团队拥有带有批准设置和权限的共享配置;云端访问在 Plus、Pro、Business、Healthcare、Education 和 Enterprise 计划中可用。全新升级的 Codex CLI 增加了语音引导功能,并提供 /agents 视图用于分配和跟踪多个任务;在 ChatGPT 桌面应用中的全新代码审查体验能够对云端更改进行自动首次审查,反馈可在 GitHub 拉取请求或 GitLab 合并请求中共享。两者均在所有计划中提供。
Codex Security 云端可按需或按计划扫描 GitHub 仓库,调查发现、删除重复项并在云端准备修复,同时提供通过 Daybreak Blue 提供的模型访问,无需单独的 Daybreak 应用。该功能对桌面和网页上的 Pro、Business、Enterprise 以及 Edu 用户开放。
Decisions API 将 Luna 的智能应用于用户自定义的、具有有限预定义答案的问题,使开发者能够对内容进行分类、路由请求或选择代理的下一步操作;该 API 于 2026 年 9 月 29 日进入有限预览,计划在未来几天进行全面发布。Agents API 现已支持计算机使用,并将 Codex 的多代理功能、工具搜索、工具调用和上下文压缩引入应用程序;它可通过 API 以及在 Codex 和 ChatGPT Work 的 Pro 500 和 Enterprise 计划中使用。OpenAI 还与 Amazon 合作推出 Bedrock Managed Agents,使 Agents API 的核心功能能够在 AWS 原生运行并与 AWS 资源集成。
Ultrafast 作为高级速度层,可实现最高八倍的代币生成速度,在 Codex 中达到每秒 300 代币,并在 API 中实现最高六倍的生成速度,以上数据来自 OpenAI。GPT-6 Astra Ultrafast 现已在 API 以及在 ChatGPT Work 和 Codex 的 Pro 500 与 Enterprise 计划中可用,GPT-6.1 Sol Ultrafast 即将推出。
ChatGPT 协作、插件和计划
ChatGPT Space 是一个共享空间,团队成员、ChatGPT 和用户的点可以在此构建共享知识,支持在桌面和网页端的 Pro、Business 和 Enterprise 计划使用;移动端目前仅限于查找、阅读和分享页面,直至移动端的创建和编辑功能上线。Pages 作为专为人类和代理协作而设计的新文档类型,可在相同的计划中使用,协作幻灯片具备同步多编辑器支持,并可导出至 PowerPoint 或 Google Slides,预计将在未来几周内推出。
Business 和 Enterprise 用户现在可以在 ChatGPT 中创建团队,并委派按计划运行或响应新邮件、Slack 消息等事件的重复团队任务,并且他们可以在 Slack 和 Microsoft Teams 的频道、线程或直接消息中提及 @ChatGPT,而无需为每位团队成员单独购买许可证。Meetings 插件在 macOS 上的 ChatGPT 桌面应用中以 beta 形式提供,适用于 Pro 和 Business 用户,Enterprise 访问即将推出,可在 ChatGPT Space 中记录笔记并保存带有行动项的个性化摘要,笔记完成后会删除音频。可共享的个人资料展示可复用的 Sites 和插件,适用于 Free、Go、Plus、Pro、Business 和 Enterprise 计划,技能共享仅限于工作区。
对于开发者,插件扩展 在 ChatGPT 中添加侧边栏主页、交互面板和文件查看器,OpenAI 还新增了 Plugin Creator 工具、重新设计的提交流程、改进的插件排名与发现、在 Business、Enterprise、Healthcare 和 Edu 计划中的 Sites 内进行插件托管,并支持提议的 MCP Events 规范,使插件能够在连接的应用中发生事件时启动自动化。
使用 ChatGPT 登录可让 Plus 和 Pro 用户将其计划配额应用于 16 家合作伙伴,包括 Cognition 的 Devin、Notion、Vercel、T3、OpenClaw 和 Dactyl,并提供每个工具的使用控制,而身份登录在全球范围内可用。全新的 Pro 500 计划提供 OpenAI 所称的最高使用配额,达至 ChatGPT Plus 配额的 25 倍,包含 Ultrafast 访问权限,现已上线。OpenAI Marketplace 让符合条件的企业客户能够将其现有的 OpenAI 承诺部分用于获批的合作伙伴软件,首批 32 家合作伙伴包括 Adobe、Figma、Sierra、Decagon、Hubspot、Salesforce、ServiceNow、Harvey、Legora、Palo Alto Networks、CrowdStrike 和 Baseten,企业客户可表达兴趣。
在 OpenAI Private Intelligence 名义下,公司提供零数据保留的 Private Safety Processing,声称该功能可在不让 OpenAI 员工访问底层内容的情况下实现自动安全审查,并计划在今年秋季推出结合机密计算和严格可验证控制的 Private Inference 预览。OpenAI 还推出了 Dots,这些始终在线的代理在符合条件的市场中对 Pro 和 Business Premium 计划可用,Enterprise、Edu 和 Healthcare 访问则作为默认关闭、需管理员启用的 beta 版本提供。












