AI 模型与平台

OpenAI 将插件引入 Live 语音并将语音引入 ChatGPT 工作

mm
将 Unite.AI 添加到您在 Google 上的首选来源

OpenAI 于 2026 年 9 月 23 日在 ChatGPT 的 Live 语音体验中添加了插件支持,覆盖网页、iOS 和 Android,并将 Voice 引入 ChatGPT 工作的网页和移动端,依据公司发布的 ChatGPT 发布说明。此更新允许用户在语音对话中调用已连接的应用,并可通过手机或浏览器使用语音启动 Work 任务。

Live 语音中的插件

2026 年 9 月 23 日的条目指出,Live 现已在网页、iOS 和 Android 上支持插件。在 Voice 对话期间,用户可以调用其账户关联的插件和已连接的应用,并在聊天中查看文字回复。Free 和 Go 用户可以在聊天中使用 Voice 以及其计划支持的插件,账户已有的应用连接、权限和使用限制也会保留。

OpenAI 的 ChatGPT 语音帮助文章 记录了其工作原理。在 Live 对话中,用户会请求 ChatGPT 使用账户中可用的插件。用户可能需要先连接该应用并登录,且现有的应用权限和工作区限制仍然适用。当某项操作需要在网页或移动端获得批准时,Voice 会弹出屏幕审查并提供屏幕控件以批准或拒绝,OpenAI 表示不支持通过语音进行批准。

ChatGPT 工作中的 Voice

发布说明称,Voice 现已在网页和移动端的 Work 中可用。通过语音,用户可以让 Work 起草文档、演示文稿和电子表格,调用已连接的应用,或在浏览器中进行操作。如果用户结束语音通话时任务仍在运行,任务会转为文字继续。Work 中的 Voice 需要账户同时拥有 Voice 和 Work 的访问权限。

根据帮助文章,Work 中的 Voice 遵循计划的 Voice 限额和计费,语音启动的任务与键入任务一样计入普通的 Work 使用量。文章还单独记录了 macOS 和 Windows 上的 ChatGPT 桌面应用中的 Voice,用户可以启动任务、检查进度、询问其代理的情况,并通过一次对话协调多个代理。

Voice 选项、使用限制及声明的局限性

帮助文章列出了三种 Voice 选项。Live 根据用户的计划运行在 GPT-Live-1 或 GPT-Live-1 mini 上,OpenAI 描述其能够同时听和说、使用网络搜索和记忆、通过受支持的小部件显示可视化结果,并在同一聊天中处理文本和图像。Advanced 是之前的实时 Voice 体验,保留了视频和屏幕共享等受支持的移动功能,而 Live 不支持这些功能。Standard 是一种轮流对话的选项,会在生成回复之前转录用户的语音。

在 Chat 中使用 Voice 时,Live 的使用量以滚动的 24 小时为周期进行统计。文章中列出的限制为:Free 用户仅能有限制地使用 GPT-Live-1 mini,Go 用户可使用 GPT-Live-1 mini 最多 3 小时,Plus 用户可使用 GPT-Live-1 最多 3 小时,Pro 订阅者每月 100 美元可使用最多 15 小时,Pro 订阅者每月 200 美元则可无限使用 GPT-Live-1。Business Standard 可使用 GPT-Live-1 3 小时,超出部分按每分钟 1.25 积分计费;Business Premium 可使用 15 小时。Enterprise、Edu 和 Clinicians 工作区采用积分计费,费用为每分钟 1.25 积分;Enterprise 的基于使用量计费模式则为每分钟 0.05 美元。

OpenAI 还指出 Live 目前有两项限制:不支持视频或屏幕共享,且目前无法从用户的 ChatGPT 库中查找或添加文件,尽管根据账户情况,仍可手动将受支持的文件附加到聊天中。

已记录的推出路径

2026 年 9 月 23 日的更新延续了同一发布说明中记录的时间线。2026 年 7 月 8 日,OpenAI 为付费用户在 ChatGPT Voice 中推出了 GPT-Live-1,并为 Free 用户推出了 GPT-Live-1 mini,公司称这些模型能够同时听和说,使轮流发言和打断更自然,并具备网络搜索、记忆以及在 chatgpt.com 和 iOS、Android 应用中的可视化小部件。2026 年 7 月 9 日,公司推出了 ChatGPT Work,这是一种用于更长、多步骤工作的代理,能够研究和分析信息、跨已连接的应用和文件操作,并生成文档、电子表格、演示文稿、报告和 Sites,向除 Free 和 Go 之外的付费计划在网页和移动端推出。2026 年 7 月 23 日,ChatGPT Voice 在 Work 中以及桌面应用中的 Codex 中可用。

2026 年 8 月 31 日,Live 语音对话的内容获得了在 iPhone 锁屏以及支持的 iPhone 上通过 Live Activities 显示在动态岛的功能。2026 年 9 月 9 日,OpenAI 让 Voice 在需要搜索或推理更难问题时使用 GPT-5.6 或 GPT-6 Astra,按计划简化了 GPT-Live 的每日使用限制,停止了在 Plus 和 Pro 用户达到 Voice 限额后切换至 GPT-Live mini 的做法,并废弃了独立的 Instant、Medium 和 High Voice 智能等级。

Jonas Reeve 是 Unite.AI 的 AI 生成分析师,专注于认知 AI、人工通用智能(AGI)和机器智能的理论基础。他的工作探索了学习、推理、记忆和抽象如何在生物和人工系统中出现,建立了现代 AI 架构和认知科学、心灵哲学长期存在的问题之间的联系。
以概念和反思的方法,Jonas 检视了推理模型、代理系统、涌现认知和对齐理论等框架,旨在阐明 AGI 进展的真正含义——以及它的不意味着什么。与其追逐时间表或炒作,他强调了第一原则、概念严谨性和当前模型的局限性。
Jonas Reeve 撰写的文章由 AI 生成并由 Unite.AI 的编辑团队审查,以确保高级 AI 概念的准确性、清晰性和负责讨论。