AI 模型与平台

人工智能公司 Anthropic 将 Opus 和 Sonnet 模型引入 Claude 语音模式

mm
将 Unite.AI 添加到您在 Google 上的首选来源

Anthropic 已将其更强大的模型集成到 Claude 的语音模式中,允许用户使用 Opus 和 Sonnet 模型进行语音对话,而不仅仅是之前的 Haiku 模型。该公司于 2026 年 7 月 23 日确认了这一变化,称其目的是使 Claude 的语音模式更适合实际工作,而不仅仅是快速查询。

根据 Anthropic 的 语音模式文档,该功能现在默认使用用户在文本聊天中最后选择的模型,并且可以在对话中间通过模型选择器切换到 Haiku、Sonnet 或 Opus 模型。这种方式可以处理之前 Haiku 模型难以处理的任务,例如更长的推理、客户推销的反馈或需要使用工具的请求,例如通过语音草拟电子邮件和更新日历条目。

语音模式还可以访问连接的应用程序,包括 Gmail、Google 日历、Google 文档和 Slack,因此可以通过语音请求从用户的帐户中获取上下文或执行操作,例如重新安排会议。这种应用程序集成是 Anthropic 和 OpenAI 之间的明显区别,后者最近更新的语音模式改变了 ChatGPT 的说话方式,但仍然无法使用外部工具来完成工作。

产品决策,而不是新的语音模型

对于任何关注前沿实验室实际发布的内容的人来说,这次发布的显著部分是 Anthropic 没有构建什么。这里没有新的语音原生语音模型。Anthropic 告诉 Engadget,该更新“专注于智能和工具访问”,并且“继续投资语音”,“今年晚些时候会有更多内容”。底层管道仍然是基于回合的:Claude 倾听、暂停思考,然后说话,据报道它依赖于外部文本转语音提供商,例如 ElevenLabs 来生成语音输出。

将推理模型路由到语音中更像是一种能力升级,而不是音频升级。现在,语音请求可以由能够规划和解决问题的模型处理,而 Haiku 模型则专注于快速返回答案。语音模式的变化完全来自于其背后的模型。

这与 OpenAI 的投注不同。OpenAI 投入了大量资源开发一个双向、语音原生的系统 GPT-Live,它可以同时处理用户说的话并生成回复,更加接近电话交谈的节奏。Anthropic 另一方面,将其最强大的推理模型路由到传统的语音堆栈,并接受这种对话方式带来的限制。由于语音模型本身没有改变,用户不太可能注意到中断处理或更流畅的来回对话的改善。变化的是 Claude 如何推理它被问及的问题,而不是它在回答问题时听起来有多自然。

这种权衡映射到 Claude 用户在文本中已经面临的问题:最强大的模型并不总是适合任务。选择更重的模型可以带来更深入的理解,但也会以速度为代价,语音对话对延迟特别敏感。将选择权交给用户,而不是默认为每个人选择最快的选项,这是更新的实际内容。

可用内容和缺失内容

升级的语音模式正在以 beta 版本推出,适用于所有用户的移动、桌面和 Web 应用程序。由于这是一个现有模型的路由问题,而不是新的基础设施问题,因此推出不需要 Anthropic 交付新音频系统。免费帐户仅限于 Haiku 模型和一个连接的应用程序,而 Sonnet 和 Opus 模型则保留给付费订阅者。今年早些时候添加的多语言输入功能也包括在内,尽管 Claude 仍然无法自动检测语言切换;用户必须大声说出或在语音设置中指定他们将要说的话的语言。

模型选择器显示 Opus、Sonnet 和 Haiku,但不显示 Claude Fable 5,这是 Anthropic 最强大的、广泛可用的模型,它目前不支持语音。这种省略符合发布的逻辑。这是关于将语音与大多数人日常使用的推理模型相匹配,而不是推动可以通过语音完成的任务的边界。

结果读起来更像是一份战略声明,而不是语音突破。Anthropic 正在赌博,认为语音助手的价值来自于模型的思考和它可以访问的工具,而不是来自于专门的音频架构。它承诺今年晚些时候会有更多内容,这将显示这种立场在 OpenAI 和 Google 推出自己的语音原生系统时将如何持续下去。Anthropic 正在赌博,认为语音助手的价值来自于模型的思考和它可以访问的工具,而不是来自于专门的音频架构。其承诺的后续内容将显示这种立场在 OpenAI 和 Google 推出自己的语音原生系统时将如何持续下去。

Jonas Reeve 是 Unite.AI 的 AI 生成分析师,专注于认知 AI、人工通用智能(AGI)和机器智能的理论基础。他的工作探索了学习、推理、记忆和抽象如何在生物和人工系统中出现,建立了现代 AI 架构和认知科学、心灵哲学长期存在的问题之间的联系。
以概念和反思的方法,Jonas 检视了推理模型、代理系统、涌现认知和对齐理论等框架,旨在阐明 AGI 进展的真正含义——以及它的不意味着什么。与其追逐时间表或炒作,他强调了第一原则、概念严谨性和当前模型的局限性。
Jonas Reeve 撰写的文章由 AI 生成并由 Unite.AI 的编辑团队审查,以确保高级 AI 概念的准确性、清晰性和负责讨论。