AI 模型与平台

Anthropic 将 Claude Sonnet 5.5 缓存读取费用削减 50%

mm
将 Unite.AI 添加到您在 Google 上的首选来源

Anthropic 于 2026 年 10 月 7 日,将 Claude Sonnet 5.5 的缓存读取费用降低 50%,从每百万 token $0.20 降至 $0.10,立即生效。公司还为 Max 和 Team 订阅者推出了每月的 Claude Platform API 额度:Max 5x 每月 $100,Max 20x 每月 $200,Team 计划的用户可累计至每月最高 $500。

这两项变动与 Claude Haiku 5.5 的发布一起在“进一步更新”章节的 Claude Haiku 5.5 公告 中宣布,Claude Haiku 5.5 是公司推出的新小型模型。Anthropic 将此举描述为提升其模型和产品价值的改进。

Sonnet 5.5 缓存读取定价

此降价适用于缓存读取,即后续 API 请求检索先前缓存内容时计费的 token。Sonnet 5.5 的缓存读取费用现为每百万 token $0.10,而非 $0.20。Anthropic 表示,由于缓存读取在模型 token 消耗中占比很大,此变动可将大多数代理任务运行 Sonnet 5.5 的成本降低约 20%。公司还通过一张 Terminal-Bench 4.0 图表展示了 Sonnet 5.5 在旧缓存读取费率和新费率下,准确率与每次尝试成本的对比。

Anthropic 的 Claude Platform 定价文档 中的提示缓存章节指出,缓存命中现在仅收取标准输入费用的 5%,适用于 Claude Opus 5.5 和 Claude Sonnet 5.5:Opus 5.5 为每百万 token $0.20,Sonnet 5.5 为每百万 token $0.10。文档列出了 Claude Fable 5.1 和 Claude Mythos 5.1 的 2.5% 费率,以及其他所有模型的标准 10% 费率。根据其乘数系统,五分钟缓存写入按基础输入费用的 1.25 倍计费,一小时写入按两倍计费。Sonnet 5.5 其余费率保持不变:每百万输入 token $2, 每百万输出 token $10, 五分钟缓存写入每百万 token $2.50, 一小时缓存写入每百万 token $4。

Anthropic 于 2026 年 9 月 28 日发布 Claude Sonnet 5.5,其定价与 Sonnet 5 相同:每百万输入 token $2、每百万输出 token $10,以及每百万 token $0.20 的缓存读取费用。新的费率取代了发布时的缓存读取价格,其他模型定价保持不变。

按计划划分的每月 API 额度

第二项变动为 Claude Platform(Anthropic 的 API 环境)新增了循环的每月额度。Anthropic 表示,该额度旨在让订阅者能够尝试构建调用其 API 的工具、应用和代理,并可在公司任何模型上使用。根据该计划的 帮助中心条款,Max 5x 订阅者每月可获 $100,Max 20x 订阅者每月可获 $200。Team 计划中,额度按席位累计(标准席位每月 $20,高级席位每月 $100),并汇总至单一每月上限 $500 的余额。包括非营利和科研人员计划在内的折扣 Team 计划也采用相同的每席位额度。Anthropic 的示例计算显示,一个拥有三个位标准席位和两个高级席位的团队每月可获 $260,若再增加一个高级席位,则下个周期的额度将升至 $360。该额度池每次充值时均根据计划中的席位数进行计算。

免费、专业版和企业版计划不在适用范围内。Max 或 Team 订阅必须处于激活且良好状态,新订阅者需在符合条件的计划上使用满七天后才能领取额度。订阅可通过网页、iOS 或 Android 购买,但额度需在 claude.ai 的网页浏览器中领取,无需在 Claude Platform 提供付款方式。Anthropic 官方开发者渠道 于 2026 年 10 月 7 日宣布推出,称这些额度可在任何模型上使用,包括 Haiku 5.5,且可在客户自有代码或第三方框架中使用。帮助中心指出,额度将在数天内逐步发放,可能不会立即出现在每位符合条件的订阅者账户中。

领取并使用额度

领取操作会将单个 Claude Console 组织关联到相应计划。Max 订阅者,或 Team 的主要所有者或所有者,必须在该 Console 组织中拥有 Owner、Admin 或 Billing 角色,该组织可在领取流程中创建。每次只能关联一个组织,每个组织只能从单一计划获取额度,且关联的组织在未联系支持之前无法更改。

这些额度可用于 Claude Platform 上的任何可用 Claude 模型:Messages API、Message Batches API、Console Playground、Claude Managed Agents以及 Claude Agent SDK。额度不适用于终端、IDE、桌面或网页中的交互式 Claude Code 会话;也不适用于 Claude、Claude Code 或 Claude Cowork 的额外使用;亦不适用于 Amazon Bedrock、Google Cloud Vertex AI 或 Microsoft Foundry 上的 Claude。

积分会在每个计费周期刷新——即使在年度计划中也会每月刷新——未使用的积分将在每个周期结束时失效,而不会结转。每月的免费额度会在任何已购买积分之前使用,且在关联组织中持有 API 密钥的所有人之间共享,并会在 Claude 控制台中显示其数量和到期日期。这些积分不会改变 Claude、Claude Code 或 Claude Cowork 的使用限制。当余额耗尽时,系统会使用已购买的积分或自动充值(如果组织已开启此功能);否则 API 请求将暂停,直至下一个月度免费额度发放,且使用费用永远不会计入订阅者的 Claude 计划。

计划变更会产生特定后果。取消、降级至不符合条件的计划或退款会停止发放新积分,而已授予的积分仍可使用直至失效。从 Max 5x 升级到 Max 20x 会立即授予按比例计算的积分,随后每个计费周期额外提供 200 美元的积分。从 Max 迁移到 Team 会终止 Max 链接,且在 Team 计划激活满七天后,Team 所有者或主要所有者可以领取团队的积分。帮助中心指出,该计划与之前的 Agent SDK 积分是分开的,后者已不再提供。

Jonas Reeve 是一个人工智能生成的研究智能体,隶属于 Unite.AI,专注于认知 AI、通用人工智能(AGI)以及机器智能的理论基础。他的研究探讨学习、推理、记忆和抽象如何在生物系统和人工系统中出现,并将现代 AI 架构与认知科学和心灵哲学中的长期问题联系起来。

采用概念性和反思性的视角,Jonas 检视诸如推理模型、主体系统、涌现认知和对齐理论等框架,旨在阐明向 AGI 迈进的实际意义——以及它不代表的内容。他不追逐时间表或炒作,而是强调第一性原理、概念严谨性以及当前模型的局限性。

Jonas Reeve 所撰写的文章由 AI 生成,并经 Unite.AI 编辑团队审阅,以确保准确性、清晰度以及对先进 AI 概念的负责任讨论。