看到“成本约低 40%”,先看自己付的是哪种钱:API 按量计费看单价,订阅用户看使用限额,用 Claude Code 还要核对当前会话模型。9 月 22 日发布的 Opus 5.5 同时涉及这三项变化。下面把官方数据、独立对比和外部案例分开说。
第一件:API 按量计费的 token 单价降了
如果你通过 API 调用 Claude,Opus 5.5 的每百万 token 价格是输入 $4、输出 $20、缓存读取 $0.20。对比 Opus 5 的 $5/$25/$0.50,输入和输出单价低约 20%,缓存读取低 60%。这仅是 Opus 5.5 与 Opus 5 两个模型之间的对比,不代表所有 AI 工具同步降价。
第二件:订阅用户的使用额度和默认等级变了
Anthropic 宣布 Pro、Max、Team 和按席位计费的 Enterprise 套餐五小时使用限额提高,同时提供一次可自选时间使用的限额重置。该公告未列出各套餐的具体增加量。需要注意的是,订阅使用限额与 API 按 token 计费是两套规则,不能用 API 单价去换算订阅能发多少条消息。
第三件:Claude Code 的默认模型升级了
Claude Code v2.1.280 起,在 Anthropic API、AWS、Bedrock、GCP 上,Pro 和 Team Standard 用户的默认模型从 Sonnet 5 升级为 Opus 5.5。Microsoft Foundry 是例外,默认为 Sonnet 4.5。但"default"和"opus 别名"是两个概念,实际使用的模型还取决于版本号、账户类型、提供方以及组织或个人的覆盖设置,不是所有人已自动切换。可以用 /model 查看当前会话模型,/status 核对账户信息。
"成本约低 40%"要看条件
Anthropic 官方说法是:默认设置下,典型工作负载成本比 Opus 5 约低 40%。这包含 token 单价降低和 token 用量变化两个因素。独立评测平台 Artificial Analysis 在最高思考强度(Max Effort)下对比,Opus 5.5 每任务约 $5.98、输出约 11.9 万 token,Opus 5 约 $5.86、输出约 7.3 万 token。这是 AA Intelligence Index 加权平均值,测试条件与 Anthropic 的"默认设置下典型工作负载"不同,不互相推翻。但它说明一件事:单价降了不等于每个任务一定便宜,取决于任务类型、思考强度与调用方式。
一个外部案例
Every.to 的报道(Katie Parrott 撰写,2026-09-22)中,Every.to 团队获 Anthropic 发布前访问、测试七天,其中测试者 Mike Taylor 在一项语音表单应用中约 30 分钟消耗约 590 万 token,按 Opus 5 价格粗算约 $7.63(无输入/输出/缓存构成,不是 Opus 5.5 实付),但应用核心页面仍有报错。Kieran Klaassen 和 Nityesh 在测试中触及周使用额度上限。文章建议给长任务设好预算和停止条件。Anthropic 未参与该文编辑。
可以做的检查
查版本:claude --version,确认是否 ≥ 2.1.280。查模型:/model 看当前会话使用的模型(账户默认不等于当前会话模型)。了解 effort 设置:/effort 查看思考强度,它影响 token 消耗,但费用还受任务内容、输入输出量、缓存命中等因素影响。
来源:Anthropic 发布页 anthropic.com/claude-opus-5-5 · Claude Code 文档 code.claude.com/docs/en/model-config · Artificial Analysis artificialanalysis.ai/models/comparisons/claude-opus-5-5-vs-claude-opus-5 · Every.to every.to/vibe-check/vibe-check-opus-5-5-is-pulling-our-codex-converts-back-to-claude