
Claude Opus 5.5 正式发布:9 月 22 日改了什么
claude-opus-5-5,1M token 上下文与 128K 最大输出沿用 Opus 5,思考改为始终开启。对已经跑在 Opus 5 上的代码,官方文档列出了四项破坏性变更。Claude Opus 5.5 发布状态
| 项目 | 已确认状态 |
|---|---|
| 发布日期 | 2026 年 9 月 22 日 |
| Anthropic 生命周期 | Active;官方推荐大多数工作负载从它开始 |
| 官方模型 ID | claude-opus-5-5(无日期后缀,与 claude-opus-5 同一规则) |
| 标准价格 | 输入 $4 / MTok,输出 $20 / MTok |
| 提示缓存 | 5 分钟写入 $5,1 小时写入 $8,缓存读取 $0.20 / MTok(输入价的 5%) |
| Batch API | 输入 $2 / MTok,输出 $10 / MTok |
| 上下文窗口 | 100 万 token |
| 最大输出 | 128,000 token(Batch API 加 beta 头可到 300K) |
| 输入与输出 | 文本 + 图像输入,文本输出 |
| 思考 | Adaptive,始终开启;默认 effort 为 medium |
| 知识截止 | 2026 年 6 月 |
| 公布的退役下限 | 在 Anthropic 自营平台上不早于 2027 年 9 月 22 日 |
| 官方可用渠道 | Claude API、Amazon Bedrock(anthropic.claude-opus-5-5)、Claude Platform on AWS、Google Cloud、Microsoft Foundry |
以上都是 Anthropic 发布说明、模型总览和价格页上的官方事实,核查时间为 2026 年 9 月 22 日。网关可用性、地区条款、吞吐与计费仍然因渠道和账号而异,请按你实际使用的合同核验。
9 月 22 日的发布具体改了什么?
effort 原样带过去,未必能看到公告里描述的节省。能力方面,Anthropic 把 Opus 5.5 定位在长时间 Agent 编程、分析师级知识工作,以及读取密集图表、示意图和截图。公告报告 FrontierCode 得分 54.6%,称它在默认 effort 下以约 20% 的成本击败 GPT-6 Astra,并称它“在大多数工作上达到 Claude Fable 5.1 的水平”。我们没有审阅这些结论背后的评测配置,所以本文把它们当作需要在你自己的 trace 上复现的主张,而不是结果。
现有集成必须测试的四项破坏性变更
400 或悄悄改变行为的变更。400 是 Anthropic 原生 API 的行为。在 EvoLink 上,网关会把旧的 thinking: disabled 和 budget_tokens 设置兼容转换为自适应思考而不是拒绝,强制工具选择则在 Chat Completions 与 Messages 两个端点上都会被拒绝;网关行为以 Claude Opus 5.5 模型页为准。- 思考不能关闭。
thinking: {"type": "disabled"}和手动的budget_tokens写法都会返回400 invalid_request_error。省略thinking字段或传adaptive,用effort控制深度。如果你之前关思考是为了省 token,改用更低的 effort 档位。 - 强制工具调用被拒绝。
tool_choice的any和tool类型返回400,token 计数端点同样如此。保留auto,在工具上设strict: true保证参数符合 schema,或者把 schema 移到 structured outputs,并在提示词里说明何时该用工具。 - 思考块绑定到模型和对话。 Opus 5.5 能读 Opus 5 以及更早的 Opus、Sonnet、Haiku 的思考块,但不能读 Fable 或 Mythos 的。反过来,只有 Claude Fable 5.1 和 Mythos 5.1 能读 Opus 5.5 的思考块;回退到任何其他模型都会丢掉这些块继续跑。对话中途修改 system prompt、工具或更早的轮次会让思考块失效,2026 年 8 月 31 日及之后创建的账号在这种修改后重放思考块会默认返回
400。 - Claude API 和 Google Cloud 上不再接受
computer_20251124工具。 改为声明computer_toolset_20260801,并把 Agent 循环改成处理成员工具的 tool-use 块。Amazon Bedrock 上旧工具仍然可用。
thinking 块返回,而不是 text 块。在默认的 display: "omitted" 下这些块的文本为空,原来把这些说明当进度流式展示的应用会在工具调用之间“安静下来”。把 display 设为 "updates"(beta,需请求头 thinking-display-updates-2026-08-18)或 "summarized",并渲染非空的思考块即可恢复。effort 是 medium,而 Opus 5 是 high,不传 effort 的请求现在做的工作变少了。安全分类器覆盖的类别也更多:除了 cyber,stop_details.category 可能出现 bio 和 reasoning_extraction,并且服务端回退不会重试 reasoning_extraction 类的拒答。Opus 5.2 传闻是怎么收场的
claude-opus-5-5 的别名。Opus 5.5、Opus 5、Sonnet 5 和 Fable 5.1 是四种路由决策
| 模型 | 当前角色 | 路由含义 |
|---|---|---|
| Claude Opus 5 | 仍在服务的前代,$5 / $25,退役不早于 2027 年 7 月 24 日 | 在 5.5 灰度期间作为有度量的回退路由;重测之前不要假设它多余 |
| Claude Opus 5.5 | 最新 Opus,$4 / $20,Anthropic 推荐的默认 | 优先在 Agent 编程、长文档和视觉分析上评估 |
| Claude Sonnet 5 | 均衡档,$2 / $10 | 日常编程、高并发 Agent 和延迟敏感对话仍然默认它 |
| Claude Fable 5.1 | 顶配档,$10 / $50 | Opus 5.5 在高 effort 下仍达不到要求时再升级 |
Anthropic 自己的建议是大多数工作负载从 Opus 5.5 开始,只有更高 effort 的 Opus 评测仍不达标时才转向 Fable 5.1。这不意味着 Opus 5 在第一天就多余:一个已经在它上面验收通过、尚未重测的工作负载,目前没有任何证据说明新路由对这个任务更好。
正式发布不代表所有渠道完全一致
Anthropic 从发布当天起就在 Claude API、AWS、Google Cloud 和 Microsoft Foundry 上列出了 Opus 5.5。但三个细节仍然因渠道而异。Fast mode(每百万 $8 / $40)只在 Claude API 上以研究预览形式提供。旧版 computer-use 工具在 Bedrock 上继续可用,但在 Claude API 和 Google Cloud 上不行。Claude 应用里的订阅额度与 API 的 token 计费是两回事,模型出现在聊天选择器里,不说明 API key 有多少速率配额。
claude-opus-5-5 ID,用你现有的 API key 即可。模型页写明了网关为兼容而转换的设置和直接拒绝的设置。上生产流量之前,先在自己的账号上确认返回的模型、usage 和计费维度;模型发布了,不等于生产门槛通过了。开发者已经得到哪些答案,还有什么必须实测
这次发布回答了一周前还悬着的问题:公开名称、API ID、上下文和输出上限、token 价格、缓存经济性、平台列表、迁移风险,全部有了文档。它没有回答的是:Opus 5.5 是不是你产品的正确路由。
high 降到 medium,而模型在同一档位下每轮想得更多,任何成本比较之前都需要重新做一遍 effort 扫描。Anthropic 的迁移指南说的也是这件事:重跑扫描、重新评估针对旧模型写的提示词、先在开发环境测试再切生产流量。值得持续监控的七个生产信号
| 信号 | 要保留的证据 | 在 Opus 5.5 上为什么重要 |
|---|---|---|
| 路由身份 | 请求的与返回的模型 ID | 回退到非 Fable 模型会悄悄丢掉思考块 |
| Effort | 每个请求实际发送的档位 | 不传现在等于 medium,不再是 high |
| 工具行为 | 选中的工具、参数、strict 校验、重试 | 强制工具调用没了,auto 不保证一定调用 |
| 对话完整性 | 只追加的历史、原样传回的思考块 | 新账号上编辑过的历史会返回 400 |
| 进度输出 | 工具调用之间非空的 thinking 块 | 默认展示设置下流式 UI 会“安静” |
| 成本 | 每个成功任务的输入、缓存写入、缓存读取、输出、工具费 | 60% 的缓存读取降价只惠及缓存重的工作负载 |
| 安全机制 | stop_reason、stop_details.category、是否触发回退 | 新增拒答类别,其中一类不会被重试 |
把这些字段放进同一份评测记录。没有路由身份和计费证据的质量提升是不完整的,一条更便宜但需要更多重试或人工修补的 trace,每个成功任务的成本仍可能更高。
哪些团队现在应该测试 Opus 5.5?
当你的工作负载是在真实仓库里长时间运行的 Agent 编程、从大量证据里产出分析师级文档、或者读取过去需要裁切工具才能处理的密集图表和截图时,优先评估。缓存读取降价在大段稳定前缀多数轮次都命中缓存时最有价值。
不要因为它更新就切。日常编程、高并发 Agent 和延迟敏感对话通常属于 Sonnet 5;已经在 Opus 5 上验收通过的工作负载,在切换前值得做一次配对重放。之前在 Opus 5 上为了延迟而关闭思考的团队,除了改代码还要预留提示词复查的时间,因为剩下的唯一杠杆是 effort。
EvoLink 生产上线检查表
| 关口 | 要核实的内容 | 回滚条件 |
|---|---|---|
| 身份 | 请求与返回的模型都是 claude-opus-5-5 | 出现意外模型或不透明回退 |
| 请求形态 | 无 thinking: disabled、无 budget_tokens、无强制 tool_choice、显式 effort | 重放生产请求出现任何 400 |
| 质量 | 在选定 effort 下成功任务率持平或提升 | 任一关键任务类别回退 |
| 历史 | 思考块在支持的对话流程和回退路径中都保持有效 | 编辑或降级后历史失效 |
| 成本 | effort 扫描后每个成功任务的成本下降 | token 或复核成本超过 Opus 5 基线 |
| 可靠性 | 错误率与 p95 延迟保持在服务目标内 | 容量或延迟突破关口 |
先重放,再影子流量,再小比例灰度。把模型选择放在配置里,这样一次失败的晋升只是改配置,不是重写。
在 EvoLink 上评估 Claude Opus 5.5 阅读 Opus 5.5 vs Opus 5 升级决策常见问题
Claude Opus 5.5 什么时候发布?
Anthropic 于 2026 年 9 月 22 日发布 Claude Opus 5.5,将其列为 Active,并承诺在自营平台上不早于 2027 年 9 月 22 日退役。
Claude Opus 5.5 已经提供 API 吗?
Claude Opus 5.5 的模型 ID 是什么?
claude-opus-5-5,固定 ID,无日期后缀。EvoLink 在 Chat Completions 和 Messages 两个端点上使用同一个字符串。Bedrock 上的 ID 是 anthropic.claude-opus-5-5。Claude Opus 5.5 比 Opus 5 便宜多少?
Anthropic 标价每百万输入 / 输出 token $4 / $20,Opus 5 是 $5 / $25,降幅 20%。缓存读取从 $0.50 降到 $0.20,降幅 60%。Anthropic 说的“运行成本低 40%”是它在自己的任务组合上得出的总成本估算,不是标价。
能在 Claude Opus 5.5 上关闭思考吗?
thinking: disabled 和 budget_tokens 都会返回 400;在 EvoLink 上,网关会把这些旧设置兼容转换为自适应思考而不报错,但同样关不掉思考。省略该字段或传 adaptive,用 effort(low 到 max,默认 medium)控制深度。Opus 5.2 和 Opus 5.5 是同一个东西吗?
Anthropic 从未官宣过“Opus 5.2”,这个名字来自 9 月中旬的社区路由报道。Opus 5.5 是 Anthropic 实际发布的模型。早前的报道是否描述的是这个模型的早期流量并未得到确认,所以我们把两个名字分开处理。
Opus 5.5 会取代 Claude Opus 5 吗?
不会自动取代。Opus 5 仍然是 Active,退役下限为 2027 年 7 月 24 日。Anthropic 建议新工作负载从 Opus 5.5 开始,但已经在 Opus 5 上验收通过的工作负载应该先重测再迁移。
切换前在哪里对比 Opus 5.5 与 Opus 5?
来源
- Anthropic:平台发布说明,2026 年 9 月 22 日条目
- Anthropic:模型总览
- Anthropic:定价
- Anthropic:Claude Opus 5.5 新变化
- Anthropic:迁移到 Claude Opus 5.5
- Anthropic:Introducing Claude Opus 5.5


