GPT Image 2.5 Flare 与 Sunburst 已上线 EvoLink立即体验
Claude Opus 5.5 发布封面:陶土色拱门与穿过其中的流线
发布观察

Claude Opus 5.5 正式发布:9 月 22 日改了什么

EvoLink 团队
EvoLink 团队
产品团队
2026年9月22日
21 分钟阅读
Claude Opus 5.5 已于 2026 年 9 月 22 日正式发布。 Anthropic 将它列为最新的 Opus 模型,面向长时间运行的 Agent 编程与知识型工作,官方标价 每百万输入 token $4、每百万输出 token $20,低于 Opus 5 的 $5 / $25。模型 ID 是 claude-opus-5-5,1M token 上下文与 128K 最大输出沿用 Opus 5,思考改为始终开启。对已经跑在 Opus 5 上的代码,官方文档列出了四项破坏性变更。
对 EvoLink 用户来说,模型已经可以直接调用:Claude Opus 5.5 模型页是路由状态、当前 EvoLink 价格和接入参数的唯一事实来源。本文讲清 Anthropic 发布了什么、对开发者意味着什么,以及这一周的“Opus 5.2”传闻是怎么收场的。要不要升级、怎么算成本、怎么灰度,见 Claude Opus 5.5 vs Claude Opus 5。

Claude Opus 5.5 发布状态

项目已确认状态
发布日期2026 年 9 月 22 日
Anthropic 生命周期Active;官方推荐大多数工作负载从它开始
官方模型 IDclaude-opus-5-5(无日期后缀,与 claude-opus-5 同一规则)
标准价格输入 $4 / MTok,输出 $20 / MTok
提示缓存5 分钟写入 $5,1 小时写入 $8,缓存读取 $0.20 / MTok(输入价的 5%)
Batch API输入 $2 / MTok,输出 $10 / MTok
上下文窗口100 万 token
最大输出128,000 token(Batch API 加 beta 头可到 300K)
输入与输出文本 + 图像输入,文本输出
思考Adaptive,始终开启;默认 effort 为 medium
知识截止2026 年 6 月
公布的退役下限在 Anthropic 自营平台上不早于 2027 年 9 月 22 日
官方可用渠道Claude API、Amazon Bedrock(anthropic.claude-opus-5-5)、Claude Platform on AWS、Google Cloud、Microsoft Foundry

以上都是 Anthropic 发布说明、模型总览和价格页上的官方事实,核查时间为 2026 年 9 月 22 日。网关可用性、地区条款、吞吐与计费仍然因渠道和账号而异,请按你实际使用的合同核验。

9 月 22 日的发布具体改了什么?

最重要的变化是每一个 token 计费维度都降价了,而上下文与输出上限不变。标准输入和输出相对 Opus 5 便宜 20%。缓存读取从每百万 $0.50 降到 $0.20,降幅 60%,原因是 Opus 5.5 把缓存命中定价为输入价的 5%,其他 Claude 模型是 10%(Fable 5.1 与 Mythos 5.1 为 2.5%)。缓存写入随输入价同步下调:$5 与 $8,对比之前的 $6.25 与 $10。
Anthropic 的公告说得更多:Opus 5.5“运行成本比 Opus 5 低 40%”,输出速度“快 30% 以上”。这两个数字要分开读。20% 和 60% 是价格页上可以直接验证的标价算术。40% 是 Anthropic 在自己的任务组合上测出来的总成本,把单价下调和“每个完成任务消耗更少 token”合在一起。它是厂商在你没有跑过的工作负载上得出的估算。Anthropic 自己的文档同时指出,在相同 effort 档位下,Opus 5.5 每一轮倾向于比 Opus 5 想得更多,所以如果你把原来的 effort 原样带过去,未必能看到公告里描述的节省。

能力方面,Anthropic 把 Opus 5.5 定位在长时间 Agent 编程、分析师级知识工作,以及读取密集图表、示意图和截图。公告报告 FrontierCode 得分 54.6%,称它在默认 effort 下以约 20% 的成本击败 GPT-6 Astra,并称它“在大多数工作上达到 Claude Fable 5.1 的水平”。我们没有审阅这些结论背后的评测配置,所以本文把它们当作需要在你自己的 trace 上复现的主张,而不是结果。

现有集成必须测试的四项破坏性变更

跑在 Opus 5 上的代码,不是改一个模型字符串就能迁到 Opus 5.5。Anthropic 文档记录了四项会返回 400 或悄悄改变行为的变更。
范围说明:下文的 400 是 Anthropic 原生 API 的行为。在 EvoLink 上,网关会把旧的 thinking: disabled 和 budget_tokens 设置兼容转换为自适应思考而不是拒绝,强制工具选择则在 Chat Completions 与 Messages 两个端点上都会被拒绝;网关行为以 Claude Opus 5.5 模型页为准。
  1. 思考不能关闭。 thinking: {"type": "disabled"} 和手动的 budget_tokens 写法都会返回 400 invalid_request_error。省略 thinking 字段或传 adaptive,用 effort 控制深度。如果你之前关思考是为了省 token,改用更低的 effort 档位。
  2. 强制工具调用被拒绝。 tool_choice 的 any 和 tool 类型返回 400,token 计数端点同样如此。保留 auto,在工具上设 strict: true 保证参数符合 schema,或者把 schema 移到 structured outputs,并在提示词里说明何时该用工具。
  3. 思考块绑定到模型和对话。 Opus 5.5 能读 Opus 5 以及更早的 Opus、Sonnet、Haiku 的思考块,但不能读 Fable 或 Mythos 的。反过来,只有 Claude Fable 5.1 和 Mythos 5.1 能读 Opus 5.5 的思考块;回退到任何其他模型都会丢掉这些块继续跑。对话中途修改 system prompt、工具或更早的轮次会让思考块失效,2026 年 8 月 31 日及之后创建的账号在这种修改后重放思考块会默认返回 400。
  4. Claude API 和 Google Cloud 上不再接受 computer_20251124 工具。 改为声明 computer_toolset_20260801,并把 Agent 循环改成处理成员工具的 tool-use 块。Amazon Bedrock 上旧工具仍然可用。
第五项变化不报错,但会改变用户看到的东西:模型在工具调用之间写的简短说明,现在以进度更新类的 thinking 块返回,而不是 text 块。在默认的 display: "omitted" 下这些块的文本为空,原来把这些说明当进度流式展示的应用会在工具调用之间“安静下来”。把 display 设为 "updates"(beta,需请求头 thinking-display-updates-2026-08-18)或 "summarized",并渲染非空的思考块即可恢复。
还有两个默认值变了。默认 effort 是 medium,而 Opus 5 是 high,不传 effort 的请求现在做的工作变少了。安全分类器覆盖的类别也更多:除了 cyber,stop_details.category 可能出现 bio 和 reasoning_extraction,并且服务端回退不会重试 reasoning_extraction 类的拒答。

Opus 5.2 传闻是怎么收场的

9 月 14 日到 21 日之间,社区帖子称 Claude Code 悄悄把部分 Opus 5 请求路由到一个被叫作“Opus 5.2”的新构建,第三方页面还流传过三个候选名字和一个内部代号。我们的 Opus 5.2 发布追踪在 9 月 18 日记录:Anthropic 没有任何这样的模型、ID 或价格。
这次发布用我们追踪文里说过的方式回答了“身份”问题:一条带日期的发布说明、一个模型页、一个可调用的 ID、有文档的价格和一份迁移指南,名字叫 Claude Opus 5.5。它没有回答的是:9 月的路由报道是不是这个模型的早期流量。Anthropic 没有这样说,“Opus 5.2”这个产品从未被官宣,两个名字在本站仍然是独立实体。把“Opus 5.2”当作一个已经收场的社区叫法,不要当作 claude-opus-5-5 的别名。
下一个流传的名字同理。Anthropic 尚未宣布 Claude Opus 6,我们的 Opus 6 发布追踪继续把它当作未确认的下一代,而 Opus 5.5 是当前这一代里的点版本。

Opus 5.5、Opus 5、Sonnet 5 和 Fable 5.1 是四种路由决策

模型当前角色路由含义
Claude Opus 5仍在服务的前代,$5 / $25,退役不早于 2027 年 7 月 24 日在 5.5 灰度期间作为有度量的回退路由;重测之前不要假设它多余
Claude Opus 5.5最新 Opus,$4 / $20,Anthropic 推荐的默认优先在 Agent 编程、长文档和视觉分析上评估
Claude Sonnet 5均衡档,$2 / $10日常编程、高并发 Agent 和延迟敏感对话仍然默认它
Claude Fable 5.1顶配档,$10 / $50Opus 5.5 在高 effort 下仍达不到要求时再升级

Anthropic 自己的建议是大多数工作负载从 Opus 5.5 开始,只有更高 effort 的 Opus 评测仍不达标时才转向 Fable 5.1。这不意味着 Opus 5 在第一天就多余:一个已经在它上面验收通过、尚未重测的工作负载,目前没有任何证据说明新路由对这个任务更好。

正式发布不代表所有渠道完全一致

Anthropic 从发布当天起就在 Claude API、AWS、Google Cloud 和 Microsoft Foundry 上列出了 Opus 5.5。但三个细节仍然因渠道而异。Fast mode(每百万 $8 / $40)只在 Claude API 上以研究预览形式提供。旧版 computer-use 工具在 Bedrock 上继续可用,但在 Claude API 和 Google Cloud 上不行。Claude 应用里的订阅额度与 API 的 token 计费是两回事,模型出现在聊天选择器里,不说明 API key 有多少速率配额。

在 EvoLink 上,Claude Opus 5.5 路由在 OpenAI 兼容的 Chat Completions 端点和 Anthropic Messages 端点上都接受同一个 claude-opus-5-5 ID,用你现有的 API key 即可。模型页写明了网关为兼容而转换的设置和直接拒绝的设置。上生产流量之前,先在自己的账号上确认返回的模型、usage 和计费维度;模型发布了,不等于生产门槛通过了。

开发者已经得到哪些答案,还有什么必须实测

这次发布回答了一周前还悬着的问题:公开名称、API ID、上下文和输出上限、token 价格、缓存经济性、平台列表、迁移风险,全部有了文档。它没有回答的是:Opus 5.5 是不是你产品的正确路由。

40% 的成本、30% 的速度、FrontierCode 的成绩、“大多数工作达到 Fable 5.1 水平”,在你的 trace 上成立之前都是假设。由于默认 effort 从 high 降到 medium,而模型在同一档位下每轮想得更多,任何成本比较之前都需要重新做一遍 effort 扫描。Anthropic 的迁移指南说的也是这件事:重跑扫描、重新评估针对旧模型写的提示词、先在开发环境测试再切生产流量。

值得持续监控的七个生产信号

信号要保留的证据在 Opus 5.5 上为什么重要
路由身份请求的与返回的模型 ID回退到非 Fable 模型会悄悄丢掉思考块
Effort每个请求实际发送的档位不传现在等于 medium,不再是 high
工具行为选中的工具、参数、strict 校验、重试强制工具调用没了,auto 不保证一定调用
对话完整性只追加的历史、原样传回的思考块新账号上编辑过的历史会返回 400
进度输出工具调用之间非空的 thinking 块默认展示设置下流式 UI 会“安静”
成本每个成功任务的输入、缓存写入、缓存读取、输出、工具费60% 的缓存读取降价只惠及缓存重的工作负载
安全机制stop_reason、stop_details.category、是否触发回退新增拒答类别,其中一类不会被重试

把这些字段放进同一份评测记录。没有路由身份和计费证据的质量提升是不完整的,一条更便宜但需要更多重试或人工修补的 trace,每个成功任务的成本仍可能更高。

哪些团队现在应该测试 Opus 5.5?

当你的工作负载是在真实仓库里长时间运行的 Agent 编程、从大量证据里产出分析师级文档、或者读取过去需要裁切工具才能处理的密集图表和截图时,优先评估。缓存读取降价在大段稳定前缀多数轮次都命中缓存时最有价值。

不要因为它更新就切。日常编程、高并发 Agent 和延迟敏感对话通常属于 Sonnet 5;已经在 Opus 5 上验收通过的工作负载,在切换前值得做一次配对重放。之前在 Opus 5 上为了延迟而关闭思考的团队,除了改代码还要预留提示词复查的时间,因为剩下的唯一杠杆是 effort。

关口要核实的内容回滚条件
身份请求与返回的模型都是 claude-opus-5-5出现意外模型或不透明回退
请求形态无 thinking: disabled、无 budget_tokens、无强制 tool_choice、显式 effort重放生产请求出现任何 400
质量在选定 effort 下成功任务率持平或提升任一关键任务类别回退
历史思考块在支持的对话流程和回退路径中都保持有效编辑或降级后历史失效
成本effort 扫描后每个成功任务的成本下降token 或复核成本超过 Opus 5 基线
可靠性错误率与 p95 延迟保持在服务目标内容量或延迟突破关口

先重放,再影子流量,再小比例灰度。把模型选择放在配置里,这样一次失败的晋升只是改配置,不是重写。

在 EvoLink 上评估 Claude Opus 5.5 阅读 Opus 5.5 vs Opus 5 升级决策

常见问题

Claude Opus 5.5 什么时候发布?

Anthropic 于 2026 年 9 月 22 日发布 Claude Opus 5.5,将其列为 Active,并承诺在自营平台上不早于 2027 年 9 月 22 日退役。

Claude Opus 5.5 已经提供 API 吗?

是。Anthropic 在 Claude API、Amazon Bedrock、Claude Platform on AWS、Google Cloud 和 Microsoft Foundry 上都有文档。在 EvoLink 上它是已上线的生产路由,模型页有当前价格和参数。

Claude Opus 5.5 的模型 ID 是什么?

claude-opus-5-5,固定 ID,无日期后缀。EvoLink 在 Chat Completions 和 Messages 两个端点上使用同一个字符串。Bedrock 上的 ID 是 anthropic.claude-opus-5-5。

Claude Opus 5.5 比 Opus 5 便宜多少?

Anthropic 标价每百万输入 / 输出 token $4 / $20,Opus 5 是 $5 / $25,降幅 20%。缓存读取从 $0.50 降到 $0.20,降幅 60%。Anthropic 说的“运行成本低 40%”是它在自己的任务组合上得出的总成本估算,不是标价。

能在 Claude Opus 5.5 上关闭思考吗?

两条路径都不能。在 Anthropic 原生 API 上,thinking: disabled 和 budget_tokens 都会返回 400;在 EvoLink 上,网关会把这些旧设置兼容转换为自适应思考而不报错,但同样关不掉思考。省略该字段或传 adaptive,用 effort(low 到 max,默认 medium)控制深度。

Opus 5.2 和 Opus 5.5 是同一个东西吗?

Anthropic 从未官宣过“Opus 5.2”,这个名字来自 9 月中旬的社区路由报道。Opus 5.5 是 Anthropic 实际发布的模型。早前的报道是否描述的是这个模型的早期流量并未得到确认,所以我们把两个名字分开处理。

Opus 5.5 会取代 Claude Opus 5 吗?

不会自动取代。Opus 5 仍然是 Active,退役下限为 2027 年 7 月 24 日。Anthropic 建议新工作负载从 Opus 5.5 开始,但已经在 Opus 5 上验收通过的工作负载应该先重测再迁移。

切换前在哪里对比 Opus 5.5 与 Opus 5?

看 Claude Opus 5.5 vs Claude Opus 5 升级指南,里面有成本模型、兼容性风险和灰度方案。

来源

事实核验时间:2026 年 9 月 22 日。性能、速度和总成本的表述均来自 Anthropic;EvoLink 用户应在自己的路由和工作负载上实测。

准备好把 AI 成本降低 89% 吗?

现在就开始使用 EvoLink,体验智能 API 路由的强大能力。