
Claude Opus 5 正式发布:7 月 24 日有哪些变化?
最新状态 — 2026 年 7 月 24 日: Anthropic 已正式发布 Claude Opus 5。该模型已在 Claude、Claude Code、Claude API、Amazon Bedrock、Google Cloud Vertex AI 和 Microsoft Foundry 上提供,同时成为 Claude Max 的默认模型,也是 Claude Pro 可选择的最强模型。
claude-opus-5,context window 为 100 万 token,最大输出为 128K token。Anthropic 官方基础标价是输入 $5/MTok、输出 $25/MTok,与 Opus 4.8 相同。这个 URL 之前用于追踪 Honeycomb 等发布前信号。我们保留了下方时间线,让读者可以区分“当时能够确认的线索”和“Anthropic 现在已经确认的产品事实”。
Claude Opus 5 发布状态
| 问题 | 2026 年 7 月 24 日官方答案 | 对生产的意义 |
|---|---|---|
| Claude Opus 5 发布了吗? | 是,Anthropic 已于 7 月 24 日发布 | 可以从“观察发布”进入受控评测 |
| 在哪些平台可用? | Claude、Claude Code、Anthropic API、Bedrock、Vertex AI、Microsoft Foundry | 覆盖广泛,但仍需核对账号与地区资格 |
| API model ID 是什么? | claude-opus-5 | 目标路由验证通过后再使用官方标识 |
| 官方基础价格? | 输入 $5/MTok,输出 $25/MTok | 与 Opus 4.8 相同,但任务成本仍受输出、重试与审核影响 |
| 上下文与输出上限? | 1M context、128K 最大输出 | 长上下文和长任务仍需真实 workload 验证 |
| 是否在所有产品中默认启用? | Claude Max 默认;Claude Pro 可选最强模型 | 订阅默认不等于 API 经济性或应用兼容性 |
Anthropic 公布了哪些变化
low、medium、high、xhigh 和 max 五档 effort。迁移时有三点需要特别验证:
- 在关闭 thinking 的同时使用
xhigh或max会返回 400 错误。 - Fast mode 约为 2.5 倍速度、2 倍基础 token 价格,需要单独的延迟敏感路由策略。
- Anthropic 的安全 fallback 是需要显式启用的 beta 功能,并非所有请求都会自动回退。启用默认 fallback 后,符合条件的 classifier refusal 才可能在 Opus 4.8 上重试;应同时记录请求模型与实际返回模型。
如何理解发布 Benchmark
“Opus 5 全面超过 Fable 5”过于宽泛,准确说法必须落到具体 Benchmark。
| Anthropic 发布声明 | 公布结果 | 合理解释 |
|---|---|---|
| ARC-AGI-3 | 约为下一名的 3 倍 | Anthropic 报告 Opus 5 在该 Benchmark 达到 SOTA |
| CursorBench 3.2 | Max effort 距 Fable 峰值不到 0.5%,成本约一半 | 在这个编码测试接近持平,不代表所有编码任务都更强 |
| AutomationBench | 相同任务成本下约为下一名的 1.5 倍 | 对自动化工作流是有力的一方证据 |
| OSWorld 2.0 | 以略高于三分之一的成本超过 Fable 最佳成绩 | 在 Anthropic 公布的 computer-use 设置中表现更优 |
| Frontier-Bench v0.1 | 最高已公布结果 | 说明其在该困难任务集中的能力 |
这些是 Anthropic 的发布方结果,不是 EvoLink 的独立测试。它们适合作为同一 prompts、tools、timeouts、effort 和验收标准下的复放假设。
Anthropic 同时说明 Opus 5 在网络安全方面仍落后于 Mythos 5。这也说明模型选择应跟随任务,而不是跟随一个总榜单。
Claude Opus 5 发布时间线
| 日期 | 状态事件 | 发生了什么 |
|---|---|---|
| 2026 年 7 月 24 日 | Anthropic 正式发布 Claude Opus 5 | 产品名、model ID、价格、限制、平台和发布数据得到确认 |
| 2026 年 7 月 14 日 | 二手报道传播疑似 Vertex AI 标识 | 是值得追踪的信号,但仍不是稳定的开发者契约 |
| 2026 年 7 月 8–9 日 | Honeycomb EAP 据报短暂出现在 Cursor | 合作方测试变得可见,但最终身份当时仍未确认 |
| 2026 年 5 月 28 日 | Claude Opus 4.8 发布 | 建立了上一代 Opus 基线与迁移对照组 |
7 月 24 日以前,Honeycomb 只能支持“可能是下一代 Opus”的推断,不能确认名称、价格、model ID 或发布日期。正式公告已经解决这些问题;旧的 300 万 context 或未知定价猜测应由官方文档替代。
生产团队现在应该验证什么
| 验证项 | 扩量前的最低证据 |
|---|---|
| 路由契约 | 请求、返回模型、usage、错误、streaming 与计费均通过 |
| 行为兼容性 | Prompt 遵循、输出结构、工具选择、结构化输出与错误恢复 |
| 长上下文可靠性 | 在代表性 1M-context 工作中保持检索准确与约束 |
| Effort 策略 | 各档 effort 的质量、延迟与成本分别测量 |
| 安全 fallback | 如果启用 beta fallback,日志与验收测试能识别 Opus 4.8 重试 |
| 经济性 | 单个验收任务成本包含输出、重试、cache、fallback 与审核 |
| 回滚 | Opus 4.8 或其他已验证路线可随时恢复 |
推荐上线顺序
- 将模型选择留在配置或路由层,不要散落在业务逻辑中。
- 用 Opus 5 复放已成功任务、Opus 4.8 已知失败和 frontier tasks。
- 记录任务验收率、工具失败、延迟、token、fallback 与人工审核。
- 先开放给高价值编码或 Agent 任务的小流量通道。
- 只提升质量或单个成功任务成本的 workload。
- 保留已测试的 fallback 与量化回滚阈值。
统一 API 网关的价值就在这里:模型变化时,应用可以比较路线并调整策略,而不必为每次发布重写供应商集成。
最终状态
Benchmark 领先是开始测试的理由,不是替换所有默认模型的理由。应先放入 challenger 通道,与 Opus 4.8 和其他强模型做同条件评测,再按任务价值路由。
查看 Claude Opus 5 在 EvoLink 的可用状态来源
- Anthropic:Introducing Claude Opus 5
- Anthropic:Claude API release notes
- Anthropic:Models overview
- Anthropic:What's new in Claude Opus 5
- Anthropic:Claude API pricing
常见问题
Claude Opus 5 要发布了吗?
已经发布。Anthropic 于 2026 年 7 月 24 日正式发布 Claude Opus 5,并在第一方产品、API 和主流云平台上线。
Claude Opus 5 什么时候发布的?
正式发布日期是 2026 年 7 月 24 日。
Claude Opus 5 API 可以使用了吗?
claude-opus-5。EvoLink 是否已开放对应路线属于单独的路由状态,需要到模型页核对。Claude Opus 5 的 model ID 是什么?
claude-opus-5。修改生产配置前,仍需在所使用的网关或云平台核对该标识。Claude Opus 5 价格是多少?
Anthropic 标准标价为输入 $5/MTok、输出 $25/MTok。Fast mode 约快 2.5 倍,但基础 token 价格为两倍,应作为独立的低延迟路线测算。
Claude Opus 5 是 Claude Max 的默认模型吗?
是。Anthropic 表示 Opus 5 是 Max 的默认模型,也是 Pro 用户可选择的最强模型。
Claude Opus 5 超过 Fable 5 了吗?
Claude Opus 5 在 ARC-AGI-3 达到 SOTA 了吗?
按照 Anthropic 的发布结果,是的,其成绩约为下一名的三倍。
Honeycomb 与正式版本有什么区别?
Honeycomb 只是发布前信号。7 月 24 日的公告确认了 Opus 5 的最终名称、API 标识、价格、限制、可用性和行为。


