Claude Opus 5 API
选择 Claude Opus 5
Claude Opus 5 是 Anthropic 最新的 Opus 旗舰模型,面向最困难的编程任务、长时间运行的智能体和高判断力的代码审查。输入、缓存写、缓存读、输出与联网搜索共五个计费维度独立计价,Token 价格为官方价 95 折。
Claude Opus 5
Anthropic Opus 系列旗舰模型
claude-opus-5仓库级软件工程、重度调用工具的长周期智能体、高风险代码审查,以及答错代价远高于 Token 单价的研究与分析工作。
Claude Opus 5 价格
用交互式价格计算器估算单次请求费用。EvoLink Token 价格为 Anthropic 官方价 95 折。
Token 价格计算器
输入单次请求的 Token 组成与联网搜索次数。单次请求预估
Claude Opus 5每次请求最低消费 0.01 Credits。
EvoLink 对比 Anthropic 官方
相同 Token 组合,按页面展示的 EvoLink 价格计算。预算参考
按当前 Token 组合估算可调用次数。快速测试
日常开发
生产评估
模型价格
| 模型 | 上下文 | 输入 Token | 缓存写入 Token | 缓存读取 Token | 输出 Token | 联网搜索次数 |
|---|---|---|---|---|---|---|
Claude Opus 5claude-opus-5 | 全部上下文长度 | $4.750 / 1M-5% 323 cr / 1M$5.000官方价格 | $5.939 / 1M-5% 403.8 cr / 1M$6.250官方价格 | $0.475 / 1M-5% 32.3 cr / 1M$0.500官方价格 | $23.750 / 1M-5% 1615 cr / 1M$25.000官方价格 | $0.010 / 次0.68 cr / 次 |
Claude Opus 5
全部上下文长度美元与 Credits 均按每百万 Token 展示。生产使用前,请以价格表当前显示的价格为准。
联网搜索工具按次计费,使用官方原价、不参与折扣;搜索结果带入请求的 Token 另按 Token 价计费。
面向最难编程与智能体任务的 Claude Opus 5 API
通过 EvoLink 统一 API 调用 Anthropic 最新的 Opus 旗舰模型,每百万输入 / 输出 Token $4.75 / $23.75,为官方价 95 折。支持 100 万 Token 上下文窗口、12.8 万最大输出、写入与读取分开计价的提示词缓存,以及按次计费的联网搜索工具。

提示词缓存按读写两个维度独立计费
Claude 的提示词缓存在写入前缀时收取写入价,在复用时按远低于输入价的读取价计费。稳定的系统提示词、仓库说明和工具 Schema 只需写入一次,后续在长智能体运行中反复低价读取。
100 万 Token 上下文与 12.8 万最大输出
可以在同一工作上下文中保留相关代码、规格、文档和智能体状态,但不要把上限当成目标。先检索真正相关的证据,缓存稳定前缀,并按任务难度设置输出预算。
Thinking 与 effort 会改变延迟和 Token 用量
Anthropic 在 Opus 5 上默认使用 adaptive thinking,API 的 effort 默认值为 high。上线前应在所选 EvoLink 协议上核验实际参数支持、响应内容、输出 Token 与延迟,不要把 max_tokens 当作 thinking 预算。
切换生产流量前,先重放真实任务
Token 单价相同,不代表完成单个任务的成本相同。模型行为和分词方式可能改变计费 Token、重试次数与工具路径;切换流量前,请用真实生产样本比较成功率、总成本和人工修改量。
Claude Opus 5 的高价位在哪里能赚回来
Opus 档位的价格只有在任务足够难、更好的答案能省掉后续工作时才划算。选型应按「答错的代价」而不是「每 Token 的价格」来决定。
仓库级软件工程
在同一上下文中审阅大型代码库、跨服务追踪依赖、规划多文件改动,同时保持架构约束不丢失。衡量标准应是被采纳的补丁与审查耗时,而不是孤立代码片段的质量。
重度使用工具的长周期智能体
多步编排、工具选择与代码执行的长时间运行场景,一次错误分支的代价远高于 Token 差价。跨轮次完整回放 assistant 消息、tool-call ID、参数与工具返回结果。
高风险审查与分析
安全审查、迁移方案规划、合同与研究分析,以及任何「自信地答错」代价高昂的场景。100 万 Token 窗口可以把完整证据集放在同一处。
什么时候该选其他路由
日常编程、大批量智能体、分类任务和对延迟敏感的对话通常更适合 Claude Sonnet 5。Claude Opus 4.8 在 EvoLink 上折扣更深,只要它的答案够用,就仍是更便宜的 Opus 路由。
五个计费维度,各自独立计量
Claude Opus 5 不是单一混合价。搞清楚某个工作负载真正消耗哪些维度,Opus 档位的预算才可预测。
输入与输出 Token
每次请求都会触及的两个维度:EvoLink 每百万输入 Token $4.75、输出 Token $23.75,比 Anthropic 官方的 $5.00 与 $25.00 低 5%。生成密集型任务的成本由输出主导,应按任务难度限制 max_tokens。
缓存写入与缓存读取
写入前缀每百万 Token $5.939,复用时每百万 Token 仅 $0.475。稳定的系统提示词、仓库说明与工具 Schema 只需写入一次,之后整轮运行都以约输入价十分之一的价格读取。
联网搜索工具
按次计费 $0.01,使用官方原价、不参与折扣。搜索结果还会作为普通输入 Token 进入请求,因此一次重度检索既要付按次费用,也要付它带入的 Token 费用。
无需更换模型栈即可接入 Claude Opus 5
保留同一个 EvoLink 客户端与 API 密钥,把最难的工作负载路由到 Opus 5,简单或对延迟敏感的流量继续走已验证的备选路由。
沿用现有兼容客户端流程
把客户端指向 EvoLink,用同一个 API 密钥鉴权,模型选 claude-opus-5。兼容 OpenAI 的 Chat Completions 端点与 Anthropic Messages 端点均可使用。
使用文档中的 API 模型 ID
两种协议的 API 模型名都是 claude-opus-5。该模型的页面 URL 与模型参数完全一致。
按缓存复用组织提示词结构
把稳定的系统提示词、仓库说明与工具 Schema 放在请求前部,让昂贵的前缀只写入一次,本次会话后续都以低价读取。
按单任务交付价值做路由
与 Claude Opus 4.8、Sonnet 5 对比成功率、重试次数、输出 Token、缓存命中、总耗时和人工修改量,而不只比 Token 单价。
复制模型 ID,发出第一条请求
产品页只保留可验证的最小请求。Thinking、effort、工具调用、故障处理与生产迁移由完整 API 使用指南继续说明。
curl https://direct.evolink.ai/v1/messages \
-H "Authorization: Bearer $EVOLINK_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-opus-5",
"max_tokens": 8192,
"messages": [
{"role": "user", "content": "Review this pull request and list the blocking issues."}
]
}'完成生产评估后,再对比各条 Claude 路由
EvoLink先用真实任务确认 Opus 5 是否能减少重试和人工修改,再结合价格、上下文、缓存方式与任务类型选择生产路由。
| 模型 | Claude Opus 5 | Claude Opus 4.8 | Claude Sonnet 5 |
|---|---|---|---|
| 输入 / 输出 | $4.75 / $23.75 | $4.5 / $22.5 | $1.8 / $9 |
| 上下文 | 1M | 1M | 1M |
| 缓存 | 读 + 写 | 读 + 写 | 读 + 写 |
| 适用场景 | 仓库级软件工程、重度调用工具的长周期智能体、高风险代码审查,以及答错代价远高于 Token 单价的研究与分析工作。 | 上一代 Opus 旗舰,在 EvoLink 上折扣更深,仍是高端编程与智能体任务的高性价比 Opus 路由。 | 以 Sonnet 的价格提供接近 Opus 的编程与智能体表现,适合日常生产流量。 |
EvoLink 上的其他 Claude 模型

Claude Opus 4.8
上一代 Opus 旗舰,在 EvoLink 上折扣更深,适合仍能稳定完成任务且更看重成本的生产流量。
查看模型
Claude Sonnet 5
以更均衡的成本承接日常编程、高并发智能体和对延迟敏感的生产任务。
查看模型
Claude Fable 5
面向更高能力与更长周期智能体任务的 Claude 路由,适合能力优先于成本的工作负载。
查看模型
Claude Haiku 4.5
速度更快、成本更低,适合子智能体、高并发分类和低延迟对话。
查看模型其他文本模型

GPT-5.6
OpenAI 的分层前沿模型系列,便于按能力、延迟和成本组合路由。
查看模型
Grok 4.5
提供 50 万上下文与服务端搜索工具的 xAI 推理与工具调用路由。
查看模型
Kimi K3
面向仓库级编程与多文档任务的长上下文推理模型。
查看模型
Gemini 3.6 Flash
适合无需 Opus 级判断力的高并发、低成本生产流量。
查看模型相关阅读

Claude Opus 6 发布追踪
跟踪下一代 Opus,同时不把发布时间、API 接入、模型 ID、价格或规格当作已确认事实。
阅读指南
Claude Opus 5 对比 Claude Opus 4.8
生产环境该跑哪条 Opus 路由,以及 Opus 5 要好到什么程度才值得更浅的折扣。
阅读指南
Claude Opus 5 对比 Claude Fable 5
判断何时应把 Opus 5 作为高端默认模型,以及 Fable 5 何时值得承担两倍官方 Token 单价。
阅读指南
Claude Opus 5 对比 GPT-5.6
两条前沿路由在计费维度、上下文与智能体任务上的差异对比。
阅读指南
GPT-6 Astra vs Claude Opus 5:编程、Agent 与成本
对比已公布的上下文、价格与 Agent 控制,再按同条件评测选择主路由和 fallback。
阅读指南
Claude Opus 5 API 使用指南
完成首次请求、thinking 与 effort 配置、安全迁移和生产检查。
阅读指南Claude Opus 5 API 常见问题
Claude Opus 5 API 现在可以调用吗?
可以。Claude Opus 5 已作为生产路由在 EvoLink 上线,模型 ID 为 "claude-opus-5"。
Claude Opus 5 API 应该使用哪个模型 ID?
model 请填写 "claude-opus-5"。兼容 OpenAI 的 Chat Completions 端点与 Anthropic Messages 端点使用同一个 ID。
Claude Opus 5 API 在 EvoLink 上多少钱?
EvoLink 价格为官方价 95 折:输入每百万 Token $4.75、输出每百万 Token $23.75,官方价分别为 $5.00 与 $25.00。
Claude Opus 5 的提示词缓存怎么计费?
缓存写入与缓存读取是两个独立维度:EvoLink 每百万缓存写入 Token $5.939、缓存读取 Token $0.475,官方价分别为 $6.25 与 $0.50。
Claude Opus 5 的联网搜索工具怎么计费?
联网搜索按次计费 $0.01,使用官方原价、不参与折扣。搜索结果带入请求的 Token 仍按正常 Token 价计费。
Claude Opus 5 支持哪些协议和 SDK?
用兼容 OpenAI 的 Chat Completions 端点或 Anthropic Messages 端点,均使用同一个 EvoLink API 密钥。Claude Code 等 Anthropic 原生客户端只需把 base URL 指向 EvoLink 即可使用。
Claude Opus 5 的上下文窗口和最大输出是多少?
EvoLink 路由记录的是 1,000,000 Token 上下文窗口,单次响应最大输出 128K Token。
Claude Opus 5 默认开启 Thinking 吗?
Anthropic 在 Opus 5 上默认使用 adaptive thinking,API 的 effort 默认值为 high。具体参数是否通过所选 EvoLink 端点透传,应以 API 文档和实际请求结果为准。
Claude Opus 5 适合哪些工作负载?
它适合特别复杂的编程任务、重度使用工具的长周期智能体,以及出错后续成本很高的关键审查。
Claude Opus 5 可以和其他模型路由一起使用吗?
可以。使用同一个 EvoLink 客户端和 API 密钥,把高难任务交给 Claude Opus 5,简单或对延迟敏感的请求继续走已验证的其他路由。
生产环境应该怎样评估 Claude Opus 5?
比较首次成功率、交付通过率、重试次数、输出 Token、缓存命中率、有效工具调用、总耗时、人工修改量和回退频率,而不只看单价。