GPT Image 2.5 Flare 与 Sunburst 已上线 EvoLink立即体验

Claude Opus 5.5 API

通过 EvoLink 统一对话 API 接入 Anthropic 的 Claude Opus 5.5(也常被搜索为 Opus 5.5)。集成前可先测试长上下文编程、工具调用、提示缓存。

Anthropic文本生成可用
$3.800 / 百万输入 Token 起$4.000 官方价-5%
API 文档
思考恒开Effort 控制工具调用提示词缓存联网搜索工具Chat + Messages API
生产路由已上线
上下文
1M 上下文 · 最大输出 128K
适用场景
长周期 Agent 编程、分析级知识工作、图表与截图解读
可输入
文本 + 图像
输出形态
文本 · JSON(结构化输出)· 工具调用

选择 Claude Opus 5.5

Claude Opus 5.5 是 Anthropic 最新的 Opus 模型,面向长周期的 Agent 编程、知识工作与视觉分析,官方标价低于 Claude Opus 5。输入、缓存写、缓存读、输出与联网搜索共五个计费维度独立计价。

Claude Opus 5.5

Anthropic 最新 Opus 模型

已选择
模型 ID
claude-opus-5-5
适合

在真实代码库里做多步编程、审查 Pull Request、分析级报告与财务模型,以及读取密集图表、示意图和截图——更好的答案配上更低的 Token 单价,能省掉后续的工作量。

输入
$3.800 / 1M-5%
258.4 cr / 1M$4.000官方价
缓存写入
$4.750 / 1M-5%
323 cr / 1M$5.000官方价
缓存读取
$0.192 / 1M-4%
13 cr / 1M$0.200官方价
输出
$19.000 / 1M-5%
1292 cr / 1M$20.000官方价

所有费率按每百万 Token 计,同时显示美元与 Credits,以你账户当前的价格为准。

Claude Opus 5.5 价格

集成前先估算一次 Claude Opus 5.5 请求的费用。计算器按你账户的当前费率计算,官方价格仅作对照。

请求费用计算器

输入一次请求的 Token 组合和成功的工具调用次数。

单次请求预估

Claude Opus 5.5
USD$0.0096
Credits0.6486

官方价预估 $0.011 · 省 $0.0006(5%)

输入 Token0.2584 cr
缓存写入 Token0 cr
缓存读取 Token0.0026 cr
输出 Token0.3876 cr

最低计费:每次请求 0.01 Credits。

预算指南

按当前 Token 组合估算可发起的请求数。
充值 Credits
$10
约 1048 次请求

快速测试

$50
约 5242 次请求

日常开发

$100
约 10484 次请求

生产评估

服务端工具费率

只有成功的服务端调用按次计费;失败的尝试不收工具费,但 Token 照常计费。
  • 网页搜索$0.010/ 次0.68 cr / 次

面向长周期编程与知识工作的 Claude Opus 5.5 API

通过 EvoLink 统一 API 调用 Anthropic 最新的 Opus 模型,每百万输入 / 输出 Token $3.800 / $19.000。Opus 5.5 接替 Claude Opus 5,官方标价更低,保留 100 万 Token 上下文与 12.8 万最大输出;思考模式始终开启,思考深度、延迟与成本统一用 effort 控制。

Claude Opus 5.5 在 EvoLink 上以模型 ID claude-opus-5-5 提供,支持 Chat Completions · Anthropic Messages,和其他模型共用同一把 API 密钥与余额。它提供 1M 上下文窗口,最大输出 128K Token,并支持长上下文编程、工具调用、提示缓存。

Claude Opus 5.5

Claude Opus 5.5 规格与能力

数字取自 EvoLink 路由配置;能力以 API 当前实际提供为准。

上下文窗口
1M Token
最大输出
128K Token
输入
文本 + 图像
输出
文本 · JSON(结构化输出)· 工具调用
推理
常开推理
工具调用
函数调用,支持多步工具序列
提示缓存
缓存写入 + 缓存读取两种费率
服务端工具
网页搜索,按成功调用次数计费
协议
Chat Completions · Anthropic Messages
模型 ID
claude-opus-5-5

什么时候该选 Claude Opus 5.5 这条 Opus 路由

Opus 5.5 的 Token 单价低于 Opus 5,Anthropic 的测试还显示它完成同一任务常常用更少的 Token。按「完成一个任务值多少」来选路由,先调 effort,再动提示词。

在真实代码库里做多步编程

把一个改动一路推进到测试通过、审查 Pull Request、规划多文件重构。Anthropic 称在默认 medium effort 下,它在这类任务上已追平或超过 high effort 的 Claude Opus 5,且步骤更少。衡量标准应是被采纳的补丁,而不是代码片段的质量。

分析级知识工作

长篇分析报告、财务模型、大批文档的核查。Anthropic 称它比 Opus 5 明显更少给出输入材料里没有依据的数字或来源,但上线前仍应拿自己的证据集核对引用。

图表、示意图与截图

读取密集图表、架构图和界面截图,尤其是含义取决于位置的内容——箭头连着哪两个框、两个版本之间改了什么。Anthropic 称它在每个 effort 档位上的视觉准确度都高于 Opus 5,很多时候不需要裁剪工具。

什么时候该选其他路由

日常编程、大批量智能体、分类任务和对延迟敏感的对话通常更适合 Claude Sonnet 5;最难的推理任务可升级到 Claude Fable 5.1。只有在某个工作负载已经在 Claude Opus 5 上验证过、且还没来得及重测时,才继续留在 Opus 5。

两种方式使用 Claude Opus 5.5:EvoLink API 或 Agent

产品后端与批量任务走 EvoLink API;编码与分析类工作可直接在 Codex、Claude、Gemini 里调用 Claude Opus 5.5。两条路径共用同一把 EvoLink API 密钥、余额、模型 ID 与请求记录。

方式一

用 EvoLink API 接入

适合:产品后端、批量任务、自动化流水线

向 EvoLink 发送 OpenAI 兼容的 Chat Completions(或 Anthropic Messages)请求,自行控制模型 ID、系统提示、输出预算、工具与结构化输出。

  1. 1在控制台创建 EvoLink API 密钥
  2. 2把 OpenAI 或 Anthropic SDK 的 base URL 指向 EvoLink,并选择上方显示的模型 ID
  3. 3先发一条有代表性的请求,从 usage 字段读取输入、缓存与输出 token
  4. 4按任务设置 max_tokens 与重试;多轮时保留 tool-call ID 与工具结果
方式二

用 Agent 调用

适合:在 Codex、Claude、Gemini 里做编码、评审与分析

把任务、要带入的材料和验收标准交给 Agent,由它组装请求、通过 EvoLink 调用 Claude Opus 5.5,并把回答连同 token 用量一起返回。

  1. 1在本地环境变量里配置 EVOLINK_API_KEY,不要写进代码或提示词
  2. 2描述任务、要带入的材料和期望的输出格式
  3. 3让 Agent 通过 EvoLink 调用 Claude Opus 5.5,并在发送前先展示请求
  4. 4让 Agent 汇报回答、token 用量和任何错误信息

Claude Opus 5.5 API 代码示例与错误处理

这个示例是最短可运行的请求:一条 OpenAI 兼容的 Chat Completions 调用,带系统提示、用户消息和输出预算。完整参数与响应说明见 API 标签页。

查看完整 API 文档
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-opus-5-5",
    "messages": [
      { "role": "system", "content": "You are a senior engineer reviewing a pull request." },
      { "role": "user", "content": "Review this diff and list the blocking issues with file and line:\n<diff>" }
    ],
    "max_tokens": 16000
  }'

# Anthropic Messages is also available at /v1/messages with the same model
# ID.
# Thinking is always on for this model and counts toward max_tokens, so
# leave room for it. The response includes choices[0].message and a usage
# object (prompt_tokens, completion_tokens, and cache read / write tokens
# when caching applies).

请求无效或参数不支持

对照 API 文档检查模型 ID、messages 数组和参数范围,去掉该路由不支持的字段。

鉴权或余额问题

检查 Authorization bearer token,并在控制台确认可用余额。

超出上下文长度

提示词 token 超过了 Claude Opus 5.5 的上下文窗口。裁剪或只检索相关材料,并复用缓存前缀。

触发限流(429)

退避并带抖动重试;用批处理或队列代替并发突发。

内容或工具调用被拒

重试前检查敏感内容、格式错误的 tool-call 参数和 JSON schema 不匹配。

从 Claude Opus 5 迁移到 Opus 5.5,无需更换模型栈

保留同一个 EvoLink 客户端与 API 密钥。大部分请求可以原样沿用,下面四步覆盖在 Opus 5.5 上行为有变化的设置。

01

更换模型 ID

把客户端指向 EvoLink,沿用同一个 API 密钥,模型选 claude-opus-5-5。兼容 OpenAI 的 Chat Completions 端点与 Anthropic Messages 端点都接受这个 ID。

迁移成本低
02

去掉关闭思考的设置

Opus 5.5 在任何 effort 档位下都不能关闭思考。去掉 thinking: disabled 和 budget_tokens,不传 thinking 字段或传 adaptive,并按内容块类型而不是位置读取响应。

破坏性变更
03

显式设置 effort

默认 effort 是 medium,比 Claude Opus 5 的 high 低一档。先从 medium 开始,在自己的任务上试 low 和 high;想让它少想一些时,先降 effort,再考虑在提示词里加「少思考」之类的指令。

需调参
04

按单任务交付价值做路由

用回放的真实生产样本,与 Claude Opus 5、Sonnet 5 对比成功率、重试次数、输出 Token、缓存命中、总耗时和人工修改量,而不只比 Token 单价。

需评估

用提示缓存复用智能体上下文

将稳定的系统提示词和工具定义缓存后,可在多轮智能体任务中复用。写入与读取分别计费。Anthropic 官方读取价为其输入价的 5%;在 EvoLink 估算缓存命中与未命中的成本时,应使用页面展示的写入、读取价格。

100 万 Token 上下文与 12.8 万最大输出

可以在同一工作上下文中保留相关代码、规格、文档和智能体状态。思考内容计入 max_tokens,要给它留出空间:长周期 Agent 编程的单轮可以从 64K 起步再调。

思考始终开启,effort 是唯一的控制手段

Opus 5.5 始终启用自适应思考,默认 effort 为 medium。Anthropic 上游拒绝 thinking: disabled 和 budget_tokens;EvoLink 会将这些旧设置兼容转换为自适应思考,但它们不能关闭思考。建议省略 thinking 或发送 adaptive,并显式调整 effort。

不支持强制指定工具

不支持强制工具选择:Messages 的 any/tool,以及 Chat Completions 的 required/指定函数都会报错。使用 auto 时,在提示词中明确要求工具,并确认响应确实包含工具调用;auto 不保证调用发生。工具之间的说明可能以 thinking 块返回,客户端应按块类型解析。

Claude Opus 5.5 的五个计费维度,各自独立计量

Claude Opus 5.5 不是单一混合价。搞清楚工作负载消耗的是哪些维度——以及思考内容按输出计费——Opus 档位的预算才可预测。

输入与输出 Token

EvoLink 每百万输入 Token $3.800、输出 Token $19.000,Anthropic 官方价为 $4.000 与 $20.000。思考始终在运行,即使不返回思考文本也按输出计费,所以 max_tokens 要同时给思考和回答留够空间。

5 分钟缓存写入与缓存读取

缓存前缀 5 分钟的写入价为 $4.750/百万 Token,复用时读取价为 $0.192/百万 Token。Anthropic 官方缓存读取价为其输入价的 5%;EvoLink 报价包含舍入,估算成本时请以页面展示价格为准。

联网搜索工具

按次计费 $0.010。搜索结果还会作为普通输入 Token 进入请求,因此一次重度检索既要付按次费用,也要付它带入的 Token 费用。

完成生产评估后,再对比各条 Claude 路由

EvoLink

先在你计划使用的 effort 档位上,用真实任务确认 Opus 5.5 能否减少重试和人工修改,再结合价格、上下文、缓存方式与任务类型选择生产路由。

Claude Opus 5.5
输入 / 输出$3.8 / $19
上下文1M
缓存读 + 写
适用场景在真实代码库里做多步编程、审查 Pull Request、分析级报告与财务模型,以及读取密集图表、示意图和截图——更好的答案配上更低的 Token 单价,能省掉后续的工作量。
Claude Opus 5
输入 / 输出$4.75 / $23.75
上下文1M
缓存读 + 写
适用场景上一代 Opus 旗舰,官方标价更高;适合保留给已经验证过、还没来得及重测的工作负载。
Claude Sonnet 5
输入 / 输出$1.8 / $9
上下文1M
缓存读 + 写
适用场景以 Sonnet 的价格提供接近 Opus 的编程与智能体表现,适合日常生产流量。

Claude 模型家族

同一把 API 密钥、同一份余额,换档位不用改接入。

查看全部 Claude 模型
Claude Fable 5.1

Claude Fable 5.1

Anthropic 能力最强的模型(Opus 之上的 Fable 档),适合 Opus 5.5 在高 effort 下仍力有不逮的工作。

查看模型
Claude Opus 5

Claude Opus 5

上一代 Opus 旗舰,仍可供已验证的工作负载使用;请在你选定的 effort 档位上与 Opus 5.5 对比。

查看模型
Claude Sonnet 5

Claude Sonnet 5

以更均衡的成本承接日常编程、高并发智能体和对延迟敏感的生产任务。

查看模型

Claude Opus 5.5 之外的其他文本模型

GPT-5.6

GPT-5.6

OpenAI 的分层前沿模型系列,便于按能力、延迟和成本组合路由。

查看模型
Grok 4.5

Grok 4.5

提供 50 万上下文与服务端搜索工具的 xAI 推理与工具调用路由。

查看模型
Kimi K3

Kimi K3

面向仓库级编程与多文档任务的长上下文推理模型。

查看模型
Gemini 3.6 Flash

Gemini 3.6 Flash

适合无需 Opus 级判断力的高并发、低成本生产流量。

查看模型

Claude Opus 5.5 延伸阅读

Claude Opus 5 API 使用指南

Claude Opus 5 API 使用指南

上一代 Opus 的首次请求、effort 配置与生产检查清单——大部分同样适用,唯一例外是 Opus 5.5 不能关闭思考。

阅读指南
Claude Opus 5 对比 Claude Fable 5

Claude Opus 5 对比 Claude Fable 5

Opus 与 Fable 两个档位怎么选:什么时候 Opus 路由就是合适的高端默认,什么时候 Fable 值得更高的 Token 单价。

阅读指南
Claude API 价格指南

Claude API 价格指南

输入、输出、缓存写入、缓存读取和工具费用在 Claude 全系列里是怎么叠加的。

阅读指南
Claude Opus 6 发布追踪

Claude Opus 6 发布追踪

跟踪下一代 Opus,同时不把发布时间、API 接入、模型 ID 或价格当作已确认事实。

阅读指南

Claude Opus 5.5 API 常见问题

Claude Opus 5.5 API 现在可以调用吗?

可以。Claude Opus 5.5 已作为生产路由在 EvoLink 上线,模型 ID 为 "claude-opus-5-5"。

Claude Opus 5.5 API 应该使用哪个模型 ID?

model 请填写 "claude-opus-5-5"。兼容 OpenAI 的 Chat Completions 端点与 Anthropic Messages 端点使用同一个 ID。

Claude Opus 5.5 API 在 EvoLink 上多少钱?

EvoLink 价格:输入每百万 Token $3.800、输出每百万 Token $19.000,官方价分别为 $4.000 与 $20.000。

Claude Opus 5.5 比 Claude Opus 5 便宜吗?

按 Token 单价算是的:Anthropic 给 Opus 5.5 的输入和输出标价比 Opus 5 低约 20%,缓存读取低约 60%。Anthropic 还称它完成同一任务常常用更少的 Token,所以请在自己的工作负载上比较单个被采纳任务的成本。

Claude Opus 5.5 的提示词缓存怎么计费?

EvoLink 的 5 分钟缓存写入价为 $4.750/百万 Token,缓存读取价为 $0.192/百万 Token,对应 Anthropic 官方价 $5.000 和 $0.200。两者独立计量,估算时以包含舍入的页面报价为准。

Claude Opus 5.5 的联网搜索工具怎么计费?

联网搜索按次计费 $0.010。搜索结果带入请求的 Token 仍按正常 Token 价计费。

Claude Opus 5.5 可以关闭思考吗?

不能。思考始终开启。Anthropic 上游拒绝 thinking: disabled 和 budget_tokens;EvoLink 会兼容转换旧设置为自适应思考,无法借此关闭思考。建议省略 thinking 或发送 adaptive,通过 effort(low、medium、high、xhigh、max,默认 medium)控制深度、延迟和成本。

从 Claude Opus 5 迁移过来要改什么?

更换模型 ID,移除关闭思考的设置,并显式指定 effort:默认值从 high 变为 medium。两种协议均不支持强制工具选择(Messages 的 any/tool,Chat Completions 的 required/指定函数);使用 auto 并验证实际工具调用。响应按块类型解析;上下文与最大输出保持不变。

Claude Opus 5.5 支持哪些协议和 SDK?

用兼容 OpenAI 的 Chat Completions 端点或 Anthropic Messages 端点,均使用同一个 EvoLink API 密钥。Claude Code 等 Anthropic 原生客户端只需把 base URL 指向 EvoLink 即可使用。

Claude Opus 5.5 的上下文窗口和最大输出是多少?

EvoLink 路由记录的是 1,000,000 Token 上下文窗口,单次响应最大输出 128K Token。思考内容计入 max_tokens。

生产环境应该怎样评估 Claude Opus 5.5?

比较首次成功率、交付通过率、重试次数、所选 effort 下的输出 Token、缓存命中率、有效工具调用、总耗时、人工修改量和回退频率,而不只看单价。