GPT Image 2.5 Flare 与 Sunburst 已上线 EvoLink立即体验

Claude Sonnet 5 API

通过 EvoLink 统一对话 API 接入 Anthropic 的 Claude Sonnet 5(也常被搜索为 Sonnet 5 / Claude 5 Sonnet)。集成前可先测试长上下文编程、工具调用、提示缓存。

Anthropic文本生成可用
$1.800 / 百万输入 Token 起$2.000 官方价-10%
API 文档
Adaptive Thinking智能体编程工具调用提示词缓存Chat + Messages API
生产路由已上线
上下文
1M 上下文
适用场景
智能编程、自主 Agent、大上下文分析
可输入
文本 + 图像
输出形态
文本 · JSON(结构化输出)· 工具调用

选择 Claude Sonnet 5

Anthropic 上一代面向编程和智能体工作的 Sonnet,也是 Sonnet 4.6 的无缝替代。输入、缓存写入、缓存读取、输出与联网搜索工具按独立计费维度分别计量。

Claude Sonnet 5

Anthropic Sonnet 档编程与智能体模型

已选择
模型 ID
claude-sonnet-5
适合

日常生产编程、终端与浏览器智能体、长周期工具调用,以及更看重成本平衡而非 Opus 档费率的大上下文分析。

输入
$1.800 / 1M-10%
122.4 cr / 1M$2.000官方价
缓存写入
$2.250 / 1M-10%
153 cr / 1M$2.500官方价
缓存读取
$0.181 / 1M-10%
12.3 cr / 1M$0.200官方价
输出
$9.000 / 1M-10%
612 cr / 1M$10.000官方价

所有费率按每百万 Token 计,同时显示美元与 Credits,以你账户当前的价格为准。

Claude Sonnet 5 价格

集成前先估算一次 Claude Sonnet 5 请求的费用。计算器按你账户的当前费率计算,官方价格仅作对照。

请求费用计算器

输入一次请求的 Token 组合和成功的工具调用次数。

单次请求预估

Claude Sonnet 5
USD$0.0046
Credits0.3085

官方价预估 $0.0051 · 省 $0.0006(10%)

输入 Token0.1224 cr
缓存写入 Token0 cr
缓存读取 Token0.0025 cr
输出 Token0.1836 cr

最低计费:每次请求 0.01 Credits。

预算指南

按当前 Token 组合估算可发起的请求数。
充值 Credits
$10
约 2106 次请求

快速测试

$50
约 11021 次请求

日常开发

$100
约 22042 次请求

生产评估

服务端工具费率

只有成功的服务端调用按次计费;失败的尝试不收工具费,但 Token 照常计费。
  • 网页搜索$0.010/ 次0.68 cr / 次

Claude Sonnet 5 API — Anthropic 上一代面向编程和智能体的 Sonnet

Claude Sonnet 5(Claude 5 Sonnet)在终端和浏览器场景交付强大的编程和智能体性能,配备 1M 上下文窗口、高达 128K 的输出 Token,并默认开启 adaptive thinking。

Claude Sonnet 5 在 EvoLink 上以模型 ID claude-sonnet-5 提供,支持 Chat Completions · Anthropic Messages,和其他模型共用同一把 API 密钥与余额。它提供 1M 上下文窗口,并支持长上下文编程、工具调用、提示缓存。

Claude Sonnet 5

Claude Sonnet 5 规格与能力

数字取自 EvoLink 路由配置;能力以 API 当前实际提供为准。

上下文窗口
1M Token
输入
文本 + 图像
输出
文本 · JSON(结构化输出)· 工具调用
推理
思考模式(默认开启)
工具调用
函数调用,支持多步工具序列
提示缓存
缓存写入 + 缓存读取两种费率
服务端工具
网页搜索,按成功调用次数计费
协议
Chat Completions · Anthropic Messages
模型 ID
claude-sonnet-5

利用 Claude Sonnet 5 API 可以构建什么?

智能体编程助手

Sonnet 5 相较 Sonnet 4.6 在编程上提升最大——能够规划多步改动、运行终端并对结果进行迭代。凭借高达 128K 的输出和 1M 上下文窗口,它能处理大型代码库,并在单次请求中生成全面的代码差异、测试套件和实施计划。

自主智能体

构建能够规划一系列步骤、调用工具、读取结果并持续推进的智能体,无需在每一轮都由人工推动。Sonnet 5 专为终端和浏览器使用以及长时程运行而打造,在多步工作流中交付可靠的工具使用。

大上下文分析

借助 1M 上下文窗口,在单次请求中读取超大型文档、代码库或长智能体 trace,并让 adaptive thinking 仅在任务需要时应用更深层的推理——为研究、规划和技术策略保持可预测的成本。

两种方式使用 Claude Sonnet 5:EvoLink API 或 Agent

产品后端与批量任务走 EvoLink API;编码与分析类工作可直接在 Codex、Claude、Gemini 里调用 Claude Sonnet 5。两条路径共用同一把 EvoLink API 密钥、余额、模型 ID 与请求记录。

方式一

用 EvoLink API 接入

适合:产品后端、批量任务、自动化流水线

向 EvoLink 发送 OpenAI 兼容的 Chat Completions(或 Anthropic Messages)请求,自行控制模型 ID、系统提示、输出预算、工具与结构化输出。

  1. 1在控制台创建 EvoLink API 密钥
  2. 2把 OpenAI 或 Anthropic SDK 的 base URL 指向 EvoLink,并选择上方显示的模型 ID
  3. 3先发一条有代表性的请求,从 usage 字段读取输入、缓存与输出 token
  4. 4按任务设置 max_tokens 与重试;多轮时保留 tool-call ID 与工具结果
方式二

用 Agent 调用

适合:在 Codex、Claude、Gemini 里做编码、评审与分析

把任务、要带入的材料和验收标准交给 Agent,由它组装请求、通过 EvoLink 调用 Claude Sonnet 5,并把回答连同 token 用量一起返回。

  1. 1在本地环境变量里配置 EVOLINK_API_KEY,不要写进代码或提示词
  2. 2描述任务、要带入的材料和期望的输出格式
  3. 3让 Agent 通过 EvoLink 调用 Claude Sonnet 5,并在发送前先展示请求
  4. 4让 Agent 汇报回答、token 用量和任何错误信息

Claude Sonnet 5 API 代码示例与错误处理

这个示例是最短可运行的请求:一条 OpenAI 兼容的 Chat Completions 调用,带系统提示、用户消息和输出预算。完整参数与响应说明见 API 标签页。

查看完整 API 文档
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-sonnet-5",
    "messages": [
      { "role": "system", "content": "You are a senior engineer. Produce clean, well-tested code." },
      { "role": "user", "content": "Review this diff and list the blocking issues with file and line:\n<diff>" }
    ],
    "max_tokens": 8192
  }'

# Anthropic Messages API is also available at /v1/messages with the same model ID.
# The response includes choices[0].message and a usage object
# (prompt_tokens, completion_tokens, and cache read / write tokens when
# caching applies).

请求无效或参数不支持

对照 API 文档检查模型 ID、messages 数组和参数范围,去掉该路由不支持的字段。

鉴权或余额问题

检查 Authorization bearer token,并在控制台确认可用余额。

超出上下文长度

提示词 token 超过了 Claude Sonnet 5 的上下文窗口。裁剪或只检索相关材料,并复用缓存前缀。

触发限流(429)

退避并带抖动重试;用批处理或队列代替并发突发。

内容或工具调用被拒

重试前检查敏感内容、格式错误的 tool-call 参数和 JSON schema 不匹配。

如何集成 Claude Sonnet 5 API

通过 EvoLink 连接,选择您的模型 ID,几分钟内即可开始构建。

1

第 1 步 — 创建您的 EvoLink API 密钥

注册 EvoLink 以获取单一 API 密钥,该密钥可路由至 Anthropic、Bedrock 或 Google Cloud。

2

第 2 步 — 选择模型 ID

使用 `claude-sonnet-5` 通过 EvoLink 的统一 API 访问 Sonnet 5 模型。它是 `claude-sonnet-4-6` 的无缝替代。

3

第 3 步 — 优化质量与成本

adaptive thinking 默认开启,可通过 effort 参数调节;对稳定的系统提示词和重复的长上下文使用提示词缓存,以降低重复成本。

提示词缓存按两个独立维度计费

缓存写入与缓存读取分别计量,缓存命中按基础输入价的 0.1x 计费。稳定的系统提示词、仓库说明和工具 schema 只需支付一次写入费用,随后在长时间的智能体运行中都以低价读取。

1M 上下文窗口与 128K 最大输出

1M 既是默认值也是最大值,没有更小的变体。把关联代码、规格文档和智能体状态放在同一个工作上下文中,但应把上限视为容量而非目标:检索相关证据、缓存稳定前缀,并设置与任务匹配的输出预算。

Adaptive thinking 默认开启,取代手动预算

Sonnet 5 会自动按任务难度调整推理深度。为手动扩展思考设置 `budget_tokens` 会返回 400 错误——请改用 effort 参数控制深度,或传入 `thinking: {type: "disabled"}` 关闭。非默认的 `temperature`、`top_p`、`top_k` 同样会返回 400 错误,迁移时请移除。

切换生产流量前请重新统计 Token

Sonnet 5 使用新分词器,相同文本产生的 Token 约增加 30%。单价不变,但等价请求的计费成本与上下文容量会变化——请重新统计提示词、复查贴近预期输出长度的 `max_tokens` 上限,并在生产样本上对比成功率与总成本。

Claude Sonnet 5 API 能力

面向生产环境的关键规格与模型特性

1M 上下文窗口

在单次请求中读取超大型文档或代码库。1M 既是默认值也是最大上下文。

128K 最大输出

生成长篇回答、计划和代码,不会提前截断。

Adaptive Thinking

推理会按任务难度自动伸缩,默认开启——用 effort 参数调节,而非手动设置 thinking 预算。

智能体编程与工具使用

专为终端和浏览器智能体、可靠的函数调用以及长时程多步运行而打造。

视觉 + 多语言输入

接受文本和图像输入,具备强大的多语言理解能力。

提示词缓存费率

缓存写入与读取分别计费;缓存命中按基础输入价格的 0.1 倍计费。

在真实负载验证后再对比 Claude 路由

EvoLink

先在你自己的任务上验证 Sonnet 5 是否已达到质量要求,再对比价格、上下文、缓存与负载匹配度,选定生产路由。

Claude Sonnet 5
输入 / 输出$1.8 / $9
上下文1M
缓存读 + 写
适用场景日常生产编程、终端与浏览器智能体、长周期工具调用,以及更看重成本平衡而非 Opus 档费率的大上下文分析。
Claude Sonnet 4.6
输入 / 输出$2.7 / $13.5
上下文1M
缓存读 + 写
适用场景上一代 Sonnet,适合已在其上完成验证的负载以及成本敏感的流量。
Claude Opus 5
输入 / 输出$4.75 / $23.75
上下文1M
缓存读 + 写
适用场景Opus 档旗舰,面向质量优先于成本的最困难推理、评审与智能体任务。

Claude 模型家族

同一把 API 密钥、同一份余额,换档位不用改接入。

查看全部 Claude 模型
Claude Sonnet API (Sonnet 5.5)

Claude Sonnet API (Sonnet 5.5)

更新一代的 Sonnet,官方标价相同;把流量从 Sonnet 5 迁过去之前,先在它上面重测你的工作负载。

查看模型
Claude Opus 5.5

Claude Opus 5.5

Anthropic 最新的 Opus,用于最难的长周期编程、知识工作和视觉分析。

查看模型
Claude Fable 5.1

Claude Fable 5.1

Opus 之上的更高能力 Claude 路由,面向最长、最苛刻的智能体负载。

查看模型

Claude Sonnet 5 之外的其他文本模型

GPT-5.6

GPT-5.6

OpenAI 的分档前沿家族,可按能力、延迟与成本进行路由。

查看模型
Grok 4.5

Grok 4.5

xAI 的推理与工具调用路由,配备 500K 上下文窗口和服务端搜索工具。

查看模型
Kimi K3

Kimi K3

面向仓库级编程与多文档工作的长上下文推理模型。

查看模型
Gemini 3.6 Flash

Gemini 3.6 Flash

快速、低成本的路由,适合无需 Opus 级判断的大批量流量。

查看模型

Claude Sonnet 5 API - 常见问题

Claude Sonnet 5 的上下文窗口和最大输出是多少?

Claude Sonnet 5 支持 1M Token 的上下文窗口——它既是默认值也是最大值,没有更小的变体——单次请求最大输出可达 128K Token,非常适合大型代码库、长文档和全面的生成任务。

我应该使用哪个模型 ID,以及如何通过 EvoLink 访问?

通过 EvoLink 统一的、兼容 OpenAI 的 API,使用 `claude-sonnet-5` 即可用单一 API 密钥访问 Sonnet 5 模型。它是 `claude-sonnet-4-6` 的无缝替代——更新模型 ID,并在需要时检查 Token 预算和 thinking 设置。

Claude Sonnet 5 如何处理 extended thinking?

Sonnet 5 使用 adaptive thinking,默认开启,会将推理按任务难度伸缩。手动 extended thinking(设置 `budget_tokens`)已不再支持,会返回 400 错误——请改用 effort 参数来引导推理深度。若要关闭 thinking,传入 `thinking: {type: "disabled"}`。

从 Sonnet 4.6 迁移到 Sonnet 5 有哪些变化?

Sonnet 5 是无缝替代,但请注意三点:adaptive thinking 默认开启、手动 extended thinking 会返回 400 错误、非默认采样参数(`temperature`、`top_p`、`top_k`)会返回 400 错误——迁移时请移除它们。工具定义和响应结构保持不变。

为什么我在 Claude Sonnet 5 上的 Token 数量发生了变化?

Sonnet 5 使用新的分词器,对相同文本大约会产生多 30% 的 Token。每 Token 定价不变,但等效请求的成本和上下文容量可能有所不同——请重新计算你的提示词,并重新审视按预期输出大小设定的 `max_tokens` 限制。

Claude Sonnet 5 如何定价?

EvoLink 定价:每 100 万输入 Token $1.800,每 100 万输出 Token $9.000,官方价分别为 $2.000 和 $10.000。提示词缓存单独计费——EvoLink 每 100 万缓存写入 Token $2.250,每 100 万缓存读取 Token $0.181,官方价分别为 $2.500 和 $0.200。

Claude Sonnet 5 的联网搜索工具如何计费?

联网搜索按次计费,每次 $0.010。搜索结果带入请求的 Token 按常规 Token 计费。

Sonnet 5 与 Opus 4.8 相比如何?

Sonnet 5 交付 Opus 级的编程和智能体性能,是大多数生产工作负载的合适默认选择。Opus 4.8 则是旗舰模型,面向最难的推理和智能体任务——在顶级质量最为关键的场景下使用。

Claude Sonnet 5 在哪里可以使用?

Claude Sonnet 5 可通过 Anthropic API、AWS Bedrock、Google Cloud(Vertex AI)和 Microsoft Foundry(预览版)使用。EvoLink 可以路由到您选择的提供商。

Claude Sonnet 5 是否支持视觉和多模态输入?

是的。Sonnet 5 支持文本和图像输入,并具备强大的多语言能力,因此您可以在单次请求中结合文档、截图和视觉素材。