GPT Image 2.5 Flare 与 Sunburst 已上线 EvoLink立即体验

Claude Fable 5.1 API

通过 EvoLink 统一对话 API 接入 Anthropic 的 Claude Fable 5.1(也常被搜索为 Fable 5.1)。集成前可先测试长上下文编程、工具调用、提示缓存。

Anthropic文本生成可用
$9.500 / 百万输入 Token 起$10.000 官方价-5%
API 文档
自适应思考文本 + 图片输入提示词缓存联网搜索工具
生产路由已上线
上下文
1M 上下文 · 最大输出 128K
适用场景
最难的仓库级编程、最长周期 Agent、高风险代码审查
可输入
文本 + 图像
输出形态
文本 · JSON(结构化输出)· 工具调用

选择 Claude Fable 5.1

Claude Fable 5.1 是 Anthropic 最新的 Fable 模型,面向高难度推理、长周期智能体和高判断力的代码审查。输入、缓存写入、缓存读取、输出与联网搜索共五个计费维度独立计价。

Claude Fable 5.1

Anthropic 最新的 Fable 模型

已选择
模型 ID
claude-fable-5-1
适合

仓库级软件工程、重度调用工具的长周期智能体、高风险代码审查,以及答错代价远高于 Token 单价的研究与分析工作。

输入
$9.500 / 1M-5%
646 cr / 1M$10.000官方价
缓存写入
$11.875 / 1M-5%
807.5 cr / 1M$12.500官方价
缓存读取
$0.239 / 1M-5%
16.2 cr / 1M$0.250官方价
输出
$47.500 / 1M-5%
3230 cr / 1M$50.000官方价

所有费率按每百万 Token 计,同时显示美元与 Credits,以你账户当前的价格为准。

Claude Fable 5.1 价格

集成前先估算一次 Claude Fable 5.1 请求的费用。计算器按你账户的当前费率计算,官方价格仅作对照。

请求费用计算器

输入一次请求的 Token 组合和成功的工具调用次数。

单次请求预估

Claude Fable 5.1
USD$0.024
Credits1.6183

官方价预估 $0.026 · 省 $0.0013(5%)

输入 Token0.646 cr
缓存写入 Token0 cr
缓存读取 Token0.0033 cr
输出 Token0.969 cr

最低计费:每次请求 0.02 Credits。

预算指南

按当前 Token 组合估算可发起的请求数。
充值 Credits
$10
约 420 次请求

快速测试

$50
约 2100 次请求

日常开发

$100
约 4201 次请求

生产评估

服务端工具费率

只有成功的服务端调用按次计费;失败的尝试不收工具费,但 Token 照常计费。
  • 网页搜索$0.010/ 次0.68 cr / 次

面向最难编程与智能体任务的 Claude Fable 5.1 API

通过 EvoLink 统一 API 调用 Anthropic 最新的 Fable 模型,处理高难度推理与长周期智能体任务;每百万输入 / 输出 Token $9.500 / $47.500。支持 100 万 Token 上下文窗口、12.8 万最大输出、写入与读取分开计价的提示词缓存,以及按次计费的联网搜索工具。

Claude Fable 5.1 在 EvoLink 上以模型 ID claude-fable-5-1 提供,支持 Chat Completions · Anthropic Messages,和其他模型共用同一把 API 密钥与余额。它提供 1M 上下文窗口,最大输出 128K Token,并支持长上下文编程、工具调用、提示缓存。

Claude Fable 5.1

Claude Fable 5.1 规格与能力

数字取自 EvoLink 路由配置;能力以 API 当前实际提供为准。

上下文窗口
1M Token
最大输出
128K Token
输入
文本 + 图像
输出
文本 · JSON(结构化输出)· 工具调用
推理
思考模式(默认开启)
工具调用
函数调用,支持多步工具序列
提示缓存
缓存写入 + 缓存读取两种费率
服务端工具
网页搜索,按成功调用次数计费
协议
Chat Completions · Anthropic Messages
模型 ID
claude-fable-5-1

Claude Fable 5.1 的高价位在哪里能赚回来

最高档位的价格只有在任务足够难、更好的答案能省掉后续工作时才划算。选型应按「答错的代价」而不是「每 Token 的价格」来决定。

仓库级软件工程

在同一上下文中审阅大型代码库、跨服务追踪依赖、规划多文件改动,同时保持架构约束不丢失。衡量标准应是被采纳的补丁与审查耗时,而不是孤立代码片段的质量。

重度使用工具的长周期智能体

多步编排、工具选择与代码执行的长时间运行场景,一次错误分支的代价远高于 Token 差价。跨轮次完整回放 assistant 消息、tool-call ID、参数与工具返回结果。

高风险审查与分析

安全审查、迁移方案规划、合同与研究分析,以及任何「自信地答错」代价高昂的场景。100 万 Token 窗口可以把完整证据集放在同一处。

什么时候该选其他路由

日常编程、大批量智能体、分类任务和对延迟敏感的对话通常更适合 Claude Sonnet 5。选择 Claude Opus 5 作为默认旗舰路由前,应比较当前 Token 费率与实际回答质量。

两种方式使用 Claude Fable 5.1:EvoLink API 或 Agent

产品后端与批量任务走 EvoLink API;编码与分析类工作可直接在 Codex、Claude、Gemini 里调用 Claude Fable 5.1。两条路径共用同一把 EvoLink API 密钥、余额、模型 ID 与请求记录。

方式一

用 EvoLink API 接入

适合:产品后端、批量任务、自动化流水线

向 EvoLink 发送 OpenAI 兼容的 Chat Completions(或 Anthropic Messages)请求,自行控制模型 ID、系统提示、输出预算、工具与结构化输出。

  1. 1在控制台创建 EvoLink API 密钥
  2. 2把 OpenAI 或 Anthropic SDK 的 base URL 指向 EvoLink,并选择上方显示的模型 ID
  3. 3先发一条有代表性的请求,从 usage 字段读取输入、缓存与输出 token
  4. 4按任务设置 max_tokens 与重试;多轮时保留 tool-call ID 与工具结果
方式二

用 Agent 调用

适合:在 Codex、Claude、Gemini 里做编码、评审与分析

把任务、要带入的材料和验收标准交给 Agent,由它组装请求、通过 EvoLink 调用 Claude Fable 5.1,并把回答连同 token 用量一起返回。

  1. 1在本地环境变量里配置 EVOLINK_API_KEY,不要写进代码或提示词
  2. 2描述任务、要带入的材料和期望的输出格式
  3. 3让 Agent 通过 EvoLink 调用 Claude Fable 5.1,并在发送前先展示请求
  4. 4让 Agent 汇报回答、token 用量和任何错误信息

Claude Fable 5.1 API 代码示例与错误处理

这个示例是最短可运行的请求:一条 OpenAI 兼容的 Chat Completions 调用,带系统提示、用户消息和输出预算。完整参数与响应说明见 API 标签页。

查看完整 API 文档
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-fable-5-1",
    "messages": [
      { "role": "system", "content": "You are a senior engineer reviewing a pull request." },
      { "role": "user", "content": "Review this diff and list the blocking issues with file and line:\n<diff>" }
    ],
    "max_tokens": 8192,
    "temperature": 0.2
  }'

# Anthropic Messages is also available at /v1/messages with the same model
# ID.
# The response includes choices[0].message and a usage object
# (prompt_tokens, completion_tokens, and cache read / write tokens when
# caching applies).

请求无效或参数不支持

对照 API 文档检查模型 ID、messages 数组和参数范围,去掉该路由不支持的字段。

鉴权或余额问题

检查 Authorization bearer token,并在控制台确认可用余额。

超出上下文长度

提示词 token 超过了 Claude Fable 5.1 的上下文窗口。裁剪或只检索相关材料,并复用缓存前缀。

触发限流(429)

退避并带抖动重试;用批处理或队列代替并发突发。

内容或工具调用被拒

重试前检查敏感内容、格式错误的 tool-call 参数和 JSON schema 不匹配。

无需更换模型栈即可接入 Claude Fable 5.1

保留同一个 EvoLink 客户端与 API 密钥,把最难的工作负载路由到 Fable 5.1,简单或对延迟敏感的流量继续走已验证的备选路由。

01

沿用现有兼容客户端流程

把客户端指向 EvoLink,用同一个 API 密钥鉴权,模型选 claude-fable-5-1。兼容 OpenAI 的 Chat Completions 端点与 Anthropic Messages 端点均可使用。

迁移成本低
02

使用文档中的 API 模型 ID

两种协议的 API 模型名都是 claude-fable-5-1。该模型的页面 URL 与模型参数完全一致。

ID 已核对
03

按缓存复用组织提示词结构

把稳定的系统提示词、仓库说明与工具 Schema 放在请求前部,让昂贵的前缀只写入一次,本次会话后续都以低价读取。

成本控制
04

按单任务交付价值做路由

与 Claude Opus 5、Claude Fable 5 对比成功率、重试次数、输出 Token、缓存命中、总耗时和人工修改量,而不只比 Token 单价。

需评估

提示词缓存按读写两个维度独立计费

写入前缀每百万 Token $11.875,复用时每百万 Token $0.239。稳定的系统提示词、仓库说明与工具 Schema 只需写入一次,后续复用按独立的缓存读取费率计费。

100 万 Token 上下文与 12.8 万最大输出

可以在同一工作上下文中保留相关代码、规格、文档和智能体状态,但不要把上限当成目标。先检索真正相关的证据,缓存稳定前缀,并按任务难度设置输出预算。

Thinking 与 effort 会改变延迟和 Token 用量

Anthropic 在 Fable 5.1 上默认使用 adaptive thinking,API 的 effort 默认值为 high。上线前应在所选 EvoLink 协议上核验实际参数支持、响应内容、输出 Token 与延迟,不要把 max_tokens 当作 thinking 预算。

切换生产流量前,先重放真实任务

Token 单价相同,不代表完成单个任务的成本相同。模型行为和分词方式可能改变计费 Token、重试次数与工具路径;切换流量前,请用真实生产样本比较成功率、总成本和人工修改量。

强制工具选择与 Thinking 历史需要迁移检查

Fable 5.1 不接受 tool_choice 的 any 和 tool,使用时会返回 HTTP 400。旧版 Claude 也无法读取 Fable 5.1 的 Thinking Block;同时应保持会话历史只追加,因为编辑早期轮次会让这些 Block 失效。

五个计费维度,各自独立计量

Claude Fable 5.1 不是单一混合价。搞清楚某个工作负载真正消耗哪些维度,最高档位的预算才可预测。

输入与输出 Token

每次请求都会触及的两个维度:EvoLink 每百万输入 Token $9.500、输出 Token $47.500,Anthropic 官方价为 $10.000 与 $50.000。生成密集型任务的成本由输出主导,应按任务难度限制 max_tokens。

缓存写入与缓存读取

写入前缀每百万 Token $11.875,复用时每百万 Token $0.239。稳定的系统提示词、仓库说明与工具 Schema 只需写入一次,后续复用按独立的缓存读取费率计费。

联网搜索工具

按次计费 $0.010。搜索结果还会作为普通输入 Token 进入请求,因此一次重度检索既要付按次费用,也要付它带入的 Token 费用。

完成生产评估后,再对比各条 Claude 路由

EvoLink

先用真实任务确认 Fable 5.1 是否能减少重试和人工修改,再结合价格、上下文、缓存方式与任务类型选择生产路由。

Claude Fable 5.1
输入 / 输出$9.5 / $47.5
上下文1M
缓存读 + 写
适用场景仓库级软件工程、重度调用工具的长周期智能体、高风险代码审查,以及答错代价远高于 Token 单价的研究与分析工作。
Claude Fable 5
输入 / 输出$9 / $45
上下文1M
缓存读 + 写
适用场景上一代 Fable;请根据实际工作负载比较其 Token 与缓存读取费率。
Claude Opus 5
输入 / 输出$4.75 / $23.75
上下文1M
缓存读 + 写
适用场景选择 Claude Opus 5 作为默认旗舰路由前,应比较当前 Token 费率与实际回答质量。

Claude 模型家族

同一把 API 密钥、同一份余额,换档位不用改接入。

查看全部 Claude 模型
Claude Opus 5

Claude Opus 5

选择 Claude Opus 5 作为默认旗舰路由前,应比较当前 Token 费率与实际回答质量。

查看模型
Claude Sonnet 5

Claude Sonnet 5

更均衡的路由,适合日常编码、高并发智能体与对延迟敏感的生产流量。

查看模型
Claude Fable 5

Claude Fable 5

上一代 Fable;请根据实际工作负载比较其 Token 与缓存读取费率。

查看模型

Claude Fable 5.1 之外的其他文本模型

GPT-5.6

GPT-5.6

OpenAI 的分层前沿模型系列,便于按能力、延迟和成本组合路由。

查看模型
Grok 4.5

Grok 4.5

提供 50 万上下文与服务端搜索工具的 xAI 推理与工具调用路由。

查看模型
Kimi K3

Kimi K3

面向仓库级编程与多文档任务的长上下文推理模型。

查看模型
Gemini 3.6 Flash

Gemini 3.6 Flash

适合无需 Opus 级判断力的高并发、低成本生产流量。

查看模型

相关阅读

Claude Fable 5.1 发布时间

Claude Fable 5.1 发布时间

查看已确认的发布事实、渠道边界、迁移风险和上线后必须验证的生产信号。

阅读指南
Claude Fable 5 vs Fable 5.1

Claude Fable 5 vs Fable 5.1

对比缓存经济性、兼容性、合格任务成本与可回滚升级方案。

阅读指南
Claude Fable 5.1 vs GPT-6 Astra

Claude Fable 5.1 vs GPT-6 Astra

对比两款已发布旗舰的缓存经济性、Agent 控制与同条件生产评测;Astra 的 EvoLink 通道仍在接入。

阅读指南
Claude Opus 5 vs Claude Fable 5

Claude Opus 5 vs Claude Fable 5

判断什么时候默认走 Opus 档,以及 Fable 是否能为具体任务带来足够价值。

阅读指南
Claude Fable 5 API 价格

Claude Fable 5 API 价格

Token 成本、Usage Credits 与成本算例,对照 Anthropic 官方标价与 EvoLink 折扣价。

阅读指南
Claude Opus 6 发布前瞻

Claude Opus 6 发布前瞻

跟踪下一代 Opus,同时不把发布时间、API 接入、模型 ID 或价格当作已确认事实。

阅读指南

Claude Fable 5.1 API 常见问题

Claude Fable 5.1 API 现在可以调用吗?

可以。Claude Fable 5.1 已作为生产路由在 EvoLink 上线,模型 ID 为 "claude-fable-5-1"。

Claude Fable 5.1 API 应该使用哪个模型 ID?

model 请填写 "claude-fable-5-1"。兼容 OpenAI 的 Chat Completions 端点与 Anthropic Messages 端点使用同一个 ID。

Claude Fable 5.1 API 在 EvoLink 上多少钱?

EvoLink 价格:输入每百万 Token $9.500、输出每百万 Token $47.500,官方价分别为 $10.000 与 $50.000。

Claude Fable 5.1 的提示词缓存怎么计费?

缓存写入与缓存读取是两个独立维度:EvoLink 每百万缓存写入 Token $11.875、缓存读取 Token 约 $0.239,官方价分别为 $12.500 与 $0.250。

Claude Fable 5.1 的联网搜索工具怎么计费?

联网搜索按次计费 $0.010。搜索结果带入请求的 Token 仍按正常 Token 价计费。

Claude Fable 5.1 支持哪些协议和 SDK?

用兼容 OpenAI 的 Chat Completions 端点或 Anthropic Messages 端点,均使用同一个 EvoLink API 密钥。Claude Code 等 Anthropic 原生客户端只需把 base URL 指向 EvoLink 即可使用。

Claude Fable 5.1 的上下文窗口和最大输出是多少?

EvoLink 路由记录的是 1,000,000 Token 上下文窗口,单次响应最大输出 128K Token。

Claude Fable 5.1 默认开启 Thinking 吗?

Anthropic 在 Fable 5.1 上默认使用 adaptive thinking,API 的 effort 默认值为 high。具体参数是否通过所选 EvoLink 端点透传,应以 API 文档和实际请求结果为准。

Claude Fable 5.1 适合哪些工作负载?

它适合特别复杂的编程任务、重度使用工具的长周期智能体,以及出错后续成本很高的关键审查。

Claude Fable 5.1 支持强制选择工具吗?

不支持。tool_choice 使用 any 或 tool 会返回 HTTP 400;迁移时应使用 auto 或 none,并先验证工具路由。

把 Fable 5.1 会话切换到其他模型时要注意什么?

旧版 Claude 无法读取 Fable 5.1 的 Thinking Block。会话历史还应保持只追加,因为修改早期轮次会让这些 Thinking Block 失效。