
Claude Fable 5.1 于 9 月 1 日发布:有哪些变化?
Claude Fable 5.1 发布状态
| 项目 | 官方确认状态 |
|---|---|
| 发布日期 | 2026 年 9 月 1 日 |
| Anthropic 生命周期 | Active,当前最新 Fable 模型 |
| 官方模型 ID | claude-fable-5-1 |
| 上下文窗口 | 100 万 tokens |
| 最大输出 | 12.8 万 tokens |
| 输入与输出 | 文本、图像输入,文本输出 |
| Thinking | Adaptive,始终开启;默认 effort 为 high |
| 官方最早退役时间 | 不早于 2027 年 9 月 1 日 |
这些是厂商公开事实。不同渠道、地区和账号的可用性、吞吐与计费条件仍可能不同,生产团队必须核验自己实际使用的服务合同。
9 月 1 日的发布具体改了什么?
Anthropic 还把 Fable 5.1 定位为更适合长周期 Agent 编码、多步研究,以及复杂文档、表格和幻灯片工作。上线前应把这些视为厂商声明,直到它们通过自己的评测集。Anthropic 估算典型历史工作负载可降低约 25% 成本,缓存密集的 Agent 工作最高约 45%;这不是适用于所有请求的固定折扣。
现有集成必须测试的三项破坏性变更
- 强制工具选择发生变化。 强制
tool_choice为any或tool的请求会报错,原本假设必须调用工具的路由逻辑需要重测。 - 旧模型不能读取 Fable 5.1 的 thinking blocks。 跨模型回退必须划分干净的会话边界,或者显式处理历史兼容性。
- 修改早期对话会使 thinking blocks 失效。 对话回放、脱敏、摘要和历史重写流程都要单独验证。
另外五项新增能力包括:逐消息 effort、逐轮 system message、工具调用间的进度更新、更低的缓存读取价格,以及内容溯源。其中部分控制仍是 Beta,不应默认所有厂商渠道都具有完全相同的支持范围。

哪些团队现在应该测试 Fable 5.1?
如果工作负载包含长 Agent 轨迹、反复读取大型稳定上下文、仓库级编码,或复杂知识工作交付物,应优先评测。只有当大量输入真正命中缓存时,更低的缓存读取价格才会显著改变成功任务成本。
不要仅因为 5.1 更新就全量迁移。Anthropic 建议多数工作负载先从 Claude Opus 5 开始,只有当高 effort 的 Opus 仍未通过评测时再升级到 Fable 5.1。短请求如果几乎没有缓存复用,不会获得标准 token 单价优惠;更慢的相对延迟和较高输出价格仍可能主导账单。
EvoLink 生产上线检查表
| 门槛 | 需要验证 | 回滚条件 |
|---|---|---|
| 模型身份 | 请求与返回模型符合目标路由 | 返回模型异常或回退不可见 |
| 质量 | 代表性轨迹的成功任务率提升 | 关键任务类型出现回归 |
| 工具 | 工具选择、Schema、重试和停止行为正确 | 强制工具报错或循环调用 |
| 历史 | Thinking blocks 与支持的对话流程兼容 | 编辑或回退后历史失效 |
| 成本 | 缓存命中率与成功任务总成本改善 | Token 或人工复核成本高于基线 |
| 可靠性 | 错误率和 p95 延迟满足 SLO | 容量或延迟突破门槛 |
推荐顺序是离线回放、影子流量、窄范围金丝雀。通过 EvoLink 统一 API 网关把模型选择保持为配置项,即使升级失败,也不需要重写应用架构。
在 EvoLink 评测 Claude Fable 5.1上线前信号最终如何得到验证
9 月 1 日以前,搜索结果把 Claude Web 标签、知识截止时间变化、EAP 代号、合作渠道列表和对 Fable 5.1 名称的猜测混在一起。这些信号可以帮助团队决定监控什么,但任何一项都不能单独证明公开 API 已经存在。正式发布通过带日期的 Anthropic 公告、模型页、可调用 ID、价格和迁移指南,解决了产品身份问题。
这段历史仍然有价值:UI 标签只能证明对应 UI;模型自述的知识截止时间不是身份凭证;合作方目录只证明该渠道;看起来合理的 slug 也不是模型 ID。生产可用必须同时有文档化路由、成功的鉴权请求、返回模型身份、用量记录和实际计费事件。
Fable 5.1、Fable 5 与 Mythos 5.1 是三种路由决策
| 模型 | 当前角色 | 接入含义 |
|---|---|---|
| Claude Fable 5 | 仍在用的前代模型 | 5.1 灰度期间保留为可度量回滚路由 |
| Claude Fable 5.1 | 最新公开可用 Fable 模型 | 面向高难推理和长周期任务评测 |
| Claude Mythos 5.1 | 相同底层能力、不同安全措施 | 仅限经过审核的项目,不能把 Fable 权限当成 Mythos 权限 |
安全措施和 fallback 可能改变最终完成请求的模型,账户、区域、数据保留与 Marketplace 条款也可能改变可用性。因此要记录请求模型、返回模型、拒绝类别、fallback 和实际渠道,而不是把所有成功响应都概括为“Fable 5.1 正常”。
正式发布不代表所有渠道完全一致
Anthropic 已在 Claude API 和支持的 Marketplace 中记录 Fable 5.1,但原生 API、云市场、消费者订阅和第三方网关的配额与计费可能不同。订阅额度不能直接换算成 API token 账单,消费者端能选到模型也不代表某个 API Key 已有配额。EvoLink 用户应在模型页确认实时路由与价格,再用生产账户和区域完成验证。
如果请求只在 fallback 后成功、返回了意外模型、没有可核对的账单记录,或者在并发下行为不同,即使模型已经官宣,该路由仍未通过生产门槛。
开发者已经得到哪些答案,还有什么必须实测
公开名称、API ID、上下文与输出上限、标准 token 价格、缓存读取降价和迁移风险已经确认。但“是否最适合你的产品”没有被发布公告回答。官方 Benchmark、典型任务约省 25%、智能体任务最高约省 45%,都应该被视为需要用真实流量复现的假设。
团队仍要测量合格任务率、完整轨迹完成率、工具失败恢复、p50/p95 延迟、缓存命中占比、输出增长、拒绝与 fallback、区域可用性、数据保留,以及每个合格任务的总成本。
值得持续监控的七个生产信号
| 信号 | 需要留存的证据 | 作用 |
|---|---|---|
| 路由身份 | 请求与返回模型 ID | 发现别名和不透明 fallback |
| 可用性 | 按账户、区域统计成功率与错误率 | 区分官宣与真实容量 |
| 工具行为 | 工具选择、参数、结果与重试 | 发现 Agent 循环破坏性变化 |
| 对话完整性 | Thinking Block 与只追加历史 | 避免无效重放和降级失败 |
| 成本 | 输入、缓存写读、输出和工具 | 验证缓存优惠是否真正生效 |
| 质量 | 合格结果与人工修改量 | 用产品证据替代发布热度 |
| 运维 | 延迟、安全措施、保留与回滚 | 判断路由能否长期启用 |
这些字段应进入同一份评测记录。没有路由身份和计费证据的质量提升并不完整;如果低价轨迹需要更多重试或人工返工,每个合格任务反而可能更贵。
常见问题
Claude Fable 5.1 什么时候发布?
Anthropic 于 2026 年 9 月 1 日发布 Claude Fable 5.1,并将其标记为 Active。
Claude Fable 5.1 已经提供 API 吗?
是。Anthropic 已记录 Claude API 和支持的云渠道。EvoLink 用户在生产上线前仍应通过模型页核验自身账号的鉴权访问、返回模型、用量和账单。
Claude Fable 5.1 的模型 ID 是什么?
claude-fable-5-1。具体接入方式和 EvoLink 当前价格由模型页负责,本文只回答发布与变化。标准 token 价格下降了吗?
没有。厂商标准输入、输出价格仍为 $10/$50 每百万 tokens。直接降价的是缓存读取,从 $1 降至 $0.25。
Fable 5.1 一定比 Fable 5 便宜 25% 吗?
不一定。25% 是 Anthropic 对历史典型工作负载组合的估算。实际节省取决于缓存复用、输出量、effort、重试、回退和人工复核。
Fable 5.1 能不经测试直接替代 Fable 5 吗?
不能。工具选择和 thinking-block 行为存在三项官方记录的破坏性变化,必须进行匹配回放并保留回滚能力。
所有工作负载都应该使用 Fable 5.1 吗?
不应该。只有高难度推理或长周期工作能带来可测量增益时才应使用;多数流量可能由 Opus 5 或其他路由获得更好的质量、延迟和成本平衡。
在哪里查看 Fable 5 与 5.1 的详细对比?
来源
- Anthropic Claude Fable 5.1 模型概览
- Anthropic Claude Fable 5.1 公告
- Anthropic Prompt Caching 文档
- Anthropic Claude Fable 5.1 Prompt 指南


