
Claude Fable 5 vs Fable 5.1:違いとアップグレード判断
判断表
| Workload | 推奨 | 理由 |
|---|---|---|
| 長時間Agent | 5.1 Canary | Cache readが75%安い |
| 大規模Coding | 5.1評価 | 自社traceで確認 |
| 強制Tool | Fable 5維持 | any/toolがエラー |
| 編集History | 設計変更 | thinking blocks非互換 |
| 短い非Cache処理 | Opus 5も比較 | 通常料金は同じ |
確認済み差分
| 項目 | Fable 5 | Fable 5.1 |
|---|---|---|
| ライフサイクル | 稼働中の前世代 | 稼働中の最新版 |
| コンテキスト / 最大出力 | 1M / 128K | 1M / 128K |
| 入力 / 出力料金 | $10 / $50 | $10 / $50 |
| 5分 / 1時間キャッシュ書き込み | $12.50 / $20 | $12.50 / $20 |
| キャッシュ読み取り | $1 | $0.25 |
| 思考モード | 適応的 | 適応的、常時有効 |
| 知識カットオフ | 2026年1月 | 2026年6月 |
入力 + cache + 出力 + tools + retries + fallback + reviewで測ります。3つの互換性リスク
1. Tool強制
tool_choiceのanyとtoolは失敗します。2. モデル切替
旧モデルは5.1のthinking blocksを読めません。
3. History編集
過去ターンの変更でthinking blocksが無効になります。
可逆的な移行

基準保存→同条件Replay→Shadow→限定Canary→Fallback維持の順で進めます。
本番昇格の基準
- 合格タスク品質:同じrubricで退行なし。
- 長期信頼性:完走、復旧、loopを測定。
- コスト:成功単価とcache hit。
- 遅延:p50とp95。
- 運用時の挙動:返却モデル、tool、usage、fallback。
- データと安全性:retention、region、safeguards。
Fable 5を残すべき場合
既存IntegrationがProduct基準を満たし、強制Toolに依存する、またはappend-onlyのThinking Historyへ未対応なら、Fable 5は安定したBaselineです。既知のLatency、理解済みの拒否挙動、検証済みfallbackは新Version公開後も価値があります。
移行中に残すのは停滞ではなくControl Groupの確保です。Prompt、Tool、effort、Evaluator、Retry、観測期間を固定し、Model改善とTraffic変化や評価Driftを分離します。
同一条件で互換性全体をテスト
| 検証面 | Fable 5の基準 | Fable 5.1のテスト |
|---|---|---|
| Tool選択 | auto、none、any、指定Toolを記録 | 強制Modeを外しstrict Schema確認 |
| Thinking History | 返却Blockを保持 | 一方向Compatibilityとappend-only確認 |
| Prompt変更 | system、tools、過去Messageを保存 | Prefix変更を検出 |
| Agent Loop | Batch、Retry、Recoveryを記録 | 完了、Loop、進捗を比較 |
| Effort | Production設定を固定 | Task分類ごとにSweep |
| Safeguard | 拒否Categoryと最終Modelを記録 | 実際の完了Modelを確認 |
| Cost | TokenとToolを全計測 | Cache Hitと手修正を含める |
| Context/Output | 両方1M / 128K | 容量向上を主張しない |
| Cache read | $1対$0.25/MTok | 実Hitだけで節約測定 |
| Output Risk | 両方$50/MTok | 長い回答を制限 |
| Latency | Task全体のp50/p95 | Demoを分布とみなさない |
| Knowledge | 2026年1月対6月 | 文書化Baselineであり保証ではない |
| Channel | Account、Region、Billing | App表示とAPI Accessを分離 |
単発回答ではなくTrace全体を比べます。もっとも高価なのは、複数ToolとReviewを消費した後で却下される、もっともらしい未完成出力です。
よくあるアップグレード失敗
- Model IDだけ変え、ToolとThinking Historyの非互換を見落とす。
- Cache割引を全Task一律25%節約と表現する。
- 新Promptと古いProduction Traceを比較する。
- Benchmarkや1回のDemoだけで全量化する。
- Canary期間前にfallbackを削除する。
- 実際に回答したfallback Modelを記録しない。
- Token単価だけを最適化しRetry、Tool、Latency、修正を除外する。
価格以外の変更
Fable 5.1はMessageごとのeffort、Turn単位System Message、進捗更新、Content Provenanceを追加します。BetaやChannel対応は異なるため個別に検証し、Provider Benchmarkを自社Trafficの勝利とみなしません。
合格タスク当たりコスト
Input + Cache Writes + Cache Reads + Output + Tool + Retry + fallback + Reviewで計算します。Cache中心Agentは大きく下がる可能性がありますが、短いInputと長いOutputでは効果が小さいため、Cache Hit Tokenと合格結果を同じReportに記録します。アップグレードしない条件
強制Toolが残る、Historyを書き換える、Thinking Blockを旧Modelへ渡す、Policy Review未完、または既存Routeが基準を満たし5.1に測定可能な価値がない場合はFable 5を維持します。
FAQ
そのまま置き換えられますか?
現行の後継ですが、無検証でそのまま置き換えることはできません。3つの文書化された互換性変更をテストしてください。
安くなりましたか?
標準の入力・出力料金は同じです。キャッシュ読み取りだけが75%安いため、総コストの差は実際に再利用するキャッシュ量で決まります。
両方1M contextですか?
はい。どちらも100万トークンのコンテキストと128,000トークンの最大出力を公開しています。
Cache中心Agentは移行すべき?
有力なCanary候補です。キャッシュ読み取りは4分の1ですが、合格タスク品質、遅延、運用挙動も基準を通過した場合だけ昇格してください。
会話途中で切替可能?
無条件には切り替えられません。旧ClaudeモデルはFable 5.1のThinking Blockを読めないため、モデル間フォールバックでは会話履歴を明示的に管理してください。
全トラフィック向け?
いいえ。タスク価値と測定結果でルーティングします。通常トラフィックはOpus 5や別の低コストRouteが適する場合があります。
Release情報は?
Tool呼び出しでは何が変わりましたか?
tool_choiceのanyとtoolの強制指定を拒否します。Tool依存のトラフィックを移す前に、対応する自動選択とアプリケーション側制御を検証してください。

