
Claude Opus 5.5 vs Claude Opus 5:アップグレードすべきか
400 を返し、デフォルト effort は high から medium に下がり、同じ effort レベルではモデルが 1 ターンあたり多く思考します。判断の全体像
| あなたの状況 | 推奨 | 理由 |
|---|---|---|
| 新しいワークロードで Opus の基準値がまだない | Opus 5.5 から始める | Anthropic 推奨のデフォルト、定価が低い、上限は同じ |
Opus 5 が本番稼働中、thinking 有効、tool_choice: auto | カナリアの後ろで 5.5 を試験導入 | effort を明示すればコードは通常そのまま使えるが、以下の 5 つのリスク(thinking 設定、ツール選択、進捗テキスト、thinking ブロックのフォールバック、computer use のバージョン)は必ず確認 |
Opus 5 が本番稼働中だが thinking: disabled か強制ツール選択を使っている | まずリクエストを修正し、その後試験導入 | どちらも 5.5 では 400 |
| 大きな安定プレフィックスを持つキャッシュ中心のエージェント | 試験導入を優先 | 5.5 のキャッシュ読み取りは 60% 安い |
| 会話の途中で Opus から Sonnet や Haiku に落ちるフォールバックチェーン | フォールバック経路を再テスト | Opus 5.5 の thinking ブロックを読めるのは Fable 5.1 と Mythos 5.1 だけ |
| ツール呼び出し間のテキストを表示するストリーミング UI | 展開前に thinking.display を処理 | そのテキストは thinking ブロックに入り、デフォルトでは空 |
| レイテンシ重視で速度のために thinking を切っていた | 5.5 の low effort を thinking オフの Opus 5 と比較 | thinking は無効化できず、effort が唯一のレバー |
この表に無条件の勝者はいません。あなたのワークロードが Anthropic の最適化対象で、リクエストの形がすでに互換なら、アップグレードは報われます。そうでなければ、まずエンジニアリング時間がかかります。
Anthropic が変えたこと
| 項目 | Claude Opus 5 | Claude Opus 5.5 | 出典 |
|---|---|---|---|
| リリース | 2026 年 7 月 24 日 | 2026 年 9 月 22 日 | リリースノート |
| モデル ID | claude-opus-5 | claude-opus-5-5 | モデル概要 |
| 入力 / 出力 | $5 / $25 per MTok | $4 / $20 per MTok | 料金 |
| キャッシュ書き込み 5 分 / 1 時間 | $6.25 / $10 | $5 / $8 | 料金 |
| キャッシュ読み取り | $0.50(入力の 10%) | $0.20(入力の 5%) | 料金 |
| Batch | $2.50 / $12.50 | $2 / $10 | 料金 |
| Fast mode(Claude API のみ) | $10 / $50 | $8 / $40 | 料金 |
| コンテキスト / 最大出力 | 1M / 128K | 1M / 128K | モデル概要 |
| Thinking | デフォルトでオン。effort high 以下では disabled 可 | 常時オン。disabled と budget_tokens は 400 | What's new |
| デフォルト effort | high | medium | モデル概要 |
強制ツール選択(any、tool) | サポート | 400 を返す | What's new |
| ツール呼び出し間のテキスト | text ブロック | 進捗 thinking ブロック、デフォルト表示では空 | What's new |
| Thinking ブロックの可搬性 | Opus 5.5、Fable 5.1、Mythos 5.1 が読める | Fable 5.1 と Mythos 5.1 のみ読める | What's new |
| Claude API / Google Cloud の computer use | ツールセットまたは computer_20251124 | ツールセットのみ | What's new |
| セーフガードのカテゴリ | cyber | cyber、bio、reasoning_extraction | What's new |
| 知識カットオフ | より古い | 2026 年 6 月 | モデル概要 |
| 廃止の下限 | 2027 年 7 月 24 日以前にはなし | 2027 年 9 月 22 日以前にはなし | モデル概要 |
この表の項目はすべて検証可能な、ドキュメント化された契約上の変更です。Anthropic の能力に関する主張は別のカテゴリです。FrontierCode でのトップ成績、「on most work」で Claude Fable 5.1 と同等、30% 以上速い出力、Opus 5 より 40% 低い運用コストを報告していますが、これらは Anthropic 自身のタスク構成についての主張です。あなたの評価で検証すべき仮説として扱ってください。
同じ基準でのコスト:20%、60%、それとも 40%?
3 つの異なる数字が出回っていますが、それぞれ測っているものが違います。
- 20% は入力と出力の定価差です。挙動の違いを考える前の、すべてのトークンに適用されます。
- 60% はキャッシュ読み取りの定価差です。入力のうちキャッシュから供給される部分にだけ適用されます。
- 40% は Anthropic 自身のワークロードにおける総運用コストの見積もりです。単価の下落と完了タスクあたりのトークン削減を束ねた数字なので、あなたのタスクが新モデルでどう振る舞うかに依存します。
下の表は、3 つの固定トークン構成に定価を当てたもので、1,000 タスクあたりの金額です。これは価格計算であり、品質を加味したコストではありません。
| ワークロード(タスクあたり) | Opus 5 | Opus 5.5 | 変化 |
|---|---|---|---|
| A. 単発、キャッシュなし:入力 20K、出力 4K | $200.00 | $160.00 | -20% |
| B. キャッシュ中心のエージェント:キャッシュ読み取り 60K、新規入力 10K、キャッシュ書き込み 5K、出力 6K | $261.25 | $197.00 | -25% |
| C. A と同じだが、5.5 が同じ effort で出力トークンを 25% 多く出す | $200.00 | $180.00 | -10% |
xhigh と max で顕著だと述べています。思考は出力として課金されます。構成 A では、Opus 5.5 は出力トークンを最大 50% 多く出しても、タスクあたり価格が Opus 5 と同じになるだけです。実際にそうなるかは選んだ effort レベルと、モデルがより少ないターンで受け入れ可能な結果に到達するかに依存し、後者が Anthropic の 40% という数字の由来です。互換性リスク、影響が出る順に
1. 今後失敗するリクエスト
400 エラーは Anthropic API の挙動です。EvoLink では、ゲートウェイが旧設定の thinking: disabled と budget_tokens を拒否せず adaptive thinking に変換します。一方、強制ツール選択は Chat Completions と Messages の両エンドポイントで拒否されます。ゲートウェイの挙動は Claude Opus 5.5 モデルページを参照してください。thinking: {"type": "disabled"} と thinking: {"type": "enabled", "budget_tokens": N} はどちらも 400 invalid_request_error を返します。tool_choice: {"type": "any"} と {"type": "tool", "name": ...} は 400 を返し、トークンカウントのエンドポイントでも同様です。Claude API と Google Cloud では、computer_20251124 ツールのエントリは 400 を返すので、代わりに computer_toolset_20260801 を宣言してください。thinking フィールドを削除するか、等価な thinking: {"type": "adaptive"} を送り、output_config.effort を明示的に設定します。tool_choice: auto を維持し、スキーマどおりの引数が必要なツールには strict: true を設定するか、スキーマを structured outputs に移し、いつツールを使うべきかをプロンプトで指示してください。そのうえで、ループ内で実際にツール呼び出しが発生したかを確認します。auto は呼び出しを保証しません。2. 静かに動くデフォルト
effort を省略したリクエストは、Opus 5 では high で、Opus 5.5 では medium で動きます。本番のリクエストで effort を一度も設定していないなら、最初の Opus 5.5 リプレイは同条件の比較になりません。結果を読む前に両モデルで明示的にレベルを設定し、その後 5.5 で low、medium、high をスイープしてください。3. 消える進捗テキスト
text ブロックとして返していました。Opus 5.5 はそれを進捗 thinking ブロックとして返し、各ツール呼び出しの前に最大 1 つ、デフォルトの display: "omitted" では thinking フィールドが空です。エラーは出ず、ストリーミング UI が黙るだけです。thinking.display を "updates"(ベータヘッダー thinking-display-updates-2026-08-18)または "summarized" に設定し、空でない thinking ブロックを対応するツール呼び出しの前に描画し、ブロックは無変更で返してください。4. 推論を失うフォールバックチェーン
400 が返ります。履歴は追記のみに保ち、system prompt やツールを編集する代わりに会話途中の system メッセージを使ってください。5. 新しい拒否カテゴリ
stop_reason: "refusal" と、bio または reasoning_extraction の stop_details.category が返ります。サーバーサイドのフォールバックは reasoning_extraction を再試行しません。Opus 5 のインテグレーションで stop_reason を一度も確認していなかったなら、試験導入の前にその確認を追加してください。6 つのシナリオと、それぞれが証明すべきこと
| シナリオ | 入力から出力 | 「より良い」の意味 | Opus 5.5 で見るべき点 |
|---|---|---|---|
| 複数ファイルのコード変更 | リポジトリのコンテキストからパッチ | テストが通る。レビュアーの修正が少なく受け入れられる | 選んだ effort での出力トークン。グリーンまでのステップ数 |
| マルチターンのツールエージェント | タスクとツールスキーマから一連のツール呼び出し | タスク完了。失敗後にループを復旧できる | auto がツールを呼ぶか。進捗ブロックの描画。thinking ブロックの返送 |
| 長文ドキュメント分析 | ドキュメントと画像から出典付きの結論 | 主張が証拠集合と一致。抜けがない | 引用チェック。Anthropic は根拠のない数値が減ったと報告、要検証 |
| 構造化抽出 | 半構造化テキストから固定 JSON | スキーマ有効率。フィールド精度 | strict: true が強制ツール選択を置き換える |
| キャッシュ中心のワークフロー | 固定プレフィックスと新タスクから結果 | 受け入れ率を維持。請求が実際に下がる | キャッシュヒット率。5 分書き込みと 1 時間書き込みの選択 |
| マルチモデルのフォールバック | 失敗またはタイムアウトしたターンから代替ルート | 会話が続く。コストが有界 | どのモデルが 5.5 の thinking ブロックを読めるか。拒否カテゴリ |
これらは結果ではありません。トラフィックを移す前に埋めるべき受け入れ記録であり、タスククラスごとに 1 つ、両モデルで同じプロンプト、ツール、タイムアウト、effort レベル、再試行ルール、レビュアーを使って作成します。
Opus 5 を残すべきとき
thinking: disabled や強制ツール選択を送っていて修正が未デプロイの場所でも残します。すべての 5.5 カナリアについて、実負荷での p95 レイテンシと拒否挙動が見えるまで十分に走るまでは、ロールバック先として残します。そして、フォールバックチェーンが下流モデルによる会話の thinking ブロック読み取りに依存している場所では、そのチェーンを再テストするまで残してください。基準値を集めている間、待つことは受動的ではありません。Anthropic は Opus 5 を Active とし、自社運営プラットフォームでの廃止下限を 2027 年 7 月 24 日としているので、リリース日ではなく証拠に基づいて移行する時間があります。
安全な移行計画
1. Opus 5 の基準値を凍結する
上の各クラスから代表的なタスクを選びます。正確なリクエストの形、effort レベル、ツールセット、受け入れ基準を記録し、Opus 5 でもう一度実行して、基準値を記憶ではなく新鮮なものにします。
2. リクエストの形を修正する
thinking: disabled と budget_tokens を削除し、effort を明示的に設定し、強制ツール選択を auto と strict に置き換え、computer use をツールセットに移し、stop_reason の処理を追加します。これをまず Opus 5 に対してリリースしてください。どの変更も Opus 5 で有効なので、リクエストの修正とモデルの変更を切り分けられます。3. effort スイープを実行する
low、medium、high それぞれでリプレイします。各レベルで受け入れタスク率、出力トークン、経過時間、受け入れタスクあたりのコストを記録します。タスククラスごとに、受け入れ基準を満たす最も安いレベルを選びます。習慣で Opus 5 の high を持ち越さないでください。4. タスククラス単位でカナリア
stop_reason、課金項目を記録します。受け入れタスクあたりのコストと品質が、1 日の好調ではなく実トラフィックの 1 サイクル全体でゲートを通過したら、そのクラスを昇格させます。5. 戻り道を定義する
claude-opus-5 に切り戻します。Opus 5 は Opus 5.5 の thinking ブロックを読めないため、会話途中のロールバックは以前の推論なしで続きます。可能なら新しい会話境界を切ってください。カナリア開始前に、誰がロールバックを起動でき、どのシグナルが起動条件かを記録します。EvoLink ではモデル選択はリクエスト内の文字列なので、手順 4 と 5 にコードのデプロイは必要ありません。
Claude Opus 5.5 のルートと現在の料金を確認 Claude Opus 5 のルートをロールバック先として残すよくある質問
Claude Opus 5.5 は Claude Opus 5 より安いですか?
トークンあたりでは安いです。Anthropic は入力と出力を 20%、キャッシュ読み取りを 60% 低く設定しています。タスクあたりでは、あなたの effort レベルでモデルが何トークン使うかに依存します。Anthropic の 40% は、自社ワークロードに対する自社の見積もりです。
Opus 5.5 は Opus 5 の単純な差し替えになりますか?
400 を返します。デフォルト effort も high から medium に下がり、ツール呼び出し間のテキストは thinking ブロックに移ります。なぜ私のワークロードでは Opus 5.5 が Opus 5 より高くなり得るのですか?
high を持ち越すのではなく、スイープで effort を選んでください。レイテンシのために Opus 5.5 で thinking を切れますか?
effort: low を使い、thinking オフの Opus 5 基準値とレイテンシと受け入れ率で比較してください。thinking 無効前提で書かれたプロンプトに関する Anthropic のガイダンスも、「推論しないで」といった指示を削除することを勧めています。Opus 5.5 から Opus 5 にフォールバックすると thinking ブロックはどうなりますか?
Opus 5 はそれを読めないため、API はモデルがリクエストを見る前に破棄します。リクエストは成功し、破棄されたブロックは課金されませんが、残りのターンは以前の推論なしで動きます。Opus 5 から Opus 5.5 への移行では保持されます。
強制ツール選択の代替はありますか?
tool_choice: auto を維持し、ツールに strict: true を設定してすべての呼び出しがスキーマに従うようにし、いつツールを使うべきかをプロンプトに書きます。純粋な JSON 出力が目的なら、ツールではなく structured outputs を使ってください。Opus 5 はフォールバックとして残すべきですか?
claude-opus-5 を Active とし、自社運営プラットフォームでの廃止下限を 2027 年 7 月 24 日としています。フォールバック先として計画している具体的なルートを、上記の thinking ブロックの挙動も含めてテストしてください。どのワークロードを最初に移すべきですか?
長時間のエージェント型コーディング、大規模ドキュメント分析、安定プレフィックスを持つキャッシュ中心のエージェントの順で、期待される効果が大きいです。日常的なコーディングや大量・低レイテンシのトラフィックは、どちらの Opus でもなく Sonnet 5 に属するのが通常です。
参照元
- Anthropic:What's new in Claude Opus 5.5
- Anthropic:Migrating to Claude Opus 5.5
- Anthropic:Models overview
- Anthropic:Pricing
- Anthropic:Effort parameter
- Anthropic:Preserved thinking
- Anthropic:Refusals and fallback
- Anthropic:Introducing Claude Opus 5.5


