GPT Image 2.5 Flare & Sunburst が EvoLink で利用可能にGPT Image 2.5 を試す
テラコッタとチャコールの経路がつながる Claude Opus 5.5 vs 5 比較カバー
比較

Claude Opus 5.5 vs Claude Opus 5:アップグレードすべきか

EvoLink Team
EvoLink Team
製品チーム
2026年9月22日
24 分
結論を先に。 長時間のエージェント型コーディング、大規模ドキュメント分析、グラフの多い視覚タスクで Claude Opus 5.5 を試験導入し、対になったリプレイが別の答えを出すまでは Claude Opus 5 をロールバック先として残してください。Anthropic の定価では Opus 5.5 はトークンあたり 20%、キャッシュ読み取りは 60% 安く、Anthropic はタスクをより少ないトークンで完了できると述べています。ただし単純な差し替えではありません。Opus 5 で動く 4 種類のリクエストは Opus 5.5 で 400 を返し、デフォルト effort は high から medium に下がり、同じ effort レベルではモデルが 1 ターンあたり多く思考します。
このガイドは、すでに本番で Opus 5 を運用しているチームのためのものです。リリースの事実と「Opus 5.2」の噂の結末は Claude Opus 5.5 リリースに、EvoLink の現在の料金、モデル ID、接続設定は Claude Opus 5.5 モデルページと Claude Opus 5 モデルページにあります。以下の価格は Anthropic 公表の定価で、2 つのモデルを同じ基準で比較するためだけに使います。

判断の全体像

あなたの状況推奨理由
新しいワークロードで Opus の基準値がまだないOpus 5.5 から始めるAnthropic 推奨のデフォルト、定価が低い、上限は同じ
Opus 5 が本番稼働中、thinking 有効、tool_choice: autoカナリアの後ろで 5.5 を試験導入effort を明示すればコードは通常そのまま使えるが、以下の 5 つのリスク(thinking 設定、ツール選択、進捗テキスト、thinking ブロックのフォールバック、computer use のバージョン)は必ず確認
Opus 5 が本番稼働中だが thinking: disabled か強制ツール選択を使っているまずリクエストを修正し、その後試験導入どちらも 5.5 では 400
大きな安定プレフィックスを持つキャッシュ中心のエージェント試験導入を優先5.5 のキャッシュ読み取りは 60% 安い
会話の途中で Opus から Sonnet や Haiku に落ちるフォールバックチェーンフォールバック経路を再テストOpus 5.5 の thinking ブロックを読めるのは Fable 5.1 と Mythos 5.1 だけ
ツール呼び出し間のテキストを表示するストリーミング UI展開前に thinking.display を処理そのテキストは thinking ブロックに入り、デフォルトでは空
レイテンシ重視で速度のために thinking を切っていた5.5 の low effort を thinking オフの Opus 5 と比較thinking は無効化できず、effort が唯一のレバー

この表に無条件の勝者はいません。あなたのワークロードが Anthropic の最適化対象で、リクエストの形がすでに互換なら、アップグレードは報われます。そうでなければ、まずエンジニアリング時間がかかります。

Anthropic が変えたこと

項目Claude Opus 5Claude Opus 5.5出典
リリース2026 年 7 月 24 日2026 年 9 月 22 日リリースノート
モデル IDclaude-opus-5claude-opus-5-5モデル概要
入力 / 出力$5 / $25 per MTok$4 / $20 per MTok料金
キャッシュ書き込み 5 分 / 1 時間$6.25 / $10$5 / $8料金
キャッシュ読み取り$0.50(入力の 10%)$0.20(入力の 5%)料金
Batch$2.50 / $12.50$2 / $10料金
Fast mode(Claude API のみ)$10 / $50$8 / $40料金
コンテキスト / 最大出力1M / 128K1M / 128Kモデル概要
Thinkingデフォルトでオン。effort high 以下では disabled 可常時オン。disabled と budget_tokens は 400What's new
デフォルト efforthighmediumモデル概要
強制ツール選択(any、tool)サポート400 を返すWhat's new
ツール呼び出し間のテキストtext ブロック進捗 thinking ブロック、デフォルト表示では空What's new
Thinking ブロックの可搬性Opus 5.5、Fable 5.1、Mythos 5.1 が読めるFable 5.1 と Mythos 5.1 のみ読めるWhat's new
Claude API / Google Cloud の computer useツールセットまたは computer_20251124ツールセットのみWhat's new
セーフガードのカテゴリcybercyber、bio、reasoning_extractionWhat's new
知識カットオフより古い2026 年 6 月モデル概要
廃止の下限2027 年 7 月 24 日以前にはなし2027 年 9 月 22 日以前にはなしモデル概要

この表の項目はすべて検証可能な、ドキュメント化された契約上の変更です。Anthropic の能力に関する主張は別のカテゴリです。FrontierCode でのトップ成績、「on most work」で Claude Fable 5.1 と同等、30% 以上速い出力、Opus 5 より 40% 低い運用コストを報告していますが、これらは Anthropic 自身のタスク構成についての主張です。あなたの評価で検証すべき仮説として扱ってください。

同じ基準でのコスト:20%、60%、それとも 40%?

3 つの異なる数字が出回っていますが、それぞれ測っているものが違います。

  • 20% は入力と出力の定価差です。挙動の違いを考える前の、すべてのトークンに適用されます。
  • 60% はキャッシュ読み取りの定価差です。入力のうちキャッシュから供給される部分にだけ適用されます。
  • 40% は Anthropic 自身のワークロードにおける総運用コストの見積もりです。単価の下落と完了タスクあたりのトークン削減を束ねた数字なので、あなたのタスクが新モデルでどう振る舞うかに依存します。

下の表は、3 つの固定トークン構成に定価を当てたもので、1,000 タスクあたりの金額です。これは価格計算であり、品質を加味したコストではありません。

ワークロード(タスクあたり)Opus 5Opus 5.5変化
A. 単発、キャッシュなし:入力 20K、出力 4K$200.00$160.00-20%
B. キャッシュ中心のエージェント:キャッシュ読み取り 60K、新規入力 10K、キャッシュ書き込み 5K、出力 6K$261.25$197.00-25%
C. A と同じだが、5.5 が同じ effort で出力トークンを 25% 多く出す$200.00$180.00-10%
注目すべきはワークロード C です。Anthropic のドキュメントは、同じ effort レベルでは Opus 5.5 が Opus 5 より 1 ターンあたり多く思考する傾向があり、特に xhigh と max で顕著だと述べています。思考は出力として課金されます。構成 A では、Opus 5.5 は出力トークンを最大 50% 多く出しても、タスクあたり価格が Opus 5 と同じになるだけです。実際にそうなるかは選んだ effort レベルと、モデルがより少ないターンで受け入れ可能な結果に到達するかに依存し、後者が Anthropic の 40% という数字の由来です。
アップグレードの判断を決める唯一の比較は受け入れられたタスクあたりのコストです。評価グループの総支出(失敗、再試行、ツール料金を含む)を受け入れ基準を通過したタスク数で割り、人手による修正時間は別に記録します。次のセクションの effort スイープの後に行い、前には行わないでください。

互換性リスク、影響が出る順に

1. 今後失敗するリクエスト

適用範囲について:以下の 400 エラーは Anthropic API の挙動です。EvoLink では、ゲートウェイが旧設定の thinking: disabled と budget_tokens を拒否せず adaptive thinking に変換します。一方、強制ツール選択は Chat Completions と Messages の両エンドポイントで拒否されます。ゲートウェイの挙動は Claude Opus 5.5 モデルページを参照してください。
リクエストビルダーで 3 つのパターンを探してください。thinking: {"type": "disabled"} と thinking: {"type": "enabled", "budget_tokens": N} はどちらも 400 invalid_request_error を返します。tool_choice: {"type": "any"} と {"type": "tool", "name": ...} は 400 を返し、トークンカウントのエンドポイントでも同様です。Claude API と Google Cloud では、computer_20251124 ツールのエントリは 400 を返すので、代わりに computer_toolset_20260801 を宣言してください。
置き換えは機械的です。thinking フィールドを削除するか、等価な thinking: {"type": "adaptive"} を送り、output_config.effort を明示的に設定します。tool_choice: auto を維持し、スキーマどおりの引数が必要なツールには strict: true を設定するか、スキーマを structured outputs に移し、いつツールを使うべきかをプロンプトで指示してください。そのうえで、ループ内で実際にツール呼び出しが発生したかを確認します。auto は呼び出しを保証しません。

2. 静かに動くデフォルト

effort を省略したリクエストは、Opus 5 では high で、Opus 5.5 では medium で動きます。本番のリクエストで effort を一度も設定していないなら、最初の Opus 5.5 リプレイは同条件の比較になりません。結果を読む前に両モデルで明示的にレベルを設定し、その後 5.5 で low、medium、high をスイープしてください。

3. 消える進捗テキスト

ツール呼び出しの間、Opus 5 は短い説明を text ブロックとして返していました。Opus 5.5 はそれを進捗 thinking ブロックとして返し、各ツール呼び出しの前に最大 1 つ、デフォルトの display: "omitted" では thinking フィールドが空です。エラーは出ず、ストリーミング UI が黙るだけです。thinking.display を "updates"(ベータヘッダー thinking-display-updates-2026-08-18)または "summarized" に設定し、空でない thinking ブロックを対応するツール呼び出しの前に描画し、ブロックは無変更で返してください。

4. 推論を失うフォールバックチェーン

Thinking ブロックには生成したモデルが記録されます。Opus 5.5 は Opus 5 とそれ以前の Opus・Sonnet・Haiku のブロックを読めるので、Opus 5 で始まり 5.5 に移る会話は推論を保持します。逆方向では Claude Fable 5.1 と Mythos 5.1 だけが Opus 5.5 のブロックを読めます。Opus 5.5 から Opus 5、Sonnet 5、Haiku 4.5 へ落ちるルーターは、残りのターンを以前の推論なしで実行します。リクエストは成功し、破棄されたブロックは課金されませんが、挙動は変わります。API はまた、5.5 の thinking ブロックより前の内容が編集されていないかを確認し、2026 年 8 月 31 日以降に作成されたアカウントでは、編集後にブロックを再送するとデフォルトで 400 が返ります。履歴は追記のみに保ち、system prompt やツールを編集する代わりに会話途中の system メッセージを使ってください。

5. 新しい拒否カテゴリ

Opus 5.5 はサイバーセキュリティに加えて生物学の分類器を動かし、内部推論の再現を迫るリクエストを拒否することがあります。その場合 stop_reason: "refusal" と、bio または reasoning_extraction の stop_details.category が返ります。サーバーサイドのフォールバックは reasoning_extraction を再試行しません。Opus 5 のインテグレーションで stop_reason を一度も確認していなかったなら、試験導入の前にその確認を追加してください。

6 つのシナリオと、それぞれが証明すべきこと

シナリオ入力から出力「より良い」の意味Opus 5.5 で見るべき点
複数ファイルのコード変更リポジトリのコンテキストからパッチテストが通る。レビュアーの修正が少なく受け入れられる選んだ effort での出力トークン。グリーンまでのステップ数
マルチターンのツールエージェントタスクとツールスキーマから一連のツール呼び出しタスク完了。失敗後にループを復旧できるauto がツールを呼ぶか。進捗ブロックの描画。thinking ブロックの返送
長文ドキュメント分析ドキュメントと画像から出典付きの結論主張が証拠集合と一致。抜けがない引用チェック。Anthropic は根拠のない数値が減ったと報告、要検証
構造化抽出半構造化テキストから固定 JSONスキーマ有効率。フィールド精度strict: true が強制ツール選択を置き換える
キャッシュ中心のワークフロー固定プレフィックスと新タスクから結果受け入れ率を維持。請求が実際に下がるキャッシュヒット率。5 分書き込みと 1 時間書き込みの選択
マルチモデルのフォールバック失敗またはタイムアウトしたターンから代替ルート会話が続く。コストが有界どのモデルが 5.5 の thinking ブロックを読めるか。拒否カテゴリ

これらは結果ではありません。トラフィックを移す前に埋めるべき受け入れ記録であり、タスククラスごとに 1 つ、両モデルで同じプロンプト、ツール、タイムアウト、effort レベル、再試行ルール、レビュアーを使って作成します。

Opus 5 を残すべきとき

Opus 5 がすでに合格率、レイテンシ、コストの目標を満たしていて、リプレイで計測可能な改善が見えない場所では Opus 5 を残してください。リクエストビルダーがまだ thinking: disabled や強制ツール選択を送っていて修正が未デプロイの場所でも残します。すべての 5.5 カナリアについて、実負荷での p95 レイテンシと拒否挙動が見えるまで十分に走るまでは、ロールバック先として残します。そして、フォールバックチェーンが下流モデルによる会話の thinking ブロック読み取りに依存している場所では、そのチェーンを再テストするまで残してください。

基準値を集めている間、待つことは受動的ではありません。Anthropic は Opus 5 を Active とし、自社運営プラットフォームでの廃止下限を 2027 年 7 月 24 日としているので、リリース日ではなく証拠に基づいて移行する時間があります。

安全な移行計画

1. Opus 5 の基準値を凍結する

上の各クラスから代表的なタスクを選びます。正確なリクエストの形、effort レベル、ツールセット、受け入れ基準を記録し、Opus 5 でもう一度実行して、基準値を記憶ではなく新鮮なものにします。

2. リクエストの形を修正する

thinking: disabled と budget_tokens を削除し、effort を明示的に設定し、強制ツール選択を auto と strict に置き換え、computer use をツールセットに移し、stop_reason の処理を追加します。これをまず Opus 5 に対してリリースしてください。どの変更も Opus 5 で有効なので、リクエストの修正とモデルの変更を切り分けられます。

3. effort スイープを実行する

基準値を Opus 5.5 で low、medium、high それぞれでリプレイします。各レベルで受け入れタスク率、出力トークン、経過時間、受け入れタスクあたりのコストを記録します。タスククラスごとに、受け入れ基準を満たす最も安いレベルを選びます。習慣で Opus 5 の high を持ち越さないでください。

4. タスククラス単位でカナリア

1 つのタスククラスの小さな割合を Opus 5.5 にルーティングし、Opus 5 を設定済みのフォールバックにして、すべての呼び出しで要求モデル、返却モデル、effort、stop_reason、課金項目を記録します。受け入れタスクあたりのコストと品質が、1 日の好調ではなく実トラフィックの 1 サイクル全体でゲートを通過したら、そのクラスを昇格させます。

5. 戻り道を定義する

ロールバックは設定変更です。そのクラスを claude-opus-5 に切り戻します。Opus 5 は Opus 5.5 の thinking ブロックを読めないため、会話途中のロールバックは以前の推論なしで続きます。可能なら新しい会話境界を切ってください。カナリア開始前に、誰がロールバックを起動でき、どのシグナルが起動条件かを記録します。

EvoLink ではモデル選択はリクエスト内の文字列なので、手順 4 と 5 にコードのデプロイは必要ありません。

Claude Opus 5.5 のルートと現在の料金を確認 Claude Opus 5 のルートをロールバック先として残す

よくある質問

Claude Opus 5.5 は Claude Opus 5 より安いですか?

トークンあたりでは安いです。Anthropic は入力と出力を 20%、キャッシュ読み取りを 60% 低く設定しています。タスクあたりでは、あなたの effort レベルでモデルが何トークン使うかに依存します。Anthropic の 40% は、自社ワークロードに対する自社の見積もりです。

Opus 5.5 は Opus 5 の単純な差し替えになりますか?

なりません。thinking を無効化する、thinking 予算を設定する、ツール選択を強制する、旧 computer use ツールを宣言するリクエストは 400 を返します。デフォルト effort も high から medium に下がり、ツール呼び出し間のテキストは thinking ブロックに移ります。

なぜ私のワークロードでは Opus 5.5 が Opus 5 より高くなり得るのですか?

同じ effort レベルで 1 ターンあたり多く思考する傾向があり、思考は出力として課金されるからです。入力 20K、出力 4K のタスクでは、出力が 50% 増えるまで Opus 5 の価格に達しません。high を持ち越すのではなく、スイープで effort を選んでください。

レイテンシのために Opus 5.5 で thinking を切れますか?

切れません。effort: low を使い、thinking オフの Opus 5 基準値とレイテンシと受け入れ率で比較してください。thinking 無効前提で書かれたプロンプトに関する Anthropic のガイダンスも、「推論しないで」といった指示を削除することを勧めています。

Opus 5.5 から Opus 5 にフォールバックすると thinking ブロックはどうなりますか?

Opus 5 はそれを読めないため、API はモデルがリクエストを見る前に破棄します。リクエストは成功し、破棄されたブロックは課金されませんが、残りのターンは以前の推論なしで動きます。Opus 5 から Opus 5.5 への移行では保持されます。

強制ツール選択の代替はありますか?

tool_choice: auto を維持し、ツールに strict: true を設定してすべての呼び出しがスキーマに従うようにし、いつツールを使うべきかをプロンプトに書きます。純粋な JSON 出力が目的なら、ツールではなく structured outputs を使ってください。

Opus 5 はフォールバックとして残すべきですか?

はい、少なくともカナリア期間中は。Anthropic は claude-opus-5 を Active とし、自社運営プラットフォームでの廃止下限を 2027 年 7 月 24 日としています。フォールバック先として計画している具体的なルートを、上記の thinking ブロックの挙動も含めてテストしてください。

どのワークロードを最初に移すべきですか?

長時間のエージェント型コーディング、大規模ドキュメント分析、安定プレフィックスを持つキャッシュ中心のエージェントの順で、期待される効果が大きいです。日常的なコーディングや大量・低レイテンシのトラフィックは、どちらの Opus でもなく Sonnet 5 に属するのが通常です。

参照元

事実の最終確認日:2026 年 9 月 22 日。コストの例は Anthropic の定価と固定トークン構成を用いた価格計算であり、計測結果ではありません。

AIコストを89%削減する準備はできましたか?

今すぐEvoLinkを始めて、インテリジェントなAPIルーティングの力を体験してください。