Kimi K3 の提供を開始しましたKimi K3 を見る
Claude Opus 5をEvoLink統合APIから複数の本番ワークロードへルーティングする構成
チュートリアル

Claude Opus 5 APIの使い方:EvoLinkでの本番導入・移行ガイド

Jessie
Jessie
COO
2026年7月24日
更新日 2026年7月25日
29 分
Claude Opus 5 は、EvoLink でモデル ID claude-opus-5 として利用できます。EvoLink API キーを作成し、EvoLink のダイレクト Messages エンドポイント に Claude Messages リクエストを送信します。このルートは既存の EvoLink Claude Messages API 仕様 を使用するため、すでに Claude ルートを利用しているチームは、別のプロバイダー統合を追加せずに移行できます。
利用可能になったことと、本番導入の検証が完了したことは同じではありません。モデル ID は設定で管理し、自分のアカウントで response.model、使用量、請求、ストリーミング、ツール動作を確認したうえで、ワークロード単位で段階的にトラフィックを移行します。これにより「ルートが利用可能」と「すべてのアプリケーション経路が導入基準を満たした」を明確に区別できます。
このガイドは最初の API 呼び出しだけにとどまりません。thinking、effort、max_tokens の関係、Opus 4.8 からの移行で変わる点、拒否や通信障害の処理、そしてコストを考慮した本番ルーティングで Opus 5 をどこに配置すべきかを説明します。

Claude Opus 5 API の概要

Anthropic は、複雑なエージェント コーディングとエンタープライズ作業向けに、Claude Opus 5 を 2026 年 7 月 24 日にリリースしました。 Opus 5 の公式ドキュメント では、コア API コントラクトが定義されています。
フィールド検証された値なぜそれが重要なのか
Anthropic モデル IDclaude-opus-5API プロバイダーによってサポートされている正確な識別子を使用します。
コンテキストウィンドウ100万トークン大規模なリポジトリとドキュメント セットは 1 つのモデル コンテキストに収まりますが、利用可能なすべてのコンテキストを送信することが最も安価な設計になることはほとんどありません。
最大出力128,000 トークンmax_tokens は依然として思考と目に見える出力を制限します。
Thinkingデフォルトで有効Thinking を省略していた Opus 4.8 リクエストは、移行後に挙動が変わります
Effort レベルlowmediumhighxhighmaxEffort は品質、レイテンシ、トークン使用量を調整する主要なパラメータです
公式基本価格入力トークン 100 万あたり 5 ドル、出力トークン 100 万あたり 25 ドルOpus 4.8 と同じ基本トークン価格
EvoLink Messages エンドポイントダイレクト Messages エンドポイント長時間実行される Claude リクエストに推奨される EvoLink エンドポイント
EvoLink ルート ステータス利用可能EvoLink Messages API を介して claude-opus-5 を呼び出し、独自のワークロードで本番環境の動作を検証します。

実際の要点は単純です。Claude Opus 5 は、EvoLink 経由で呼び出すことができるようになりましたが、パラメータの互換性、請求、操作動作は、完全な運用展開の前に実際のアカウント レベルのリクエストで検証する必要があります。

統合 API を通じて Claude Opus 5 を使用する理由

新しいモデルを呼び出すのは簡単です。発売週以降にアプリケーションの柔軟性を維持するのはより困難です。

チームがすべての Anthropic ネイティブ機能をすぐに必要とし、Claude のみを使用する予定の場合は、直接統合が正しい選択となります。統合ゲートウェイは、アプリケーションがモデルの選択、コストの抑制、フォールバックの保持、または製品全体にモデル固有のコードを広めることなくプロバイダーの切り替えを行う必要がある場合に、より便利になります。

したがって、EvoLink の有用な役割は、すべてのリクエストを Opus 5 リクエストにすることではありません。ルーティング層でモデルの選択を維持するためです。

Application task
  -> routing policy
  -> selected model
  -> Messages API request
  -> actual-model and usage verification
  -> quality and cost record
  -> promote, retry, fall back, or roll back

このアーキテクチャはチームに 4 つの具体的な利点をもたらします。

  1. 統合された接続面。 アプリケーションは、文書化された 1 つのエンドポイントを通じて Claude 形式のメッセージを送信します。
  2. 構成可能なモデルの選択。 ビジネス ロジックは routine_codingarchitecture_escalation などのジョブを記述し、構成は現在のモデルを選択します。
  3. 測定可能なフォールバック。 再試行またはモデル変更は、目に見えないベンチマーク汚染物質ではなく、明示的な運用イベントになります。
  4. 移行の柔軟性。 次のモデル変更は主にルーティングと評価の決定であり、プロンプト、製品コード、および顧客設定全体の書き換えではありません。
ファミリー単位の選択には、EvoLink の Claude モデルコレクション を使用します。正確なルート、現在のモデル情報、料金については、Claude Opus 5 モデルページ を確認してください。

Claude Opus 5 API を初めて呼び出す

1. 製品コードを変更する前にアカウント アクセスを確認する

EvoLink ルートが利用可能です。運用トラフィックを変更する前に、アカウントがそれを呼び出すことができること、および完全なアプリケーション パスが期待どおりに動作することを確認してください。

  • claude-opus-5 が EvoLink アカウントにリストされます。
  • 最小限のリクエストは HTTP 200 を返します。
  • response.model は、予想されるモデルを識別します。
  • 使用記録と請求金額は、現在の EvoLink の価格設定と一致します。
  • ストリーミングやツールなどの必要な機能が同じルートで動作します。

アカウントがルートを公開しない場合、または必要な機能が失敗する場合は、既存のモデルをフォールバックとして保持し、ロールアウト前にアカウントまたは互換性の問題を解決してください。

2. API キーをサーバーに保存します

EvoLink API キーを作成し、サーバー側の環境変数からロードします。

export EVOLINK_API_KEY="your_api_key_here"
ブラウザの JavaScript、クライアント コンポーネント、パブリック リポジトリ、または NEXT_PUBLIC_* 変数でキーを公開しないでください。

3. 最小限のリクエストを送信する

最小限のリクエストは、EvoLink の Claude Messages API の形式に従います。

curl --request POST \
  --url https://direct.evolink.ai/v1/messages \
  --header "Authorization: Bearer $EVOLINK_API_KEY" \
  --header "Content-Type: application/json" \
  --data '{
    "model": "claude-opus-5",
    "max_tokens": 4096,
    "messages": [
      {
        "role": "user",
        "content": "Review this service architecture and identify the three highest-risk failure points."
      }
    ]
  }'

オプションのパラメータを指定せずに開始します。小さなペイロードは、作業、ツール、ストリーミング、またはキャッシュによってさらに障害モードが追加される前に、認証、ルートの可用性、およびコアのリクエスト コントラクトを分離します。

4. ステータスコードだけでなく応答を確認する

HTTP 応答が成功すると、エンドポイントが何かを返したことを証明します。それ自体では、意図したモデルが要求に応えたこと、またはその結果が Opus 5 の評価に属することを証明するものではありません。

少なくとも次のことを記録します。

  • response.model
  • response.stop_reason
  • 入出力の使用法
  • リクエストのレイテンシ
  • 利用可能な場合は ID をリクエストします
  • アプリケーションタスクID
  • 再試行とフォールバックの数

次のサーバー側 TypeScript の例では、再試行不可能なクライアント エラーと再試行可能な容量エラーを区別し、型なしの値を使用せずに返されたモデルを検証します。

type Usage = {
  input_tokens: number
  output_tokens: number
  cache_creation_input_tokens?: number
  cache_read_input_tokens?: number
}

type TextBlock = {
  type: 'text'
  text: string
}

type MessageResponse = {
  id: string
  model: string
  stop_reason: string | null
  content: TextBlock[]
  usage: Usage
}

const RETRYABLE_STATUS = new Set([429, 500, 503, 524])

function isMessageResponse(value: unknown): value is MessageResponse {
  if (typeof value !== 'object' || value === null) return false

  const record = value as Record<string, unknown>
  return (
    typeof record.id === 'string' &&
    typeof record.model === 'string' &&
    Array.isArray(record.content) &&
    typeof record.usage === 'object' &&
    record.usage !== null
  )
}

async function callClaudeOpus5(prompt: string): Promise<MessageResponse> {
  const credential = process.env.EVOLINK_API_KEY
  if (!credential) throw new Error('EVOLINK_API_KEY is not configured')

  for (let attempt = 0; attempt < 3; attempt += 1) {
    const response = await fetch('https://direct.evolink.ai/v1/messages', {
      method: 'POST',
      headers: {
        Authorization: `Bearer ${credential}`,
        'Content-Type': 'application/json',
      },
      body: JSON.stringify({
        model: 'claude-opus-5',
        max_tokens: 4096,
        messages: [{ role: 'user', content: prompt }],
      }),
      signal: AbortSignal.timeout(120_000),
    })

    if (response.ok) {
      const payload: unknown = await response.json()
      if (!isMessageResponse(payload)) {
        throw new Error('Unexpected Claude Messages API response')
      }

      if (payload.model !== 'claude-opus-5') {
        throw new Error(`Unexpected response model: ${payload.model}`)
      }

      return payload
    }

    if (!RETRYABLE_STATUS.has(response.status) || attempt === 2) {
      throw new Error(`Claude request failed with HTTP ${response.status}`)
    }

    const backoffMs = 1_000 * 2 ** attempt + Math.floor(Math.random() * 250)
    await new Promise((resolve) => setTimeout(resolve, backoffMs))
  }

  throw new Error('Claude request exhausted its retry policy')
}

これは参照パターンであり、アカウントレベルのテストの代替ではありません。大容量サービスでは、構造化ログ、リクエスト相関、同時実行制御、およびルーティング ポリシーによって選択されたフォールバックを追加します。

Thinking、Effort、max_tokens の関係

Opus 5 は、おなじみのリクエストの動作を変更します。 Thinking はデフォルトでオンになっており、モデルが適用できるコンピューティングの量はエフォートによって制御されます。

Claude Opus 5でEffortを段階的に上げ、検証済みの出力へ到達するThinkingワークフロー
Claude Opus 5でEffortを段階的に上げ、検証済みの出力へ到達するThinkingワークフロー
Thinking 設定EffortAnthropic の Opus 5 APIで有効か本番運用への影響
デフォルトまたはアダプティブlowはい最低コストの評価レーン
デフォルトまたはアダプティブmediumはい有用なコストとレイテンシのベースライン
デフォルトまたはアダプティブhighはいAPI のデフォルトおよび一般的なインテリジェンスに敏感なルート
デフォルトまたはアダプティブxhighはい難しいコーディングとエージェント作業の推奨される開始点
デフォルトまたはアダプティブmaxはい追加のトークンの使用が許容される、機能が重要なタスク
無効lowmedium、または highはい追加の出力とツール呼び出しの検証が必要です。
無効xhigh または maxいいえ400 エラーを返す
Anthropic は、難しいコーディングやエージェント処理では xhigh、その他の品質重視のワークロードでは high から始め、評価品質を維持できる範囲で lowmedium を試すことを推奨しています。xhigh または max では、Thinking、サブエージェント、ツール呼び出しに十分な余裕を持たせるため、少なくとも 64K の max_tokens から調整します。

よくある統合ミスを防ぐための 3 つの詳細:

  1. max_tokens は思考と目に見える出力をカバーします。 思考を持たない Opus 4.8 ルートから継承された上限により、Opus 5 のタスクが予想よりも早く切り捨てられる可能性があります。
  2. Effort だけでは回答の表示量を安定して制御できません。 簡潔な回答や成果物の目標文字数は、プロンプトで明示します。
  3. プロバイダーのサポートは異なる場合があります。 現在のルートのドキュメントまたは実際のテストでフィールドが受け入れられることを確認した後、output_config.effort を EvoLink 経由でのみ送信します。

現実的なところでは思考を有効にし続けましょう。 Anthropic は、思考を無効にすると、ツール呼び出しが通常のテキストとして表示されたり、表示される応答で内部 XML のようなタグが露出したりする可能性があると警告しています。

古い前提を引き継がずに Claude Opus 4.8 から移行する

モデル ID の変更は簡単です。

- "model": "claude-opus-4-8"
+ "model": "claude-opus-5"
公式移行ガイド では、実際のアプリケーションのレビューが必要な動作の変更が特定されています。同族置換の決定には、Claude Opus 5 と Claude Opus 4.8 の比較 を使用してください。このガイドでは、引き続き移行の実装に焦点を当てます。

リクエストの移行

  • thinking フィールドのないリクエストは、thing をオンにして実行されるようになりました。
  • 以前何も考えずに実行されていたワークフローの max_tokens を再確認します。
  • 無効化した思考を xhigh または max と組み合わせないでください。
  • 4.8 より前の設定から temperaturetop_ptop_k が残っていないか確認してください。Opus 4.8 の時点でこれらは拒否されており、Opus 5 でも同じ挙動です。
  • 繰り返されるプロンプトが以前は短すぎてキャッシュできなかった場合は、新しい 512 トークンのプロンプト キャッシュの最小値をテストします。
  • stop_reason: "refusal" をアプリケーションの結果として処理します。

プロンプトの移行

Opus 5 は、自身の作業を検証し、進捗状況を説明し、サブエージェントに委任する可能性が高くなります。以前のモデル用に調整されたプロンプトでは、誤ってこれらの動作が倍増する可能性があります。

次の 4 つの方法でプロンプトを更新します。

  • 意図した回答または文書の長さを指定します。
  • 再確認するための無条件の指示を削除するか、最終検証者を追加します。
  • 狭いタスクの範囲を制限します。
  • 独立した並行作業が正当化されない限り、サブエージェントの委任には制限を設けます。
Anthropic の Opus 5 プロンプト ガイド では、難しいコーディング作業のために完全なタスク仕様を事前に提示し、冗長な検証足場を回避しながら、モデルを実行します。

ハーネスの移行

生のモデル呼び出しだけでなく、アプリケーション全体を通じて代表的なタスクを再生します。確認:

  • ツールの選択と引数
  • ストリーミングパーサーの動作
  • タイムアウトと再試行の制限
  • 拒否対応
  • 実際に返されたモデル
  • トークンとキャッシュの使用法
  • 出力の長さ
  • 実際のレビュー担当者または下流チェックによるタスクの承認

ワークロードに応じて Opus 5 を昇格させます。モデルは、日常的な抽出に不必要なコストを追加しながら、困難なアーキテクチャ タスクを改善できます。

ツールの使用、ストリーミング、拒否、およびトランスポートの失敗を処理する

EvoLink Messages API は、ストリーミング、ツール、ツールの選択、使用法、停止理由を公開します。実稼働ループは、200 個の応答ごとに最終応答が含まれると想定するのではなく、応答に基づいて分岐する必要があります。

Send message
  -> end_turn: return the answer
  -> tool_use: execute the allowed tool and continue
  -> refusal: apply the refusal and fallback policy
  -> max_tokens: mark the result incomplete
  -> transport error: retry only when the error is retryable

最大ツール ループ数を設定し、すべてのツール引数を検証し、失敗したタスクを説明するために必要なトレースを保存します。アプリケーション レベルの承認とスキーマ検証を行わずに、モデルで生成されたツール呼び出しを決して実行しないでください。

障害をクラス別に処理します。

結果推奨されるアクション
400 無効なリクエストモデル、Thinking、Effort、サンプリング、スキーマの各フィールドを修正し、無条件に再試行しない
401認証サーバー側の認証情報を修正する
402請求クレジットを復元するか、製品の応答を変更します。
404 モデルが見つかりませんEvoLink モデル列挙型とアカウント アクセスを再確認してください。
429 レート制限ジッターを使用して有界指数バックオフを適用する
503 過負荷です厳しい予算内で再試行するか、承認されたフォールバックに移行してください。
524 タイムアウト直接エンドポイントを使用し、長時間タスクのタイムアウトを設定し、追跡されていない作業の重複を回避します。
stop_reason: "refusal"結果を記録し、ワークロードのフォールバック ポリシーまたはユーザー メッセージ ポリシーを適用します。

拒否は、失敗した HTTP リクエストと同じではありません。 Anthropic では、これを Opus 5 の通常の応答結果として文書化しています。自動フォールバックは Anthropic のネイティブ API で利用できる場合がありますが、プロバイダー固有のフィールドをゲートウェイ リクエストに入れる前に、EvoLink を確認してください。

成功したタスクごとのコストを測定する

Claude Opus 5 は、Opus 4.8 と同じ公式の基本トークン価格を維持しますが、定価ではどのルートが安いか制作チームにわかりません。

次の決定指標を使用します。

successful-task cost =
  input token cost
  + output token cost
  + retry cost
  + fallback cost
  + tool execution cost
  + human review or repair cost
同じプライバシー保護済み評価セットを mediumhighxhigh で実行します。文章の流暢さだけでなく、タスクが合格したかを記録してください。高い Effort が再試行や手作業の修正を減らすなら経済的ですが、medium でも合格するタスクでは過剰コストになります。

評価表には以下を含める必要があります。

メトリックなぜそれが属するのか
承認されたタスク率結果が使用可能かどうかを測定します。
入力トークンと出力トークンの合計モデルの請求書全体を把握
キャッシュの読み取りと書き込み繰り返されるコンテキストが再利用されているかどうかを示します。
ツールの呼び出しと失敗エージェント ループのオーバーヘッドを明らかにする
再試行とフォールバック隠れたマルチリクエストコストを防止
エンドツーエンドの遅延インタラクティブフィットとバックグラウンドフィットを分離
人間によるレビュー時間トークンの価格設定が見逃しているクリーンアップをキャプチャ

単一のプロンプトだけで普遍的な Effort 推奨値を決めないでください。各ワークロードの品質基準を満たす最も低い Effort を選び、失敗コストが高いタスクにだけ上位レベルへのエスカレーションを残します。

ワークロード別に Sonnet、Opus、Fable をルーティングする

Anthropic は Opus 5 を複雑なエージェントコーディングや企業向け業務の出発点として位置づけています。一方、Fable 5 は一般提供される Claude モデルの中で最上位です。Opus 5 vs Fable 5 選択ガイドで、この製品階層をワークロードルールへ変換できます。
Claude Opus 5 と EvoLink の他のモデル レーンのプロダクション ルーティングとフォールバック ワークフロー
Claude Opus 5 と EvoLink の他のモデル レーンのプロダクション ルーティングとフォールバック ワークフロー
ワークロード推奨される出発ルートエスカレーション信号
分類、抽出、短い書き換え低価格モデルスキーマまたは品質の障害が許容されたしきい値を超えています。
コーディングと制作アシスタントの日常業務Claude Sonnet 5デバッグの失敗が繰り返される、リポジトリの範囲が広い、または意思決定のリスクが高い
複雑なデバッグ、アーキテクチャ、および長いエージェント ループClaude Opus 5タスクは未解決のままであり、期待値はプレミアムを正当化します。
最高難易度の自律作業または知識作業Claude Fable 5測定されたタスク値がより高い価格をサポートする場合にのみ使用してください。

ルーティングの決定を設定に保存します。

type Workload =
  | 'routine_text'
  | 'everyday_coding'
  | 'complex_agent'
  | 'frontier_escalation'

const modelByWorkload: Record<Workload, string> = {
  routine_text: 'configured-low-cost-model',
  everyday_coding: 'claude-sonnet-5',
  complex_agent: 'claude-opus-5',
  frontier_escalation: 'claude-fable-5',
}

アプリケーションは、要求されたモデルと返されたモデルの両方をログに記録する必要があります。フォールバックが発生した場合は、そのトレースをクリーンな Opus 5 ベンチマークから除外するか、個別にラベルを付けます。

ここで、統合 API が活躍します。価値は 1 つの新しいモデルへのアクセスではありません。その価値は、リリースごとにアプリケーションを書き直すことなく、運用上の決定を変更できることです。選択がモデル プロバイダーにまたがる場合は、ルーティング ポリシーを変更する前に、Claude Opus 5 と GPT-5.6 の比較 を使用してください。

本番準備チェックリスト

実際のトラフィックを Opus 5 に移動する前に:

  • claude-opus-5 が EvoLink アカウントにリストされています。
  • 最小限のリクエストは、期待される response.model を返します。
  • 使用量と請求は文書化されたルートと一致します。
  • 製品が依存している場合、ストリーミングは確認されています。
  • 必要なすべてのツール パスには、有効な要求と結果のトレースがあります。
  • アプリケーションは、拒否と HTTP 失敗を区別します。
  • 再試行可能なエラーと再試行不可能なエラーは異なるポリシーに従います。
  • 既知のフォールバック ルートが存在し、実行されています。
  • 代表的なタスクは複数の作業レベルで再生されました。
  • プロモーションのしきい値は、承認されたタスクのレート、レイテンシ、および成功したタスクのコストを使用します。
  • モデル ID は、ビジネス ロジックではなく構成内に存在します。
  • ロールバック条件は明示的です。

よくある質問

Claude Opus 5 API モデル ID は何ですか?

EvoLink リクエスト モデル ID は claude-opus-5 です。構成内に保持し、運用トラフィックを評価するときに返されたモデルを検証します。
はい。EvoLink Claude Messages API で claude-opus-5 を指定します。現在の製品情報と料金については、Claude Opus 5 モデルページ を確認してください。
ダイレクト EvoLink メッセージ エンドポイント を使用します。 EvoLink では、長時間実行されるリクエストやタイムアウトが重要な作業には直接ベース URL を推奨します。

Claude Opus 5 では思考がデフォルトで有効になっていますか?

はい。 Opus 5 では、thinking フィールドを省略すると、適応的思考がオンのままになります。これは、フィールドが存在しないときに何も考えずに実行された Opus 4.8 リクエストとは異なります。

どの Effort レベルを選ぶべきですか?

難しいコーディングやエージェント作業の場合は xhigh から開始し、その他のインテリジェンスが重要なタスクの場合は high から開始し、コストとレイテンシとして medium または low を評価します。コントロール。 max は、タスク値が制約のないトークンの使用を正当化する場合にのみ使用してください。

Claude Opus 4.8 から移行するにはどうすればよいですか?

モデル ID を更新し、思考のデフォルト、max_tokens、サンプリング パラメータ、プロンプトの長さ、検証手順、サブエージェントの動作、拒否処理、使用量、およびコストを再テストします。移行は文字列の置換ではなく、ワークフローの評価として扱います。

Claude Opus 5 の価格はいくらですか?

Anthropic の公式基本価格は、入力トークン 100 万あたり 5 ドル、出力トークン 100 万あたり 25 ドルで、Opus 4.8 から変わりません。ゲートウェイ ルートの 現在の EvoLink 価格表 を確認し、トークン価格だけではなく、成功したタスクのコストによってモデルを比較します。

ソース

AIコストを89%削減する準備はできましたか?

今すぐEvoLinkを始めて、インテリジェントなAPIルーティングの力を体験してください。