
Claude Opus 5 APIの使い方:EvoLinkでの本番導入・移行ガイド
claude-opus-5 として利用できます。EvoLink API キーを作成し、EvoLink のダイレクト Messages エンドポイント に Claude Messages リクエストを送信します。このルートは既存の EvoLink Claude Messages API 仕様 を使用するため、すでに Claude ルートを利用しているチームは、別のプロバイダー統合を追加せずに移行できます。response.model、使用量、請求、ストリーミング、ツール動作を確認したうえで、ワークロード単位で段階的にトラフィックを移行します。これにより「ルートが利用可能」と「すべてのアプリケーション経路が導入基準を満たした」を明確に区別できます。max_tokens の関係、Opus 4.8 からの移行で変わる点、拒否や通信障害の処理、そしてコストを考慮した本番ルーティングで Opus 5 をどこに配置すべきかを説明します。Claude Opus 5 API の概要
| フィールド | 検証された値 | なぜそれが重要なのか |
|---|---|---|
| Anthropic モデル ID | claude-opus-5 | API プロバイダーによってサポートされている正確な識別子を使用します。 |
| コンテキストウィンドウ | 100万トークン | 大規模なリポジトリとドキュメント セットは 1 つのモデル コンテキストに収まりますが、利用可能なすべてのコンテキストを送信することが最も安価な設計になることはほとんどありません。 |
| 最大出力 | 128,000 トークン | max_tokens は依然として思考と目に見える出力を制限します。 |
| Thinking | デフォルトで有効 | Thinking を省略していた Opus 4.8 リクエストは、移行後に挙動が変わります |
| Effort レベル | low、medium、high、xhigh、max | Effort は品質、レイテンシ、トークン使用量を調整する主要なパラメータです |
| 公式基本価格 | 入力トークン 100 万あたり 5 ドル、出力トークン 100 万あたり 25 ドル | Opus 4.8 と同じ基本トークン価格 |
| EvoLink Messages エンドポイント | ダイレクト Messages エンドポイント | 長時間実行される Claude リクエストに推奨される EvoLink エンドポイント |
| EvoLink ルート ステータス | 利用可能 | EvoLink Messages API を介して claude-opus-5 を呼び出し、独自のワークロードで本番環境の動作を検証します。 |
実際の要点は単純です。Claude Opus 5 は、EvoLink 経由で呼び出すことができるようになりましたが、パラメータの互換性、請求、操作動作は、完全な運用展開の前に実際のアカウント レベルのリクエストで検証する必要があります。
統合 API を通じて Claude Opus 5 を使用する理由
新しいモデルを呼び出すのは簡単です。発売週以降にアプリケーションの柔軟性を維持するのはより困難です。
チームがすべての Anthropic ネイティブ機能をすぐに必要とし、Claude のみを使用する予定の場合は、直接統合が正しい選択となります。統合ゲートウェイは、アプリケーションがモデルの選択、コストの抑制、フォールバックの保持、または製品全体にモデル固有のコードを広めることなくプロバイダーの切り替えを行う必要がある場合に、より便利になります。
したがって、EvoLink の有用な役割は、すべてのリクエストを Opus 5 リクエストにすることではありません。ルーティング層でモデルの選択を維持するためです。
Application task
-> routing policy
-> selected model
-> Messages API request
-> actual-model and usage verification
-> quality and cost record
-> promote, retry, fall back, or roll backこのアーキテクチャはチームに 4 つの具体的な利点をもたらします。
- 統合された接続面。 アプリケーションは、文書化された 1 つのエンドポイントを通じて Claude 形式のメッセージを送信します。
- 構成可能なモデルの選択。 ビジネス ロジックは
routine_codingやarchitecture_escalationなどのジョブを記述し、構成は現在のモデルを選択します。 - 測定可能なフォールバック。 再試行またはモデル変更は、目に見えないベンチマーク汚染物質ではなく、明示的な運用イベントになります。
- 移行の柔軟性。 次のモデル変更は主にルーティングと評価の決定であり、プロンプト、製品コード、および顧客設定全体の書き換えではありません。
Claude Opus 5 API を初めて呼び出す
1. 製品コードを変更する前にアカウント アクセスを確認する
EvoLink ルートが利用可能です。運用トラフィックを変更する前に、アカウントがそれを呼び出すことができること、および完全なアプリケーション パスが期待どおりに動作することを確認してください。
claude-opus-5が EvoLink アカウントにリストされます。- 最小限のリクエストは HTTP 200 を返します。
response.modelは、予想されるモデルを識別します。- 使用記録と請求金額は、現在の EvoLink の価格設定と一致します。
- ストリーミングやツールなどの必要な機能が同じルートで動作します。
アカウントがルートを公開しない場合、または必要な機能が失敗する場合は、既存のモデルをフォールバックとして保持し、ロールアウト前にアカウントまたは互換性の問題を解決してください。
2. API キーをサーバーに保存します
EvoLink API キーを作成し、サーバー側の環境変数からロードします。
export EVOLINK_API_KEY="your_api_key_here"NEXT_PUBLIC_* 変数でキーを公開しないでください。3. 最小限のリクエストを送信する
最小限のリクエストは、EvoLink の Claude Messages API の形式に従います。
curl --request POST \
--url https://direct.evolink.ai/v1/messages \
--header "Authorization: Bearer $EVOLINK_API_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "claude-opus-5",
"max_tokens": 4096,
"messages": [
{
"role": "user",
"content": "Review this service architecture and identify the three highest-risk failure points."
}
]
}'オプションのパラメータを指定せずに開始します。小さなペイロードは、作業、ツール、ストリーミング、またはキャッシュによってさらに障害モードが追加される前に、認証、ルートの可用性、およびコアのリクエスト コントラクトを分離します。
4. ステータスコードだけでなく応答を確認する
HTTP 応答が成功すると、エンドポイントが何かを返したことを証明します。それ自体では、意図したモデルが要求に応えたこと、またはその結果が Opus 5 の評価に属することを証明するものではありません。
少なくとも次のことを記録します。
response.modelresponse.stop_reason- 入出力の使用法
- リクエストのレイテンシ
- 利用可能な場合は ID をリクエストします
- アプリケーションタスクID
- 再試行とフォールバックの数
次のサーバー側 TypeScript の例では、再試行不可能なクライアント エラーと再試行可能な容量エラーを区別し、型なしの値を使用せずに返されたモデルを検証します。
type Usage = {
input_tokens: number
output_tokens: number
cache_creation_input_tokens?: number
cache_read_input_tokens?: number
}
type TextBlock = {
type: 'text'
text: string
}
type MessageResponse = {
id: string
model: string
stop_reason: string | null
content: TextBlock[]
usage: Usage
}
const RETRYABLE_STATUS = new Set([429, 500, 503, 524])
function isMessageResponse(value: unknown): value is MessageResponse {
if (typeof value !== 'object' || value === null) return false
const record = value as Record<string, unknown>
return (
typeof record.id === 'string' &&
typeof record.model === 'string' &&
Array.isArray(record.content) &&
typeof record.usage === 'object' &&
record.usage !== null
)
}
async function callClaudeOpus5(prompt: string): Promise<MessageResponse> {
const credential = process.env.EVOLINK_API_KEY
if (!credential) throw new Error('EVOLINK_API_KEY is not configured')
for (let attempt = 0; attempt < 3; attempt += 1) {
const response = await fetch('https://direct.evolink.ai/v1/messages', {
method: 'POST',
headers: {
Authorization: `Bearer ${credential}`,
'Content-Type': 'application/json',
},
body: JSON.stringify({
model: 'claude-opus-5',
max_tokens: 4096,
messages: [{ role: 'user', content: prompt }],
}),
signal: AbortSignal.timeout(120_000),
})
if (response.ok) {
const payload: unknown = await response.json()
if (!isMessageResponse(payload)) {
throw new Error('Unexpected Claude Messages API response')
}
if (payload.model !== 'claude-opus-5') {
throw new Error(`Unexpected response model: ${payload.model}`)
}
return payload
}
if (!RETRYABLE_STATUS.has(response.status) || attempt === 2) {
throw new Error(`Claude request failed with HTTP ${response.status}`)
}
const backoffMs = 1_000 * 2 ** attempt + Math.floor(Math.random() * 250)
await new Promise((resolve) => setTimeout(resolve, backoffMs))
}
throw new Error('Claude request exhausted its retry policy')
}これは参照パターンであり、アカウントレベルのテストの代替ではありません。大容量サービスでは、構造化ログ、リクエスト相関、同時実行制御、およびルーティング ポリシーによって選択されたフォールバックを追加します。
Thinking、Effort、max_tokens の関係
Opus 5 は、おなじみのリクエストの動作を変更します。 Thinking はデフォルトでオンになっており、モデルが適用できるコンピューティングの量はエフォートによって制御されます。

| Thinking 設定 | Effort | Anthropic の Opus 5 APIで有効か | 本番運用への影響 |
|---|---|---|---|
| デフォルトまたはアダプティブ | low | はい | 最低コストの評価レーン |
| デフォルトまたはアダプティブ | medium | はい | 有用なコストとレイテンシのベースライン |
| デフォルトまたはアダプティブ | high | はい | API のデフォルトおよび一般的なインテリジェンスに敏感なルート |
| デフォルトまたはアダプティブ | xhigh | はい | 難しいコーディングとエージェント作業の推奨される開始点 |
| デフォルトまたはアダプティブ | max | はい | 追加のトークンの使用が許容される、機能が重要なタスク |
| 無効 | low、medium、または high | はい | 追加の出力とツール呼び出しの検証が必要です。 |
| 無効 | xhigh または max | いいえ | 400 エラーを返す |
xhigh、その他の品質重視のワークロードでは high から始め、評価品質を維持できる範囲で low や medium を試すことを推奨しています。xhigh または max では、Thinking、サブエージェント、ツール呼び出しに十分な余裕を持たせるため、少なくとも 64K の max_tokens から調整します。よくある統合ミスを防ぐための 3 つの詳細:
max_tokensは思考と目に見える出力をカバーします。 思考を持たない Opus 4.8 ルートから継承された上限により、Opus 5 のタスクが予想よりも早く切り捨てられる可能性があります。- Effort だけでは回答の表示量を安定して制御できません。 簡潔な回答や成果物の目標文字数は、プロンプトで明示します。
- プロバイダーのサポートは異なる場合があります。 現在のルートのドキュメントまたは実際のテストでフィールドが受け入れられることを確認した後、
output_config.effortを EvoLink 経由でのみ送信します。
現実的なところでは思考を有効にし続けましょう。 Anthropic は、思考を無効にすると、ツール呼び出しが通常のテキストとして表示されたり、表示される応答で内部 XML のようなタグが露出したりする可能性があると警告しています。
古い前提を引き継がずに Claude Opus 4.8 から移行する
モデル ID の変更は簡単です。
- "model": "claude-opus-4-8"
+ "model": "claude-opus-5"リクエストの移行
thinkingフィールドのないリクエストは、thing をオンにして実行されるようになりました。- 以前何も考えずに実行されていたワークフローの
max_tokensを再確認します。 - 無効化した思考を
xhighまたはmaxと組み合わせないでください。 - 4.8 より前の設定から
temperature、top_p、top_kが残っていないか確認してください。Opus 4.8 の時点でこれらは拒否されており、Opus 5 でも同じ挙動です。 - 繰り返されるプロンプトが以前は短すぎてキャッシュできなかった場合は、新しい 512 トークンのプロンプト キャッシュの最小値をテストします。
stop_reason: "refusal"をアプリケーションの結果として処理します。
プロンプトの移行
Opus 5 は、自身の作業を検証し、進捗状況を説明し、サブエージェントに委任する可能性が高くなります。以前のモデル用に調整されたプロンプトでは、誤ってこれらの動作が倍増する可能性があります。
次の 4 つの方法でプロンプトを更新します。
- 意図した回答または文書の長さを指定します。
- 再確認するための無条件の指示を削除するか、最終検証者を追加します。
- 狭いタスクの範囲を制限します。
- 独立した並行作業が正当化されない限り、サブエージェントの委任には制限を設けます。
ハーネスの移行
生のモデル呼び出しだけでなく、アプリケーション全体を通じて代表的なタスクを再生します。確認:
- ツールの選択と引数
- ストリーミングパーサーの動作
- タイムアウトと再試行の制限
- 拒否対応
- 実際に返されたモデル
- トークンとキャッシュの使用法
- 出力の長さ
- 実際のレビュー担当者または下流チェックによるタスクの承認
ワークロードに応じて Opus 5 を昇格させます。モデルは、日常的な抽出に不必要なコストを追加しながら、困難なアーキテクチャ タスクを改善できます。
ツールの使用、ストリーミング、拒否、およびトランスポートの失敗を処理する
EvoLink Messages API は、ストリーミング、ツール、ツールの選択、使用法、停止理由を公開します。実稼働ループは、200 個の応答ごとに最終応答が含まれると想定するのではなく、応答に基づいて分岐する必要があります。
Send message
-> end_turn: return the answer
-> tool_use: execute the allowed tool and continue
-> refusal: apply the refusal and fallback policy
-> max_tokens: mark the result incomplete
-> transport error: retry only when the error is retryable最大ツール ループ数を設定し、すべてのツール引数を検証し、失敗したタスクを説明するために必要なトレースを保存します。アプリケーション レベルの承認とスキーマ検証を行わずに、モデルで生成されたツール呼び出しを決して実行しないでください。
障害をクラス別に処理します。
| 結果 | 推奨されるアクション |
|---|---|
| 400 無効なリクエスト | モデル、Thinking、Effort、サンプリング、スキーマの各フィールドを修正し、無条件に再試行しない |
| 401認証 | サーバー側の認証情報を修正する |
| 402請求 | クレジットを復元するか、製品の応答を変更します。 |
| 404 モデルが見つかりません | EvoLink モデル列挙型とアカウント アクセスを再確認してください。 |
| 429 レート制限 | ジッターを使用して有界指数バックオフを適用する |
| 503 過負荷です | 厳しい予算内で再試行するか、承認されたフォールバックに移行してください。 |
| 524 タイムアウト | 直接エンドポイントを使用し、長時間タスクのタイムアウトを設定し、追跡されていない作業の重複を回避します。 |
stop_reason: "refusal" | 結果を記録し、ワークロードのフォールバック ポリシーまたはユーザー メッセージ ポリシーを適用します。 |
拒否は、失敗した HTTP リクエストと同じではありません。 Anthropic では、これを Opus 5 の通常の応答結果として文書化しています。自動フォールバックは Anthropic のネイティブ API で利用できる場合がありますが、プロバイダー固有のフィールドをゲートウェイ リクエストに入れる前に、EvoLink を確認してください。
成功したタスクごとのコストを測定する
Claude Opus 5 は、Opus 4.8 と同じ公式の基本トークン価格を維持しますが、定価ではどのルートが安いか制作チームにわかりません。
次の決定指標を使用します。
successful-task cost =
input token cost
+ output token cost
+ retry cost
+ fallback cost
+ tool execution cost
+ human review or repair costmedium、high、xhigh で実行します。文章の流暢さだけでなく、タスクが合格したかを記録してください。高い Effort が再試行や手作業の修正を減らすなら経済的ですが、medium でも合格するタスクでは過剰コストになります。評価表には以下を含める必要があります。
| メトリック | なぜそれが属するのか |
|---|---|
| 承認されたタスク率 | 結果が使用可能かどうかを測定します。 |
| 入力トークンと出力トークンの合計 | モデルの請求書全体を把握 |
| キャッシュの読み取りと書き込み | 繰り返されるコンテキストが再利用されているかどうかを示します。 |
| ツールの呼び出しと失敗 | エージェント ループのオーバーヘッドを明らかにする |
| 再試行とフォールバック | 隠れたマルチリクエストコストを防止 |
| エンドツーエンドの遅延 | インタラクティブフィットとバックグラウンドフィットを分離 |
| 人間によるレビュー時間 | トークンの価格設定が見逃しているクリーンアップをキャプチャ |
単一のプロンプトだけで普遍的な Effort 推奨値を決めないでください。各ワークロードの品質基準を満たす最も低い Effort を選び、失敗コストが高いタスクにだけ上位レベルへのエスカレーションを残します。
ワークロード別に Sonnet、Opus、Fable をルーティングする

| ワークロード | 推奨される出発ルート | エスカレーション信号 |
|---|---|---|
| 分類、抽出、短い書き換え | 低価格モデル | スキーマまたは品質の障害が許容されたしきい値を超えています。 |
| コーディングと制作アシスタントの日常業務 | Claude Sonnet 5 | デバッグの失敗が繰り返される、リポジトリの範囲が広い、または意思決定のリスクが高い |
| 複雑なデバッグ、アーキテクチャ、および長いエージェント ループ | Claude Opus 5 | タスクは未解決のままであり、期待値はプレミアムを正当化します。 |
| 最高難易度の自律作業または知識作業 | Claude Fable 5 | 測定されたタスク値がより高い価格をサポートする場合にのみ使用してください。 |
ルーティングの決定を設定に保存します。
type Workload =
| 'routine_text'
| 'everyday_coding'
| 'complex_agent'
| 'frontier_escalation'
const modelByWorkload: Record<Workload, string> = {
routine_text: 'configured-low-cost-model',
everyday_coding: 'claude-sonnet-5',
complex_agent: 'claude-opus-5',
frontier_escalation: 'claude-fable-5',
}アプリケーションは、要求されたモデルと返されたモデルの両方をログに記録する必要があります。フォールバックが発生した場合は、そのトレースをクリーンな Opus 5 ベンチマークから除外するか、個別にラベルを付けます。
本番準備チェックリスト
実際のトラフィックを Opus 5 に移動する前に:
-
claude-opus-5が EvoLink アカウントにリストされています。 - 最小限のリクエストは、期待される
response.modelを返します。 - 使用量と請求は文書化されたルートと一致します。
- 製品が依存している場合、ストリーミングは確認されています。
- 必要なすべてのツール パスには、有効な要求と結果のトレースがあります。
- アプリケーションは、拒否と HTTP 失敗を区別します。
- 再試行可能なエラーと再試行不可能なエラーは異なるポリシーに従います。
- 既知のフォールバック ルートが存在し、実行されています。
- 代表的なタスクは複数の作業レベルで再生されました。
- プロモーションのしきい値は、承認されたタスクのレート、レイテンシ、および成功したタスクのコストを使用します。
- モデル ID は、ビジネス ロジックではなく構成内に存在します。
- ロールバック条件は明示的です。
よくある質問
Claude Opus 5 API モデル ID は何ですか?
claude-opus-5 です。構成内に保持し、運用トラフィックを評価するときに返されたモデルを検証します。Claude Opus 5 は EvoLink から入手できますか?
claude-opus-5 を指定します。現在の製品情報と料金については、Claude Opus 5 モデルページ を確認してください。どの EvoLink エンドポイントを使用すればよいですか?
Claude Opus 5 では思考がデフォルトで有効になっていますか?
thinking フィールドを省略すると、適応的思考がオンのままになります。これは、フィールドが存在しないときに何も考えずに実行された Opus 4.8 リクエストとは異なります。どの Effort レベルを選ぶべきですか?
xhigh から開始し、その他のインテリジェンスが重要なタスクの場合は high から開始し、コストとレイテンシとして medium または low を評価します。コントロール。 max は、タスク値が制約のないトークンの使用を正当化する場合にのみ使用してください。Claude Opus 4.8 から移行するにはどうすればよいですか?
max_tokens、サンプリング パラメータ、プロンプトの長さ、検証手順、サブエージェントの動作、拒否処理、使用量、およびコストを再テストします。移行は文字列の置換ではなく、ワークフローの評価として扱います。

