GPT Image 2.5 Flare & Sunburst が EvoLink で利用可能にGPT Image 2.5 を試す

Claude Haiku 5.5 API

Anthropic の Claude Haiku 5.5(Haiku 5.5 とも検索されます)に EvoLink の統一チャット API からアクセス。統合前にツール利用、構造化出力、プロンプトキャッシュを試せます。

Anthropicテキスト生成利用可能
$0.096 / 100 万入力トークンから$0.100 公式価格-4%
API ドキュメント
適応型思考effort 制御ツール利用構造化出力プロンプトキャッシュChat + Messages API
本番ルート公開中
コンテキスト
コンテキスト 1M · 最大出力 128K
適した用途
大量の分類・情報抽出、ルーティング、サブエージェントのタスク
入力
テキスト + 画像
出力
テキスト · JSON(構造化出力)· ツール呼び出し

Claude Haiku 5.5 を選ぶ

大量の分類、情報抽出、ルーティング、サブエージェントの仕事に向けた Anthropic 最新の Haiku モデルです。プロンプト長によって 2 つの料金表のいずれかが適用され、入力、キャッシュ書き込み、キャッシュ読み取り、出力、Web 検索ツールの 5 つの課金軸を個別に計測します。

Claude Haiku 5.5

Anthropic 最新の Haiku モデル

選択中
モデル ID
claude-haiku-5-5
適した用途

チケットや意図の分類、JSON へのフィールド抽出、リクエストのルーティング、上位モデルの下で動くサブエージェントのステップなど、Sonnet に切り上げなくても Haiku 価格帯のルートでタスクを完了できるはずの、大量かつレイテンシ重視の仕事。

≤ 100K
入力
$0.096 / 1M-4%
6.5 cr / 1M$0.100公式価格
キャッシュ書き込み
$0.120 / 1M-5%
8.1 cr / 1M$0.125公式価格
キャッシュ読み取り
$0.011 / 1M
0.7 cr / 1M
出力
$0.475 / 1M-5%
32.3 cr / 1M$0.500公式価格
> 100K
入力
$0.478 / 1M-4%
32.5 cr / 1M$0.500公式価格
キャッシュ書き込み
$0.596 / 1M-5%
40.5 cr / 1M$0.625公式価格
キャッシュ読み取り
$0.052 / 1M
3.5 cr / 1M
出力
$2.375 / 1M-5%
161.5 cr / 1M$2.500公式価格

すべての料金は 100 万トークンあたりで、USD とクレジットの両方で表示され、お使いのアカウントの現在の価格を反映します。 プロンプトが 100K トークンを超えると、すべてのトークンに長コンテキスト段階(×5)が適用されます。

Claude Haiku 5.5 の料金

統合前に Claude Haiku 5.5 の 1 リクエストあたりの費用を見積もれます。計算機はお使いのアカウントの現在の料金を使い、公式価格は比較用の参考として表示します。

リクエスト計算機

1 リクエスト分のトークン構成と成功したツール呼び出し回数を入力してください。

1 リクエストの推定費用

Claude Haiku 5.5
短コンテキスト料金
USD$0.0003
クレジット0.0164

公式価格の見積 $0.0003 · $0.0001 お得(4%)

入力トークン0.0065 cr
キャッシュ書き込みトークン0 cr
キャッシュ読み取りトークン0.0002 cr
出力トークン0.0097 cr

最低課金:1 リクエストあたり 0.01 クレジット。 プロンプトが 100K トークンを超えると、すべてのトークンに長コンテキスト段階(×5)が適用されます。

予算の目安

現在のトークン構成でのおおよそのリクエスト数。
クレジットを追加
$10
約 39634 リクエスト

手早いテスト向け

$50
約 207317 リクエスト

日常的な開発向け

$100
約 414634 リクエスト

本番評価向け

サーバーサイドツールの料金

Web 検索の可否は選択したルートによって異なり、対応していないルートもあります。web_search を送信する前に対応状況を確認してください。以下の料金は対応ルートにのみ適用されます。
  • ウェブ検索$0.010/ 回0.68 cr / 回

Claude Haiku 5.5 API

EvoLinkの統一ゲートウェイでClaude Haiku 5.5 APIを利用できます。このページで案内する Haiku の現行バージョンは Claude Haiku 5.5 です。EvoLink の統一 API で、大量の分類、情報抽出、ルーティング、サブエージェント呼び出しを実行できます。100 万トークンのコンテキストウィンドウと最大 12.8 万トークンの出力に対応します。10 万トークン以下のプロンプトの料金は、100 万トークンあたり入力 $0.096・出力 $0.475 です。モデル間で同じ API キーを使い、初回リクエスト前に thinking と max_tokens の設定を確認してください。

Claude Haiku 5.5 は EvoLink ではモデル ID claude-haiku-5-5 として Chat Completions · Anthropic Messages で提供され、他のモデルと同じ API キーと残高で使えます。1M のコンテキストウィンドウと最大 128K トークンの出力に加えてツール利用、構造化出力、プロンプトキャッシュを備えています。

Claude Haiku 5.5

Claude Haiku 5.5 の仕様と機能

数値は EvoLink のルート設定に基づき、機能は API が現在提供しているものです。

コンテキストウィンドウ
1M トークン
最大出力
128K トークン
入力
テキスト + 画像
出力
テキスト · JSON(構造化出力)· ツール呼び出し
推論
思考モード(デフォルトでオン)
ツール利用
複数ステップのツール連携を含む Function Calling
プロンプトキャッシュ
キャッシュ書き込み + 読み取りの料金
長コンテキスト段階
プロンプト 100K トークン超で ×5
プロトコル
Chat Completions · Anthropic Messages
モデル ID
claude-haiku-5-5

Claude Haiku 5.5 を既定ルートにすべき場面

Haiku 5.5 は、大量処理やレイテンシ重視の仕事に向けた Anthropic の高速・低コストな Claude です。完了したタスクあたりのコストでルートを選び、プロンプトを変える前にまず effort を調整してください。

大量の分類、ルーティング、情報抽出

チケットへのラベル付け、意図の判定、リクエストの振り分け、ドキュメントからのフィールド抽出と JSON 化に使えます。各プロンプトはコンパクトに保ち、構造化出力か enum 値を返すツールで回答を制約してください。そうすれば応答は短く収まり、リクエストは基本料金表のままになります。

上位モデルの下で動くサブエージェント

Opus や Sonnet のモデルがタスクを計画し、検索やファイル読み取りなどの範囲の狭いステップを Haiku 5.5 で実行します。Anthropic は、Haiku 5.5 が指示への追従とサブエージェントとしての動作の両面で Haiku 4.5 より大幅に優れていると説明しています。評価は完了したステップで行い、単発の応答では判断しないでください。

低レイテンシのチャットとサポートアシスタント

短いシステムプロンプトで、定型的な質問に答え、少数のツールを呼び出します。チャットや短いツールタスクは low effort から始め、長い会話を通じてアシスタントが厳格なルールを守る必要がある場面では effort を上げてください。

別のルートを選ぶべき場合

複数ファイルにまたがるコーディング、長期にわたるエージェント、アナリスト水準の文章作成には Claude Sonnet 5.5 が適しており、その上位が Claude Opus 5.5 です。サンプリングパラメータ、思考予算、アシスタントのプリフィルに依存していて、まだ再テストしていないワークロードは Claude Haiku 4.5 に残してください。

Claude Haiku 5.5 を使う 2 つの方法:EvoLink API または Agent

プロダクトのバックエンドやバッチ処理には EvoLink API を、コーディングや分析のワークフローには Codex・Claude・Gemini から Claude Haiku 5.5 を直接呼び出せます。どちらも同じ EvoLink API キー、残高、モデル ID、リクエスト履歴を共有します。

方法 1

EvoLink API で統合する

向いている用途:プロダクトのバックエンド、バッチ処理、自動化パイプライン

OpenAI 互換の Chat Completions(または Anthropic Messages)リクエストを EvoLink に送り、モデル ID、システムプロンプト、出力予算、ツール、構造化出力を自分で制御します。

  1. 1コンソールで EvoLink API キーを作成する
  2. 2OpenAI または Anthropic の SDK の base URL を EvoLink に向け、上に表示されたモデル ID を選ぶ
  3. 3代表的なリクエストを 1 件送り、usage フィールドで入力・キャッシュ・出力トークンを確認する
  4. 4タスクごとに max_tokens と再試行を設定し、複数ターンでは tool-call の ID と結果を保持する
方法 2

Agent から呼び出す

向いている用途:Codex・Claude・Gemini でのコーディング、レビュー、分析

タスク、含める入力、受け入れ基準を Agent に渡すと、Agent がリクエストを組み立て、EvoLink 経由で Claude Haiku 5.5 を呼び出し、回答をトークン使用量とともに返します。

  1. 1EVOLINK_API_KEY をローカル環境変数に設定する(コードやプロンプトには書かない)
  2. 2タスク、含める入力、期待する出力形式を説明する
  3. 3EvoLink 経由で Claude Haiku 5.5 を呼び出し、送信前にリクエストを表示するよう Agent に指示する
  4. 4回答、トークン使用量、エラー本文を Agent に報告させる

Claude Haiku 5.5 API のコード例とエラー処理

この例は最短で実行できるリクエストです:システムプロンプト、ユーザーメッセージ、出力予算を含む OpenAI 互換の Chat Completions 呼び出し。パラメータとレスポンスの完全なリファレンスは API タブを開いてください。

完全な API ドキュメントを見る
cURL
curl -X POST https://direct.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "messages": [
      { "role": "system", "content": "Classify each support ticket as billing, bug, or how-to. Reply with one word." },
      { "role": "user", "content": "I was charged twice for my subscription." }
    ],
    "max_tokens": 4096
  }'

# Thinking is on by default and counts toward max_tokens, so leave room for
# it. This Chat Completions request returns choices[0].message and usage
# (prompt_tokens, completion_tokens, and cache read / write tokens when
# caching applies).
# For the Anthropic Messages format at /v1/messages, follow the linked
# Claude reference; its request fields and response format are different.

無効なリクエストまたは未対応パラメータ

API リファレンスに照らしてモデル ID、messages 配列、パラメータ範囲を確認し、このルートが対応しないフィールドを削除してください。

認証または残高の問題

Authorization の Bearer トークンを確認し、コンソールで利用可能残高を確かめてください。

コンテキスト長の超過

プロンプトのトークンが Claude Haiku 5.5 のコンテキストウィンドウを超えています。必要な情報だけに絞るか検索で取り出し、キャッシュ済みプレフィックスを再利用してください。

レート制限(429)

バックオフとジッターを入れて再試行し、並列バーストではなくバッチやキューで送ってください。

コンテンツまたはツール呼び出しの拒否

再試行の前に、センシティブな内容、形式不正の tool-call 引数、JSON スキーマの不一致を確認してください。

Claude Haiku 5.5 API 接続前の確認事項

EvoLink のクライアントと API キーは 1 つのままで構いません。ほとんどのリクエストはそのまま使え、以下の 4 ステップで Claude Haiku 4.5 と挙動が異なる設定をカバーします。

01

モデル ID を切り替える

クライアントの接続先を EvoLink にし、同じ API キーのまま claude-haiku-5-5 を選びます。OpenAI 互換の Chat Completions エンドポイントと Anthropic Messages エンドポイントのどちらでも使えます。

移行コスト小
02

思考のための余裕を残す

思考は既定でオンになっており max_tokens に含まれるため、1 語の回答に合わせた上限では、テキストが書かれる前に使い切られることがあります。max_tokens を引き上げるか effort を下げてください。応答が thinking ブロックから始まる場合があるため、content はブロックの種類ごとに読み取ってください。

挙動の変更
03

Haiku 4.5 専用の設定を削除する

Anthropic は Haiku 5.5 で、思考予算、既定値以外のサンプリング値、アシスタントのプリフィルを拒否します。EvoLink は思考予算を effort レベル付きの適応型思考に変換し、temperature、top_p、top_k を取り除きます。プリフィルは構造化出力かシステムプロンプトでの指示に置き換えてください。

破壊的変更
04

プロンプト 10 万トークンの境界に注意する

入力、キャッシュ書き込み、キャッシュ読み取りの合計で料金表が決まります。履歴を切り詰める、検索で取り込む量を減らす、ジョブを分割するなどして、大量のリクエストはプロンプトを 10 万トークン以下に抑えてください。より多くのコンテキストが必要なリクエストには、高い方の料金表で予算を見込んでください。

コスト管理

繰り返し使うコンテキスト向けのプロンプトキャッシュ

安定したシステムプロンプト、ツールスキーマ、参照ドキュメントをキャッシュし、複数のリクエストで再利用できます。書き込みと読み取りは別々に課金されます。Anthropic は Haiku 4.5 と比べてキャッシュ可能なプロンプトの最小長を引き下げたため、より短いプロンプトもキャッシュできるようになりました。キャッシュされたトークンも、料金表を決めるプロンプト長に含まれます。

100 万トークンのコンテキストと、10 万で切り替わる料金表

このルートでは 100 万トークンのコンテキストウィンドウと最大 12.8 万トークンの出力を記録しています。入力、キャッシュ書き込み、キャッシュ読み取りを合わせて 10 万トークン以下のプロンプトには基本料金が適用され、10 万を超えると出力を含むリクエスト全体が 5 倍で課金されます。思考は max_tokens に含まれるため、余裕を残してください。

思考は既定でオン、制御は effort で行う

thinking を指定しないリクエストは適応型思考で動作し、レベルを選ばない限り effort は medium です。思考は出力として課金され、要約を要求しない限りそのテキストは省略されます。thinking: disabled は effort が high 以下であれば引き続き受け付けられますが、Anthropic は代わりに effort を下げることを推奨しています。

適用されなくなった Haiku 4.5 のパラメータ

Anthropic は Haiku 5.5 で、思考予算、既定値以外のサンプリング値、アシスタントのプリフィルを拒否します。EvoLink は互換性のため、思考予算を effort レベル付きの適応型思考に変換し、temperature、top_p、top_k を取り除きます。ツールの強制選択は受け付けられますが、その場合の応答は思考なしでツール呼び出しから始まります。

Claude Haiku 5.5:2 つの料金表と 5 つの課金軸

Claude Haiku 5.5 は単一の混合料金では課金されません。プロンプト長で料金表が決まり、各課金軸は個別に計測され、思考は出力として課金されます。

プロンプト長に応じた入力・出力トークン

10 万トークン以下のプロンプトでは、EvoLink の料金は入力 100 万トークンあたり $0.096、出力 100 万トークンあたり $0.475 で、Anthropic 公式は $0.100 と $0.500 です。プロンプトが 10 万トークンを超えると、リクエスト全体が高い方の料金表に移り、入力 $0.478、出力 $2.375 になります。思考はテキストが返らない場合でも出力として課金されます。

5 分間のキャッシュ書き込みとキャッシュ読み取り

プレフィックスを 5 分間保存する書き込み料金は 100 万トークンあたり $0.120、再利用時の読み取り料金は 100 万トークンあたり $0.011 です。キャッシュされたトークンも、料金表を決めるプロンプト長に含まれます。EvoLink の料金は課金単位の整数値に切り上げられるため、キャッシュ読み取り料金が公式定価をわずかに上回る場合があります。節約額の見積もりには表示料金を使用してください。

Web 検索ツール

web_search 対応ルートでは検索 1 回につき $0.010 で、高い方の料金表の倍率はかかりません。検索結果のトークンは通常の入力として課金されます。接続前にルートの対応状況を確認してください。料金が設定されていても、すべてのルートがこのツールに対応しているとは限りません。

ワークロードで検証してから Claude ルートを比較

EvoLink

まず運用予定の effort レベルで、Haiku 5.5 が自社のタスクで品質を保てるかを確認します。そのうえで料金、コンテキスト、キャッシュ、ワークロード適性を比べて本番ルートを決めてください。

Claude Haiku 5.5
入力 / 出力$0.096 / $0.475
コンテキスト1M
キャッシュ読み取り + 書き込み
適した用途チケットや意図の分類、JSON へのフィールド抽出、リクエストのルーティング、上位モデルの下で動くサブエージェントのステップなど、Sonnet に切り上げなくても Haiku 価格帯のルートでタスクを完了できるはずの、大量かつレイテンシ重視の仕事。
Claude Haiku 4.5
入力 / 出力$0.9 / $4.5
コンテキスト200K
キャッシュ読み取り + 書き込み
適した用途前世代の Haiku。プロンプト長にかかわらず単一の料金で課金されます。サンプリングパラメータや思考予算がまだ必要なワークロードに残してください。
Claude Sonnet 5.5
入力 / 出力$1.9 / $9.5
コンテキスト1M
キャッシュ読み取り + 書き込み
適した用途Anthropic 最新の Sonnet。複数ファイルにまたがるコーディング、ツールを多用するエージェント、Haiku 5.5 では完了できない仕事に向けた一段上の選択肢です。

Claude モデルファミリー

同じ API キーと残高のまま、統合を変えずにティアを切り替えられます。

Claude モデルをすべて比較
Claude Sonnet 5.5

Claude Sonnet 5.5

Anthropic 最新の Sonnet。複数ファイルにまたがるコーディングやツールを多用するエージェントの仕事を Haiku 5.5 では完了できない場合の、一段上の選択肢です。

モデルを見る
Claude Opus 5.5

Claude Opus 5.5

Anthropic 最新の Opus。最も難しい長期にわたるコーディング、ナレッジワーク、視覚分析向けです。

モデルを見る
Claude Fable 5.1

Claude Fable 5.1

Anthropic で最も高性能なモデルで、Opus の上位にあたる Fable 層。最も長く、最も負荷の高いエージェントワークロード向けです。

モデルを見る

Claude Haiku 5.5 以外の EvoLink のテキストモデル

GPT-5.6

GPT-5.6

能力・レイテンシ・コストに応じてルーティングできる OpenAI の階層型フロンティアモデル群。

モデルを見る
Grok 4.5

Grok 4.5

50 万のコンテキストウィンドウとサーバー側検索ツールを備えた xAI の推論・ツール利用ルート。

モデルを見る
Kimi K3

Kimi K3

リポジトリ規模のコーディングや複数ドキュメントの作業に向けた長コンテキスト推論モデル。

モデルを見る
Gemini 3.6 Flash

Gemini 3.6 Flash

大量の本番トラフィックに向けた Google の高速・低コストなルート。

モデルを見る

Claude Haiku 5.5 の関連記事

Claude API 料金ガイド

Claude API 料金ガイド

Claude ファミリー全体で、入力・出力・キャッシュ書き込み・キャッシュ読み取り・ツール料金がどう積み上がるかを解説します。

ガイドを読む
Claude Sonnet 5.5 と Opus 5.5:どちらを選ぶ?

Claude Sonnet 5.5 と Opus 5.5:どちらを選ぶ?

Haiku 5.5 がサブエージェントのステップを担うとき、作業を計画するモデルをどう選ぶかを解説します。

ガイドを読む

Claude Haiku 5.5 API よくある質問

Claude Haiku 5.5はどのようなモデルですか?

このページは、EvoLink でモデル ID "claude-haiku-5-5" として利用できる Claude Haiku 5.5 を扱っています。Haiku はモデルファミリー名です。リクエストでは "haiku" をモデル ID として送らず、正確なバージョンを指定してください。Claude Haiku 4.5 には個別のモデルページと料金があります。

Claude Haiku 5.5 API ではどのモデル ID を使えばよいですか?

model に "claude-haiku-5-5" を指定します。OpenAI 互換の Chat Completions エンドポイントと Anthropic Messages エンドポイントで同じ ID を使えます。

EvoLink での Claude Haiku 5.5 API の料金はいくらですか?

10 万トークン以下のプロンプトでは、EvoLink の料金は入力 100 万トークンあたり $0.096、出力 100 万トークンあたり $0.475 で、Anthropic 公式は $0.100 と $0.500 です。プロンプトが 10 万トークンを超える場合の料金は $0.478 と $2.375 です。

10 万トークンの料金表はどのような仕組みですか?

プロンプト長は、入力トークンにキャッシュ書き込みとキャッシュ読み取りのトークンを加えたものです。10 万以下なら基本料金が適用されます。10 万を超えると、境界を超えた分のトークンだけでなく、入力、出力、キャッシュ書き込み、キャッシュ読み取りを含むリクエスト全体が 5 倍で課金されます。Web 検索の呼び出しに倍率はかかりません。

Claude Haiku 5.5 は Claude Haiku 4.5 より安いですか?

Anthropic の定価では、Haiku 5.5 は 10 万トークン以下のプロンプトで Haiku 4.5 の料金の 10 分の 1、それを超える場合は半額です。Haiku 5.5 は新しいトークナイザーを使っており、同じテキストでもトークン数が約 30% 多くなります。また、思考が既定でオンです。そのため、トークン単価だけでなく、自身のワークロードで完了したタスクあたりのコストを比較してください。

Claude Haiku 5.5 のプロンプトキャッシュはどう課金されますか?

基本料金表では、EvoLink の 5 分間キャッシュ書き込みは 100 万トークンあたり $0.120、キャッシュ読み取りは $0.011 です。Anthropic 公式は $0.125 と $0.010 です。両者は別々に計測され、プロンプトが 10 万トークンを超えるとどちらも 5 倍で課金されます。ワークロードの見積もりには、端数処理を含む表示料金を使用してください。

Claude Haiku 5.5 の Web 検索ツールはどう課金されますか?

web_search 対応ルートでは検索 1 回につき $0.010 です。検索結果のトークンは通常の入力として課金されます。接続前にルートの対応状況を確認してください。料金が設定されていても、すべてのルートがこのツールに対応しているとは限りません。

Claude Haiku 5.5 で思考をオフにできますか?

はい、effort が high 以下であれば、thinking: disabled を送信してオフにできます。xhigh または max では Anthropic が拒否するため、effort レベルを下げるか適応型思考を使ってください。Anthropic は、思考をオフにする代わりに effort を下げることを推奨しています。low effort では、単純なリクエストでモデルが思考を省略できるためです。

Claude Haiku 5.5 ではどの effort レベルを使えばよいですか?

既定値は medium です。Anthropic は、チャット、短いツールタスク、単純な大量リクエストには low、エージェント型コーディングを含むほとんどの仕事には medium、ナレッジワークや厳格な指示への追従には high を勧めています。xhigh と max は、採用を決める前に Claude Sonnet 5.5 と比較してください。

Claude Haiku 4.5 から移行すると何が変わりますか?

モデル ID を変更し、思考予算を適応型思考と effort レベルに置き換え、temperature、top_p、top_k を削除し、アシスタントのプリフィルを置き換えてください。思考は既定でオンのため、content はブロックの種類ごとに読み取り、小さい max_tokens の値を見直してください。トークナイザーは同じテキストでもより多くのトークンを数え、コンテキストは 100 万トークンに、最大出力は 128K に増えます。また、Claude API では computer use に computer toolset が必要です。

短い分類リクエストが、テキストなしで max_tokens に達して止まるのはなぜですか?

思考は max_tokens に含まれます。1 語の回答に合わせた上限は思考だけで使い切られることがあり、その場合、応答は thinking ブロックの後、テキストが出る前に終了します。思考のための余裕を残すように max_tokens を引き上げるか、effort レベルを下げてください。

Claude Haiku 5.5 の拒否応答はどのような形ですか?

安全性分類器がリクエストを拒否することがあります。応答は通常の成功レスポンスで、stop_reason が "refusal" になり、カテゴリが付きます。そのため、content を読む前に stop_reason を確認してください。Anthropic は、拒否された Haiku 5.5 のリクエストを別のモデルで処理し直すことはありません。クライアント側で拒否を処理し、別のプロンプトを試してください。

Claude Haiku 5.5 ではどのプロトコルと SDK が使えますか?

OpenAI 互換の Chat Completions エンドポイントか Anthropic Messages エンドポイントを、同じ EvoLink API キーで利用できます。Claude Code などの Anthropic ネイティブクライアントは、ベース URL を EvoLink に向ければ使えます。

Claude Code サブスクリプションの利用制限は EvoLink 上の Claude Haiku 5.5 API に適用されますか?

Claude のサブスクリプション枠と EvoLink API の課金は別です。EvoLink 経由のリクエストは表示料金で EvoLink 残高を消費し、アカウントとルートの制限は引き続き適用されます。互換クライアントで EvoLink API キーとドキュメント記載のエンドポイントを設定してください。

Claude Haiku 5.5 のコンテキストウィンドウと最大出力はどれくらいですか?

EvoLink のルートでは 1,000,000 トークンのコンテキストウィンドウと、1 回の応答あたり最大 128K トークンの出力を記録しています。思考は max_tokens に含まれ、10 万トークンを超えるプロンプトは高い方の料金表で課金されます。

本番環境で Claude Haiku 5.5 を評価するときは何を測るべきですか?

初回成功率、有効な構造化出力、リトライ回数、タスクあたりのモデルリクエスト数、選んだ effort での出力トークン、キャッシュヒット率、プロンプトが 10 万トークンを超えるリクエストの割合、採用される結果が得られるまでの時間、人手による修正を追跡し、トークン単価だけで判断しないでください。