curl --request POST \
--url https://direct.evolink.ai/v1/responses \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "grok-4.7",
"input": "プロンプトキャッシュとは何かを一文で説明してください。",
"reasoning": {
"effort": "xhigh"
},
"max_output_tokens": 2048,
"prompt_cache_key": "grok-session-001"
}
'{
"id": "55d44212-8d5e-90cc-975f-36d341ce21f5",
"object": "response",
"status": "completed",
"model": "grok-4.7",
"created_at": 1786538000,
"output": [
{
"id": "<string>",
"type": "web_search_call",
"status": "completed",
"content": [
{}
],
"encrypted_content": "<string>"
}
],
"usage": {
"input_tokens": 10329,
"output_tokens": 299,
"total_tokens": 10628,
"input_tokens_details": {
"cached_tokens": 6016
},
"output_tokens_details": {
"reasoning_tokens": 128
},
"num_server_side_tools_used": 2,
"server_side_tool_usage_details": {
"web_search_calls": 2,
"x_search_calls": 0,
"code_interpreter_calls": 0,
"document_search_calls": 0,
"file_search_calls": 0,
"mcp_calls": 0,
"x_posts_fetched": 0,
"x_users_fetched": 0
}
}
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient quota",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/billing"
}
}{
"error": {
"code": 429,
"message": "Rate limit exceeded",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Internal server error",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 503,
"message": "Service temporarily unavailable",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}Grok 全モデルインターフェース - Responses 完全なパラメータ
- xAI Grok テキストモデル向けの OpenAI 互換 Responses エンドポイント。モデルは
modelパラメータで選択(全指定値はmodelパラメータの対照表を参照) - コンテキストウィンドウ 500K トークン。プロンプトが 200K トークン以上になると、すべてのトークン種別が 2 倍の料金で課金されます
- プロンプトキャッシュは自動的に有効:キャッシュにヒットした入力トークンはより安いキャッシュ料金で課金されます
- 同期モードとストリーミング(SSE)モードに対応
- xAI のサーバーサイドツールは xAI のインフラ上で実行されます:
web_search、x_search、code_execution、attachment_search、collections_search。X Search は取得した投稿数とユーザープロフィール数に基づき、それ以外は成功した呼び出し回数に基づいて課金されます。 - 通常の
functionツール(クライアント側の関数呼び出し)にも対応し、呼び出しごとの追加料金はかかりません - xAI の公式仕様では、
grok-4.7はデフォルトでencrypted_contentを含むreasoning項目を返します。実際に返されるフィールドは利用する接続先のレスポンスを確認してください。
curl --request POST \
--url https://direct.evolink.ai/v1/responses \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "grok-4.7",
"input": "プロンプトキャッシュとは何かを一文で説明してください。",
"reasoning": {
"effort": "xhigh"
},
"max_output_tokens": 2048,
"prompt_cache_key": "grok-session-001"
}
'{
"id": "55d44212-8d5e-90cc-975f-36d341ce21f5",
"object": "response",
"status": "completed",
"model": "grok-4.7",
"created_at": 1786538000,
"output": [
{
"id": "<string>",
"type": "web_search_call",
"status": "completed",
"content": [
{}
],
"encrypted_content": "<string>"
}
],
"usage": {
"input_tokens": 10329,
"output_tokens": 299,
"total_tokens": 10628,
"input_tokens_details": {
"cached_tokens": 6016
},
"output_tokens_details": {
"reasoning_tokens": 128
},
"num_server_side_tools_used": 2,
"server_side_tool_usage_details": {
"web_search_calls": 2,
"x_search_calls": 0,
"code_interpreter_calls": 0,
"document_search_calls": 0,
"file_search_calls": 0,
"mcp_calls": 0,
"x_posts_fetched": 0,
"x_users_fetched": 0
}
}
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient quota",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/billing"
}
}{
"error": {
"code": 429,
"message": "Rate limit exceeded",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Internal server error",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 503,
"message": "Service temporarily unavailable",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}https://direct.evolink.ai で、テキストモデルへの対応が優れており、長時間接続をサポートします。https://api.evolink.ai はマルチモーダルの主力エンドポイントで、テキストモデルに対しては代替アドレスとして使用されます。Grok 4.7 の利用方法
model を grok-4.7 に設定します。コンテキストウィンドウは 500,000 トークン、知識のカットオフは 2026 年 5 月です。推論の深さは reasoning.effort で指定し、low、medium、high(デフォルト)、xhigh に対応します。推論は無効化できません。
xAI の暗号化された推論の仕様では、4.7 は明示的な include なしで、encrypted_content を持つ reasoning 項目を output に返します。会話履歴を自分で管理する場合は、完全な reasoning 項目を他の履歴出力とともに変更せず次の input に渡してください。暗号文をデコードしたり変更したりしないでください。実際のレスポンスに含まれるフィールドを確認してください。
X Search の課金
X Search の新しい課金規則は Grok 4.5、4.6、4.7 に適用されます。1 回の検索で複数の投稿とプロフィールを取得する場合があり、親投稿や引用投稿も数えます。たとえば投稿 30 件とプロフィール 3 件を取得すると、ツール料金は30 × 0.005 USD + 3 × 0.01 USD = 0.18 USD となり、別途トークン料金がかかります。
取得数は usage.server_side_tool_usage_details.x_posts_fetched と x_users_fetched で確認します。両方のフィールドがないレスポンスは、互換処理として成功した呼び出し回数で課金されます。x_search_calls は呼び出し回数、max_tool_calls は回数の制御値であり、実際の制限効果は接続先によって異なります。どちらも取得数や料金の上限にはなりません。x_users_fetched は使用量フィールドであり、追加のツール宣言は不要です。
image_generation は現在 Grok 4.5、4.6、4.7 で利用できません。互換性のため宣言は受け付けますが、モデルに届く前にツールが削除されます。認識されない tools[].type は 400 を返します。承認
##すべてのAPIにBearer Token認証が必要です##
APIキーの取得:
APIキー管理ページにアクセスしてAPIキーを取得してください
リクエストヘッダーに追加:
Authorization: Bearer YOUR_API_KEY
ボディ
呼び出すモデル:
| モデル ID | 位置づけ |
|---|---|
grok-4.7 | xAI の推論・ツール呼び出しモデル。500K トークンのコンテキストウィンドウ。xhigh 対応。知識のカットオフ:2026-05 |
grok-4.6 | xAI の推論 + ツール呼び出しモデル、コンテキストウィンドウ 500K;xhigh 推論レベルに追加対応;知識のカットオフは 2026-02-01 |
grok-4.5 | xAI の推論 + ツール呼び出しモデル、コンテキストウィンドウ 500K;推論レベルは high まで(xhigh は受理されますが high に降格されます) |
grok-4.7, grok-4.6, grok-4.5 "grok-4.7"
モデルへの入力:単純な文字列、または OpenAI Responses の入力アイテムの配列(例:{"role":"user","content":[...]})。
"Search the web for the latest SpaceX launch and summarize it in one sentence."
SSE によるストリーミング出力の有無。デフォルトは false。終端レスポンスの status と usage を確認してください。completed は生成完了を表し、出力上限などに達した場合は incomplete になることがあります。response.completed イベントだけを待たないでください。
false
生成するトークンの最大数(推論トークンを含む)。
2048
推論の深さをオブジェクトで指定します:{"effort": "low" | "medium" | "high" | "xhigh"}。デフォルトは high で、推論は無効化できません。grok-4.7 と grok-4.6 は xhigh に対応し、grok-4.5 は high として扱います。推論トークンは出力トークンとして課金され、usage.output_tokens_details.reasoning_tokens に記録されます。
Show child attributes
Show child attributes
ツールの宣言。サーバーサイドツール料金はトークン料金に加算され、長いコンテキストの料金倍率は適用されません:
| ツールの種類 | 機能 | 課金単位と料金 |
|---|---|---|
web_search | ウェブ検索とページ閲覧 | 成功した呼び出し 1 回あたり 0.005 米ドル |
x_search | X の投稿・アカウント・話題を検索 | 取得した投稿 1 件あたり 0.005 米ドル + プロフィール 1 件あたり 0.01 米ドル |
code_execution | サンドボックスで Python を実行(別名:code_interpreter) | 成功した呼び出し 1 回あたり 0.005 米ドル |
attachment_search | 会話の添付ファイルを検索(入力にファイルがある場合は自動で有効になることがあります) | 成功した呼び出し 1 回あたり 0.01 米ドル |
collections_search | アップロード済みの文書コレクションを検索(別名:file_search) | 成功した呼び出し 1 回あたり 0.0025 米ドル |
X Search の新しい課金方式は grok-4.5、grok-4.6、grok-4.7 に適用されます。1 回の呼び出しで複数の投稿が返る場合があり、検索やスレッド取得で返る親投稿・引用投稿も数えます。実際の使用量は usage.server_side_tool_usage_details を参照してください。2 つの取得数フィールドが両方ともない場合は、互換処理として成功した呼び出し回数で課金します。
通常の function ツールにも対応します(クライアント側の関数呼び出しで、サーバーサイドツールの呼び出し料金はかかりません)。
image_generation は現在 Grok 4.5、4.6、4.7 で利用できません。互換性のため宣言は受け付けますが、モデルに届く前にツールが削除されます。認識されない tools[].type は 400 を返します。
Show child attributes
Show child attributes
[{ "type": "web_search" }]
ツールの選択を制御します:"auto"(デフォルト)/ "none" / "required"、または特定のツールを指定するオブジェクト(例:{"type": "web_search"})。
auto, none, required 任意のキャッシュルーティングキー。同一会話や同じプロンプト接頭辞を共有するリクエストで安定した値を使うと、キャッシュヒットの可能性を高められます。ヒットは保証されず、キャッシュの課金規則も変わりません。実際のヒット数は usage 内の cached_tokens で確認してください。
"grok-session-001"
追加で返すレスポンスフィールド。たとえば grok-4.6 では ["reasoning.encrypted_content"] で暗号化された推論を要求できます。xAI の仕様では grok-4.7 は明示的な include なしでデフォルトで返します。
["reasoning.encrypted_content"]
ツール呼び出し回数の制御値。ゲートウェイはこの値を転送し、ツール料金の事前確保額の見積もりに使います。接続先が回数を厳密に制限するかどうかは、実際の動作で確認する必要があります。X の投稿やユーザープロフィールの取得数は制限されず、料金の上限にもなりません。
1
レスポンス
レスポンスが返されました。status も確認してください。生成完了は completed、出力上限などによる未完了は incomplete、失敗は failed です。stream=true の場合は SSE ストリームとなるため、終端レスポンスの status と usage を読み取ってください。
レスポンスの一意の識別子
"55d44212-8d5e-90cc-975f-36d341ce21f5"
レスポンスタイプ
response "response"
応答ステータス
completed, incomplete, failed "completed"
実際に使用されたモデル名
"grok-4.7"
作成タイムスタンプ
1786538000
生成順に並ぶ出力項目:reasoning 項目(暗号化された推論を含む場合があります)、サーバーサイドツールの呼び出し項目、function_call 項目、output_text を含む message 項目。ツール使用量は usage に基づきます。1 回の x_search 呼び出しで複数の投稿やプロフィールの料金が発生する場合があります。
Show child attributes
Show child attributes
トークンとツールの使用統計。プロンプトが 200K トークン以上の場合、すべてのトークン種別が 2 倍で課金されます。ツール料金は倍率の影響を受けません。
Show child attributes
Show child attributes