Skip to main content
POST
Grok チャット補完(全モデル、完全なパラメータ)
BaseURL:デフォルトの BaseURL は https://direct.evolink.ai で、テキストモデルへの対応が優れており、長時間接続をサポートします。https://api.evolink.ai はマルチモーダルの主力エンドポイントで、テキストモデルに対しては代替アドレスとして使用されます。
このページでは通常の function 呼び出しを説明します。サーバーサイドツール(ウェブ検索、X 検索、コード実行、添付ファイル検索、コレクション検索)には、設定と課金を説明している Responses API を推奨します。

Grok 4.7 の利用方法

model を grok-4.7 に設定し、既存の messages リクエスト形式をそのまま使います。コンテキストウィンドウは 500,000 トークン、知識のカットオフは 2026 年 5 月です。 トップレベルの reasoning_effort パラメータを使います。推論の深さ:low / medium / high(デフォルト)/ xhigh。推論は無効化できません。grok-4.7 と grok-4.6 は xhigh に対応し、grok-4.5 はこの値を受け付けますが high として扱います。推論トークンは出力トークンとして課金されます。 prompt_cache_key は同じプロンプト接頭辞を持つリクエストに安定したキャッシュルーティングのヒントを与えますが、ヒットは保証しません。実際のヒット数は usage.prompt_tokens_details.cached_tokens で確認してください。複数ターンで暗号化された推論を保持するには Responses API を使ってください。

承認

Authorization
string
header
必須

##すべてのAPIにBearer Token認証が必要です##

APIキーの取得:

APIキー管理ページにアクセスしてAPIキーを取得してください

リクエストヘッダーに追加:

ボディ

application/json
model
enum<string>
必須

呼び出すモデル:

利用可能なオプション:
grok-4.7,
grok-4.6,
grok-4.5
例:

"grok-4.7"

messages
object[]
必須

チャットメッセージのリスト。system、user、assistant のロールに対応します。

Minimum array length: 1
例:
stream
boolean
デフォルト:false

ストリーミングでレスポンスを返すかどうか(SSE、chat.completion.chunk イベント)。デフォルトは false。

例:

false

max_tokens
integer

生成するトークンの最大数。

例:

1024

reasoning_effort
enum<string>
デフォルト:high

推論の深さ:low / medium / high(デフォルト)/ xhigh。推論は無効化できません。grok-4.7 と grok-4.6 は xhigh に対応し、grok-4.5 はこの値を受け付けますが high として扱います。推論トークンは出力トークンとして課金されます。

利用可能なオプション:
low,
medium,
high,
xhigh
temperature
number

サンプリング温度(0-2)。値を大きくすると出力がよりランダムになります。

例:

0.7

top_p
number

Nucleus サンプリングのパラメータ(0-1)。

例:

0.95

tools
object[]

このページでは通常の OpenAI function ツール定義を説明します(クライアント側の関数呼び出しで、サーバーサイドツールの呼び出し料金はかかりません)。ウェブ検索や X 検索などの設定と使用量については Responses API を参照してください。

tool_choice

関数の選択を制御します:"auto" / "none" / "required"、または特定の関数を指定するオブジェクト。

利用可能なオプション:
auto,
none,
required
prompt_cache_key
string

任意のキャッシュルーティングキー。同一会話や同じプロンプト接頭辞を共有するリクエストで安定した値を使うと、キャッシュヒットの可能性を高められます。ヒットは保証されず、キャッシュの課金規則も変わりません。実際のヒット数は usage 内の cached_tokens で確認してください。

例:

"grok-session-001"

レスポンス

チャット補完が正常に生成されました(JSON オブジェクト、または stream=true の場合は chat.completion.chunk イベントの SSE ストリーム)

id
string

チャット補完の一意の識別子

例:

"chatcmpl-20260812164515123456789AbCdEfGh"

model
string

実際に使用されたモデル名

例:

"grok-4.7"

object
enum<string>

レスポンスタイプ

利用可能なオプション:
chat.completion
例:

"chat.completion"

created
integer

作成タイムスタンプ

例:

1786538000

choices
object[]

チャット補完選択肢のリスト

usage
object

トークン使用統計。プロンプトが 200K トークン以上の場合、すべてのトークン種別(入力、キャッシュ入力、出力)が 2 倍で課金されます。