Skip to main content
POST
BaseURL:デフォルトの BaseURL は https://direct.evolink.ai で、テキストモデルへの対応が優れており、長時間接続をサポートします。https://api.evolink.ai はマルチモーダルサービスの主力エンドポイントで、テキストモデルに対しては代替アドレスとして使用されます。
POST /v1/responses を使用し、model でモデルを選択します。必須フィールドは model と input です。例では使い始めやすいように、出力上限と推論強度も指定しています。
Responses はトップレベルの reasoning_effortthinking ではなく、ネストした reasoning.effort を使用します。思考の使用量は output_tokens に含まれます。簡単なタスクで reasoning_tokens=0 が返っても、思考の無効化に対応することを意味しません。推論強度。low を推奨します。glm-5.3 / glm-5.3-flash / glm-5.3-flashx の互換ルールminimalnone は 5.3 シリーズの思考を無効にしません。 思考トークンは出力として課金されます。認識されない値は互換変換せず、そのまま扱われます。表の値を使用してください。これらの互換ルールは glm-5.2 には適用されません。このエンドポイントでは glm-5.2none を指定しても思考トークンが生成される場合があり、思考の無効化は保証されません。

本文を読み取る

順序付き出力項目。type=message の content 内にある type=output_text の text が本文です。reasoning が本文より前に来る場合や、function_call のターンに本文がない場合があります。常に output[0] を読む実装は避けてください。 応答 JSON を response に解析した後、次のように本文を抽出できます。
今回の生成の出力トークン上限。思考トークンも含みます。1024 を目安にタスクに応じて調整してください。少なすぎると思考中に上限に達し、reasoning 項目のみで本文が返らない場合があります。status と incomplete_details を確認してください。パラメータ名は max_tokens ではなく max_output_tokens です。
ツール呼び出し、画像入力、SSE 処理、複数ターンの会話は完全なパラメータを参照してください。

承認

Authorization
string
header
必須

Authorization ヘッダーに Bearer YOUR_API_KEY を指定します。

ボディ

application/json
model
enum<string>
デフォルト:glm-5.3-flash
必須

GLM モデルを選択します。4 モデルともこのエンドポイントのテキスト入力に対応します。オプション機能はモデルによって異なります。

利用可能なオプション:
glm-5.3,
glm-5.3-flash,
glm-5.3-flashx,
glm-5.2
:

"glm-5.3-flash"

input
必須

必須。テキスト文字列、または Responses 入力項目の配列。配列にはメッセージ、モデル出力の再送項目、function_call_output を含められます。複数ターンでは毎回すべての履歴を送信できます。システムプロンプトは先頭の role=system メッセージに置くことを推奨します。画像は input_image を使用し、glm-5.3-flash と glm-5.3-flashx のみ対応します。Chat Completions の messages / image_url ブロック形式は使用しないでください。

:

"自己紹介を一文でしてください。"

max_output_tokens
integer

今回の生成の出力トークン上限。思考トークンも含みます。1024 を目安にタスクに応じて調整してください。少なすぎると思考中に上限に達し、reasoning 項目のみで本文が返らない場合があります。status と incomplete_details を確認してください。パラメータ名は max_tokens ではなく max_output_tokens です。

必須範囲: x >= 1
:

1024

stream
boolean
デフォルト:false

SSE ストリーミングを有効にします。本文は response.output_text.delta の delta から読み取ります。成功時の終了イベントは response.completed です。response.incomplete、response.failed、error でもそのターンを終了して処理してください。[DONE] や接続終了だけを待たないでください。

reasoning
object

Responses はトップレベルの reasoning_effort や thinking ではなく、ネストした reasoning.effort を使用します。思考の使用量は output_tokens に含まれます。簡単なタスクで reasoning_tokens=0 が返っても、思考の無効化に対応することを意味しません。

レスポンス

生成完了または不完全な結果。status を確認してください。ストリーミングでは text/event-stream を返します。

id
string

今回の応答 ID。previous_response_id にはそのまま指定します。

:

"response_demo"

object
string
Allowed value: "response"
created_at
integer

作成時刻。Unix 秒単位。

model
string
:

"glm-5.3-flash"

status
enum<string>

completed は今回の生成終了を示し、ツール呼び出しのみの場合もあります。incomplete は出力が不完全であることを示します。output と error を両方確認してください。

利用可能なオプション:
completed,
incomplete,
failed,
in_progress,
queued
output
object[]

順序付き出力項目。type=message の content 内にある type=output_text の text が本文です。reasoning が本文より前に来る場合や、function_call のターンに本文がない場合があります。常に output[0] を読む実装は避けてください。

output_text
string

本文を集約したオプションフィールド。存在しない場合があります。汎用クライアントでは output を走査してください。

usage
object
error
object | null

応答エラー。成功時は通常 null です。

incomplete_details
object
metadata
object | null