Skip to main content
POST
BaseURL 说明:默认 BaseURL 为 https://direct.evolink.ai,对文本模型支持更好,支持长连接;https://api.evolink.ai 为备用地址。
使用 POST /v1/responses,通过 model 选择 glm-5.3glm-5.3-flashglm-5.3-flashxglm-5.2。最少需要 modelinput;示例额外设置输出预算与推理档位,便于直接开始。
参数名称与 Chat Completions 不同:输入使用 input,输出上限使用 max_output_tokens,推理强度使用 reasoning.effortglm-5.3glm-5.3-flashglm-5.3-flashx 的实际思考档位为 lowhighmax;兼容 xhighmaxmediumhighminimal / nonelowminimalnone 不会关闭 5.3 系列的思考,思考 token 仍按输出计费。

读取正文

响应的 output 可能同时包含推理、正文和工具调用。遍历 type="message" 中的 output_text 内容块,不要假设第一项就是正文。 假设已将响应 JSON 解析为 response,可以这样提取文本:
为推理预留输出预算max_output_tokens 包含思考与正文,建议从 1024 起按任务调整。若 status="incomplete"incomplete_details.reason="max_output_tokens",请调高上限;预算耗尽时可能只有推理项,没有正文。
工具调用、图像输入、SSE 处理与多轮对话,请查看完整参数文档

授权

Authorization
string
header
必填

在 Authorization 请求头中传入 Bearer YOUR_API_KEY。

请求体

application/json
model
enum<string>
默认值:glm-5.3-flash
必填

选择 GLM 模型。四个型号均支持本接口的文本调用。

不同模型支持的能力有所不同,请查看对应型号的说明。

可用选项:
glm-5.3,
glm-5.3-flash,
glm-5.3-flashx,
glm-5.2
示例:

"glm-5.3-flash"

input
必填

必填。纯文本字符串,或 Responses 输入项数组。数组支持消息、回传的模型输出项与 function_call_output。多轮对话可在每次请求中携带完整历史;系统提示词推荐作为 role=system 消息放在数组首项。图片使用 input_image,仅 glm-5.3-flash 与 glm-5.3-flashx 支持。不要使用 Chat Completions 的 messages / image_url 内容块格式。

示例:

"请用一句话介绍你自己。"

max_output_tokens
integer

本次生成的输出 token 上限,包含推理 token。建议从 1024 起按任务调整。过小可能在思考阶段耗尽预算,只返回 reasoning 项而没有正文;检查 status 和 incomplete_details。不要改写为 max_tokens。

必填范围: x >= 1
示例:

1024

stream
boolean
默认值:false

开启 SSE 流式返回。正文读取 response.output_text.delta 的 delta;成功终态为 response.completed。遇到 response.incomplete、response.failed 或 error 也应结束本轮并处理。不要只等待 [DONE] 或连接断开。

reasoning
object

Responses 使用嵌套 reasoning.effort,而非顶层 reasoning_effort 或 thinking。推理用量包含在 output_tokens 中;简单任务可能返回 reasoning_tokens=0,这不代表支持关闭思考。

响应

生成成功或返回不完整结果;检查 status。流式时返回 text/event-stream。

id
string

本轮响应 ID。用于 previous_response_id 时原样传入。

示例:

"response_demo"

object
string
Allowed value: "response"
created_at
integer

创建时间,Unix 秒。

model
string
示例:

"glm-5.3-flash"

status
enum<string>

completed 表示本轮生成结束,也可能仅有工具调用;incomplete 表示输出不完整。请同时检查 output 和 error。

可用选项:
completed,
incomplete,
failed,
in_progress,
queued
output
object[]

有序输出项。遍历 type=message 的 content 中 type=output_text 的 text 得到正文。reasoning 可能在正文之前;function_call 轮次可能没有正文。不要固定读取 output[0]。

output_text
string

可选的正文聚合字段,可能缺失。通用客户端应遍历 output。

usage
object
error
object | null

响应错误;成功时通常为 null。

incomplete_details
object
metadata
object | null