Messages 接口
GLM 全模型接口 - Messages 快速开始
- 使用 Anthropic Messages 协议调用 GLM 系列模型,通过
model参数选择具体型号 - 最少只需
model、max_tokens与messages三个参数(max_tokens在 Anthropic 协议中必填) - 全系列 1M token 上下文窗口,最大输出 131,072 tokens
- 全系列默认开启思考,响应
content里会带type="thinking"块,该部分计入 output token - 需要流式输出、工具调用、图像输入等能力,请查看「完整参数」页
POST
BaseURL 说明:默认 BaseURL 为
https://direct.evolink.ai,对文本模型支持更好,支持长连接;https://api.evolink.ai 是多模态主力地址,对文本模型作为备用地址使用。GLM 系列默认开启思考,响应
content 数组里会带 type="thinking" 块,这部分计入 output token。因此 max_tokens 不宜设得过小,建议不低于 1024,否则可能思考还没结束就被截断、拿不到正文。授权
##所有接口均需要使用 Bearer Token 进行认证##
获取 API Key:
访问 API Key 管理页面 获取您的 API Key
使用时在请求头中添加:
备注:EvoLink 对 /v1/messages 统一采用 Bearer Token 鉴权。
请求体
application/json
要调用的模型:
可用选项:
glm-5.3, glm-5.3-flash, glm-5.2 示例:
"glm-5.3"
本次生成的最大 token 数,Anthropic 协议中为必填。
注意:GLM 系列默认开启思考,思考内容也占用 output token,因此该值不宜过小,建议不低于 1024。
必填范围:
1 <= x <= 131072示例:
1024
对话消息列表,按时间顺序排列。至少包含 1 条消息。
Minimum array length:
1响应
消息对象
Anthropic 风格的消息响应
消息唯一 ID(格式形如 msg_<uuid>)
响应对象类型
可用选项:
message 可用选项:
assistant 实际使用的模型
示例:
"glm-5.3"
响应内容块列表
可能包含的 block type:
thinking:推理过程(思考开启时,默认开启)text:最终回答文本tool_use:模型发起的工具调用
停止原因
end_turn:自然结束(命中 stop_sequences 时也返回此值)max_tokens:达到 max_tokens 上限tool_use:模型触发工具调用
可用选项:
end_turn, max_tokens, tool_use Token 使用统计(Anthropic 规范)