GPT 全模型接口 - Chat Completions 完整参数
- GPT 系列文本模型的 OpenAI 兼容 Chat Completions 接口,通过
model选择具体模型(全部可选值见model参数的对照表) - 全系为推理模型,通过
reasoning_effort控制推理深度;推理 token 计入输出 token 计费 - Prompt 缓存自动生效:命中缓存的输入 token 按更低的缓存价计费
- 支持同步与流式(SSE)两种模式
- 支持文本 + 图像混合输入,以及
function工具调用 - 服务端工具(联网搜索、代码执行、文档检索、MCP)仅在 Responses 接口提供
- 注意 采样类参数(
temperature、top_p、logprobs等)各模型支持范围不同,逐参数见下方说明
https://direct.evolink.ai,对文本模型支持更好,支持长连接;https://api.evolink.ai 是多模态主力地址,对文本模型作为备用地址使用。function 工具调用。stop(停止序列)与 web_search_options 在所有模型上均不支持,传入会返回 400;logit_bias 不适用于本系列模型。temperature、top_p、frequency_penalty、presence_penalty、logprobs、verbosity 各模型支持范围不同,请以上方各参数的说明为准。授权
请求体
要调用的模型:
gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna, gpt-5.5, gpt-5.4, gpt-5.2, gpt-5.1 "gpt-5.6-sol"
对话消息列表,支持多轮上下文与多模态输入。
role 可选 system / developer / user / assistant / tool。
content 可以是字符串,也可以是内容块数组。块类型支持 text(文本)、image_url(图像)两种:
图像
image_url.url传入图片的公网 URLimage_url也可直接写成字符串,等价于{ "url": "..." }detail控制图像解析精度,可选auto(默认)/low/high/original- 图片需能被正常下载,否则返回
400
注意 本接口的块类型与 Responses 接口不同(Responses 用 input_text / input_image),两者不可混用,写错会返回 400。
是否以流式方式返回(SSE 事件流,以 data: [DONE] 结束)。默认 false。
false
生成的最大 token 数(含推理 token)。
注意 本系列模型使用 max_completion_tokens。为兼容旧代码,只传 max_tokens 时会被自动视作 max_completion_tokens;但不要同时传这两个字段,gpt-5.1 / gpt-5.2 / gpt-5.4 上同时传会返回 400。
2048
推理深度控制。可选值随模型不同:
推理 token 按输出 token 计费,并计入 usage.completion_tokens_details.reasoning_tokens。
none, low, medium, high, xhigh "medium"
回答详略程度,可选 low / medium / high。
注意 仅 gpt-5.6-sol / gpt-5.6-terra / gpt-5.6-luna / gpt-5.5 支持;其余模型不支持该参数。
low, medium, high "low"
采样温度,取值 0 ~ 2,值越低输出越确定。
注意 仅 gpt-5.5 / gpt-5.4 / gpt-5.2 / gpt-5.1 支持。gpt-5.6 家族只接受默认值 1,传入其他值会返回 400。
0 <= x <= 20.7
核采样参数,取值 0 ~ 1。建议不要与 temperature 同时调整。
注意 仅 gpt-5.5 / gpt-5.4 / gpt-5.2 / gpt-5.1 支持;gpt-5.6 家族不支持该参数。
0 <= x <= 10.9
频率惩罚,取值 -2 ~ 2。正值按 token 出现频率进行惩罚,降低重复内容的概率。
注意 仅 gpt-5.4 / gpt-5.2 / gpt-5.1 支持;gpt-5.6 家族与 gpt-5.5 不支持该参数。
-2 <= x <= 20.5
存在惩罚,取值 -2 ~ 2。正值鼓励模型讨论新话题。
注意 仅 gpt-5.4 / gpt-5.2 / gpt-5.1 支持;gpt-5.6 家族与 gpt-5.5 不支持该参数。
-2 <= x <= 20.5
是否返回每个输出 token 的对数概率。
注意 仅 gpt-5.4 / gpt-5.2 / gpt-5.1 支持;gpt-5.6 家族与 gpt-5.5 不支持该参数。
true
每个位置返回的候选 token 数量,取值 0 ~ 5,需与 logprobs: true 同时使用。
注意 支持范围同 logprobs。
0 <= x <= 52
生成的候选回复数量,返回 choices 数组中的多个结果。全部 token(含每个候选的输出)都会计费。
1
随机种子。相同的种子与参数组合下,模型会尽量返回一致的结果(尽力而为,不保证完全可复现)。
42
输出格式控制:
{"type": "text"}:默认的自由文本{"type": "json_object"}:返回合法 JSON,要求messages中出现json字样,否则返回400{"type": "json_schema", "json_schema": {...}}:按给定 JSON Schema 输出结构化结果,配合"strict": true强制贴合 schema
工具列表,用于 Function Calling(客户端函数调用,无按次费用)。
服务端工具(联网搜索、代码执行等)不在本接口提供,请改用 Responses 接口。
工具选择控制:"auto"(默认)/ "none" / "required",或用对象指定某个函数,如 {"type": "function", "function": {"name": "get_weather"}}。
none, auto, required 是否允许模型在一轮中并行调用多个工具。默认 true,设为 false 可强制逐个调用。
true
缓存分组键。为同一类前缀相同的请求传入相同的值,可提升 Prompt 缓存命中率。
"app-chat-v1"
终端用户标识,用于区分调用来源。
"user-1024"
响应
对话生成成功(JSON 对象;stream=true 时为 SSE 事件流,以 data: [DONE] 结束)