Skip to main content
POST
GPT 对话补全(全模型,完整参数)
BaseURL 说明:默认 BaseURL 为 https://direct.evolink.ai,对文本模型支持更好,支持长连接;https://api.evolink.ai 是多模态主力地址,对文本模型作为备用地址使用。
服务端工具(联网搜索、代码执行、文档检索、MCP)仅在 Responses 接口提供;Chat Completions 接口只支持普通 function 工具调用。
注意 本系列全部为推理模型,stop(停止序列)与 web_search_options 在所有模型上均不支持,传入会返回 400logit_bias 不适用于本系列模型。temperaturetop_pfrequency_penaltypresence_penaltylogprobsverbosity 各模型支持范围不同,请以上方各参数的说明为准。

授权

Authorization
string
header
必填

##所有接口均需 Bearer Token 认证##

获取 API Key:

访问 API Key 管理页面 获取你的 API Key

添加到请求头:

请求体

application/json
model
enum<string>
必填

要调用的模型:

可用选项:
gpt-5.6-sol,
gpt-5.6-terra,
gpt-5.6-luna,
gpt-5.5,
gpt-5.4,
gpt-5.2,
gpt-5.1
示例:

"gpt-5.6-sol"

messages
object[]
必填

对话消息列表,支持多轮上下文与多模态输入。

role 可选 system / developer / user / assistant / tool

content 可以是字符串,也可以是内容块数组。块类型支持 text(文本)、image_url(图像)两种:

图像

  • image_url.url 传入图片的公网 URL
  • image_url 也可直接写成字符串,等价于 { "url": "..." }
  • detail 控制图像解析精度,可选 auto(默认)/ low / high / original
  • 图片需能被正常下载,否则返回 400

注意 本接口的块类型与 Responses 接口不同(Responses 用 input_text / input_image),两者不可混用,写错会返回 400

示例:
stream
boolean
默认值:false

是否以流式方式返回(SSE 事件流,以 data: [DONE] 结束)。默认 false

示例:

false

max_completion_tokens
integer

生成的最大 token 数(含推理 token)。

注意 本系列模型使用 max_completion_tokens。为兼容旧代码,只传 max_tokens 时会被自动视作 max_completion_tokens;但不要同时传这两个字段gpt-5.1 / gpt-5.2 / gpt-5.4 上同时传会返回 400

示例:

2048

reasoning_effort
enum<string>

推理深度控制。可选值随模型不同:

推理 token 按输出 token 计费,并计入 usage.completion_tokens_details.reasoning_tokens

可用选项:
none,
low,
medium,
high,
xhigh
示例:

"medium"

verbosity
enum<string>

回答详略程度,可选 low / medium / high

注意gpt-5.6-sol / gpt-5.6-terra / gpt-5.6-luna / gpt-5.5 支持;其余模型不支持该参数。

可用选项:
low,
medium,
high
示例:

"low"

temperature
number

采样温度,取值 0 ~ 2,值越低输出越确定。

注意gpt-5.5 / gpt-5.4 / gpt-5.2 / gpt-5.1 支持。gpt-5.6 家族只接受默认值 1,传入其他值会返回 400

必填范围: 0 <= x <= 2
示例:

0.7

top_p
number

核采样参数,取值 0 ~ 1。建议不要与 temperature 同时调整。

注意gpt-5.5 / gpt-5.4 / gpt-5.2 / gpt-5.1 支持;gpt-5.6 家族不支持该参数。

必填范围: 0 <= x <= 1
示例:

0.9

frequency_penalty
number

频率惩罚,取值 -2 ~ 2。正值按 token 出现频率进行惩罚,降低重复内容的概率。

注意gpt-5.4 / gpt-5.2 / gpt-5.1 支持;gpt-5.6 家族与 gpt-5.5 不支持该参数。

必填范围: -2 <= x <= 2
示例:

0.5

presence_penalty
number

存在惩罚,取值 -2 ~ 2。正值鼓励模型讨论新话题。

注意gpt-5.4 / gpt-5.2 / gpt-5.1 支持;gpt-5.6 家族与 gpt-5.5 不支持该参数。

必填范围: -2 <= x <= 2
示例:

0.5

logprobs
boolean
默认值:false

是否返回每个输出 token 的对数概率。

注意gpt-5.4 / gpt-5.2 / gpt-5.1 支持;gpt-5.6 家族与 gpt-5.5 不支持该参数。

示例:

true

top_logprobs
integer

每个位置返回的候选 token 数量,取值 0 ~ 5,需与 logprobs: true 同时使用。

注意 支持范围同 logprobs

必填范围: 0 <= x <= 5
示例:

2

n
integer
默认值:1

生成的候选回复数量,返回 choices 数组中的多个结果。全部 token(含每个候选的输出)都会计费。

示例:

1

seed
integer

随机种子。相同的种子与参数组合下,模型会尽量返回一致的结果(尽力而为,不保证完全可复现)。

示例:

42

response_format
object

输出格式控制:

  • {"type": "text"}:默认的自由文本
  • {"type": "json_object"}:返回合法 JSON,要求 messages 中出现 json 字样,否则返回 400
  • {"type": "json_schema", "json_schema": {...}}:按给定 JSON Schema 输出结构化结果,配合 "strict": true 强制贴合 schema
tools
object[]

工具列表,用于 Function Calling(客户端函数调用,无按次费用)。

服务端工具(联网搜索、代码执行等)不在本接口提供,请改用 Responses 接口

tool_choice

工具选择控制:"auto"(默认)/ "none" / "required",或用对象指定某个函数,如 {"type": "function", "function": {"name": "get_weather"}}

可用选项:
none,
auto,
required
parallel_tool_calls
boolean
默认值:true

是否允许模型在一轮中并行调用多个工具。默认 true,设为 false 可强制逐个调用。

示例:

true

prompt_cache_key
string

缓存分组键。为同一类前缀相同的请求传入相同的值,可提升 Prompt 缓存命中率。

示例:

"app-chat-v1"

user
string

终端用户标识,用于区分调用来源。

示例:

"user-1024"

响应

对话生成成功(JSON 对象;stream=true 时为 SSE 事件流,以 data: [DONE] 结束)

id
string

本次对话的唯一标识

示例:

"chatcmpl-CvJ2p8mQxK7nR4wS"

object
enum<string>

响应类型

可用选项:
chat.completion
示例:

"chat.completion"

created
integer

创建时间戳

示例:

1786705221

model
string

实际使用的模型名称

示例:

"gpt-5.6-sol"

choices
object[]

生成结果列表(长度等于请求中的 n

usage
object

Token 用量统计。Prompt 缓存自动生效,命中缓存的输入 token 按更低的缓存价计费。