跳转到主要内容
POST
BaseURL 说明:默认 BaseURL 为 https://direct.evolink.ai,对文本模型支持更好,支持长连接;https://api.evolink.ai 是多模态主力地址,含图像 / 音频 / 视频输入时请使用该地址。

授权

Authorization
string
header
必填

##所有接口均需要使用 Bearer Token 进行认证##

获取 API Key

访问 API Key 管理页面 获取您的 API Key

使用时在请求头中添加

请求体

application/json
model
enum<string>
必填

对话模型名称

可用选项:
qwen3.8-max-preview
示例:

"qwen3.8-max-preview"

messages
(System Message · object | User Message · object | Assistant Message · object | Tool Message · object)[]
必填

对话消息列表,支持多轮对话。不同角色(system / user / assistant / tool)的消息字段结构不同,请选择对应角色查看。

enable_thinking
boolean
默认值:false

是否开启深度思考

  • true:模型输出思考过程,通过 reasoning_content 返回
  • false(默认):不输出思考过程

注:部分模型在非流式调用下需显式设置为 true 才返回思考内容。

temperature
number

采样温度,控制输出随机性。较低值更确定、较高值更多样。取值范围 [0, 2]。建议 temperature 与 top_p 不要同时调整。

必填范围: 0 <= x <= 2
top_p
number

核采样(Nucleus Sampling)参数,从累积概率前若干 token 中采样。取值范围 (0, 1]。建议不要同时调整 temperature 和 top_p。

必填范围: 0 <= x <= 1
max_completion_tokens
integer

生成内容长度上限(Token 数),包含思维链和回答。思考类模型推荐使用该参数。默认值与最大值均为模型最大输出长度;超出后以 finish_reason=length 提前停止。

max_tokens
integer

旧版生成长度限制参数。

已弃用:新接入请改用 max_completion_tokens。该参数仅限制回答部分(不含思维链)。

stream
boolean
默认值:false

是否以流式方式返回响应。

  • true:通过 SSE(Server-Sent Events)逐块返回
  • false(默认):一次性返回完整响应
stream_options
object

流式响应选项,仅在 stream=true 时有效。

tools
object[]

工具定义列表,用于 Function Calling。每个工具需定义名称、描述与参数 schema。

响应

对话生成成功

id
string

本次对话的唯一标识

示例:

"chatcmpl-xxxxxxxx"

object
string
示例:

"chat.completion"

created
integer

创建时间(Unix 秒)

示例:

1735120033

model
string
示例:

"qwen3.8-max-preview"

choices
object[]
usage
object

Token 使用统计信息。