跳转到主要内容
POST
BaseURL 说明:默认 BaseURL 为 https://direct.evolink.ai,对文本模型支持更好,支持长连接;https://api.evolink.ai 是多模态主力地址,含图像输入时请使用该地址。会话缓存:Responses 接口通过请求头 x-dashscope-session-cache: enable 开启服务端会话缓存以降低多轮延迟与成本。

授权

Authorization
string
header
必填

##所有接口均需要使用 Bearer Token 进行认证##

获取 API Key

访问 API Key 管理页面 获取您的 API Key

使用时在请求头中添加

请求头

x-dashscope-session-cache
enum<string>
默认值:disable

会话缓存开关。设为 enable 时,服务端自动缓存对话上下文以降低多轮推理延迟与成本。

可用选项:
enable,
disable

请求体

application/json
model
enum<string>
必填

对话模型名称

可用选项:
qwen3.8-max-preview
示例:

"qwen3.8-max-preview"

input
必填

模型输入。可传字符串(纯文本),也可传 Chat 格式的消息数组(支持多模态 input_text / input_image)。

instructions
string

作为系统指令插入到上下文起始位置。使用 previous_response_id 时,上一轮的 instructions 不会传入本轮。

previous_response_id
string

上一轮响应的唯一 ID(响应 id,有效期 7 天)。用于关联多轮对话,服务端自动检索并组合该轮的输入与输出作为上下文。

max_output_tokens
integer

本次生成输出内容的最大 token 数(含思考)。

reasoning
object

思考控制。

store
boolean
默认值:true

是否存储本次响应。

  • true(默认):可被 previous_response_id 引用
  • false:不存储,后续无法引用
stream
boolean
默认值:false

是否以 Responses 事件流式返回。

temperature
number

采样温度,取值范围 [0, 2]

必填范围: 0 <= x <= 2
top_p
number

核采样参数,取值范围 (0, 1]

必填范围: 0 <= x <= 1
tools
object[]

工具列表。支持内置工具(web_search 联网搜索、web_extractor 网页抓取、code_interpreter 代码解释器)及自定义 function

响应

生成成功

id
string

本次响应唯一 ID(有效期 7 天,可作 previous_response_id

示例:

"resp_xxxxxxxx"

object
string
示例:

"response"

status
string

响应状态

示例:

"completed"

model
string
示例:

"qwen3.8-max-preview"

output
object[]

输出项数组(含 message / reasoning / 内置工具调用等)

usage
object

Token 使用统计。