跳转到主要内容
POST
BaseURL 说明:默认 BaseURL 为 https://direct.evolink.ai,对文本模型支持更好,支持长连接;https://api.evolink.ai 是多模态主力地址,含图像输入时请使用该地址。

授权

Authorization
string
header
必填

##所有接口均需要使用 Bearer Token 进行认证##

获取 API Key

访问 API Key 管理页面 获取您的 API Key

使用时在请求头中添加

请求体

application/json
model
enum<string>
必填

对话模型名称

可用选项:
qwen3.8-max-preview
示例:

"qwen3.8-max-preview"

max_tokens
integer
必填

生成内容的最大 token 数。

必填(Anthropic 协议要求)。若模型生成超过该值将被截断。

示例:

1024

messages
object[]
必填

对话消息列表(不含 system)。每条消息含 roleuser / assistant)与 content(字符串或内容块数组)。

system

系统提示词。纯文本时传字符串;需声明显式缓存时传内容块数组(在块上加 cache_control)。

temperature
number

采样温度,取值范围 [0, 2]

必填范围: 0 <= x <= 2
top_p
number

核采样参数,取值范围 (0, 1]

必填范围: 0 <= x <= 1
top_k
integer

从概率最高的 K 个 token 中采样。

stop_sequences
string[]

自定义停止序列,命中后停止生成。

stream
boolean
默认值:false

是否以 Anthropic SSE 事件流式返回。

thinking
object

深度思考配置。开启后模型以 thinking 内容块返回思考过程。

tools
object[]

工具定义列表(Anthropic tools 格式),用于 Function Calling。

响应

生成成功

id
string
示例:

"msg_xxxxxxxx"

type
string
示例:

"message"

role
string
示例:

"assistant"

model
string
示例:

"qwen3.8-max-preview"

content
object[]

回复内容块数组

stop_reason
string

停止原因:end_turn(正常结束)、max_tokens(达到上限)、stop_sequence(命中停止序列)、tool_use(需要调用工具)

示例:

"end_turn"

usage
object

Token 使用统计(Anthropic 语义:input_tokens 不含缓存,与 cache 字段互斥相加)。