curl --request POST \
--url https://direct.evolink.ai/v1/chat/completions \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "deepseek-v4-flash",
"messages": [
{
"role": "user",
"content": "请介绍一下你自己"
}
]
}
'{
"id": "837f529d-00f9-4731-b2e1-4a54fc31790a",
"object": "chat.completion",
"created": 1777026806,
"model": "deepseek-v4-flash",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "你好!我是 DeepSeek 助手,随时为你解答问题、提供帮助。"
},
"logprobs": null,
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 7,
"completion_tokens": 31,
"total_tokens": 38,
"prompt_tokens_details": {
"cached_tokens": 0
},
"prompt_cache_hit_tokens": 0,
"prompt_cache_miss_tokens": 7
},
"system_fingerprint": "fp_evolink_v4_20260402"
}DeepSeek V4 - OpenAI 兼容接口
- 使用 OpenAI Chat Completions 协议调用 DeepSeek V4 模型
- 支持
deepseek-v4-flash(快速通用)、deepseek-v4-pro(深度推理)和deepseek-v4-flash-vision-exp(图像理解)三个模型 - 纯文本对话:单轮或多轮上下文对话,支持 1M 超长上下文
- 图像理解:
deepseek-v4-flash-vision-exp可在一条消息中混合传入文本与图片,支持多图 - 系统提示词:自定义 AI 的角色和行为
- 思考模式:通过
thinking.type控制深度推理;deepseek-v4-pro思考内容通过reasoning_content返回 - 流式输出:支持 SSE 流式返回
- 工具调用:支持 Function Calling(最多 128 个工具)
- JSON 模式:通过
response_format启用 - 上下文缓存:相同前缀请求自动命中缓存,大幅降低输入成本
未知参数行为:上游对请求体中未识别的顶层字段静默忽略、不报错。参数名拼错不会有任何提示,请以本文档列出的字段为准。
curl --request POST \
--url https://direct.evolink.ai/v1/chat/completions \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "deepseek-v4-flash",
"messages": [
{
"role": "user",
"content": "请介绍一下你自己"
}
]
}
'{
"id": "837f529d-00f9-4731-b2e1-4a54fc31790a",
"object": "chat.completion",
"created": 1777026806,
"model": "deepseek-v4-flash",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "你好!我是 DeepSeek 助手,随时为你解答问题、提供帮助。"
},
"logprobs": null,
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 7,
"completion_tokens": 31,
"total_tokens": 38,
"prompt_tokens_details": {
"cached_tokens": 0
},
"prompt_cache_hit_tokens": 0,
"prompt_cache_miss_tokens": 7
},
"system_fingerprint": "fp_evolink_v4_20260402"
}https://direct.evolink.ai,对文本模型支持更好,支持长连接;https://api.evolink.ai 是多模态主力地址,对文本模型作为备用地址使用。授权
##所有接口均需要使用 Bearer Token 进行认证##
获取 API Key:
访问 API Key 管理页面 获取您的 API Key
使用时在请求头中添加:
Authorization: Bearer YOUR_API_KEY
请求体
对话模型名称
deepseek-v4-flash:快速通用模型,1M 上下文deepseek-v4-pro:深度推理模型,擅长数学、编程和复杂逻辑deepseek-v4-flash-vision-exp:在 Flash 基础上增加原生图像理解的实验性模型,文本能力、参数与计费均与 Flash 一致
提示:三个模型 均默认启用 thinking,响应会包含 reasoning_content,可通过 thinking.type="disabled" 关闭以降低输出 token 成本。
图片仅 deepseek-v4-flash-vision-exp 支持:向 deepseek-v4-flash / deepseek-v4-pro 传图片会返回 400 This model does not support image。
实验性说明:-exp 为上游标记的实验版本,模型名与可用性可能变动,建议在业务中做好降级预案。
deepseek-v4-flash, deepseek-v4-pro, deepseek-v4-flash-vision-exp "deepseek-v4-flash"
对话消息列表,支持多轮对话
不同角色的消息具有不同的字段结构,请选择对应角色查看
1- System Message
- User Message
- Assistant Message
- Tool Message
Show child attributes
Show child attributes
思考模式控制(V4 新增)
说明:
- 用于控制深度思考(Chain of Thought)功能
- 两个模型均默认启用(
type=enabled) - 启用后,推理过程会通过
choices[].message.reasoning_content返回,并按输出 token 计费
多轮对话/工具调用注意:若本轮响应带有 reasoning_content,下一轮请求的 messages 历史中对应的 assistant 消息必须原样回传该字段,否则接口会返回 400 The reasoning_content in the thinking mode must be passed back to the API。若不想处理,可整会话显式 thinking.type="disabled"。
Show child attributes
Show child attributes
采样温度,控制输出的随机性
说明:
- 较低值(如 0.2):更确定、更聚焦的输出
- 较高值(如 1.5):更随机、更有创意的输出
- 默认值:1
0 <= x <= 21
核采样(Nucleus Sampling)参数
说明:
- 控制从累积概率前多少的 token 中采样
- 例如 0.9 表示从累积概率达到 90% 的 token 中选择
- 默认值:1.0(考虑所有 token)
建议:不要同时调整 temperature 和 top_p
0 <= x <= 11
限制生成内容的最大 token 数量
说明:
- V4 系列最大可达 384,000 tokens
- 开启 thinking 时,reasoning_tokens 也计入 max_tokens 上限
- 不设置则由模型自行决定生成长度
1 <= x <= 3840004096
指定响应格式
说明:
- 设置为
{"type": "json_object"}可启用 JSON 模式 - JSON 模式下模型会输出合法的 JSON 格式内容
- 建议在 system 或 user 消息中明确要求输出 JSON,以获得最佳效果
Show child attributes
Show child attributes
停止序列,模型遇到这些字符串时会停止生成
说明:
- 可以是单个字符串或字符串数组
- 最多支持 16 个停止序列
是否以流式方式返回响应
true:流式返回,通过 SSE(Server-Sent Events)逐块实时返回内容false:等待完整响应后一次性返回(默认)
false
流式响应选项
仅在 stream=true 时有效
Show child attributes
Show child attributes
工具定义列表,用于 Function Calling
说明:
- 最多支持 128 个工具定义
- 每个工具需要定义名称、描述和参数 schema
128Show child attributes
Show child attributes
控制工具调用行为
可选值:
none:不调用任何工具auto:模型自动决定是否调用工具(默认,当提供 tools 时)required:强制模型调用一个或多个工具- 对象形式
{"type":"function","function":{"name":"xxx"}}:指定调用某个工具
默认值:未提供 tools 时为 none,提供 tools 时为 auto
none, auto, required 是否返回 token 的对数概率
说明:
- 设置为
true时,响应中会包含每个 token 的对数概率信息
返回概率最高的前 N 个 token 的对数概率
说明:
- 需要
logprobs设置为true - 取值范围:
[0, 20]
0 <= x <= 20响应
对话生成成功
对话完成的唯一标识符
"53c548dc-ec02-4a2f-bbb6-eca4184630b8"
实际使用的模型名称
"deepseek-v4-flash"
响应类型
chat.completion "chat.completion"
创建时间戳(Unix 秒)
1777021417
对话生成的选择列表
Show child attributes
Show child attributes
Token 使用统计信息(含缓存与推理分项)
Show child attributes
Show child attributes
系统指纹标识
"fp_evolink_v4_20260402"