GPT Image 2.5 Flare 与 Sunburst 已上线 EvoLink立即体验

DeepSeek V4 Pro API

通过 EvoLink 统一对话 API 接入 DeepSeek 的 V4 Pro(也常被搜索为 DeepSeek V4)。集成前可先测试推理、长上下文编程、提示缓存。

DeepSeek文本生成可用
$1.324 / 百万输入 Token 起
API 文档
长上下文编程思考模式提示词缓存Chat + Messages + Responses
生产路由已上线
上下文
1M 上下文 · 最大输出 384K
适用场景
Flash 不够用时的深度推理、复杂编程与 Agent 运行
可输入
文本
输出形态
文本 · JSON(结构化输出)

DeepSeek 计划于 2026 年 9 月 14 日把官方直连接口的 deepseek-v4-pro 转到 V4.1 Flash;EvoLink 上的 deepseek-v4-pro 不受影响,仍是 V4 Pro。详见V4.1 Flash 迁移指南

选择 DeepSeek V4 Pro

用于评估编程、推理与长上下文分析的路由,同时提供 Chat Completions、Messages 与 Responses 三种协议,用你技术栈已有的那种即可。

DeepSeek V4 Pro

DeepSeek 推理与工具调用模型

已选择
模型 ID
deepseek-v4-pro
适合

大批量编程、推理、长文档分析,以及需要低价路由与缓存输入计费的 Agent 流量。

输入
$1.324 / 1M
90 cr / 1M
缓存命中
$0.045 / 1M
3 cr / 1M
输出
$3.971 / 1M
270 cr / 1M

所有费率按每百万 Token 计,同时显示美元与 Credits,以你账户当前的价格为准。

DeepSeek V4 Pro 价格

集成前先估算一次 DeepSeek V4 Pro 请求的费用。计算器按你账户的当前费率计算,官方价格仅作对照。

请求费用计算器

输入一次请求的 Token 组合和成功的工具调用次数。

单次请求预估

DeepSeek V4 Pro
USD$0.0026
Credits0.1716
输入 Token0.09 cr
缓存命中 Token0.0006 cr
输出 Token0.081 cr

最低计费:每次请求 0.01 Credits。

预算指南

按当前 Token 组合估算可发起的请求数。
充值 Credits
$10
约 3962 次请求

快速测试

$50
约 19813 次请求

日常开发

$100
约 39627 次请求

生产评估

服务端工具费率

只有成功的服务端调用按次计费;失败的尝试不收工具费,但 Token 照常计费。
  • 网页搜索$0.010/ 次0.68 cr / 次

DeepSeek V4 Pro API 是什么?

DeepSeek V4 Pro 是 DeepSeek 的旗舰推理档:1.6 万亿参数 MoE 架构(每 token 激活 49B)、100 万 Token 上下文、38.4 万最大输出,默认开启思考模式。在 EvoLink 上可通过 /v1/chat/completions(OpenAI 风格)与 /v1/messages(Anthropic 风格)两种协议调用,模型 ID 为 deepseek-v4-pro。价格边界、支持的工作流与模型配置见下方 Pricing 与 API 区。DeepSeek 计划自北京时间 2026 年 9 月 14 日 12:00(UTC 04:00)起,把官方直连接口上的 deepseek-v4-pro 转到 V4.1 Flash;EvoLink 上的 deepseek-v4-pro 不受影响,继续提供 V4 Pro。

DeepSeek V4 Pro 在 EvoLink 上以模型 ID deepseek-v4-pro 提供,支持 Chat Completions · Anthropic Messages · Responses,和其他模型共用同一把 API 密钥与余额。它提供 1M 上下文窗口,最大输出 384K Token,并支持推理、长上下文编程、提示缓存。

DeepSeek V4 Pro

DeepSeek V4 Pro 规格与能力

数字取自 EvoLink 路由配置;能力以 API 当前实际提供为准。

上下文窗口
1M Token
最大输出
384K Token
输入
文本
输出
文本 · JSON(结构化输出)
推理
思考模式(默认开启)
提示缓存
自动缓存读取,享较低费率
服务端工具
网页搜索,按成功调用次数计费
协议
Chat Completions · Anthropic Messages · Responses
模型 ID
deepseek-v4-pro

Chat Completions、Messages 与 Responses 请求必须使用这里展示的真实模型 ID。

DeepSeek V4 Pro API 适合哪些任务?

DeepSeek V4 Pro 的 100 万 Token 上下文、可配置推理和工具调用能力,主要服务于需要持续保留证据、调用外部工具并交付可验证结果的任务。该模型为纯文本模型,不接受图片输入。下面按工作负载说明它可能带来的价值,以及接入前应确认的边界。

仓库级编程与代码审查

把相关源码、Issue、测试结果和历史修改放进同一任务,适合跨文件定位问题、生成修改计划和审查变更。上线前应使用固定仓库任务检查测试通过率、未完成步骤、结构化结果和人工修正量,不能只凭一次演示判断编程能力。

长文档与多来源分析

100 万 Token 上下文可以同时容纳长报告、合同、知识库片段、历史消息和检索结果。更大的上下文不一定带来更好的答案;应检查关键证据是否被保留,并结合 Pricing 区的实时价格与缓存输入机制评估每个可接受结果的成本。

长链路 Agent 与终端工作流

0813 正式版大幅提升了 agentic 编码与终端任务表现,也是社区反馈(需求信号,非实测结论)中 V4 Pro 相对闭源模型最常被提及的价值场景。通过函数调用接入你自己的检索与执行工具,并在真实工作负载上验证多步骤任务完成率后再扩量。

结构化输出与 Agent 编排

文本输入可以进入 JSON Schema、函数调用和多步骤 Agent 流程,用于抽取、审查和下游自动化。生产接入前应测试 Schema 有效率、函数参数、流式结束事件,以及工具失败后是否能够安全恢复。

通过不同平台使用 DeepSeek V4 Pro,有哪些差别?

即使使用同一个模型,不同接入平台提供的上下文配置、工具支持、用量展示和计费方式也可能不同。通过 EvoLink 接入时,可以在统一 API 下查看模型配置与用量,并让后续模型切换保持简单。

使用正确的 API 模型 ID

页面 URL 与 API 请求使用的模型 ID 是同一个字符串:deepseek-v4-pro。现有 Chat Completions 或 Responses 应用只需在模型配置中使用正确 ID,具体字段可继续查看页面 API 区。

以当前 API 通道的配置为准

DeepSeek 记录的模型窗口为 100 万 Token,但不同平台可能提供不同的上下文配置、工具集合和限流方式。通过 EvoLink 使用时,以当前页面展示的模型配置、可用功能和实际 usage 为准。

按工作流选择 Chat 或 Responses

普通聊天、流式输出和客户端函数可以从 Chat Completions 开始;需要长链路多步骤 Agent 工作流时,再评估 0813 版新增的 Responses 协议——其文档化的服务端工具为 function calling、web search 与 apply_patch,code interpreter 在该路由会被忽略。这样可以沿用熟悉的 OpenAI 风格接入,同时避免加入暂时不需要的复杂度。

在统一网关中保留模型选择空间

通过 EvoLink 使用同一套账号、余额和 API 方式接入 Grok、GPT、Claude 与 Kimi。模型选择保持在配置层后,可以根据任务质量、成本和可用性调整路由,而不必为每个供应商重复改造业务代码。

如何更准确地控制 DeepSeek V4 Pro API 成本?

现有 Pricing 区负责展示实时 Token 价格(输入、缓存命中、输出)。实际使用时,还可以通过缓存、上下文管理、推理设置和模型路由减少不必要的消耗,让成本与完成的业务任务对应起来。

让重复上下文更容易使用缓存

稳定的系统提示、工具 Schema 和共享上下文更适合复用缓存。按所选协议配置支持的缓存或会话标识,并从 usage 中查看 cached tokens,可以更准确地判断重复请求是否获得了缓存收益。

只发送当前任务真正需要的上下文

100 万 Token 窗口适合大型代码库和长文档,但并不意味着每次请求都要填满。优先选择与当前任务相关的文件、对话和检索结果,可以减少输入成本,也更容易让模型聚焦关键证据。

按任务调整推理、输出与工具调用

简单任务可以从较低 reasoning effort 和较短输出开始,复杂分析再逐步增加推理预算。研究与 Agent 工作流还应关注工具调用次数,避免重复搜索、重复执行或无效循环带来额外消耗。

按完成任务的总成本比较模型

将 Token、缓存输入、服务端工具和必要重试放到同一个任务中评估。EvoLink 集中展示模型与用量,便于团队比较 DeepSeek V4 Pro 与其他路由完成相同工作所需的总费用。

两种方式使用 DeepSeek V4 Pro:EvoLink API 或 Agent

产品后端与批量任务走 EvoLink API;编码与分析类工作可直接在 Codex、Claude、Gemini 里调用 DeepSeek V4 Pro。两条路径共用同一把 EvoLink API 密钥、余额、模型 ID 与请求记录。

方式一

用 EvoLink API 接入

适合:产品后端、批量任务、自动化流水线

向 EvoLink 发送 OpenAI 兼容的 Chat Completions(或 Anthropic Messages)请求,自行控制模型 ID、系统提示、输出预算、工具与结构化输出。

  1. 1在控制台创建 EvoLink API 密钥
  2. 2把 OpenAI 或 Anthropic SDK 的 base URL 指向 EvoLink,并选择上方显示的模型 ID
  3. 3先发一条有代表性的请求,从 usage 字段读取输入、缓存与输出 token
  4. 4按任务设置 max_tokens 与重试;多轮时保留 tool-call ID 与工具结果
方式二

用 Agent 调用

适合:在 Codex、Claude、Gemini 里做编码、评审与分析

把任务、要带入的材料和验收标准交给 Agent,由它组装请求、通过 EvoLink 调用 DeepSeek V4 Pro,并把回答连同 token 用量一起返回。

  1. 1在本地环境变量里配置 EVOLINK_API_KEY,不要写进代码或提示词
  2. 2描述任务、要带入的材料和期望的输出格式
  3. 3让 Agent 通过 EvoLink 调用 DeepSeek V4 Pro,并在发送前先展示请求
  4. 4让 Agent 汇报回答、token 用量和任何错误信息

DeepSeek V4 Pro API 代码示例与错误处理

这个示例是最短可运行的请求:一条 OpenAI 兼容的 Chat Completions 调用,带系统提示、用户消息和输出预算。完整参数与响应说明见 API 标签页。

查看完整 API 文档
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-pro",
    "messages": [
      { "role": "system", "content": "You are a senior engineer reviewing a pull request." },
      { "role": "user", "content": "Review this diff and list every risky change with file and line:\n<diff>" }
    ],
    "max_tokens": 4096,
    "temperature": 0.2
  }'

# Anthropic Messages (/v1/messages) and Responses (/v1/responses) accept the
# same model ID.
# The response includes choices[0].message and a usage object (prompt,
# cached, and completion tokens).

请求无效或参数不支持

对照 API 文档检查模型 ID、messages 数组和参数范围,去掉该路由不支持的字段。

鉴权或余额问题

检查 Authorization bearer token,并在控制台确认可用余额。

超出上下文长度

提示词 token 超过了 DeepSeek V4 Pro 的上下文窗口。裁剪或只检索相关材料,并复用缓存前缀。

触发限流(429)

退避并带抖动重试;用批处理或队列代替并发突发。

内容或工具调用被拒

重试前检查敏感内容、格式错误的 tool-call 参数和 JSON schema 不匹配。

DeepSeek V4 Pro 的 Chat Completions、Responses 与生产流量怎么选?

两种协议服务于不同工作流。这里给出选型摘要;具体请求字段继续以页面 API 区和 EvoLink 文档为准,价格与工具调用费用继续以现有 Pricing 区为准。

01

普通对话与客户端函数:Chat Completions

已有 OpenAI 兼容聊天、流式响应或客户端 function calling 流程时,优先从 Chat Completions 开始。重点确认消息格式、流式结束、函数参数和 usage 是否与现有客户端预期一致。

对话与客户端函数
02

Agent 工作流:Responses

需要长链路多步骤 Agent 流程或 Codex 型集成时,再评估 0813 版新增的 Responses 协议。接入前应对照当前 EvoLink 文档确认支持的请求字段、失败状态和重试边界。

Agent 工作流
03

大上下文任务:同时观察缓存与总费用

长文档、代码库和长会话不应默认把全部内容塞进一次请求。比较代表性上下文长度、缓存命中与未命中、输出长度和重试次数,再用最终账单核算成功任务成本。

上下文成本
04

生产流量:从小规模开始并保留回退

先让一小部分可观察的任务使用 DeepSeek V4 Pro,并保留已经稳定运行的 GPT、Claude 或 Kimi 路由。EvoLink 统一 API 可以集中管理模型选择、用量和余额,并在限流、超时、Schema 或工具失败时切换路由。

逐步扩量

缓存命中只按新输入的零头计费

前缀缓存是自动的:稳定的系统提示、仓库说明和工具定义在后续请求中按缓存命中而不是完整输入计费。估算 Agent 循环成本之前,先在自己的日志里测真实命中率。

1M Token 上下文,384K 输出上限

把相关文件、规范和 Agent 状态放进同一个工作上下文,但把上限当作容量而不是目标:只检索真正需要的内容,保持前缀稳定以便命中缓存,并按任务设置输出预算。

DeepSeek V4 Pro 与 Qwen 3.8 Max、GLM-5.3 对比

EvoLink

对照输入输出费率、上下文、缓存和适用任务。先用同一批请求实测再选路由;下表采用你账户当前的费率。

DeepSeek V4 Pro
输入 / 输出$1.324 / $3.971
上下文1M
缓存自动缓存命中
最适合大批量编程、推理、长文档分析,以及需要低价路由与缓存输入计费的 Agent 流量。
Qwen 3.8 Max
输入 / 输出$1.765 / $5.295
上下文1.05M
缓存显式提示词缓存
最适合仓库级工程、多文档综合、重度工具调用 Agent
GLM-5.3
输入 / 输出$1.4 / $4.4
上下文1M
缓存自动缓存命中
最适合编程 Agent、长链路任务、重工具调用流程

将 DeepSeek V4 Pro 用于生产环境前,建议确认什么?

从小规模真实工作负载开始,可以更快确认模型是否符合团队对质量、延迟、成本和稳定性的要求,再决定哪些流量适合逐步迁移。

接入与用量信息清晰

确认应用使用正确的 deepseek-v4-pro 模型 ID 和目标协议,并能正常获得所需的响应、usage 与缓存信息。清晰的用量数据便于后续分析成本,也能让 Chat 与 Responses 工作流保持一致的观测方式。

输出满足实际业务要求

使用代码修改、长文档分析、研究或结构化抽取等真实任务检查结果。除了回答质量,还应关注测试是否通过、引用是否可靠、函数参数是否正确,以及 JSON Schema 能否被下游系统直接使用。

延迟与异常处理符合预期

在常见请求量下观察响应时间,并为限流、超时、无效结构化输出和工具失败准备重试方式。通过 EvoLink 保持模型选择可配置,可以在某条路由暂时不可用时切换到已经验证的替代模型。

成本与模型选择保持可控

结合 Pricing、usage 和最终费用评估同一类任务的总成本,再决定 DeepSeek V4 Pro 适合默认路由、特定高难度任务还是备用模型。统一网关让团队可以按质量与预算调整模型,而不必重新建设接入层。

建议先将 DeepSeek V4 Pro 用于一小部分可观察、可回退的任务,确认质量、延迟和成本符合预期后再逐步扩大。通过 EvoLink 统一 API 保留多模型选择,可以让后续扩量、切换和成本优化更加简单。

DeepSeek V4 模型家族

同一把 API 密钥、同一份余额,换档位不用改接入。

DeepSeek V4.1 Flash

DeepSeek V4.1 Flash

DeepSeek 支持文字与图片输入的 Flash 模型

查看模型
DeepSeek V4 Flash Vision

DeepSeek V4 Flash Vision

Vision Exp 旧模型 ID,现已重定向到 DeepSeek V4.1 Flash

查看模型
DeepSeek V4 Flash

DeepSeek V4 Flash

DeepSeek 推理与工具调用模型

查看模型

DeepSeek V4 Pro 之外的其他文本模型

GPT-5.6

GPT-5.6

需要在同一 OpenAI 模型家族中按能力、延迟和成本分层路由时,可与 DeepSeek V4 Pro 使用相同任务做配对测试。

查看模型
Claude Opus 5

Claude Opus 5

需要长时间 Agent、复杂代码审查和工具可靠性时,可作为 DeepSeek V4 Pro 的高端对照与生产回退。

查看模型
Kimi K3

Kimi K3

长上下文任务高度关注缓存输入价格和总 Token 成本时,可与 DeepSeek V4 Pro 比较成功任务成本。

查看模型
DeepSeek V4 Flash

DeepSeek V4 Flash

大批量编程、推理和 Agent 流量优先考虑成本时,可作为 DeepSeek V4 Pro 的低价对照与回退路由。

查看模型

DeepSeek V4 Pro 延伸阅读

DeepSeek V4 Pro API 怎么用

DeepSeek V4 Pro API 怎么用

首次调用、thinking 档位控制、Claude Code 切换,以及三个静默失效的迁移坑。

阅读指南
DeepSeek V4 Pro 0813 已上线:更新了什么

DeepSeek V4 Pro 0813 已上线:更新了什么

正式版的 agent 与 Codex 变化,已对照上游文档核验。

阅读指南
DeepSeek V4 API 评测:Flash 与 Pro 怎么选

DeepSeek V4 API 评测:Flash 与 Pro 怎么选

对比两档的成本、思考模式,以及生产上线检查清单。

阅读指南
DeepSeek V4.1 Flash 迁移指南

DeepSeek V4.1 Flash 迁移指南

官方接口和 EvoLink 上各有哪些模型 ID 变了,以及切流前怎么测试 V4.1 Flash。

阅读指南

DeepSeek V4 Pro API 常见问题

现在可以通过 EvoLink 使用 DeepSeek V4 Pro API 吗?

可以。DeepSeek V4 Pro 已在 EvoLink 生产路由上线,且不受 DeepSeek 9 月 14 日官方接口变更(把 deepseek-v4-pro 转到 V4.1 Flash)的影响,使用模型 ID deepseek-v4-pro 通过 Chat Completions 或 Responses 直接调用;扩量前建议先在本页确认模型 ID、价格、上下文和支持方式。

deepseek-v4-pro 是 DeepSeek V4 Pro 的 API 模型 ID 吗?

是的。请求中 model 字段填写的就是 deepseek-v4-pro,与本页 URL 一致。自 2026 年 8 月 13 日起,同一个 ID 已自动指向升级后的 0813 正式版——升级不需要换 ID。

DeepSeek V4 Pro 0813 正式版更新了什么?

0813 正式版(2026 年 8 月 13 日发布)大幅提升了 agentic 编码与终端任务基准表现,并新增 Responses API 支持。可调用的模型 ID 保持 deepseek-v4-pro 不变。旧别名 deepseek-chat 与 deepseek-reasoner 已于 2026 年 7 月 24 日在上游退役。

DeepSeek V4 Pro 支持哪些输入和输出?

仅支持文本输入和文本输出。DeepSeek V4 Pro 在任何协议下都没有视觉能力,但两条路由的边界不同:Messages 路由会直接拒绝图片和文档内容类型;Responses 路由则把图片和文件附件转成占位符,并不会真正理解。截图理解、文档解析类任务请路由到同一 EvoLink 网关上带视觉能力的模型。

Chat Completions 和 Responses API 应该怎么选?

普通聊天、流式响应和客户端函数优先评估 Chat Completions;长链路多步骤 Agent 工作流优先评估 0813 版新增的 Responses。精确字段以页面 API 区和 EvoLink 文档为准。

DeepSeek V4 Pro 的 reasoning effort 应该怎么选?

合法档位是 low、high 和 max,默认为 high;medium 可以传入,但会被静默映射为 high,因此比较 medium 和 high 不会有真实差异。建议日常任务从 low 起步,在相同任务上比较 low 和 high 的质量、延迟与总费用,max 留给失败重来比额外推理 Token 更贵的最难任务。

缓存输入会怎样影响 DeepSeek V4 Pro API 价格?

缓存输入可以降低重复上下文成本,但缓存未命中、长输出、重试和反复工具步骤仍会增加总费用。应以 Pricing 区和最终请求账单计算成功任务成本。

DeepSeek V4 Pro 有什么速率限制?

DeepSeek 的 V4 文档记载,其官方直连接口没有按 Token 的 RPM/TPM 限速,而是账户级并发上限——Pro 约 500 并发,超限返回 429,排队约 10 分钟未开始推理会被断开。这些数字描述的是 DeepSeek 官方接口,不代表 EvoLink 路线的容量。请实测你在 EvoLink 账户上的限制,把在途请求数压在其下,并使用指数退避。

怎样比较 DeepSeek V4 Pro、GPT、Claude 与 Kimi?

可以让不同模型完成相同的真实任务,并使用一致的上下文、工具和推理设置。结合结果质量、响应时间、Token 构成、工具表现和总费用,更容易判断每类流量适合哪条 EvoLink 路由。

DeepSeek V4 Pro 开源吗?

4 月 Preview 版权重以 MIT 协议发布在 Hugging Face;截至 2026 年 8 月 13 日,0813 正式版权重尚未发布。开源权重和托管 API 是两条独立的获取路径——EvoLink 路由提供的是托管 API,而同款 MIT 权重存在于第三方托管,正是回退路由可行的原因。

存在 DeepSeek V4 Pro Max 这个模型吗?

不存在。“Pro Max”不是独立型号——“max”是同一个 deepseek-v4-pro 模型 ID 上的最高思考档位。看到“Pro-Max”的说法时,它指的是以最大推理档运行本模型,不是另一个产品。

上线 DeepSeek V4 Pro 时应该保留什么回退模型?

建议保留一个已经稳定运行、能够完成同类任务的模型,并让路由选择保持可配置。发生限流、超时或无效输出时,可以通过 EvoLink 切换到 GPT、Claude、Kimi 或其他合适的替代路由。