
DeepSeek V4 Pro 迁移 V4.1 Flash:旧模型名对照与切换检查清单
deepseek-v4-flash 与 deepseek-v4-pro 不受影响,继续提供 DeepSeek V4 Flash 与 V4 Pro;只有 deepseek-v4-flash-vision-exp 变了,现已重定向到 DeepSeek V4.1 Flash。因此你可以让现有的 Flash、Pro 任务照常运行,同时并排评测 V4.1 Flash,不必被官方的截止时间推着迁移。哪些模型名变了?逐个 ID 对照
| 模型 ID | DeepSeek 官方直连接口 | EvoLink | 该做什么 |
|---|---|---|---|
deepseek-v4-flash | 9 月 10 日起转到 V4.1 Flash | 不受影响,仍是 DeepSeek V4 Flash | 继续运行;需要图片输入或想用新模型时再评测 V4.1 Flash |
deepseek-v4-flash-vision-exp | 9 月 10 日起转到 V4.1 Flash | 重定向到 DeepSeek V4.1 Flash | 重新跑图片评测集;把 ID 改为 deepseek-v4.1-flash |
deepseek-v4-pro | 9 月 14 日 UTC 04:00 起转到 V4.1 Flash | 不受影响,仍是 DeepSeek V4 Pro | 直连官方的用户:截止前做好准备。EvoLink 用户:无需被动切换 |
deepseek-flash | V4.1 Flash 的当前官方名 | 不是 EvoLink 的模型 ID | 只在 DeepSeek 官方直连接口使用 |
deepseek-v4.1-flash | 不是 DeepSeek 官方接口的名字 | DeepSeek V4.1 Flash | 新接入 EvoLink 时使用 |
/deepseek-v4-1-flash 用的是连字符,不是模型 ID。响应里回显你请求的模型名,适合写进日志,但每条结果由哪个服务商、哪个 ID 产生,最好自己另行记录。哪些应用需要先处理?
按请求实际发往哪里、以及答案变化会造成多大后果来排优先级。
| 应用情况 | 现状 | 第一步 |
|---|---|---|
在 DeepSeek 官方直连接口调用 deepseek-v4-pro | 9 月 14 日起改由 V4.1 Flash 处理 | 截止前保存基线输出和测试;判断 V4.1 Flash 是否达标,或者需要通过其他路线(例如 EvoLink)继续使用 V4 Pro |
在官方直连接口调用 deepseek-v4-flash 或 deepseek-v4-flash-vision-exp | 已经由 V4.1 Flash 处理 | 把近期结果与 9 月 10 日之前保存的输出对比 |
在 EvoLink 上使用 deepseek-v4-flash-vision-exp | 已重定向到 V4.1 Flash | 重新跑视觉评测集;把 ID 改为 deepseek-v4.1-flash |
在 EvoLink 上使用 deepseek-v4-flash 或 deepseek-v4-pro | 不变 | 不需要被动迁移;用一批真实任务抽样评测 V4.1 Flash |
| 在官方直连接口上让 Flash 与 Pro 互为备用 | 9 月 14 日后两个名字都落到 V4.1 Flash | 换成仍提供不同模型的路线,例如 EvoLink 上的 V4 Flash 与 V4 Pro,并另行确认它们不共用服务商、配额或故障点 |
必需的协议、计费规则或回退目标还不清楚时,不要扩大生产流量。你仍然可以先准备测试样例、配置候选路线、评测非关键任务。一个简短的文字请求调通,只是验证的开始,不是结束。
第一次改动要小,再逐项测试客户端请求与响应
第一次对比时,保持现有提示词、工具 Schema 和任务样例不变。模型、客户端库、提示词和推理设置一起改,回归问题就很难定位。
deepseek-v4.1-flash,从模型页上的请求示例开始。DeepSeek Chat 文档说明了 EvoLink 上 DeepSeek 的通用请求格式。不要未经核对就照搬官方直连接口的示例——端点、鉴权方式和支持的字段都要确认。下面这些客户端行为要分别检查:
- 思考控制: DeepSeek 文档说明其官方直连接口默认开启思考模式。请确认你的请求实际使用的设置,不要把“可选”理解成“关闭”,并在每次评测时记录下来。思考模式说明
- 对话历史: 确认哪些消息、推理内容块和工具结果需要回传。第一轮成功,不代表多轮对话也能正常运行。
- 工具调用: 检查工具名、参数解析、调用 ID、结果顺序以及下一轮助手回复。先用无副作用的测试工具,再接入会对外部系统产生影响的操作。
- 流式输出: 确保客户端能正确处理完成和中断事件。分别记录首个输出的时间和得到完整可用答案的时间。
- 图片输入: 不同协议的图片字段不同(Chat Completions 用
image_url,Messages 用image内容块,Responses 用input_image)。先在你用的协议上测一张图,再批量处理。 - 用量: 查看实际响应字段和账户扣费。缺少缓存 Token 数据表示用量未知,不等于缓存命中为零。
拿你现在用的模型做对比
deepseek-v4-flash 或 deepseek-v4-pro)和 deepseek-v4.1-flash,再并排比较结果。Vision Exp 是例外:它的 ID 已经重定向到 V4.1 Flash,原模型不能再拿来对比,只能用重定向之前保存的输出。官方直连接口上的旧模型名也一样。把同一个提示词发给指向同一模型的两个名字,并不是模型对比。
先从数量可控的代表性任务开始。例如,从日常任务、困难案例、长上下文输入和已知失败中挑选 30–50 个样例。这只是建议的起始样本量,不构成统计保证。每类重要工作负载都要有足够的样例,避免一个好看的演示掩盖其他地方的失败。
| 工作负载 | 从当前集成中保留 | 在候选模型上测量 |
|---|---|---|
| 编程 | 输入文件、需求改动、已采纳的补丁和测试集 | 测试通过率、意外改动、未完成任务和复核工作量 |
| Agent 工具调用 | 工具 Schema、预期调用顺序和最终状态 | 参数是否正确、重复调用、恢复能力和任务完成情况 |
| 结构化抽取 | 输入、预期字段和校验规则 | Schema 有效性、缺失值、错误值和复核比例 |
| 视觉 | 原始图片和标注好的可见证据 | 字段准确率、编造细节以及对无法辨认内容的处理 |
| 长上下文分析 | 必需的源段落和参考答案 | 证据召回、无依据的结论、延迟和任务成本 |
每条结果旁边都要记录请求配置:模型 ID、验证日期、输出上限、推理控制、提示词版本、工具定义和上下文大小。输出波动大到可能影响决策的案例要重复跑。报告不确定性,不要把单次运行包装成通用排名。
运行评测之前先定义失败。补丁无效、工具参数作用到错误的记录、编造必填字段,即使回复读起来很通顺,也应判为失败。不太关键的风格差异单独归类,避免掩盖功能性回归。
迁移验收记录表
每个测试样例在共享表格里记一行。这样每条结果都能对上它的运行条件、产生的成本和支持的决策,批准切流还是暂停,都用同一份证据判断。
| 字段组 | 需要记录 |
|---|---|
| 身份与条件 | 服务商与 base URL;当前与候选模型 ID;协议;思考开关与档位;提示词版本;测试集版本 |
| 任务与结果 | 样例 ID;输入类型(文字或图片);预期结果;实际输出;通过或失败及原因;工具副作用或重复调用 |
| 运行与成本 | 首个输出时间;得到完整结果的时间;输入、缓存与输出用量;最终扣费;重试次数 |
| 发布决策 | 自定的通过门槛(例如关键失败为零);观察窗口;扩大流量的条件;暂停的条件;与输入类型匹配的回退目标 |
填写示例(仅作说明,不是实测结果):
| 字段 | 示例 |
|---|---|
| 样例 ID | INV-017 |
| 输入类型 | 图片:扫描发票 |
| 当前 → 候选 | deepseek-v4-flash-vision-exp 重定向前保存的输出 → deepseek-v4.1-flash |
| 预期结果 | 包含发票号、日期和总金额的 JSON |
| 通过规则 | 三个字段都与标注一致;没有编造字段 |
| 结果 | 失败:把小计当成了总金额 |
| 用量与扣费 | 记录这次请求的 usage 字段和最终扣费 |
| 决策 | 发票类流量暂不切到候选模型;补充同类发票样例后重跑 |
| 回退目标 | 在同一批发票上通过验收的另一条视觉模型,或人工复核 |
验收通过后再切流量

用功能开关或路由配置,让候选模型只处理一类有边界的工作负载,并记录哪些请求用了它。先从内部或非关键任务开始,应用检查通过后再引入客户流量。
一个可行的顺序是:
- 确认请求。 核对准确的模型 ID、协议、权限和价格来源。
- 离线回放样例。 与当前模型或已保存的验收标准对比,在不影响线上流量的情况下定位失败。
- 小范围试运行。 选一小类工作负载或一小批租户,出错时影响可控。监控合格结果、延迟和扣费。
- 按任务类型扩量。 在通过的任务上扩大使用;更难或测量不充分的任务,继续留在已经通过验收的模型上。
- 服务商变更后复查。 ID 不变,不代表应用可以跳过后续回归测试。
阈值按你自己的服务要求来定。例如,团队可以要求:没有关键的工具调用失败、Schema 有效率不低于现有水平、p95 延迟在响应预算内。这些是应用层的门槛,不是对 V4.1 Flash 性能的断言。
回退必须指向一个仍然提供原有行为的目标,而且要和输入类型匹配。
- 纯文字任务: 在 EvoLink 上,
deepseek-v4-flash与deepseek-v4-pro继续可用,文字任务在 V4.1 Flash 上试运行不达标时,改配置就能切回去。 - 依赖图片证据的任务: V4 Flash 和 V4 Pro 只支持文字输入,接不住这类任务。请回退到另一条通过同样视觉验收的模型,或者停止处理、转人工复核。只有确认版式和像素细节的损失不影响结果时,OCR 加文字模型的管线才能当回退。不要静默丢弃图片,也不要把图片换成占位符后把回复算作成功。
- Vision Exp:
deepseek-v4-flash-vision-exp不能作为回退目标,因为它已经重定向到 V4.1 Flash。
按“每个合格结果的成本”比较
对一批评测任务:
每个合格任务的 API 成本 = 实际扣费的 API 总成本 / 合格任务数失败的尝试和重试都要计入实际扣费总额。如果没有任何合格任务,这个比值无定义,不要写成“每次成功成本为零”。人工复核和工具服务成本单独统计;如果你的决策关心的是总运营成本,再把它们加进来。
举一个假设的例子:100 个任务总花费 1.00,其中 80 个合格,每个合格任务成本是 0.0125;另一种配置总花费 0.90,但只有 60 个合格,每个合格任务成本是 0.015。账单更低的那批,按可用结果算反而更贵。以上数字仅作说明,不是 EvoLink 价格,也不是实测数据。
排查问题时,一次只改一个变量
| 现象 | 先检查 | 下一步 |
|---|---|---|
| 请求在生成前就被拒绝 | 有效的 Key、端点和模型 ID | 用最小的文档示例请求;区分鉴权问题和模型可用性问题 |
| 文字请求成功,图片失败 | 图片字段和所选协议 | 先测一张支持的图片,再加批量或工具 |
| 第一轮成功,Agent 随后停住 | 工具结果 ID、历史和客户端解析器 | 用确定性的测试工具复现一个两步任务 |
| 输出被截断 | 输出上限和结束原因 | 在有上限的范围内调整;避免无限重试 |
| 单价差不多,账单却变了 | 推理、缓存、输出长度和失败尝试 | 在同一批合格任务上比较最终扣费 |
| “回退”后行为没变 | 这个 ID 是否已重定向到新模型 | 文字任务切回仍提供原模型的 ID,例如 EvoLink 上的 deepseek-v4-flash;图片任务改用另一条经过验证的视觉模型 |
排查时保留脱敏后的请求、响应、时间和请求 ID。公开的问题反馈里不要包含 API Key 或客户敏感输入。具体的错误名和 HTTP 行为以实际响应和当前文档为准,不要根据模型 ID 的写法去猜。
常见问题
在 EvoLink 上,现有的 DeepSeek 请求都要改模型名吗?
deepseek-v4-flash 和 deepseek-v4-pro 不用改,两者继续提供 V4 Flash 与 V4 Pro。deepseek-v4-flash-vision-exp 仍然能用,但已经重定向到 V4.1 Flash;准备好之后把它改成 deepseek-v4.1-flash,并重新跑一遍图片检查。在 EvoLink 上配置 V4.1 Flash,模型名该填什么?
deepseek-v4.1-flash。网站地址用连字符,DeepSeek 官方直连接口用的是 deepseek-flash。端点、服务商和模型名要成套使用,不能混用。V4 Pro 什么时候切换?会影响 EvoLink 吗?
deepseek-v4-pro,它继续提供 V4 Pro。如果你直接调用 DeepSeek 官方接口,请在截止前再核对一次公告。可以把新旧模型并排对比吗?
deepseek-v4-flash 或 deepseek-v4-pro,以及 deepseek-v4.1-flash。Vision Exp 不行,因为它的 ID 已经重定向到 V4.1 Flash,只能和之前保存的输出对比。DeepSeek 官方直连接口上的旧模型名也是如此。“思考模式可选”是不是就是默认关闭?
不是。它的意思是在支持的地方提供非思考模式。请确认你的请求实际使用的设置,并把它和评测结果一起记录。
迁移之后账单会降吗?
这取决于账户费率、Token 构成、推理量、缓存复用、重试和合格率。请用等价任务的最终扣费来衡量,不要把官方降价或标价当成账单的保证。
在 EvoLink 上,原来的 Vision Exp 图片任务会怎样?
deepseek-v4.1-flash,让配置与实际处理请求的模型保持一致。迁移之后,什么样的回退才有用?
deepseek-v4-flash 与 deepseek-v4-pro 仍分别提供 V4 Flash 和 V4 Pro。图片任务:这两个模型只支持文字输入,需要另一条经过验证的视觉模型或人工流程。已经重定向到 V4.1 Flash 的 ID(例如 deepseek-v4-flash-vision-exp)不能把行为回退到旧模型。资料来源与下一步
以下官方文档核验于 2026 年 9 月 10 日:


