GPT Image 2.5 Flare 与 Sunburst 已上线 EvoLink立即体验
DeepSeek V4.1 Flash 迁移:旧应用经过路由核对与工作负载评测后完成切换
guide

DeepSeek V4 Pro 迁移 V4.1 Flash:旧模型名对照与切换检查清单

Jacey
Jacey
2026年9月10日
23 分钟阅读
如果你的应用在调用 DeepSeek V4 Flash、Vision Exp 或 Pro,先确认请求发到了哪里。 DeepSeek 于 2026 年 9 月 10 日发布 V4.1 Flash。在 DeepSeek 官方直连接口上,旧的 Flash 与 Vision Exp 模型名已经转到 V4.1 Flash,Pro 请求计划于**北京时间 2026 年 9 月 14 日 12:00(UTC 04:00)**起跟进。官方更新日志
EvoLink 上的情况不同:deepseek-v4-flashdeepseek-v4-pro 不受影响,继续提供 DeepSeek V4 Flash 与 V4 Pro;只有 deepseek-v4-flash-vision-exp 变了,现已重定向到 DeepSeek V4.1 Flash。因此你可以让现有的 Flash、Pro 任务照常运行,同时并排评测 V4.1 Flash,不必被官方的截止时间推着迁移。
适用范围: 本文是基于 DeepSeek 官方文档和 EvoLink 当前路由整理的迁移步骤,不是某次已完成的生产迁移报告。切流前,请在自己的账户上实测质量和扣费。
查看 DeepSeek V4.1 Flash 模型页

哪些模型名变了?逐个 ID 对照

模型 IDDeepSeek 官方直连接口EvoLink该做什么
deepseek-v4-flash9 月 10 日起转到 V4.1 Flash不受影响,仍是 DeepSeek V4 Flash继续运行;需要图片输入或想用新模型时再评测 V4.1 Flash
deepseek-v4-flash-vision-exp9 月 10 日起转到 V4.1 Flash重定向到 DeepSeek V4.1 Flash重新跑图片评测集;把 ID 改为 deepseek-v4.1-flash
deepseek-v4-pro9 月 14 日 UTC 04:00 起转到 V4.1 Flash不受影响,仍是 DeepSeek V4 Pro直连官方的用户:截止前做好准备。EvoLink 用户:无需被动切换
deepseek-flashV4.1 Flash 的当前官方名不是 EvoLink 的模型 ID只在 DeepSeek 官方直连接口使用
deepseek-v4.1-flash不是 DeepSeek 官方接口的名字DeepSeek V4.1 Flash新接入 EvoLink 时使用
官方一侧的信息以 DeepSeek 当前模型与价格表为准。EvoLink 页面地址 /deepseek-v4-1-flash 用的是连字符,不是模型 ID。响应里回显你请求的模型名,适合写进日志,但每条结果由哪个服务商、哪个 ID 产生,最好自己另行记录。

哪些应用需要先处理?

按请求实际发往哪里、以及答案变化会造成多大后果来排优先级。

应用情况现状第一步
在 DeepSeek 官方直连接口调用 deepseek-v4-pro9 月 14 日起改由 V4.1 Flash 处理截止前保存基线输出和测试;判断 V4.1 Flash 是否达标,或者需要通过其他路线(例如 EvoLink)继续使用 V4 Pro
在官方直连接口调用 deepseek-v4-flashdeepseek-v4-flash-vision-exp已经由 V4.1 Flash 处理把近期结果与 9 月 10 日之前保存的输出对比
在 EvoLink 上使用 deepseek-v4-flash-vision-exp已重定向到 V4.1 Flash重新跑视觉评测集;把 ID 改为 deepseek-v4.1-flash
在 EvoLink 上使用 deepseek-v4-flashdeepseek-v4-pro不变不需要被动迁移;用一批真实任务抽样评测 V4.1 Flash
在官方直连接口上让 Flash 与 Pro 互为备用9 月 14 日后两个名字都落到 V4.1 Flash换成仍提供不同模型的路线,例如 EvoLink 上的 V4 Flash 与 V4 Pro,并另行确认它们不共用服务商、配额或故障点

必需的协议、计费规则或回退目标还不清楚时,不要扩大生产流量。你仍然可以先准备测试样例、配置候选路线、评测非关键任务。一个简短的文字请求调通,只是验证的开始,不是结束。

第一次改动要小,再逐项测试客户端请求与响应

第一次对比时,保持现有提示词、工具 Schema 和任务样例不变。模型、客户端库、提示词和推理设置一起改,回归问题就很难定位。

使用有效的 EvoLink API Key,把模型设为 deepseek-v4.1-flash,从模型页上的请求示例开始。DeepSeek Chat 文档说明了 EvoLink 上 DeepSeek 的通用请求格式。不要未经核对就照搬官方直连接口的示例——端点、鉴权方式和支持的字段都要确认。

下面这些客户端行为要分别检查:

  • 思考控制: DeepSeek 文档说明其官方直连接口默认开启思考模式。请确认你的请求实际使用的设置,不要把“可选”理解成“关闭”,并在每次评测时记录下来。思考模式说明
  • 对话历史: 确认哪些消息、推理内容块和工具结果需要回传。第一轮成功,不代表多轮对话也能正常运行。
  • 工具调用: 检查工具名、参数解析、调用 ID、结果顺序以及下一轮助手回复。先用无副作用的测试工具,再接入会对外部系统产生影响的操作。
  • 流式输出: 确保客户端能正确处理完成和中断事件。分别记录首个输出的时间和得到完整可用答案的时间。
  • 图片输入: 不同协议的图片字段不同(Chat Completions 用 image_url,Messages 用 image 内容块,Responses 用 input_image)。先在你用的协议上测一张图,再批量处理。
  • 用量: 查看实际响应字段和账户扣费。缺少缓存 Token 数据表示用量未知,不等于缓存命中为零。
V4 Pro 教程Vision Exp 教程介绍了此前的接入方式。复用其中的代码片段前,请先阅读文章开头的生命周期说明。

拿你现在用的模型做对比

在 EvoLink 上,V4 Flash、V4 Pro 和 V4.1 Flash 是三个不同的模型。把同一批样例分别发给你当前的 ID(deepseek-v4-flashdeepseek-v4-pro)和 deepseek-v4.1-flash,再并排比较结果。

Vision Exp 是例外:它的 ID 已经重定向到 V4.1 Flash,原模型不能再拿来对比,只能用重定向之前保存的输出。官方直连接口上的旧模型名也一样。把同一个提示词发给指向同一模型的两个名字,并不是模型对比。

先从数量可控的代表性任务开始。例如,从日常任务、困难案例、长上下文输入和已知失败中挑选 30–50 个样例。这只是建议的起始样本量,不构成统计保证。每类重要工作负载都要有足够的样例,避免一个好看的演示掩盖其他地方的失败。

工作负载从当前集成中保留在候选模型上测量
编程输入文件、需求改动、已采纳的补丁和测试集测试通过率、意外改动、未完成任务和复核工作量
Agent 工具调用工具 Schema、预期调用顺序和最终状态参数是否正确、重复调用、恢复能力和任务完成情况
结构化抽取输入、预期字段和校验规则Schema 有效性、缺失值、错误值和复核比例
视觉原始图片和标注好的可见证据字段准确率、编造细节以及对无法辨认内容的处理
长上下文分析必需的源段落和参考答案证据召回、无依据的结论、延迟和任务成本

每条结果旁边都要记录请求配置:模型 ID、验证日期、输出上限、推理控制、提示词版本、工具定义和上下文大小。输出波动大到可能影响决策的案例要重复跑。报告不确定性,不要把单次运行包装成通用排名。

运行评测之前先定义失败。补丁无效、工具参数作用到错误的记录、编造必填字段,即使回复读起来很通顺,也应判为失败。不太关键的风格差异单独归类,避免掩盖功能性回归。

迁移验收记录表

每个测试样例在共享表格里记一行。这样每条结果都能对上它的运行条件、产生的成本和支持的决策,批准切流还是暂停,都用同一份证据判断。

字段组需要记录
身份与条件服务商与 base URL;当前与候选模型 ID;协议;思考开关与档位;提示词版本;测试集版本
任务与结果样例 ID;输入类型(文字或图片);预期结果;实际输出;通过或失败及原因;工具副作用或重复调用
运行与成本首个输出时间;得到完整结果的时间;输入、缓存与输出用量;最终扣费;重试次数
发布决策自定的通过门槛(例如关键失败为零);观察窗口;扩大流量的条件;暂停的条件;与输入类型匹配的回退目标

填写示例(仅作说明,不是实测结果):

字段示例
样例 IDINV-017
输入类型图片:扫描发票
当前 → 候选deepseek-v4-flash-vision-exp 重定向前保存的输出 → deepseek-v4.1-flash
预期结果包含发票号、日期和总金额的 JSON
通过规则三个字段都与标注一致;没有编造字段
结果失败:把小计当成了总金额
用量与扣费记录这次请求的 usage 字段和最终扣费
决策发票类流量暂不切到候选模型;补充同类发票样例后重跑
回退目标在同一批发票上通过验收的另一条视觉模型,或人工复核

验收通过后再切流量

DeepSeek V4.1 Flash 切流流程:先核对路线、回放历史样例,再小流量试运行并逐步扩大,同时保留独立的回退路线
DeepSeek V4.1 Flash 切流流程:先核对路线、回放历史样例,再小流量试运行并逐步扩大,同时保留独立的回退路线

用功能开关或路由配置,让候选模型只处理一类有边界的工作负载,并记录哪些请求用了它。先从内部或非关键任务开始,应用检查通过后再引入客户流量。

一个可行的顺序是:

  1. 确认请求。 核对准确的模型 ID、协议、权限和价格来源。
  2. 离线回放样例。 与当前模型或已保存的验收标准对比,在不影响线上流量的情况下定位失败。
  3. 小范围试运行。 选一小类工作负载或一小批租户,出错时影响可控。监控合格结果、延迟和扣费。
  4. 按任务类型扩量。 在通过的任务上扩大使用;更难或测量不充分的任务,继续留在已经通过验收的模型上。
  5. 服务商变更后复查。 ID 不变,不代表应用可以跳过后续回归测试。

阈值按你自己的服务要求来定。例如,团队可以要求:没有关键的工具调用失败、Schema 有效率不低于现有水平、p95 延迟在响应预算内。这些是应用层的门槛,不是对 V4.1 Flash 性能的断言。

回退必须指向一个仍然提供原有行为的目标,而且要和输入类型匹配。

  • 纯文字任务: 在 EvoLink 上,deepseek-v4-flashdeepseek-v4-pro 继续可用,文字任务在 V4.1 Flash 上试运行不达标时,改配置就能切回去。
  • 依赖图片证据的任务: V4 Flash 和 V4 Pro 只支持文字输入,接不住这类任务。请回退到另一条通过同样视觉验收的模型,或者停止处理、转人工复核。只有确认版式和像素细节的损失不影响结果时,OCR 加文字模型的管线才能当回退。不要静默丢弃图片,也不要把图片换成占位符后把回复算作成功。
  • Vision Exp: deepseek-v4-flash-vision-exp 不能作为回退目标,因为它已经重定向到 V4.1 Flash。
在 DeepSeek 官方直连接口上,旧模型名过了各自的切换时间后,都不能再恢复原模型。模型不同也不代表故障相互独立:依赖一条路线给另一条兜底之前,请确认两者是否共用服务商、配额或网络路径。更完整的恢复方案见故障回退设计指南

按“每个合格结果的成本”比较

使用模型页价格区账户用量,不要另外抄一份费率表。DeepSeek 官方直连价格和 EvoLink 账户费率是两套价格。标价更低的 Token,如果模型输出更多推理内容、重试更频繁或需要更多人工复核,任务成本反而可能更高。

对一批评测任务:

每个合格任务的 API 成本 = 实际扣费的 API 总成本 / 合格任务数

失败的尝试和重试都要计入实际扣费总额。如果没有任何合格任务,这个比值无定义,不要写成“每次成功成本为零”。人工复核和工具服务成本单独统计;如果你的决策关心的是总运营成本,再把它们加进来。

举一个假设的例子:100 个任务总花费 1.00,其中 80 个合格,每个合格任务成本是 0.0125;另一种配置总花费 0.90,但只有 60 个合格,每个合格任务成本是 0.015。账单更低的那批,按可用结果算反而更贵。以上数字仅作说明,不是 EvoLink 价格,也不是实测数据。

对重复使用的 Agent 提示词,把可复用的上下文放在会变的内容之前,并查看报告的缓存命中。缓存不保证可用。新输入、缓存输入和输出的计数方式要与所选协议保持一致,不要把同一批缓存 Token 扣减两次。DeepSeek 上下文缓存说明

排查问题时,一次只改一个变量

现象先检查下一步
请求在生成前就被拒绝有效的 Key、端点和模型 ID用最小的文档示例请求;区分鉴权问题和模型可用性问题
文字请求成功,图片失败图片字段和所选协议先测一张支持的图片,再加批量或工具
第一轮成功,Agent 随后停住工具结果 ID、历史和客户端解析器用确定性的测试工具复现一个两步任务
输出被截断输出上限和结束原因在有上限的范围内调整;避免无限重试
单价差不多,账单却变了推理、缓存、输出长度和失败尝试在同一批合格任务上比较最终扣费
“回退”后行为没变这个 ID 是否已重定向到新模型文字任务切回仍提供原模型的 ID,例如 EvoLink 上的 deepseek-v4-flash;图片任务改用另一条经过验证的视觉模型

排查时保留脱敏后的请求、响应、时间和请求 ID。公开的问题反馈里不要包含 API Key 或客户敏感输入。具体的错误名和 HTTP 行为以实际响应和当前文档为准,不要根据模型 ID 的写法去猜。

常见问题

deepseek-v4-flashdeepseek-v4-pro 不用改,两者继续提供 V4 Flash 与 V4 Pro。deepseek-v4-flash-vision-exp 仍然能用,但已经重定向到 V4.1 Flash;准备好之后把它改成 deepseek-v4.1-flash,并重新跑一遍图片检查。
EvoLink 的模型 ID 是 deepseek-v4.1-flash。网站地址用连字符,DeepSeek 官方直连接口用的是 deepseek-flash。端点、服务商和模型名要成套使用,不能混用。
DeepSeek 9 月 10 日的公告把官方直连接口的切换时间定在北京时间 2026 年 9 月 14 日 12:00(UTC 04:00)。这不影响 EvoLink 上的 deepseek-v4-pro,它继续提供 V4 Pro。如果你直接调用 DeepSeek 官方接口,请在截止前再核对一次公告。

可以把新旧模型并排对比吗?

在 EvoLink 上,V4 Flash 和 V4 Pro 可以:把同一批样例分别发给 deepseek-v4-flashdeepseek-v4-pro,以及 deepseek-v4.1-flash。Vision Exp 不行,因为它的 ID 已经重定向到 V4.1 Flash,只能和之前保存的输出对比。DeepSeek 官方直连接口上的旧模型名也是如此。

“思考模式可选”是不是就是默认关闭?

不是。它的意思是在支持的地方提供非思考模式。请确认你的请求实际使用的设置,并把它和评测结果一起记录。

迁移之后账单会降吗?

这取决于账户费率、Token 构成、推理量、缓存复用、重试和合格率。请用等价任务的最终扣费来衡量,不要把官方降价或标价当成账单的保证。

会继续运行,但由 DeepSeek V4.1 Flash 处理。请重新跑视觉评测集——包括小字号、表格、缺失字段和含义模糊的图片——并把模型 ID 改为 deepseek-v4.1-flash,让配置与实际处理请求的模型保持一致。

迁移之后,什么样的回退才有用?

一条仍在提供你已验证过的模型、能完成同样任务、支持同样输入类型的路线。文字任务:EvoLink 上的 deepseek-v4-flashdeepseek-v4-pro 仍分别提供 V4 Flash 和 V4 Pro。图片任务:这两个模型只支持文字输入,需要另一条经过验证的视觉模型或人工流程。已经重定向到 V4.1 Flash 的 ID(例如 deepseek-v4-flash-vision-exp)不能把行为回退到旧模型。

资料来源与下一步

以下官方文档核验于 2026 年 9 月 10 日:

先打开 V4.1 Flash 模型页,再用能暴露应用问题的最小一批代表性任务做评测。DeepSeek V4 Pro 0813 vs Flash 0731 对比仍然适用于 EvoLink 上继续提供的这两个 V4 模型。

准备好把 AI 成本降低 89% 吗?

现在就开始使用 EvoLink,体验智能 API 路由的强大能力。