
DeepSeek V4 Flash Vision Exp vs Flash:画像とテキストの選び方
ライフサイクル更新(2026 年 9 月 10 日): DeepSeek は V4.1 Flash をリリースしました。DeepSeek の公式 API ではdeepseek-v4-flashとdeepseek-v4-flash-vision-expがすでに V4.1 Flash へ転送されており、deepseek-v4-proも 2026 年 9 月 14 日 12:00(北京時間、UTC 04:00) から続く予定です。EvoLink ではdeepseek-v4-flashとdeepseek-v4-proは影響を受けず、引き続き DeepSeek V4 Flash と V4 Pro を提供します。deepseek-v4-flash-vision-expは現在 DeepSeek V4.1 Flash にリダイレクトされます。詳しくは公式アップデート、V4.1 Flash モデルページ、移行ガイドをご覧ください。
deepseek-v4-flash-vision-expへのRequestは現在V4.1 Flashにリダイレクトされるため、以下のVision Expの結果は8月21日時点のモデルのものです。後継モデルで画像評価Setを再実行してください。Routingの原則は変わりません。画像入力は、全Flash Trafficを移す理由にはなりません。EvoLinkではModalitiesを先に判定し、Route別の基準で評価し、画像Routeの後ろに検証済みFallbackを置きます。deepseek-v4-flash-vision-expをChat、Messages、Responsesで文書化しています。このモデルは実験モデルとして公開されたもので、EvoLinkでは現在このIDがV4.1 Flashにリダイレクトされるため、本番拡大前に画像形式、Usage、Billing、Fallbackを代表Requestで確認します。結論:新旧ではなく入力Modalitiesで選ぶ
| 条件 | 最初のRoute | 理由 |
|---|---|---|
| Screenshot、Scan、Chart、Photo、Rendered UIが必要 | Vision Exp | Text Flashが見られない視覚証拠が必要 |
| TaskがText、Code、JSON、Tool Outputで完結 | Flash | Visionが有効なSignalを追加しない |
| 抽出Textが信頼できLayout不要 | Flash | 正規化Textで十分 |
| Table、位置、手書き、視覚階層が重要 | Vision Exp | 元画像がLayoutを保持 |
| UI Screenshotを観察するAgent | Vision + Fallback | Groundingが必要、画像Routeは段階導入 |
| 大量Text分類、要約、Coding | Flash | 安定Text RouteをDefaultに維持 |
具体的な違い
| 項目 | Vision Exp | Flash |
|---|---|---|
| ID | deepseek-v4-flash-vision-exp | deepseek-v4-flash |
| Status | 8月21日に実験画像モデルとして公開。EvoLinkでは現在このIDがV4.1 Flashへリダイレクト | EvoLink上の本番Textモデル。9月10日の変更の影響なし |
| Input | Text + Image | Text |
| Output | Text | Text |
| 主な用途 | Screenshot、Document、Chart、Visual Agent | Coding、分類、要約、Text Agent、変換 |
| 評価 | 視覚精度、Grounding、小文字、Layout | Task精度、Latency、Token、Tool、安定性 |
| 本番方針 | Feature Flag、Protocol確認、Canary、Fallback | Default Text RouteとRegression監視 |
image_url、MessagesのBase64/URL image、Responsesのinput_imageを記載しています。画像入力ガイドでPayloadを合わせ、Files APIは専用文書で確認します。FlashのStatusと価格はFlash製品ページが正規情報です。
実装できるRouting Tree
- 視覚証拠が必要か。不要なら正規化TextをFlashへ。
- 元画像が必要か。OCRで十分ならFlashへ。
- 選択ProtocolがFormatを受けるか。非対応なら停止かVision Fallback。画像を黙って削除しない。
- Tenant/Workloadで画像Routeを許可するか。Feature FlagやAllowlistで分離。
- 視覚受入基準を満たすか。不合格は上限付きRetryかFailover。
if requires_visual_evidence and vision_route_verified:
route = "deepseek-v4-flash-vision-exp"
else:
route = "deepseek-v4-flash"Route選択理由も記録し、Usage、失敗、将来Migrationを監査可能にします。
Workload Matrix
| Workload | Route | 受入 | Fallback |
|---|---|---|---|
| Screenshot Bug | Vision | 状態と領域が正しい | 他Vision/人手 |
| 請求書/Form | Layout重要ならVision | Field精度、欠落、Page追跡 | OCR + Flash |
| Chart | Vision | Axis、Legend、Unit、Trend | 構造Data + Flash |
| UI Agent | Vision | Element GroundingとAction条件 | Accessibility Tree/他Vision |
| Source Repository | Flash | Test、File参照、完了 | Pro/他Text |
| Text分類/要約 | Flash | Labeled SetとSchema | Retry/他Text |
| Text抽出済PDF | Flash | Sample Pageとの完全性 | Layout損失PageだけVision |
| Textと画像のBatch | 分離 | Route別Success/Cost | Visual失敗を別Queue |
1 Token価格ではなく成功Task Cost
成功Task Cost = Input + Output + Retry + 前処理 + Review + 失敗影響Route別の評価
Vision Exp
- Scan/文書の転記・Field精度、ChartのAxis/Legend/Unit/Value、小文字と密なUI、Element Grounding、読めない内容を捏造しないこと、Latency/Retry/修正率。
Flash
- Text精度、Schema/Tool、First Token/総Latency、Input/Reasoning/Output Token、Retry/Escalation。
8月の公開時、DeepSeekは実験版VisionのText能力がFlash相当だと述べていました。これはVendor Claimであり、移行判断ではありません。同条件評価で明確な利点が示され、新モデルのRiskを受容できる場合にだけText Routeを変えます。
EvoLink本番導入
- ID、Protocol、画像Fieldを文書で確認。
- 実AccountでResponse、Usage、Billingを確認。
- Feature Flagを使い低Risk Canaryから開始。
- Screenshot、Chart、文書Typeごとに拡大。
- 移行価値が証明されるまでText DefaultはFlash。
よくあるRouting Error
| Error | Risk | 改善 |
|---|---|---|
| 画像モデルが新しいからFlashを全置換 | Textも画像モデルに依存 | 必要証拠でRoute |
| PDFを全部画像送信 | Textで足りる場合もVision処理 | 先に抽出、Layout時のみ画像 |
| UpstreamとEvoLinkを同一視 | Route差異 | EvoLink文書と実Call確認 |
| 表示価格だけ比較 | Retry/Review/失敗を除外 | 完了Task Cost |
| 流暢な説明を信頼 | Chart/小文字誤読 | Workload別基準 |
| 画像を黙って破棄 | 証拠なしのもっともらしい回答 | Fail Closed/Fallback |
-expを削る | EvoLinkではText専用のdeepseek-v4-flashを呼ぶ | 新しい画像Taskはdeepseek-v4.1-flash、旧IDを使い続けるなら正確に送る |
Fallback Policy
Screenshot/Chartは別Visionへ送り、画像を外してFlashへは送りません。DocumentはLayout損失が許容できる場合に追跡可能なOCR + Flashを使います。Grounding不明時は破壊的Actionを停止し、Timeout、Retry、Budgetを制限し、Fallback利用率を別計測します。
EvoLinkの統合GatewayによりText、Vision、Fallbackを明示し、UsageとCostを比較できます。
FAQ
Vision ExpとFlashは同じ?
deepseek-v4-flashは引き続きText専用のV4 Flashを提供し、deepseek-v4-flash-vision-expは現在DeepSeek V4.1 Flashにリダイレクトされます。DeepSeek公式APIでは、両方の旧名がV4.1 Flashへ転送されています。画像対応IDは?
deepseek-v4.1-flashを使います。既存のdeepseek-v4-flash-vision-expへのRequestも動作しますが、V4.1 Flashへリダイレクトされます。FlashはScreenshotを読める?
deepseek-v4-flashは引き続きText専用のV4 Flash Routeです。Pixel依存Taskはdeepseek-v4.1-flashか、検証済みの別Visionモデルを使います。Vision ExpはTextだけでも使える?
deepseek-v4-flashに残します。Vision Expは安い?
名称では判断せず、画像、Output、Retry、前処理、Reviewを含むCostで比較します。
画像Token数は?
安定しているのは?
EvoLinkではFlashが既存のText Routeです。Vision ExpのIDへのRequestは現在V4.1 Flashで処理されるため、視覚評価を再実行し、Feature Flag、Canary、検証済みFallbackで画像Trafficを段階導入します。
PDFはどちら?
deepseek-v4.1-flash)です。Fallbackは?
deepseek-v4-flash-vision-expがV4.1 Flashにリダイレクトされるため、この2つのIDの間で切り替えてもFallbackにはなりません。

