
DeepSeek V4 Flash Vision Exp vs Flash:画像とテキストの選び方
deepseek-v4-flash-vision-expをChat、Messages、Responsesで文書化しています。本番拡大前に画像形式、Usage、Billing、Fallbackを代表Requestで確認します。結論:新旧ではなく入力Modalitiesで選ぶ
| 条件 | 最初のRoute | 理由 |
|---|---|---|
| Screenshot、Scan、Chart、Photo、Rendered UIが必要 | Vision Exp | Text Flashが見られない視覚証拠が必要 |
| TaskがText、Code、JSON、Tool Outputで完結 | Flash | Visionが有効なSignalを追加しない |
| 抽出Textが信頼できLayout不要 | Flash | 正規化Textで十分 |
| Table、位置、手書き、視覚階層が重要 | Vision Exp | 元画像がLayoutを保持 |
| UI Screenshotを観察するAgent | Vision + Fallback | Groundingが必要、実験Routeは段階導入 |
| 大量Text分類、要約、Coding | Flash | 安定Text RouteをDefaultに維持 |
具体的な違い
| 項目 | Vision Exp | Flash |
|---|---|---|
| ID | deepseek-v4-flash-vision-exp | deepseek-v4-flash |
| Status | EvoLink上の実験画像理解モデル | 本番Textモデル |
| Input | Text + Image | Text |
| Output | Text | Text |
| 主な用途 | Screenshot、Document、Chart、Visual Agent | Coding、分類、要約、Text Agent、変換 |
| 評価 | 視覚精度、Grounding、小文字、Layout | Task精度、Latency、Token、Tool、安定性 |
| 本番方針 | Feature Flag、Protocol確認、Canary、Fallback | Default Text RouteとRegression監視 |
image_url、MessagesのBase64/URL image、Responsesのinput_imageを記載しています。画像入力ガイドでPayloadを合わせ、Files APIは専用文書で確認します。FlashのStatusと価格はFlash製品ページが正規情報です。
実装できるRouting Tree
- 視覚証拠が必要か。不要なら正規化TextをFlashへ。
- 元画像が必要か。OCRで十分ならFlashへ。
- 選択ProtocolがFormatを受けるか。非対応なら停止かVision Fallback。画像を黙って削除しない。
- Tenant/Workloadで実験Routeを許可するか。Feature FlagやAllowlistで分離。
- 視覚受入基準を満たすか。不合格は上限付きRetryかFailover。
if requires_visual_evidence and vision_route_verified:
route = "deepseek-v4-flash-vision-exp"
else:
route = "deepseek-v4-flash"Route選択理由も記録し、Usage、失敗、将来Migrationを監査可能にします。
Workload Matrix
| Workload | Route | 受入 | Fallback |
|---|---|---|---|
| Screenshot Bug | Vision | 状態と領域が正しい | 他Vision/人手 |
| 請求書/Form | Layout重要ならVision | Field精度、欠落、Page追跡 | OCR + Flash |
| Chart | Vision | Axis、Legend、Unit、Trend | 構造Data + Flash |
| UI Agent | Vision | Element GroundingとAction条件 | Accessibility Tree/他Vision |
| Source Repository | Flash | Test、File参照、完了 | Pro/他Text |
| Text分類/要約 | Flash | Labeled SetとSchema | Retry/他Text |
| Text抽出済PDF | Flash | Sample Pageとの完全性 | Layout損失PageだけVision |
| Textと画像のBatch | 分離 | Route別Success/Cost | Visual失敗を別Queue |
1 Token価格ではなく成功Task Cost
成功Task Cost = Input + Output + Retry + 前処理 + Review + 失敗影響Route別の評価
Vision Exp
- Scan/文書の転記・Field精度、ChartのAxis/Legend/Unit/Value、小文字と密なUI、Element Grounding、読めない内容を捏造しないこと、Latency/Retry/修正率。
Flash
- Text精度、Schema/Tool、First Token/総Latency、Input/Reasoning/Output Token、Retry/Escalation。
Vision ExpのText能力がFlash相当という記述はVendor Claimです。移行判断ではなく、同条件評価と実験Riskの受容が必要です。
EvoLink本番導入
- ID、Protocol、画像Fieldを文書で確認。
- 実AccountでResponse、Usage、Billingを確認。
- Feature Flagを使い低Risk Canaryから開始。
- Screenshot、Chart、文書Typeごとに拡大。
- 移行価値が証明されるまでText DefaultはFlash。
よくあるRouting Error
| Error | Risk | 改善 |
|---|---|---|
| 新しいからFlashを全置換 | Textも実験依存 | 必要証拠でRoute |
| PDFを全部画像送信 | Textで足りる場合もVision処理 | 先に抽出、Layout時のみ画像 |
| UpstreamとEvoLinkを同一視 | Route差異 | EvoLink文書と実Call確認 |
| 表示価格だけ比較 | Retry/Review/失敗を除外 | 完了Task Cost |
| 流暢な説明を信頼 | Chart/小文字誤読 | Workload別基準 |
| 画像を黙って破棄 | 証拠なしのもっともらしい回答 | Fail Closed/Fallback |
-expを削る | 別ID/失敗 | 正確なID保存 |
Fallback Policy
Screenshot/Chartは別Visionへ送り、画像を外してFlashへは送りません。DocumentはLayout損失が許容できる場合に追跡可能なOCR + Flashを使います。Grounding不明時は破壊的Actionを停止し、Timeout、Retry、Budgetを制限し、Fallback利用率を別計測します。
EvoLinkの統合GatewayによりText、Vision、Fallbackを明示し、UsageとCostを比較できます。
FAQ
Vision ExpとFlashは同じ?
いいえ。IDが異なり、Vision Expは画像とText、FlashはText Routeです。
画像対応IDは?
deepseek-v4-flash-vision-expです。Chat、Messages、Responsesで-expを含めて使います。FlashはScreenshotを読める?
deepseek-v4-flashはText Routeです。Pixel依存TaskはVisionを使います。Vision ExpはTextだけでも使える?
使えますが移行理由にはなりません。測定上の利点がなければFlashを維持します。
Vision Expは安い?
名称では判断せず、画像、Output、Retry、前処理、Reviewを含むCostで比較します。
画像Token数は?
Upstream最大384 Input Token。Productionでは実際のEvoLink Usageを使います。
安定しているのは?
Flashが既存Text Route、Vision Expは実験版です。Feature Flag、Canary、Fallbackが必要です。
PDFはどちら?
抽出Textで十分ならFlash、Table、位置、手書き、Stampなどが重要ならVisionです。
Fallbackは?
画像Taskは別Vision、Textで十分なら追跡可能なOCR + Flashです。


