GPT Image 2.5 Flare & Sunburst が EvoLink で利用可能にGPT Image 2.5 を試す

DeepSeek V4 Flash Vision Exp API

DeepSeek の V4 Flash Vision(DeepSeek V4 Flash Vision Exp とも検索されます)に EvoLink の統一チャット API からアクセス。統合前に画像入力、長いコンテキストでのコーディング、思考モードを試せます。

DeepSeekテキスト生成利用可能
入力 100 万トークンあたり $0.265 から$0.295 公式価格-10%
API ドキュメント
画像入力長文コンテキストでのコーディング思考モードChat + Messages + Responses
本番ルート公開中
コンテキスト
コンテキスト 1M · 最大出力 384K
適した用途
スクリーンショット・文書理解、画像 QA、マルチモーダルエージェント
入力
テキスト + 画像
出力
テキスト · JSON(構造化出力)

EvoLink では、この ID は現在 DeepSeek V4.1 Flash にリダイレクトされます。新規連携には deepseek-v4.1-flash を使ってください。以前の画像結果を再利用する前に、移行ガイドをお読みください。

DeepSeek V4 Flash Vision を選ぶ

テキストと画像を同じリクエストで扱えるネイティブマルチモーダルルートです。Chat Completions、Messages、Responses の 3 つのプロトコルで利用できます。

DeepSeek V4 Flash Vision

Vision Exp の旧モデル ID。現在は DeepSeek V4.1 Flash に転送

選択中
モデル ID
deepseek-v4-flash-vision-exp
適した用途

スクリーンショットや文書の理解、図表の抽出、OCR・UI 解析、そして画像を読む必要があるテキスト処理。

入力
$0.265 / 1M-10%
18 cr / 1M$0.295公式価格
キャッシュヒット
$0.0059 / 1M
0.4 cr / 1M
出力
$1.059 / 1M-10%
72 cr / 1M$1.177公式価格

すべての料金は 100 万トークンあたりで、USD とクレジットの両方で表示され、お使いのアカウントの現在の価格を反映します。

DeepSeek V4 Flash Vision の料金

統合前に DeepSeek V4 Flash Vision の 1 リクエストあたりの費用を見積もれます。計算機はお使いのアカウントの現在の料金を使い、公式価格は比較用の参考として表示します。

リクエスト計算機

1 リクエスト分のトークン構成を入力してください。

1 リクエストの推定費用

DeepSeek V4 Flash Vision
USD$0.0006
クレジット0.0397

公式価格の見積 $0.0007 · $0.0001 お得(10%)

入力トークン0.018 cr
キャッシュヒットトークン0.0001 cr
出力トークン0.0216 cr

最低課金:1 リクエストあたり 0.01 クレジット。

予算の目安

現在のトークン構成でのおおよそのリクエスト数。
クレジットを追加
$10
約 16372 リクエスト

手早いテスト向け

$50
約 85642 リクエスト

日常的な開発向け

$100
約 171284 リクエスト

本番評価向け

DeepSeek V4 Flash Vision Exp API

EvoLink では、deepseek-v4-flash-vision-exp へのリクエストは現在 DeepSeek V4.1 Flash にリダイレクトされます。DeepSeek は 2026 年 9 月 10 日に実験モデルの Vision Exp の提供を終了しました。既存の画像リクエストは同じ ID のまま動作します。新規連携には deepseek-v4.1-flash を使い、以前の結果を頼りにする前に画像の評価セットを再実行してください。

DeepSeek V4 Flash Vision は EvoLink ではモデル ID deepseek-v4-flash-vision-exp として Chat Completions · Anthropic Messages · Responses で提供され、他のモデルと同じ API キーと残高で使えます。1M のコンテキストウィンドウと最大 384K トークンの出力に加えて画像入力、長いコンテキストでのコーディング、思考モードを備えています。

DeepSeek V4 Flash Vision Exp

DeepSeek V4 Flash Vision の仕様と機能

数値は EvoLink のルート設定に基づき、機能は API が現在提供しているものです。

コンテキストウィンドウ
1M トークン
最大出力
384K トークン
入力
テキスト + 画像
出力
テキスト · JSON(構造化出力)
推論
思考モード(任意)
プロンプトキャッシュ
自動キャッシュ読み取り(低価格)
プロトコル
Chat Completions · Anthropic Messages · Responses
モデル ID
deepseek-v4-flash-vision-exp
画像入力
PNG · JPEG · WebP · GIF

Chat Completions、Messages、Responses のリクエストでは、ここに表示される正確なモデル ID を使用します。

DeepSeek V4 Flash Vision APIはどのタスクに向いていますか?

このIDでの画像理解は、現在DeepSeek V4.1 Flashが提供しています。合格条件が明確な視覚タスクから始め、品質、遅延、Retry、合格結果あたりの費用を比較します。

スクリーンショットとUI検査

製品画面、Dashboard、エラー状態を明確な質問とともに送り、表示ラベルや状態差を抽出して構造化QAとして返します。自動化前に固定テストセットで小さな文字、座標、密集UIを検証します。

文書と領収書の抽出

スキャンしたフォーム、請求書、領収書、レポートを構造化データに変換します。期待するJSONフィールドを定義し、監査用に原画像を保存し、不足または低信頼の項目を人の確認に回します。

グラフと図の分析

グラフ、アーキテクチャ図、技術図版を視覚証拠と同じRequestで質問します。値が小さい、または曖昧な場合は、観察したラベルと解釈を分けて出力させます。

ビジュアルAgentとUI検証

ScreenshotとTool結果を組み合わせ、Agentに画面状態の検査、次の操作提案、到達画面の確認を行わせます。操作は戻せるようにし、完了率、遅延、Retry、費用を測定します。

DeepSeek V4 Flash Vision は接続プラットフォームによって何が変わりますか?

Context設定、Tool、Usage表示、課金はプラットフォームごとに異なる場合があります。EvoLinkは設定とUsageを統一APIにまとめます。

正しいモデルIDを使う

元のモデルIDはdeepseek-v4-flash-vision-expで、EvoLinkでは現在V4.1 Flashにリダイレクトされます。新規連携ではdeepseek-v4.1-flashを使います。旧IDを使い続ける場合は-expを省略せず、現在のAPIドキュメントにある正確なフィールドを使用します。

現在のルート設定を基準にする

公開されるContext、Tool、Limitはプラットフォームで異なります。EvoLinkの現在のモデル設定、利用可能機能、実際に返るUsageを基準にします。

画像プロトコルをWorkflowで選ぶ

DeepSeekはChat Completions、Messages、Responsesの画像入力を記載しています。EvoLinkが現在このモデルに記載する形式だけを使い、Streaming、Usage、Errorをテストします。

Gateway内でモデル選択を維持する

一つのEvoLinkアカウント、残高、API形式で複数Providerを利用できます。モデルを設定で切り替えれば、品質、費用、可用性でRouteを変更できます。

DeepSeek V4 Flash Vision の API コストをより正確に管理するには?

既存Pricingが現在のToken単価を表示します。元のVision Expモデルについて、DeepSeekは画像1枚あたり最大384入力Tokenと記載していました。現在のVision Guideは公式APIの上限を画像1枚あたり1024 Tokenとしており、このIDへのRequestは現在V4.1 Flashで処理されます。完了タスク費用は、現在のルールにLive料金、Output、Retry、Cacheを合わせて見積もります。

Outputより先に画像入力を見積もる

DeepSeek公式APIの現在の上限である画像1枚1024 Tokenを計画上限にし、代表的なScreenshotと文書で実際のUsageを確認します。複数画像、長いPrompt、Output、Retryも最終料金に含まれます。

繰り返すContextをCache向けにする

安定したSystem Prompt、Tool Schema、共有Contextは再利用しやすくなります。選択したProtocolのcached tokensを確認します。

必要なContextだけ送る

大きなContext Windowを毎回満たす必要はありません。関連ファイル、Message、検索区間だけを選ぶと費用を抑え、証拠に集中できます。

完了タスクの総費用で比較する

同じ完了タスクについてToken、Cache、Tool、必要なRetryを評価します。EvoLinkのモデルとUsage情報で比較基準をそろえます。

DeepSeek V4 Flash Vision を使う 2 つの方法:EvoLink API または Agent

プロダクトのバックエンドやバッチ処理には EvoLink API を、コーディングや分析のワークフローには Codex・Claude・Gemini から DeepSeek V4 Flash Vision を直接呼び出せます。どちらも同じ EvoLink API キー、残高、モデル ID、リクエスト履歴を共有します。

方法 1

EvoLink API で統合する

向いている用途:プロダクトのバックエンド、バッチ処理、自動化パイプライン

OpenAI 互換の Chat Completions(または Anthropic Messages)リクエストを EvoLink に送り、モデル ID、システムプロンプト、出力予算、ツール、構造化出力を自分で制御します。

  1. 1コンソールで EvoLink API キーを作成する
  2. 2OpenAI または Anthropic の SDK の base URL を EvoLink に向け、上に表示されたモデル ID を選ぶ
  3. 3代表的なリクエストを 1 件送り、usage フィールドで入力・キャッシュ・出力トークンを確認する
  4. 4タスクごとに max_tokens と再試行を設定し、複数ターンでは tool-call の ID と結果を保持する
方法 2

Agent から呼び出す

向いている用途:Codex・Claude・Gemini でのコーディング、レビュー、分析

タスク、含める入力、受け入れ基準を Agent に渡すと、Agent がリクエストを組み立て、EvoLink 経由で DeepSeek V4 Flash Vision を呼び出し、回答をトークン使用量とともに返します。

  1. 1EVOLINK_API_KEY をローカル環境変数に設定する(コードやプロンプトには書かない)
  2. 2タスク、含める入力、期待する出力形式を説明する
  3. 3EvoLink 経由で DeepSeek V4 Flash Vision を呼び出し、送信前にリクエストを表示するよう Agent に指示する
  4. 4回答、トークン使用量、エラー本文を Agent に報告させる

DeepSeek V4 Flash Vision API のコード例とエラー処理

この例は最短で実行できるリクエストです:システムプロンプト、ユーザーメッセージ、出力予算を含む OpenAI 互換の Chat Completions 呼び出し。パラメータとレスポンスの完全なリファレンスは API タブを開いてください。

完全な API ドキュメントを見る
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash-vision-exp",
    "messages": [
      { "role": "system", "content": "You are a senior engineer reviewing a pull request." },
      { "role": "user", "content": "Review this diff and list every risky change with file and line:\n<diff>" }
    ],
    "max_tokens": 4096,
    "temperature": 0.2
  }'

# Anthropic Messages (/v1/messages) and Responses (/v1/responses) accept the
# same model ID.
# The response includes choices[0].message and a usage object (prompt,
# cached, and completion tokens).

無効なリクエストまたは未対応パラメータ

API リファレンスに照らしてモデル ID、messages 配列、パラメータ範囲を確認し、このルートが対応しないフィールドを削除してください。

認証または残高の問題

Authorization の Bearer トークンを確認し、コンソールで利用可能残高を確かめてください。

コンテキスト長の超過

プロンプトのトークンが DeepSeek V4 Flash Vision のコンテキストウィンドウを超えています。必要な情報だけに絞るか検索で取り出し、キャッシュ済みプレフィックスを再利用してください。

レート制限(429)

バックオフとジッターを入れて再試行し、並列バーストではなくバッチやキューで送ってください。

コンテンツまたはツール呼び出しの拒否

再試行の前に、センシティブな内容、形式不正の tool-call 引数、JSON スキーマの不一致を確認してください。

DeepSeek V4 Flash Vision で画像入力プロトコルと本番ルートをどう選ぶか

DeepSeekは3種類の画像対応形式を記載しています。有効なモデルID、Endpoint、Content Blockは現在のEvoLink APIドキュメントを正とします。

01

Chat Completions:image_url形式

既存ApplicationがOpenAI互換messages配列を使う場合に選びます。現在のEvoLinkドキュメントでVision Expとimage_urlを確認します。

OpenAI形式Chat
02

Messages:Anthropic形式の画像Block

EvoLinkがdeepseek-v4-flash-vision-expの画像Blockを明記する場合のみ使います。max_tokens、Usage、Thinking、Errorを確認します。

Anthropic Messages
03

Responses:マルチモーダルAgent入力

input_imageと構造化Responseを使う長いAgent Workflowで評価します。Field、Tool、Streaming Event、Retry境界を確認します。

Agent Workflow
04

本番:小さく始めFallbackを維持

少数の観測可能なタスクをVision Expへ送り、検証済みGPT、Claude、Kimi Routeを残します。EvoLinkがモデル選択、Usage、残高を集約します。

段階的導入

キャッシュヒットは新規入力のごく一部の料金

プレフィックスキャッシュは自動です。安定したシステムプロンプト、リポジトリの指示、ツール定義は、後続のリクエストで完全な入力ではなくキャッシュヒットとして課金されます。エージェントループのコストを見積もる前に、実際のヒット率をログで計測してください。

1M トークンのコンテキストと 384K の出力上限

関連ファイル、仕様、エージェントの状態を 1 つの作業コンテキストにまとめられますが、上限は容量であって目標ではありません。必要なものだけ取得し、プレフィックスを安定させてキャッシュに当て、タスクごとに出力予算を設定してください。

DeepSeek V4 Flash Vision を Qwen 3.8 Max・GLM-5.3 と比較

EvoLink

入出力料金、コンテキスト、キャッシュ、適した用途を比較します。同じリクエストで検証してからルートを選択してください。下表はアカウントの現在の料金です。

DeepSeek V4 Flash Vision
入力 / 出力$0.265 / $1.059
コンテキスト1M
キャッシュ自動キャッシュヒット
最適な用途スクリーンショットや文書の理解、図表の抽出、OCR・UI 解析、そして画像を読む必要があるテキスト処理。
Qwen 3.8 Max
入力 / 出力$1.765 / $5.295
コンテキスト1.05M
キャッシュ明示的なプロンプトキャッシュ
最適な用途リポジトリ規模のエンジニアリング、複数文書の統合、ツール多用エージェント
GLM-5.3
入力 / 出力$1.059 / $3.706
コンテキスト1M
キャッシュ自動キャッシュヒット
最適な用途コーディングエージェント、長いタスクチェーン、ツール多用ワークフロー

DeepSeek V4 Flash Vision を本番利用する前に何を確認しますか?

少数の実タスクから始め、品質、遅延、費用、信頼性を確認してからTrafficを増やします。

接続とUsageが明確

ID、Protocol、Response、Usage、Cache情報を確認します。これにより費用分析と観測方法を統一できます。

視覚結果が業務要件を満たす

Screenshot、Form、Graph、UI状態について、項目精度、欠落、小文字、架空の詳細、構造有効性、人の修正量を検証します。

遅延とError処理が期待どおり

応答時間を測り、Limit、Timeout、不正な構造化Output、Tool失敗へのRetryを準備します。検証済みの代替Routeを維持します。

費用とモデル選択を制御できる

Pricing、Usage、最終請求で同種タスクの費用を計算し、Vision ExpをDefault、専門、Fallbackのどこに置くか決めます。

観測可能で戻せる少数タスクから開始し、品質、遅延、費用が基準を満たした後に拡大します。EvoLink統一API内に複数モデルを保つと切替と最適化が容易です。

DeepSeek V4 モデルファミリー

同じ API キーと残高のまま、統合を変えずにティアを切り替えられます。

DeepSeek V4.1 Flash

DeepSeek V4.1 Flash

テキストと画像のワークロードに対応する DeepSeek のマルチモーダル Flash モデル

モデルを見る
DeepSeek V4 Pro

DeepSeek V4 Pro

DeepSeek の推論・ツール利用モデル

モデルを見る
DeepSeek V4 Flash

DeepSeek V4 Flash

DeepSeek の推論・ツール利用モデル

モデルを見る

DeepSeek V4 Flash Vision 以外の EvoLink のテキストモデル

GPT-5.6

GPT-5.6

性能、遅延、コストルーティングの柔軟性を比較できる OpenAI の階層型フロンティアファミリーです。

モデルを見る
Claude Opus 5

Claude Opus 5

長時間実行エージェント、ツール利用、複雑なレビュー向けの Anthropic プレミアムルートです。

モデルを見る
Kimi K3

Kimi K3

キャッシュ入力が別料金の Moonshot 長文コンテキスト推論ルートです。

モデルを見る
DeepSeek V4 Flash

DeepSeek V4 Flash

テキスト専用の V4 Flash。画像入力には対応しません。料金は各モデルの Pricing で確認し、画像を送らないワークロードで使います。

モデルを見る

DeepSeek V4 Flash Vision の関連記事

DeepSeek V4 Flash Vision Exp APIの使い方

DeepSeek V4 Flash Vision Exp APIの使い方

文書化されたChat、Messages、Responses形式で画像URLまたはBase64を送ります。

ガイドを読む
DeepSeek V4 Flash Vision Exp vs Flash

DeepSeek V4 Flash Vision Exp vs Flash

画像証拠はVision Exp、テキスト高処理量タスクはFlashへRouteします。

ガイドを読む
DeepSeek V4 APIレビュー:Flash vs Pro

DeepSeek V4 APIレビュー:Flash vs Pro

費用、Thinking Mode、本番導入Checklistを比較します。

ガイドを読む
DeepSeek V4.1 Flash 移行ガイド

DeepSeek V4.1 Flash 移行ガイド

DeepSeek公式APIとEvoLinkでどのモデルIDが変わったのか、トラフィックを移す前にV4.1 Flashをどう検証するかを解説します。

ガイドを読む

DeepSeek V4 Flash Vision Exp API FAQ

モデルIDは何ですか?

元のモデルIDはdeepseek-v4-flash-vision-expで、2026年8月21日に実験モデルとして公開されました。EvoLinkではこのIDを引き続き使えますが、現在はDeepSeek V4.1 Flashにリダイレクトされます。新規連携ではdeepseek-v4.1-flashを使ってください。

EvoLinkで画像入力を利用できますか?

現在のEvoLink APIドキュメントをRouteの正とします。文書化され、実際のAccount Requestが成功したProtocolだけを有効と判断します。

上流モデルの対応画像形式は?

DeepSeekはJPEG、PNG、GIF、WebPを記載しています。EvoLink固有のURL、Base64、File Size、複数画像要件も確認します。

画像1枚の入力Tokenは?

元のVision Expモデルについて、DeepSeekは画像1枚あたり最大384入力Tokenと記載していました。現在のVision Guideは公式APIの上限を画像1枚あたり1024 Tokenとしており、このIDへのRequestは現在V4.1 Flashで処理されます。現在のルールで計画し、代表的な画像で実UsageとLive Pricingを確認してください。Prompt、複数画像、Output、Retry、Cacheも最終料金に影響します。

Chat Completions、Messages、Responsesのどれを使いますか?

EvoLinkがこのモデルの画像対応を記載している場合、既存ApplicationのProtocolを選びます。実装前に現在のRequest構造を確認します。

Vision ExpとV4 Flashの使い分けは?

EvoLinkで新しい画像タスクを始めるなら、deepseek-v4.1-flashを使います。deepseek-v4-flash-vision-expへのRequestはすでにそこへリダイレクトされます。テキスト専用・高処理量タスクはdeepseek-v4-flashに残します。このIDは影響を受けず、引き続きV4 Flashを提供します。

密集UIや小文字を任せられますか?

密集UI、小文字、座標、表は保証ではなく評価ケースです。固定テストセットを正解データと比較し、不確実な結果を人が確認します。

Rate LimitとFile Size上限は?

テキストFlash Routeから推測しません。現在のEvoLinkドキュメントを確認し、拡大前に429、Timeout、過大画像をテストします。

他のVisionモデルとどう比較しますか?

同じ画像、Prompt、Output Schema、審査基準を使い、精度、Hallucination、遅延、Retry、合格結果あたりの費用を比較します。

どのFallbackを残すべきですか?

同じ視覚タスクで検証済みのモデルを残し、選択を設定可能にします。V4 Flashのようなテキスト専用モデルは、画像タスクを引き継げません。少量Trafficから始め、現在のモデルがProduction基準を下回れば切り替えます。