GPT Image 2.5 Flare & Sunburst sont disponibles sur EvoLinkEssayer GPT Image 2.5

DeepSeek V4 Flash Vision Exp API

Accédez à V4 Flash Vision de DeepSeek — aussi recherché sous DeepSeek V4 Flash Vision Exp — via l'API de chat unifiée d'EvoLink. Testez l'entrée d'images, le codage à long contexte, le mode réflexion avant d'intégrer.

DeepSeekGénération de texteDisponible
à partir de $0.265 / 1 M de tokens d’entrée$0.295 prix officiel-10%
Documentation API
Entrée imageCodage à long contexteMode thinkingChat + Messages + Responses
Route productionLive
Contexte
1M de contexte · 384K de sortie max.
Idéal pour
Compréhension de captures d’écran et de documents, QA visuel, agents multimodaux
Entrée
Texte + images
Sortie
Texte · JSON (sortie structurée)

Sur EvoLink, cet ID redirige désormais vers DeepSeek V4.1 Flash ; utilisez deepseek-v4.1-flash pour les nouvelles intégrations. Lisez le guide de migration avant de réutiliser des résultats image antérieurs.

Choisir DeepSeek V4 Flash Vision

Une route multimodale native qui lit texte et images dans la même requête, disponible via Chat Completions, Messages et Responses.

DeepSeek V4 Flash Vision

Ancien ID Vision Exp, désormais redirigé vers DeepSeek V4.1 Flash

Sélectionné
ID du modèle
deepseek-v4-flash-vision-exp
Idéal pour

Compréhension de captures d’écran et de documents, extraction de graphiques et de tableaux, pipelines OCR/UI, et charges de travail texte devant parfois lire une image.

Entrée
$0.265 / 1M-10%
18 cr / 1M$0.295prix officiel
Cache hit
$0.0059 / 1M
0.4 cr / 1M
Sortie
$1.059 / 1M-10%
72 cr / 1M$1.177prix officiel

Tous les tarifs sont par 1M de tokens, en USD et en crédits, et reflètent la tarification actuelle de votre compte.

Tarifs DeepSeek V4 Flash Vision

Estimez le coût d'une requête DeepSeek V4 Flash Vision avant l'intégration. Le calculateur utilise les tarifs actuels de votre compte ; les prix officiels servent de référence.

Calculateur de requête

Saisissez la répartition des tokens d'une requête.

Coût estimé par requête

DeepSeek V4 Flash Vision
USD$0.0006
Crédits0.0397

Estimation officielle $0.0007 · économie $0.0001 (10%)

Tokens d'entrée0.018 cr
Tokens cache hit0.0001 cr
Tokens de sortie0.0216 cr

Facturation minimale : 0.01 crédit par requête.

Guide budgétaire

Nombre approximatif de requêtes avec la répartition actuelle.
Ajouter des crédits
$10
Environ 16372 requêtes

Pour des tests rapides

$50
Environ 85642 requêtes

Pour le développement courant

$100
Environ 171284 requêtes

Pour l'évaluation en production

API DeepSeek V4 Flash Vision Exp

Sur EvoLink, les requêtes vers deepseek-v4-flash-vision-exp redirigent désormais vers DeepSeek V4.1 Flash, DeepSeek ayant retiré le modèle expérimental Vision Exp le 10 septembre 2026. Les requêtes image existantes continuent de fonctionner avec le même ID. Pour les nouvelles intégrations, utilisez deepseek-v4.1-flash, et relancez votre jeu d’évaluation image avant de vous fier aux résultats antérieurs.

DeepSeek V4 Flash Vision est servi sur EvoLink sous l'ID de modèle deepseek-v4-flash-vision-exp via Chat Completions · Anthropic Messages · Responses, avec la même clé API et le même solde que tous les autres modèles. Il offre une fenêtre de contexte de 1M et jusqu'à 384K tokens de sortie, ainsi que l'entrée d'images, le codage à long contexte, le mode réflexion.

DeepSeek V4 Flash Vision Exp

Spécifications et capacités de DeepSeek V4 Flash Vision

Les chiffres proviennent de la configuration de route EvoLink ; les capacités sont celles que l'API expose aujourd'hui.

Fenêtre de contexte
1M tokens
Sortie max.
384K tokens
Entrée
Texte + images
Sortie
Texte · JSON (sortie structurée)
Raisonnement
Mode réflexion optionnel
Cache de prompt
Lectures de cache automatiques à tarif réduit
Protocoles
Chat Completions · Anthropic Messages · Responses
ID du modèle
deepseek-v4-flash-vision-exp
Entrée image
PNG · JPEG · WebP · GIF

Les requêtes Chat Completions, Messages et Responses doivent utiliser l’ID exact affiché ici.

À quelles tâches l’API DeepSeek V4 Flash Vision est-elle adaptée ?

La compréhension d’image sur cet ID est désormais assurée par DeepSeek V4.1 Flash. Commencez par des tâches visuelles aux critères d’acceptation clairs, puis comparez qualité, latence, nouvelles tentatives et coût par résultat accepté.

Inspection de captures et d’interfaces

Envoyez des captures produit, tableaux de bord ou états d’erreur avec une question ciblée. Extrayez les libellés visibles et les différences d’état dans un résumé QA structuré. Testez petits caractères, coordonnées et interfaces denses sur un jeu fixe.

Extraction de documents et reçus

Transformez formulaires scannés, factures, reçus et pages de rapport en données structurées. Définissez les champs JSON, conservez l’image source pour l’audit et envoyez les champs absents ou incertains en revue humaine.

Analyse de graphiques et schémas

Interrogez graphiques, architectures et figures techniques dans la même requête que la preuve visuelle. Exigez une distinction entre libellés observés et interprétation, surtout pour les valeurs petites ou ambiguës.

Agents visuels et vérification UI

Associez captures et résultats d’outils pour inspecter un état de page, proposer l’action suivante ou confirmer l’écran attendu. Gardez les actions réversibles et mesurez réussite, latence, nouvelles tentatives et coût.

Qu’est-ce qui change pour DeepSeek V4 Flash Vision selon la plateforme d’accès ?

Configuration du contexte, outils, mesure d’usage et facturation peuvent varier. EvoLink centralise configuration et usage derrière une API unifiée.

Utiliser le bon ID de modèle

L’ID d’origine est deepseek-v4-flash-vision-exp ; sur EvoLink, il redirige désormais vers DeepSeek V4.1 Flash. Pour les nouvelles intégrations, utilisez deepseek-v4.1-flash et suivez les champs exacts de la documentation API actuelle.

Suivre la configuration de la route active

Les plateformes peuvent exposer différents contextes, outils et limites. Fiez-vous à la configuration EvoLink actuelle, aux fonctions disponibles et à l’usage réellement retourné.

Choisir le protocole image selon le workflow

DeepSeek documente les images pour Chat Completions, Messages et Responses. N’utilisez que les protocoles et blocs actuellement listés par EvoLink, puis testez streaming, usage et erreurs.

Garder le choix du modèle ouvert

Un compte, un solde et un schéma d’API EvoLink donnent accès à plusieurs fournisseurs. Une sélection configurable permet de router par qualité, coût et disponibilité sans réécrire l’intégration.

Comment mieux contrôler le coût de l’API DeepSeek V4 Flash Vision ?

La section Pricing affiche les tarifs Token actuels. Pour le modèle Vision Exp d’origine, DeepSeek documentait jusqu’à 384 Token d’entrée par image ; son guide Vision actuel fixe un plafond de 1024 Token par image sur l’API directe, et les requêtes vers cet ID tournent désormais sur V4.1 Flash. Appliquez la règle actuelle et ajoutez sortie, nouvelles tentatives et cache au coût de la tâche.

Budgéter l’image avant la sortie

Utilisez le plafond actuel de DeepSeek, 1024 Token par image sur son API directe, comme limite de planification, puis inspectez l’usage réel sur des captures et documents représentatifs.

Rendre le contexte répétitif compatible avec le cache

Prompts système, schémas d’outils et contexte partagé stables sont plus faciles à réutiliser. Vérifiez les cached tokens dans l’usage du protocole choisi.

N’envoyer que le contexte utile

Un grand contexte ne doit pas être rempli à chaque requête. Sélectionner fichiers, messages et passages pertinents réduit le coût et concentre le modèle sur la preuve.

Comparer le coût total par tâche

Évaluez Token, cache, outils et nouvelles tentatives pour une même tâche achevée. EvoLink centralise modèle et usage pour rendre la comparaison cohérente.

Deux façons d'utiliser DeepSeek V4 Flash Vision : API EvoLink ou Agent

Utilisez l'API EvoLink pour les backends produit et les traitements par lots, ou appelez DeepSeek V4 Flash Vision depuis Codex, Claude ou Gemini pour vos workflows de code et d'analyse. Les deux voies partagent la même clé API EvoLink, le même solde, le même ID de modèle et le même historique de requêtes.

Option 1

Intégrer avec l'API EvoLink

Idéal pour : backends produit, traitements par lots, pipelines automatisés

Envoyez à EvoLink des requêtes Chat Completions compatibles OpenAI (ou Anthropic Messages) et contrôlez l'ID de modèle, le prompt système, le budget de sortie, les outils et la sortie structurée.

  1. 1Créez une clé API EvoLink dans la console
  2. 2Pointez votre SDK OpenAI ou Anthropic vers l'URL de base EvoLink et sélectionnez l'ID de modèle affiché ci-dessus
  3. 3Envoyez une requête représentative et lisez le champ usage pour les tokens d'entrée, en cache et de sortie
  4. 4Définissez max_tokens et les réessais par tâche ; conservez les ID et résultats des appels d'outils entre les tours
Option 2

L'appeler avec un Agent

Idéal pour : tâches de code, de revue et d'analyse dans Codex, Claude et Gemini

Donnez à l'Agent la tâche, les entrées à inclure et les critères d'acceptation. Il assemble la requête, appelle DeepSeek V4 Flash Vision via EvoLink et renvoie la réponse avec la consommation de tokens.

  1. 1Définissez EVOLINK_API_KEY dans votre environnement local ; jamais dans le code ni dans un prompt
  2. 2Décrivez la tâche, les entrées à inclure et le format de sortie attendu
  3. 3Demandez à l'Agent d'appeler DeepSeek V4 Flash Vision via EvoLink et d'afficher la requête avant l'envoi
  4. 4Laissez l'Agent rapporter la réponse, la consommation de tokens et tout corps d'erreur

Exemple de code API DeepSeek V4 Flash Vision et gestion des erreurs

Cet exemple montre la requête exécutable la plus courte : un appel Chat Completions compatible OpenAI avec un prompt système, un message utilisateur et un budget de sortie. Ouvrez l'onglet API pour la référence complète des paramètres et réponses.

Voir la documentation API complète
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-flash-vision-exp",
    "messages": [
      { "role": "system", "content": "You are a senior engineer reviewing a pull request." },
      { "role": "user", "content": "Review this diff and list every risky change with file and line:\n<diff>" }
    ],
    "max_tokens": 4096,
    "temperature": 0.2
  }'

# Anthropic Messages (/v1/messages) and Responses (/v1/responses) accept the
# same model ID.
# The response includes choices[0].message and a usage object (prompt,
# cached, and completion tokens).

Requête invalide ou paramètre non pris en charge

Vérifiez l'ID de modèle, le tableau messages et les plages de paramètres dans la référence API ; retirez les champs que cette route ne prend pas en charge.

Problème d'authentification ou de solde

Vérifiez le jeton Bearer Authorization et confirmez le solde disponible dans la console.

Longueur de contexte dépassée

Les tokens du prompt dépassent la fenêtre de contexte de DeepSeek V4 Flash Vision. Réduisez ou ne récupérez que les éléments pertinents et réutilisez les préfixes en cache.

Limite de débit (429)

Attendez et réessayez avec un délai aléatoire ; regroupez ou mettez en file d'attente les requêtes au lieu de rafales parallèles.

Contenu ou appel d'outil rejeté

Vérifiez le contenu sensible, les arguments d'appel d'outil mal formés et les écarts de schéma JSON avant de réessayer.

Comment choisir le protocole d’entrée image et la route de production pour DeepSeek V4 Flash Vision ?

DeepSeek documente trois formes de protocole image. La documentation API EvoLink actuelle reste la référence pour les ID, endpoints et blocs activés.

01

Chat Completions : contenu image_url familier

Utilisez Chat Completions si l’application suit déjà le tableau messages compatible OpenAI. Confirmez Vision Exp et image_url dans la documentation EvoLink actuelle.

Chat style OpenAI
02

Messages : blocs image style Anthropic

N’utilisez Messages que si EvoLink liste les blocs image pour deepseek-v4-flash-vision-exp. Vérifiez max_tokens, usage, contenu de réflexion et erreurs.

Messages Anthropic
03

Responses : entrée d’agent multimodale

Évaluez Responses pour les agents longs utilisant input_image et une réponse structurée. Confirmez champs, outils, événements streaming et frontière de reprise.

Workflows agent
04

Production : démarrer petit et garder un repli

Envoyez d’abord peu de tâches observables à Vision Exp et gardez une route GPT, Claude ou Kimi éprouvée. EvoLink centralise sélection, usage et solde.

Déploiement progressif

Les hits de cache coûtent une fraction de l'entrée neuve

Le cache de préfixe est automatique : un prompt système stable, les consignes du dépôt et les définitions d'outils sont facturés comme hits de cache sur les requêtes suivantes plutôt qu'en entrée complète. Mesurez le taux de hit réel dans vos journaux avant d'estimer le coût d'une boucle d'agent.

Contexte de 1M tokens avec un plafond de sortie de 384K

Gardez les fichiers liés, les spécifications et l'état de l'agent dans un même contexte de travail, mais traitez le plafond comme une capacité et non un objectif : récupérez l'essentiel, gardez le préfixe stable pour qu'il soit mis en cache et fixez un budget de sortie par tâche.

Comparez DeepSeek V4 Flash Vision à Qwen 3.8 Max et GLM-5.3

EvoLink

Comparez les tarifs d’entrée/sortie, le contexte, le cache et les usages. Testez les mêmes requêtes avant de choisir une route ; les prix ci-dessous suivent les tarifs actuels de votre compte.

DeepSeek V4 Flash Vision
Entrée / Sortie$0.265 / $1.059
Contexte1M
CacheHits de cache automatiques
Idéal pourCompréhension de captures d’écran et de documents, extraction de graphiques et de tableaux, pipelines OCR/UI, et charges de travail texte devant parfois lire une image.
Qwen 3.8 Max
Entrée / Sortie$1.765 / $5.295
Contexte1.05M
CacheCache de prompt explicite
Idéal pourIngénierie à l’échelle d’un dépôt, synthèse multi-documents, agents à forts appels d’outils
GLM-5.3
Entrée / Sortie$1.059 / $3.706
Contexte1M
CacheHits de cache automatiques
Idéal pourAgents de codage, longues chaînes de tâches, workflows riches en outils

Que vérifier avant d’utiliser DeepSeek V4 Flash Vision en production ?

Commencez avec quelques charges réelles et validez qualité, latence, coût et fiabilité avant de déplacer davantage de trafic.

Intégration et usage sont clairs

Confirmez ID, protocole, réponses, usage et cache. Ces données rendent l’analyse des coûts et l’observabilité comparables.

Les résultats visuels répondent au besoin

Testez captures, formulaires, graphiques et états UI : exactitude des champs, omissions, petits caractères, détails inventés, structure valide et corrections humaines.

Latence et gestion d’erreurs sont adaptées

Mesurez le temps de réponse et préparez les reprises pour limites, timeouts, sorties structurées invalides et erreurs d’outils. Gardez une alternative validée.

Coût et choix restent contrôlables

Calculez le coût d’une même classe de tâches avec Pricing, usage et facture finale, puis décidez si Vision Exp est la route principale, spécialisée ou de secours.

Débutez avec des tâches observables et réversibles. N’augmentez le trafic qu’après validation de la qualité, de la latence et du coût. Plusieurs modèles derrière l’API unifiée EvoLink simplifient les changements.

Famille de modèles DeepSeek V4

Même clé API, même solde : changez de palier sans toucher à l’intégration.

DeepSeek V4.1 Flash

DeepSeek V4.1 Flash

Le modèle Flash multimodal de DeepSeek pour les charges texte et image

Voir le modèle
DeepSeek V4 Pro

DeepSeek V4 Pro

Modèle DeepSeek de raisonnement et d’utilisation d’outils

Voir le modèle
DeepSeek V4 Flash

DeepSeek V4 Flash

Modèle DeepSeek de raisonnement et d’utilisation d’outils

Voir le modèle

Autres modèles texte sur EvoLink en plus de DeepSeek V4 Flash Vision

GPT-5.6

GPT-5.6

La gamme frontier d’OpenAI pour comparer capacités, latence et flexibilité du routage des coûts.

Voir le modèle
Claude Opus 5

Claude Opus 5

La route premium d’Anthropic pour les agents longs, l’utilisation d’outils et les revues complexes.

Voir le modèle
Kimi K3

Kimi K3

La route de raisonnement long contexte de Moonshot avec un tarif distinct pour l’entrée en cache.

Voir le modèle
DeepSeek V4 Flash

DeepSeek V4 Flash

La variante Flash en texte seul, sans entrée image ; comparez ses tarifs dans Pricing au lieu de les supposer identiques. Utilisez-la quand votre charge n’envoie jamais d’images.

Voir le modèle

Pour aller plus loin avec DeepSeek V4 Flash Vision

Utiliser l’API DeepSeek V4 Flash Vision Exp

Utiliser l’API DeepSeek V4 Flash Vision Exp

Envoyer des URL d’image ou du Base64 avec les formats Chat, Messages et Responses documentés.

Lire le guide
DeepSeek V4 Flash Vision Exp vs Flash

DeepSeek V4 Flash Vision Exp vs Flash

Router les preuves visuelles vers Vision Exp et le texte à fort débit vers Flash.

Lire le guide
Test API DeepSeek V4 : Flash vs Pro

Test API DeepSeek V4 : Flash vs Pro

Comparer coût, mode de réflexion et checklist de mise en production.

Lire le guide
Guide de migration DeepSeek V4.1 Flash

Guide de migration DeepSeek V4.1 Flash

Quels ID DeepSeek ont changé sur l’API directe et sur EvoLink, et comment tester V4.1 Flash avant de déplacer du trafic.

Lire le guide

FAQ sur l’API DeepSeek V4 Flash Vision Exp

Quel est l’ID du modèle ?

L’ID d’origine est deepseek-v4-flash-vision-exp, publié comme modèle expérimental le 21 août 2026. Sur EvoLink, l’ID fonctionne toujours mais redirige désormais vers DeepSeek V4.1 Flash ; les nouvelles intégrations doivent utiliser deepseek-v4.1-flash.

L’entrée image est-elle disponible via EvoLink ?

La documentation API EvoLink actuelle fait autorité. Considérez un protocole actif seulement s’il est documenté et si une requête réelle fonctionne sur votre compte.

Quels formats d’image sont pris en charge en amont ?

DeepSeek documente JPEG, PNG, GIF et WebP. Vérifiez chez EvoLink les règles URL, Base64, taille de fichier et images multiples.

Combien de Token d’entrée utilise une image ?

Pour le modèle Vision Exp d’origine, DeepSeek documentait jusqu’à 384 Token d’entrée par image. Son guide Vision actuel fixe un plafond de 1024 Token par image sur l’API directe, et les requêtes vers cet ID tournent désormais sur V4.1 Flash. Planifiez avec la règle actuelle, puis inspectez l’usage réel et les tarifs en direct sur des images représentatives ; prompt, images multiples, sortie, reprises et cache influencent aussi la facture.

Chat Completions, Messages ou Responses ?

Choisissez le protocole déjà utilisé par l’application si EvoLink y documente l’image pour ce modèle. Vérifiez la structure active avant l’implémentation.

Quand choisir Vision Exp plutôt que V4 Flash ?

Pour les nouvelles tâches image sur EvoLink, utilisez deepseek-v4.1-flash ; les requêtes vers deepseek-v4-flash-vision-exp y sont déjà redirigées. Gardez deepseek-v4-flash pour le texte seul et les tâches orientées débit : il n’est pas concerné et sert toujours V4 Flash.

Peut-on lui confier les interfaces denses et petits textes ?

Traitez interface dense, petit texte, coordonnées et tableaux comme des cas d’évaluation. Comparez un jeu fixe à la vérité terrain et faites revoir les résultats incertains.

Quelles sont les limites de débit et de taille ?

Ne les déduisez pas de la route Flash texte. Consultez la documentation EvoLink actuelle et testez 429, timeout et images trop grandes avant l’expansion.

Comment comparer avec d’autres modèles vision ?

Utilisez les mêmes images, prompts, schémas et critères. Comparez exactitude, hallucinations, latence, reprises et coût par résultat accepté.

Quel repli garder au déploiement ?

Gardez un modèle validé pour la même tâche visuelle et rendez la sélection configurable. Les modèles texte seul comme V4 Flash ne peuvent pas reprendre les tâches image. Démarrez avec peu de trafic et basculez si le modèle actuel n’atteint pas votre seuil de production.