
DeepSeek V4 Flash Vision Exp vs Flash : image ou texte ?
Mise à jour du cycle de vie — 10 septembre 2026 : DeepSeek a publié V4.1 Flash. Sur l’API directe de DeepSeek,deepseek-v4-flashetdeepseek-v4-flash-vision-exprenvoient désormais vers V4.1 Flash, etdeepseek-v4-prodoit suivre le 14 septembre 2026 à 12 h 00, heure de Pékin (04 h 00 UTC). Sur EvoLink,deepseek-v4-flashetdeepseek-v4-prone sont pas concernés et continuent de servir DeepSeek V4 Flash et V4 Pro ;deepseek-v4-flash-vision-expredirige désormais vers DeepSeek V4.1 Flash. Voir la mise à jour officielle, la page du modèle V4.1 Flash et le guide de migration.
deepseek-v4-flash-vision-exp redirigent désormais vers V4.1 Flash : les résultats Vision Exp ci-dessous décrivent donc le modèle du 21 août, et le jeu d’évaluation image doit être relancé sur son remplaçant. Le principe de routage ne change pas : l’entrée image ne justifie pas de migrer toutes les requêtes Flash. Sur EvoLink, détectez d’abord la modalité, évaluez chaque voie avec ses propres critères et conservez un fallback validé derrière la voie image.deepseek-v4-flash-vision-exp avec compréhension d’image sur Chat Completions, Messages et Responses. Le modèle a été publié comme version expérimentale et, sur EvoLink, cet ID redirige désormais vers V4.1 Flash : vérifiez structure, usage, facturation et fallback avec des requêtes représentatives avant d’élargir la production.Verdict rapide : router par modalité, pas par nouveauté
| Condition | Premier choix | Motif |
|---|---|---|
| Capture, scan, graphique, photo ou UI rendue nécessaire | Vision Exp | Le résultat dépend d’une preuve que Flash texte ne voit pas |
| Tâche entièrement en texte, code, JSON ou sortie d’outil | Flash | La voie Vision n’ajoute aucun signal utile |
| Texte fiable déjà extrait et mise en page sans importance | Flash | Le texte normalisé suffit |
| Tableaux, position, écriture ou hiérarchie visuelle comptent | Vision Exp | L’image d’origine préserve la mise en page |
| Agent visuel observant des captures changeantes | Vision Exp + fallback | Grounding requis, déploiement progressif contrôlé |
| Classification, résumé ou code texte à fort volume | Flash | La route texte établie reste le défaut opérationnel |
Différences réelles
| Facteur | Vision Exp | Flash |
|---|---|---|
| ID | deepseek-v4-flash-vision-exp | deepseek-v4-flash |
| Statut | Publié le 21 août comme modèle image expérimental ; sur EvoLink, l’ID redirige désormais vers V4.1 Flash | Modèle texte disponible en production sur EvoLink, non concerné par le changement du 10 septembre |
| Entrée | Texte et images | Texte |
| Sortie | Texte | Texte |
| Tâches initiales | Captures, extraction de documents, graphiques, agents visuels | Code, classification, résumé, agents texte, transformation structurée |
| Évaluation | Précision visuelle, grounding, petit texte, mise en page | Précision, latence, tokens, outils, stabilité texte |
| Production | Feature flag, contrôle protocole, canary, fallback | Route texte par défaut et régressions |
image_url sur Chat, un bloc image Base64 ou URL sur Messages et input_image sur Responses. Le guide d’intégration image détaille les payloads ; Files API garde sa propre exigence documentaire.
Arbre de décision applicable
- Le résultat dépend-il d’une preuve visuelle ? Sinon, envoyer le texte normalisé à Flash.
- L’image originale est-elle nécessaire ? Si l’OCR contient tout et que la mise en page ne compte pas, rester sur Flash.
- Le protocole EvoLink accepte-t-il le format ? Sinon, arrêter ou utiliser un fallback Vision, jamais supprimer silencieusement l’image.
- La route est-elle autorisée pour ce tenant et ce workload ? Isoler la voie image par feature flag ou allowlist.
- La sortie passe-t-elle l’acceptation visuelle ? Sinon, retry borné ou failover.
if requires_visual_evidence and vision_route_verified:
route = "deepseek-v4-flash-vision-exp"
else:
route = "deepseek-v4-flash"Enregistrez la raison du routage pour auditer usage, erreurs et migrations dans le gateway unifié.
Matrice de workloads
| Workload | Route | Acceptation | Fallback |
|---|---|---|---|
| Triage de bug par capture | Vision Exp | État visible et zone pertinente corrects | Autre Vision ou revue humaine |
| Facture/formulaire | Vision si mise en page importante | Précision, omissions, traçabilité de page | OCR + Flash |
| Graphique | Vision Exp | Axes, légende, unités et tendance | Données structurées + Flash |
| Observation d’agent UI | Vision Exp | Grounding et préconditions d’action | Arbre d’accessibilité, état d’outil ou autre Vision |
| Dépôt depuis fichiers source | Flash | Tests, références de fichiers, tâche terminée | Pro ou autre modèle texte selon le risque |
| Classification/résumé | Flash | Jeu annoté et schéma de sortie | Retry ou autre texte |
| PDF avec texte propre | Flash | Complétude sur pages échantillons | Vision uniquement si perte de mise en page |
| Lot texte + captures | Séparer | Succès et coût par voie | File séparée pour les échecs visuels |
Cette séparation réserve le traitement visuel au besoin réel et évite de faire de la voie image un point unique de panne pour le trafic texte.
Comparer le coût par tâche réussie
coût tâche réussie = entrée + sortie + retries + prétraitement + revue + impact d’échecÉvaluer avec la bonne preuve
Jeu Vision Exp
- transcription et champs de scans/documents ; axes, légendes, unités et valeurs ; petit texte et UI dense ; grounding d’éléments ; refus d’inventer l’illisible ; latence, retries et corrections.
Jeu Flash
- précision texte ; schéma et outils ; première réponse et latence totale ; tokens entrée/raisonnement/sortie ; retries et escalades.
Lors de la sortie d’août, DeepSeek affirmait que Vision Exp égalait Flash sur le texte. C’est une déclaration fournisseur, pas une décision de migration. Ne déplacez le trafic texte qu’après une évaluation équivalente montrant un bénéfice produit réel, et si le risque lié au nouveau modèle est acceptable.
Déploiement EvoLink
- Vérifier que l’ID, le protocole et le champ image figurent dans les docs.
- Exécuter un appel réel et contrôler réponse, usage et facturation.
- Utiliser un feature flag, puis commencer avec un canary interne ou peu risqué.
- Étendre séparément captures, graphiques et types de documents.
- Garder Flash par défaut pour le texte jusqu’à preuve d’un bénéfice de migration.
Erreurs de routage fréquentes
| Erreur | Risque | Politique correcte |
|---|---|---|
| Remplacer Flash globalement car le modèle image est plus récent | Dépendance du trafic texte au modèle image | Router selon la preuve nécessaire |
| Envoyer tous les PDF en images | Traitement inutile si texte propre | Extraire d’abord, conserver l’image si le layout compte |
| Confondre support upstream et EvoLink | Routes différentes selon modèle/protocole | Vérifier doc EvoLink et un appel réel |
| Comparer seulement le tarif | Retries, revue et échecs absents | Mesurer le coût par tâche terminée |
| Croire une description fluide | Lecture fausse possible | Critères d’acceptation dédiés |
| Supprimer l’image sans erreur | Réponse plausible sans preuve | Échec fermé ou fallback Vision |
Retirer -exp | Sur EvoLink, cela appelle deepseek-v4-flash, texte seul | Envoyer deepseek-v4.1-flash pour les nouvelles tâches image ; si l’ancien ID est conservé, l’envoyer tel quel |
Fallback recommandé
Les captures et graphiques doivent aller vers un autre modèle Vision validé, pas vers Flash sans image. Une extraction de document peut passer par un OCR traçable puis Flash si la perte de mise en page est acceptable. Suspendez les actions destructrices d’un agent en cas de grounding incertain, bornez délais/retries/budget (un nouveau modèle ne justifie pas des retries illimités) et mesurez le fallback séparément.
Le gateway unifié EvoLink rend explicites les voies texte, Vision et fallback tout en gardant usage et coût comparables.
FAQ
Vision Exp et Flash sont-ils identiques ?
deepseek-v4-flash continue de servir V4 Flash, texte seul, tandis que deepseek-v4-flash-vision-exp redirige désormais vers DeepSeek V4.1 Flash. Sur l’API directe de DeepSeek, les deux anciens noms renvoient désormais vers V4.1 Flash.Quel ID accepte les images ?
deepseek-v4.1-flash pour les nouveaux workloads image. Les requêtes existantes vers deepseek-v4-flash-vision-exp fonctionnent toujours, mais elles sont redirigées vers V4.1 Flash.Flash peut-il lire une capture ?
deepseek-v4-flash reste la route V4 Flash texte seul. Utilisez deepseek-v4.1-flash ou un autre modèle Vision validé si les pixels comptent.Vision Exp accepte-t-il le texte seul ?
deepseek-v4-flash, sauf si votre propre évaluation montre un avantage réel de V4.1 Flash.Vision Exp est-il moins cher ?
Ne l’inférez pas du nom. Mesurez le coût complet avec image, sortie, retries, prétraitement et revue.
Combien de tokens par image ?
Quel modèle est le plus stable ?
Sur EvoLink, Flash est la route texte établie. Les requêtes vers l’ID Vision Exp tournent désormais sur V4.1 Flash : relancez votre évaluation visuelle et déployez le trafic image avec feature flag, canary et fallback validé.
PDF : Vision ou Flash ?
deepseek-v4.1-flash) si tableaux, positions, écriture, tampons ou autres preuves visuelles changent la réponse.Quel fallback pour Vision Exp ?
deepseek-v4-flash-vision-exp redirige désormais vers V4.1 Flash sur EvoLink, basculer entre ces deux IDs n’est pas un fallback.

