Seedance 2.5 est disponible sur EvoLinkEssayer Seedance 2.5
Workflow Agent DeepSeek V4 Pro reliant fichiers de code, outils, validation et routes de fallback
Lancement produit

DeepSeek V4 Pro 0813 est disponible : changements pour Agents et Codex

Jessie
Jessie
COO
6 avril 2026
Mis à jour le 13 août 2026
9 min de lecture
Mis à jour le 13 août 2026
Ce suivi de sortie a été révisé pour la mise à jour API DeepSeek-V4-Pro-0813. Le nom d'appel reste deepseek-v4-pro ; les changements importants concernent la version sous-jacente, l'intégration Agent, Responses API et Codex.
L'API officielle DeepSeek V4 Pro sert désormais DeepSeek-V4-Pro-0813 sous le nom d'appel inchangé deepseek-v4-pro. Il n'est pas nécessaire d'inventer un ID daté ni de réécrire la logique de sélection. En revanche, le build derrière l'alias stable a changé : réussite des agents, outils, latence, consommation de tokens et fallbacks doivent être retestés.
DeepSeek documente aussi une prise en charge native de la Responses API pour V4 Flash et V4 Pro, ainsi qu'une configuration directe de Codex. Sur la route officielle, cela remplace le proxy de traduction Responses vers Chat Completions auparavant utilisé par de nombreux développeurs.
Pour les utilisateurs d'EvoLink, la bonne démarche consiste à conserver la route actuelle, comparer Pro et Flash sur les mêmes tâches et vérifier chaque interface de production séparément. La compatibilité upstream ne prouve pas que chaque passerelle expose le même endpoint. Consultez la page modèle DeepSeek V4 pour les routes et tarifs EvoLink actuels.

Réponse rapide : que change DeepSeek V4 Pro 0813 ?

QuestionRéponse vérifiée au 13 août 2026
Version servieDeepSeek-V4-Pro-0813
Nom de modèle appelableInchangé : deepseek-v4-pro
Responses APIDocumentée pour deepseek-v4-flash et deepseek-v4-pro
Utilisation directe dans CodexOui, avec la configuration Responses native de DeepSeek
Contexte et sortie maximaleContexte de 1M tokens, jusqu'à 384K en sortie
Tests à refaireRéussite Agent, outils, streaming, tokens, latence, erreurs et fallback

L'alias stable et le build daté ont des rôles différents

  • DeepSeek-V4-Pro-0813 désigne la version documentée.
  • deepseek-v4-pro reste le nom officiel à envoyer à l'API.
Ne remplacez pas ce nom par une valeur supposée comme deepseek-v4-pro-0813. Un ID daté utilisé par un agrégateur ne devient pas automatiquement l'alias officiel DeepSeek.

L'alias stable réduit le coût de migration, mais impose d'enregistrer la date et le comportement de chaque évaluation. Une mise à jour fournisseur peut modifier qualité, outils, latence ou tokens sans changement de code.

Pourquoi Responses API et Codex changent le workflow Agent

Codex communique avec les fournisseurs personnalisés via une interface de type Responses. Avant le support natif, DeepSeek V4 nécessitait souvent une couche de traduction vers Chat Completions. DeepSeek documente maintenant https://api.deepseek.com comme base URL et une configuration partagée par Codex CLI, l'application de bureau ChatGPT et l'extension Codex pour VS Code.

« Compatible Responses » ne signifie cependant pas que toutes les fonctions OpenAI Responses sont présentes :

CapacitéÉtatConséquence en production
Texte, instructions, streamingPris en chargeAdapté aux sessions de code textuelles
Fonctions et recherche Web serveurPris en chargeTester les schémas et retours sur des tâches réelles
Outil personnalisé apply_patchPris en chargeCouvre un workflow central d'édition Codex
Effort de raisonnementPris en chargeRemesurer qualité, latence et coût par niveau
Images et fichiers en entréeNon pris en chargePrétraiter les tâches multimodales
file_search, code_interpreter, computer_use, MCPIgnorésNe pas déduire la parité des outils du nom du protocole
previous_response_id, conversation, storeNon pris en chargeLe client doit conserver le contexte utile
Background et service tierNon pris en chargePrévoir orchestration et retries pour les longues tâches

Les paramètres non pris en charge peuvent être ignorés silencieusement. Une réponse HTTP réussie ne suffit donc pas : chaque fonction nécessaire à l'agent doit être vérifiée dans son comportement.

Workflow de migration DeepSeek V4 avec évaluation progressive, routage de modèles et fallbacks
Workflow de migration DeepSeek V4 avec évaluation progressive, routage de modèles et fallbacks

Les tarifs fournisseur sont plus bas, sans garantie de durée

DeepSeek affiche actuellement ces tarifs directs par million de tokens :

ModèleEntrée en cacheEntrée hors cacheSortie
deepseek-v4-flash$0.0028$0.14$0.28
deepseek-v4-pro$0.003625$0.435$0.87
Ce sont les tarifs directs de DeepSeek, valables jusqu'au 16 août 2026 à 16:00 UTC, pas la facturation EvoLink. DeepSeek a déjà publié la nouvelle grille tarifaire qui entre en vigueur à ce moment-là : double tarif heures pleines/heures creuses (heures pleines de 01:00 à 04:00 et de 06:00 à 10:00 UTC ; les heures creuses sont à 50% du tarif plein), avec Pro à $0.66 en entrée hors cache / $1.98 en sortie par 1M en heures creuses ($1.32 / $3.96 en heures pleines) et un prix cache hit d'environ 1/30 du prix hors cache. Pour EvoLink, utilisez le bloc tarifaire partagé de la page modèle DeepSeek V4 Pro au lieu de recopier les prix upstream dans un budget de production.
Pour les agents, mesurez le coût par tâche réussie : tokens de raisonnement, contexte répété, boucles d'outils, retries et échecs inclus.

Ce que les équipes de production doivent retester

ÉtapeTestCritère de passage
1. IdentitéJournaliser alias, date, endpoint et routeAucun ID daté supposé dans le code
2. Évaluation hors ligneAnalyse de dépôt, debug, refactoring et outilsPas de régression critique
3. ProtocoleStreaming, fonctions, Web, apply_patch, champs ignorésOutils requis fiables
4. CoûtEntrée, cache, raisonnement, sortie, retries et coût de succèsBudget respecté
5. CanaryFaible part de trafic Pro avec fallbackErreurs et latence conformes aux SLO
6. DéploiementÉtendre par type de workloadRollback toujours disponible
Pro est un bon premier candidat pour le debug à l'échelle d'un dépôt, l'architecture, le refactoring long et les investigations riches en outils. Flash reste la voie économique pour transformations courantes, résumés, génération de tests et fort volume. Le comparatif Flash vs Pro détaille ce routage.

EvoLink ne transforme pas une sortie upstream en recommandation de migration générale. Sa valeur est de comparer et router les modèles dans un même workflow API et de facturation.

  1. Vérifiez endpoints, modèles et tarifs sur la page DeepSeek V4.
  2. Évaluez Pro et Flash avec le même jeu de tâches.
  3. Conservez un fallback validé pour les workloads sensibles à la qualité ou aux outils.
  4. Ne supposez pas la disponibilité de Responses sur EvoLink avant documentation et test de l'endpoint exact.
  5. Utilisez le guide de statut et de fallback DeepSeek pour votre politique de production.

La passerelle unifiée garde ainsi sa valeur : le modèle peut évoluer, tandis que l'évaluation, l'observabilité, la facturation et le fallback restent cohérents.

Ce qui reste non vérifié

Les documents officiels confirment version, alias, contexte, sortie, prix actuels, compatibilité Responses et configuration Codex. Ils ne prouvent pas que 0813 gagne sur toutes les tâches de code ni qu'il peut remplacer un fallback premium sans test.

Cet article ne publie donc ni victoire benchmark non étayée, ni pourcentage inventé face à la Preview, ni exemple EvoLink /v1/responses non vérifié.

FAQ

DeepSeek V4 Pro 0813 est-il un nouveau nom de modèle API ?

Non. DeepSeek-V4-Pro-0813 est la version ; le nom appelable reste deepseek-v4-pro.

Faut-il modifier les requêtes existantes ?

Le paramètre modèle ne change pas. Il faut néanmoins refaire les tests de régression car le build derrière l'alias a évolué.

V4 Pro prend-il en charge Responses API ?

Oui. DeepSeek liste Pro et Flash dans ses documents Models et Responses.

Codex peut-il se connecter sans l'ancien proxy ?

Oui pour la route officielle DeepSeek. Chaque autre passerelle doit documenter et vérifier son propre endpoint Responses.

Une configuration couvre-t-elle CLI, Desktop et VS Code ?

Selon DeepSeek, ces clients Codex partagent le même fichier de configuration.

Quels outils sont pris en charge ?

Fonctions, recherche Web serveur et apply_patch. MCP, computer use, file search, code interpreter et les autres outils personnalisés ne le sont pas.

Les images et fichiers sont-ils acceptés ?

Non. L'entrée texte est prise en charge ; les images peuvent être remplacées par un texte indicatif.

Responses API conserve-t-elle un état ?

Non. Conversation, store, background et previous_response_id ne sont pas pris en charge ; le client gère le contexte.

Où sont les benchmarks de DeepSeek V4 Pro 0813 ?

Les canaux officiels évoquent pour le build 0813 de forts gains sur les suites orientées agents (Terminal-Bench 2.1, DeepSWE, CyberGym), mais au 13 août 2026, DeepSeek n'a pas publié de tableau de benchmarks formel pour 0813, et les scores agrégés tiers reflètent encore largement le build Preview. Considérez les chiffres 0813 en circulation comme provisoires, vérifiez leurs sources et appuyez-vous sur l'évaluation de vos propres charges de travail avant de rediriger le trafic de production.

Le tarif de DeepSeek V4 Pro a-t-il changé ?

DeepSeek affiche actuellement $0.003625 en entrée cache, $0.435 hors cache et $0.87 en sortie par million de tokens, des tarifs valables jusqu'au 16 août 2026 à 16:00 UTC, date d'entrée en vigueur de la nouvelle tarification heures pleines/heures creuses déjà publiée (Pro en heures creuses : $0.022 / $0.66 / $1.98 ; heures pleines à 2×). Vérifiez la page de prix avant de budgéter ; les tarifs EvoLink sont maintenus séparément sur la page modèle.

Sources

Évaluer DeepSeek V4 Pro sur vos propres workloads

Comparez Pro et Flash depuis la page DeepSeek V4, puis mesurez réussite des tâches, fiabilité des outils, latence, retries et coût par tâche réussie avant d'augmenter le trafic de production.

Prêt à réduire vos coûts IA de 89 % ?

Commencez avec EvoLink dès aujourd'hui et découvrez la puissance du routage intelligent des API.