GPT Image 2.5 Flare & Sunburst sont disponibles sur EvoLinkEssayer GPT Image 2.5

DeepSeek V4 Pro API

Accédez à V4 Pro de DeepSeek — aussi recherché sous DeepSeek V4 — via l'API de chat unifiée d'EvoLink. Testez le raisonnement, le codage à long contexte, le cache de prompt avant d'intégrer.

DeepSeekGénération de texteDisponible
à partir de $1.324 / 1 M de tokens d’entrée
Documentation API
Codage à long contexteMode thinkingCache de promptsChat + Messages + Responses
Route productionLive
Contexte
1M de contexte · 384K de sortie max.
Idéal pour
Raisonnement plus poussé, codage complexe et agents quand Flash ne suffit pas
Entrée
Texte
Sortie
Texte · JSON (sortie structurée)

DeepSeek prévoit de faire basculer deepseek-v4-pro vers V4.1 Flash sur son API directe le 14 septembre 2026 ; sur EvoLink, deepseek-v4-pro n’est pas concerné et sert toujours V4 Pro. Voir le guide de migration V4.1 Flash.

Choisir DeepSeek V4 Pro

Une route d’évaluation pour le code, le raisonnement et les longs contextes, disponible via Chat Completions, Messages et Responses.

DeepSeek V4 Pro

Modèle DeepSeek de raisonnement et d’utilisation d’outils

Sélectionné
ID du modèle
deepseek-v4-pro
Idéal pour

Charges importantes de code, raisonnement, analyse de longs documents et agents nécessitant une route économique avec tarif d’entrée en cache.

Entrée
$1.324 / 1M
90 cr / 1M
Cache hit
$0.045 / 1M
3 cr / 1M
Sortie
$3.971 / 1M
270 cr / 1M

Tous les tarifs sont par 1M de tokens, en USD et en crédits, et reflètent la tarification actuelle de votre compte.

Tarifs DeepSeek V4 Pro

Estimez le coût d'une requête DeepSeek V4 Pro avant l'intégration. Le calculateur utilise les tarifs actuels de votre compte ; les prix officiels servent de référence.

Calculateur de requête

Saisissez la répartition des tokens d'une requête et le nombre d'appels d'outils réussis.

Coût estimé par requête

DeepSeek V4 Pro
USD$0.0026
Crédits0.1716
Tokens d'entrée0.09 cr
Tokens cache hit0.0006 cr
Tokens de sortie0.081 cr

Facturation minimale : 0.01 crédit par requête.

Guide budgétaire

Nombre approximatif de requêtes avec la répartition actuelle.
Ajouter des crédits
$10
Environ 3962 requêtes

Pour des tests rapides

$50
Environ 19813 requêtes

Pour le développement courant

$100
Environ 39627 requêtes

Pour l'évaluation en production

Tarifs des outils côté serveur

Seuls les appels côté serveur réussis sont facturés à l'appel ; les tentatives échouées n'ont pas de frais d'outil, mais les tokens restent facturés.
  • Recherche web$0.010/ appel0.68 cr / appel

Qu’est-ce que l’API DeepSeek V4 Pro ?

DeepSeek V4 Pro est le niveau le plus puissant de DeepSeek : architecture Mixture-of-Experts de 1 600 milliards de paramètres (49B actifs par token), contexte de 1 M de tokens, sortie maximale de 384K et mode thinking activé par défaut. Sur EvoLink, il est disponible via /v1/chat/completions (style OpenAI) et /v1/messages (style Anthropic) avec l’ID deepseek-v4-pro. Les limites tarifaires, les workflows pris en charge et la configuration figurent dans les sections Pricing et API. DeepSeek prévoit de rediriger deepseek-v4-pro vers V4.1 Flash sur son API directe à partir du 14 septembre 2026 à 12 h 00, heure de Pékin (04 h 00 UTC) ; sur EvoLink, deepseek-v4-pro n’est pas concerné et continue de servir V4 Pro.

DeepSeek V4 Pro est servi sur EvoLink sous l'ID de modèle deepseek-v4-pro via Chat Completions · Anthropic Messages · Responses, avec la même clé API et le même solde que tous les autres modèles. Il offre une fenêtre de contexte de 1M et jusqu'à 384K tokens de sortie, ainsi que le raisonnement, le codage à long contexte, le cache de prompt.

DeepSeek V4 Pro

Spécifications et capacités de DeepSeek V4 Pro

Les chiffres proviennent de la configuration de route EvoLink ; les capacités sont celles que l'API expose aujourd'hui.

Fenêtre de contexte
1M tokens
Sortie max.
384K tokens
Entrée
Texte
Sortie
Texte · JSON (sortie structurée)
Raisonnement
Mode réflexion (activé par défaut)
Cache de prompt
Lectures de cache automatiques à tarif réduit
Outils côté serveur
Recherche web, facturés par appel réussi
Protocoles
Chat Completions · Anthropic Messages · Responses
ID du modèle
deepseek-v4-pro

Les requêtes Chat Completions, Messages et Responses doivent utiliser l’ID exact affiché ici.

Pour quelles tâches l’API DeepSeek V4 Pro est-elle adaptée ?

DeepSeek V4 Pro associe une fenêtre de contexte de 1 000 000 tokens, un raisonnement configurable et les appels d’outils pour les tâches qui doivent conserver des preuves, appeler des systèmes externes et fournir des résultats vérifiables. Le modèle est purement textuel : il n’accepte pas d’entrée d’images. Les cas d’usage ci-dessous montrent où il peut apporter de la valeur et ce qu’il faut vérifier avant l’intégration.

Code à l’échelle d’un dépôt et revue

Réunissez le code source utile, les issues, les résultats de tests et les modifications précédentes pour diagnostiquer plusieurs fichiers, préparer une implémentation ou relire un changement. Avant le déploiement, mesurez sur des tâches fixes le taux de réussite des tests, les étapes omises, la structure des résultats et les corrections humaines nécessaires.

Longs documents et analyse multi-source

La fenêtre de 1 000 000 tokens peut contenir rapports, contrats, extraits de base de connaissances, historique et sources récupérées. Davantage de contexte n’améliore pas automatiquement la réponse : vérifiez la conservation des preuves importantes et utilisez les tarifs en temps réel et le mécanisme de cache de Pricing pour calculer le coût par résultat acceptable.

Agents longue durée et workflows en terminal

La version GA 0813 améliore nettement le codage agentique et les tâches en terminal — c’est là que les retours de la communauté (un signal de demande, pas un résultat vérifié) situent le plus souvent la valeur de V4 Pro face aux modèles fermés. Connectez vos propres outils de recherche et d’exécution via les appels de fonction, puis validez le taux d’achèvement des tâches multi-étapes sur vos charges réelles avant de monter en volume.

Sortie structurée et orchestration d’agents

Les entrées texte peuvent alimenter JSON Schema, les appels de fonction et les agents en plusieurs étapes pour l’extraction, la revue et l’automatisation. Avant la production, testez la validité du schéma, les arguments, la fin du streaming et la reprise sûre après l’échec d’un outil.

Qu’est-ce qui change selon la plateforme utilisée pour DeepSeek V4 Pro ?

Pour un même modèle, la configuration du contexte, les outils, l’affichage de l’usage et la facturation peuvent varier. EvoLink réunit configuration et consommation derrière une API unique afin de simplifier les futurs changements de modèle.

Utiliser le bon identifiant de modèle API

L’URL de la page et l’identifiant de modèle envoyé dans l’API sont la même chaîne : deepseek-v4-pro. Une application Chat Completions ou Responses existante utilise cet ID dans sa configuration. Les champs exacts restent dans la section API.

Suivre la configuration du canal API actif

DeepSeek documente une fenêtre de 1 000 000 tokens, mais les plateformes peuvent proposer des réglages de contexte, des outils et des limites différents. Avec EvoLink, référez-vous à la configuration, aux fonctions disponibles et aux données usage du canal actuel.

Choisir Chat ou Responses selon le workflow

Commencez par Chat Completions pour le chat, le streaming et les fonctions exécutées côté client. Évaluez Responses — le protocole ajouté dans la version 0813 — pour les workflows d’agents longs en plusieurs étapes ; ses outils serveur documentés sont function calling, web search et apply_patch, et code interpreter est ignoré sur cette route. Vous conservez ainsi une intégration de style OpenAI sans complexité inutile.

Conserver le choix du modèle dans une passerelle

Un compte, un solde et un format d’API EvoLink permettent d’utiliser Grok, GPT, Claude et Kimi. Lorsque le modèle reste configurable, le routage peut évoluer selon la qualité, le coût et la disponibilité sans reconstruire l’intégration pour chaque fournisseur.

Comment mieux contrôler le coût de l’API DeepSeek V4 Pro ?

La section Pricing affiche les tarifs actuels des tokens (entrée, cache hit, sortie). En pratique, le cache, la gestion du contexte, le réglage du raisonnement et le routage limitent la consommation inutile et rattachent la dépense aux tâches terminées.

Rendre le contexte répété compatible avec le cache

Les prompts système stables, les schémas d’outils et le contexte partagé sont plus faciles à réutiliser. Configurez l’identifiant de cache ou de conversation pris en charge par le protocole choisi et consultez les cached tokens dans usage pour vérifier le gain réel.

N’envoyer que le contexte utile à la tâche

Une fenêtre de 1 000 000 tokens aide sur de grands dépôts et documents, mais ne doit pas être remplie à chaque requête. Sélectionner les fichiers, messages et passages pertinents réduit le coût d’entrée et concentre le modèle sur les preuves importantes.

Adapter raisonnement, sortie et outils à la tâche

Pour une tâche simple, commencez avec un reasoning effort plus faible et une sortie courte, puis augmentez le budget pour les analyses difficiles. Suivez aussi le nombre d’appels d’outils dans les agents afin d’éviter recherches répétées, exécutions inutiles et boucles improductives.

Comparer les modèles par coût total de la tâche

Évaluez ensemble tokens, entrée en cache, outils serveur et nouvelles tentatives nécessaires. EvoLink centralise les modèles et la consommation afin de comparer le coût total d’un même travail avec DeepSeek V4 Pro et d’autres routes.

Deux façons d'utiliser DeepSeek V4 Pro : API EvoLink ou Agent

Utilisez l'API EvoLink pour les backends produit et les traitements par lots, ou appelez DeepSeek V4 Pro depuis Codex, Claude ou Gemini pour vos workflows de code et d'analyse. Les deux voies partagent la même clé API EvoLink, le même solde, le même ID de modèle et le même historique de requêtes.

Option 1

Intégrer avec l'API EvoLink

Idéal pour : backends produit, traitements par lots, pipelines automatisés

Envoyez à EvoLink des requêtes Chat Completions compatibles OpenAI (ou Anthropic Messages) et contrôlez l'ID de modèle, le prompt système, le budget de sortie, les outils et la sortie structurée.

  1. 1Créez une clé API EvoLink dans la console
  2. 2Pointez votre SDK OpenAI ou Anthropic vers l'URL de base EvoLink et sélectionnez l'ID de modèle affiché ci-dessus
  3. 3Envoyez une requête représentative et lisez le champ usage pour les tokens d'entrée, en cache et de sortie
  4. 4Définissez max_tokens et les réessais par tâche ; conservez les ID et résultats des appels d'outils entre les tours
Option 2

L'appeler avec un Agent

Idéal pour : tâches de code, de revue et d'analyse dans Codex, Claude et Gemini

Donnez à l'Agent la tâche, les entrées à inclure et les critères d'acceptation. Il assemble la requête, appelle DeepSeek V4 Pro via EvoLink et renvoie la réponse avec la consommation de tokens.

  1. 1Définissez EVOLINK_API_KEY dans votre environnement local ; jamais dans le code ni dans un prompt
  2. 2Décrivez la tâche, les entrées à inclure et le format de sortie attendu
  3. 3Demandez à l'Agent d'appeler DeepSeek V4 Pro via EvoLink et d'afficher la requête avant l'envoi
  4. 4Laissez l'Agent rapporter la réponse, la consommation de tokens et tout corps d'erreur

Exemple de code API DeepSeek V4 Pro et gestion des erreurs

Cet exemple montre la requête exécutable la plus courte : un appel Chat Completions compatible OpenAI avec un prompt système, un message utilisateur et un budget de sortie. Ouvrez l'onglet API pour la référence complète des paramètres et réponses.

Voir la documentation API complète
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-pro",
    "messages": [
      { "role": "system", "content": "You are a senior engineer reviewing a pull request." },
      { "role": "user", "content": "Review this diff and list every risky change with file and line:\n<diff>" }
    ],
    "max_tokens": 4096,
    "temperature": 0.2
  }'

# Anthropic Messages (/v1/messages) and Responses (/v1/responses) accept the
# same model ID.
# The response includes choices[0].message and a usage object (prompt,
# cached, and completion tokens).

Requête invalide ou paramètre non pris en charge

Vérifiez l'ID de modèle, le tableau messages et les plages de paramètres dans la référence API ; retirez les champs que cette route ne prend pas en charge.

Problème d'authentification ou de solde

Vérifiez le jeton Bearer Authorization et confirmez le solde disponible dans la console.

Longueur de contexte dépassée

Les tokens du prompt dépassent la fenêtre de contexte de DeepSeek V4 Pro. Réduisez ou ne récupérez que les éléments pertinents et réutilisez les préfixes en cache.

Limite de débit (429)

Attendez et réessayez avec un délai aléatoire ; regroupez ou mettez en file d'attente les requêtes au lieu de rafales parallèles.

Contenu ou appel d'outil rejeté

Vérifiez le contenu sensible, les arguments d'appel d'outil mal formés et les écarts de schéma JSON avant de réessayer.

Comment choisir Chat Completions, Responses et le trafic de production pour DeepSeek V4 Pro ?

Les deux protocoles répondent à des workflows différents. Ce résumé aide au choix ; les champs exacts restent dans la section API et la documentation EvoLink, les tarifs des tokens dans Pricing ; au moment de budgéter, comptez les tours d’appels d’outils dans le coût total de la tâche.

01

Chat standard et fonctions client : Chat Completions

Si vous utilisez déjà un chat compatible OpenAI, le streaming ou des fonctions côté client, commencez par Chat Completions. Vérifiez le format des messages, la fin du flux, les arguments de fonction et usage par rapport au comportement attendu du client.

Chat et fonctions client
02

Workflows d’agents : Responses

Évaluez l’API Responses — ajoutée dans la version 0813 — pour les enchaînements d’agents multi-étapes plus longs et les intégrations de type Codex. Avant l’intégration, confirmez les champs pris en charge, les états d’échec et les limites de nouvelles tentatives dans la documentation EvoLink actuelle.

Workflows d’agents
03

Grand contexte : observer cache et coût total

Les longs documents, dépôts et conversations ne doivent pas être envoyés intégralement par défaut. Comparez tailles de contexte représentatives, succès et échecs du cache, longueur de sortie et nouvelles tentatives, puis calculez le coût d’une tâche réussie avec la facture finale.

Coût du contexte
04

Production : commencer petit et garder un secours

Envoyez d’abord un petit groupe de tâches observables à DeepSeek V4 Pro et conservez une route GPT, Claude ou Kimi éprouvée. L’API unifiée EvoLink centralise modèle, usage et solde et facilite le changement après une limite, un timeout ou un échec de schéma ou d’outil.

Déploiement progressif

Les hits de cache coûtent une fraction de l'entrée neuve

Le cache de préfixe est automatique : un prompt système stable, les consignes du dépôt et les définitions d'outils sont facturés comme hits de cache sur les requêtes suivantes plutôt qu'en entrée complète. Mesurez le taux de hit réel dans vos journaux avant d'estimer le coût d'une boucle d'agent.

Contexte de 1M tokens avec un plafond de sortie de 384K

Gardez les fichiers liés, les spécifications et l'état de l'agent dans un même contexte de travail, mais traitez le plafond comme une capacité et non un objectif : récupérez l'essentiel, gardez le préfixe stable pour qu'il soit mis en cache et fixez un budget de sortie par tâche.

Comparez DeepSeek V4 Pro à Qwen 3.8 Max et GLM-5.3

EvoLink

Comparez les tarifs d’entrée/sortie, le contexte, le cache et les usages. Testez les mêmes requêtes avant de choisir une route ; les prix ci-dessous suivent les tarifs actuels de votre compte.

DeepSeek V4 Pro
Entrée / Sortie$1.324 / $3.971
Contexte1M
CacheHits de cache automatiques
Idéal pourCharges importantes de code, raisonnement, analyse de longs documents et agents nécessitant une route économique avec tarif d’entrée en cache.
Qwen 3.8 Max
Entrée / Sortie$1.765 / $5.295
Contexte1.05M
CacheCache de prompt explicite
Idéal pourIngénierie à l’échelle d’un dépôt, synthèse multi-documents, agents à forts appels d’outils
GLM-5.3
Entrée / Sortie$1.4 / $4.4
Contexte1M
CacheHits de cache automatiques
Idéal pourAgents de codage, longues chaînes de tâches, workflows riches en outils

Que vérifier avant d’utiliser DeepSeek V4 Pro en production ?

Commencez par quelques workloads réels afin de confirmer la qualité, la latence, le coût et la fiabilité avant de déplacer davantage de trafic.

L’intégration et l’usage sont lisibles

Vérifiez l’identifiant deepseek-v4-pro, le protocole voulu et le retour des réponses, des données usage et du cache. Des données claires facilitent l’analyse des coûts et donnent aux workflows Chat et Responses une observation cohérente.

Les sorties répondent au besoin métier

Testez des modifications de code, analyses de documents, recherches ou extractions structurées réelles. Au-delà de la réponse, vérifiez les tests, la fiabilité des citations, les arguments de fonction et la possibilité de consommer directement le JSON Schema en aval.

La latence et les erreurs sont gérables

Observez le temps de réponse sous une charge représentative et préparez les nouvelles tentatives pour limites, timeouts, sorties structurées invalides et échecs d’outils. Un modèle configurable dans EvoLink facilite le passage à une solution déjà vérifiée si une route devient indisponible.

Le coût et le choix du modèle restent contrôlables

Calculez le coût total d’une même catégorie de tâche à partir de Pricing, usage et du montant final. Décidez ensuite si DeepSeek V4 Pro doit servir de route par défaut, de modèle pour les tâches difficiles ou de secours. La passerelle unifiée sépare ce choix du travail d’intégration.

Commencez avec un petit ensemble de tâches DeepSeek V4 Pro observable et réversible. Élargissez seulement lorsque qualité, latence et coût répondent aux attentes. Plusieurs modèles derrière l’API unifiée EvoLink simplifient ensuite la montée en charge, le changement de route et l’optimisation des coûts.

Famille de modèles DeepSeek V4

Même clé API, même solde : changez de palier sans toucher à l’intégration.

DeepSeek V4.1 Flash

DeepSeek V4.1 Flash

Le modèle Flash multimodal de DeepSeek pour les charges texte et image

Voir le modèle
DeepSeek V4 Flash Vision

DeepSeek V4 Flash Vision

Ancien ID Vision Exp, désormais redirigé vers DeepSeek V4.1 Flash

Voir le modèle
DeepSeek V4 Flash

DeepSeek V4 Flash

Modèle DeepSeek de raisonnement et d’utilisation d’outils

Voir le modèle

Autres modèles texte sur EvoLink en plus de DeepSeek V4 Pro

GPT-5.6

GPT-5.6

La gamme frontier d’OpenAI pour comparer capacités, latence et flexibilité du routage des coûts.

Voir le modèle
Claude Opus 5

Claude Opus 5

La route premium d’Anthropic pour les agents longs, l’utilisation d’outils et les revues complexes.

Voir le modèle
Kimi K3

Kimi K3

La route de raisonnement long contexte de Moonshot avec un tarif distinct pour l’entrée en cache.

Voir le modèle
DeepSeek V4 Flash

DeepSeek V4 Flash

Une route open model économique pour les charges importantes de code, raisonnement et agents.

Voir le modèle

Pour aller plus loin avec DeepSeek V4 Pro

Comment utiliser l’API DeepSeek V4 Pro

Comment utiliser l’API DeepSeek V4 Pro

Premier appel, réglage de l’effort de thinking, le passage à Claude Code et trois pièges de migration qui échouent en silence.

Lire le guide
DeepSeek V4 Pro 0813 est en ligne : ce qui change

DeepSeek V4 Pro 0813 est en ligne : ce qui change

Les évolutions agent et Codex de la version GA, vérifiées face à la documentation amont.

Lire le guide
Test de l’API DeepSeek V4 : Flash ou Pro

Test de l’API DeepSeek V4 : Flash ou Pro

Comparez coût, mode thinking et checklist de mise en production.

Lire le guide
Guide de migration DeepSeek V4.1 Flash

Guide de migration DeepSeek V4.1 Flash

Quels ID DeepSeek ont changé sur l’API directe et sur EvoLink, et comment tester V4.1 Flash avant de déplacer du trafic.

Lire le guide

FAQ de l’API DeepSeek V4 Pro

L’API DeepSeek V4 Pro est-elle déjà disponible via EvoLink ?

Oui. DeepSeek V4 Pro est disponible sur la route de production EvoLink et n’est pas concerné par le changement du 14 septembre, qui redirige deepseek-v4-pro vers V4.1 Flash sur l’API propre de DeepSeek. Envoyez vos requêtes avec l’identifiant deepseek-v4-pro via Chat Completions ou Responses ; l’identifiant, les tarifs, le contexte et les workflows pris en charge figurent sur cette page.

deepseek-v4-pro est-il l’identifiant du modèle API ?

Oui. L’identifiant à envoyer dans la requête est deepseek-v4-pro — la même chaîne que l’URL de cette page. Depuis le 13 août 2026, ce même ID pointe automatiquement vers la version GA 0813 mise à niveau ; il n’y a pas d’ID à changer pour en profiter.

Qu’est-ce qui change dans la version 0813 de DeepSeek V4 Pro ?

La version GA 0813 (publiée le 13 août 2026) améliore nettement les benchmarks de codage agentique et de tâches en terminal par rapport à la préversion d’avril et ajoute la prise en charge de l’API Responses. L’identifiant appelable reste deepseek-v4-pro. Les anciens alias deepseek-chat et deepseek-reasoner ont été retirés en amont le 24 juillet 2026.

Quelles entrées et sorties DeepSeek V4 Pro prend-il en charge ?

Entrée texte et sortie texte uniquement. DeepSeek V4 Pro n’a aucune capacité de vision, quel que soit le protocole, mais les limites varient selon la route : Messages rejette les types de contenu image et document, tandis que Responses convertit les pièces jointes image et fichier en espaces réservés au lieu de les comprendre. Routez les tâches de compréhension de captures d’écran ou de documents vers un modèle doté de vision sur la même passerelle EvoLink.

Faut-il choisir Chat Completions ou l’API Responses ?

Chat Completions convient au chat, au streaming et aux fonctions côté client. Évaluez Responses — ajoutée dans la version 0813 — pour les workflows d’agents de longue durée. Les champs exacts restent dans API et la documentation EvoLink.

Comment choisir le reasoning effort ?

Les niveaux valides sont low, high et max, et la valeur par défaut est high — medium est accepté mais silencieusement converti en high, donc comparer medium et high ne produit aucune différence réelle. Commencez les tâches courantes avec low, comparez low et high sur les mêmes tâches et réservez max aux problèmes les plus difficiles, où un échec coûte plus cher que les tokens de raisonnement supplémentaires.

Comment l’entrée en cache modifie-t-elle le prix de DeepSeek V4 Pro ?

Le cache peut réduire le coût du contexte répété, mais les échecs de cache, sorties longues, nouvelles tentatives et appels d’outils répétés augmentent encore le total. Utilisez Pricing et le montant final pour calculer le coût d’une tâche réussie.

Quelles sont les limites de débit de DeepSeek V4 Pro ?

La documentation V4 de DeepSeek décrivait, pour son API directe, un plafond de concurrence au niveau du compte plutôt que des limites RPM ou TPM par token — environ 500 requêtes simultanées pour Pro —, avec un code 429 au-delà du plafond et l’abandon des requêtes en file après environ 10 minutes. Ces chiffres décrivent l’API de DeepSeek, pas la capacité des routes EvoLink. Mesurez les limites de votre compte EvoLink, gardez les requêtes en cours en dessous et utilisez un backoff exponentiel.

Comment comparer DeepSeek V4 Pro à GPT, Claude ou Kimi ?

Faites exécuter les mêmes tâches réelles avec un contexte, des outils et un raisonnement identiques. Qualité, temps de réponse, répartition des tokens, fonctionnement des outils et coût total indiquent quelle route EvoLink convient à chaque trafic.

DeepSeek V4 Pro est-il open source ?

Les poids de la préversion d’avril sont publiés sous licence MIT sur Hugging Face ; au 13 août 2026, les poids de la version GA 0813 n’avaient pas encore été publiés. Les poids ouverts et l’API hébergée sont deux voies d’accès indépendantes — la route EvoLink sert l’API hébergée, et la disponibilité des mêmes poids MIT chez des hébergeurs tiers est ce qui rend possible un repli vers un hébergement tiers.

Existe-t-il un modèle DeepSeek V4 Pro Max ?

Non. Il n’existe pas de modèle « Pro Max » distinct — « max » est le niveau de thinking le plus élevé sur le même ID de modèle deepseek-v4-pro. Si vous voyez « Pro-Max » mentionné, cela désigne l’exécution de ce modèle à l’effort de raisonnement maximal, pas un autre produit.

Quel modèle de secours conserver pendant le déploiement ?

Conservez un modèle qui traite déjà le même workload de façon fiable et laissez le routage configurable. En cas de limite, timeout ou sortie invalide, EvoLink peut passer à GPT, Claude, Kimi ou une autre solution adaptée.