curl --request POST \
--url https://direct.evolink.ai/v1/chat/completions \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data @- <<EOF
{
"model": "deepseek-v4-flash",
"messages": [
{
"role": "user",
"content": "Présentez-vous s'il vous plaît"
}
]
}
EOF{
"id": "837f529d-00f9-4731-b2e1-4a54fc31790a",
"object": "chat.completion",
"created": 1777026806,
"model": "deepseek-v4-flash",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Bonjour ! Je suis l'assistant DeepSeek, toujours prêt à répondre à vos questions et à vous aider."
},
"logprobs": null,
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 7,
"completion_tokens": 31,
"total_tokens": 38,
"prompt_tokens_details": {
"cached_tokens": 0
},
"prompt_cache_hit_tokens": 0,
"prompt_cache_miss_tokens": 7
},
"system_fingerprint": "fp_evolink_v4_20260402"
}DeepSeek V4 - API compatible OpenAI
- Appeler les modèles DeepSeek V4 via le protocole OpenAI Chat Completions
- Prend en charge trois modèles :
deepseek-v4-flash(rapide et généraliste),deepseek-v4-pro(raisonnement approfondi) etdeepseek-v4-flash-vision-exp(compréhension des images) - Conversation textuelle : dialogue contextuel en un ou plusieurs tours, prise en charge d’un contexte ultra-long de 1M
- Compréhension des images :
deepseek-v4-flash-vision-expaccepte du texte et des images mélangés dans un même message et prend en charge plusieurs images - Prompts système : personnaliser le rôle et le comportement de l’IA
- Mode de réflexion : contrôler le raisonnement approfondi via
thinking.type; le contenu de réflexion dedeepseek-v4-proest retourné viareasoning_content - Sortie en streaming : prend en charge le retour en streaming SSE
- Appel d’outils : prend en charge Function Calling (jusqu’à 128 outils)
- Mode JSON : activé via
response_format - Cache de contexte : les requêtes avec le même préfixe déclenchent automatiquement le cache, réduisant considérablement le coût d’entrée
Comportement des paramètres inconnus : Les champs de premier niveau non reconnus dans le corps de la requête sont silencieusement ignorés par le fournisseur, sans erreur. Une faute dans le nom d’un paramètre ne déclenche aucun avertissement ; utilisez uniquement les champs répertoriés dans cette référence.
curl --request POST \
--url https://direct.evolink.ai/v1/chat/completions \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data @- <<EOF
{
"model": "deepseek-v4-flash",
"messages": [
{
"role": "user",
"content": "Présentez-vous s'il vous plaît"
}
]
}
EOF{
"id": "837f529d-00f9-4731-b2e1-4a54fc31790a",
"object": "chat.completion",
"created": 1777026806,
"model": "deepseek-v4-flash",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Bonjour ! Je suis l'assistant DeepSeek, toujours prêt à répondre à vos questions et à vous aider."
},
"logprobs": null,
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 7,
"completion_tokens": 31,
"total_tokens": 38,
"prompt_tokens_details": {
"cached_tokens": 0
},
"prompt_cache_hit_tokens": 0,
"prompt_cache_miss_tokens": 7
},
"system_fingerprint": "fp_evolink_v4_20260402"
}https://direct.evolink.ai, qui offre une meilleure prise en charge des modèles de texte et des connexions persistantes. https://api.evolink.ai est le point d’accès principal pour les services multimodaux et sert d’adresse de secours pour les modèles de texte.Autorisations
##Toutes les API nécessitent une authentification Bearer Token##
Obtenir une clé API :
Visitez la Page de gestion des clés API pour obtenir votre clé API
Ajouter à l'en-tête de requête :
Authorization: Bearer YOUR_API_KEY
Corps
Nom du modèle de conversation
deepseek-v4-flash: modèle rapide et généraliste, contexte de 1Mdeepseek-v4-pro: modèle de raisonnement approfondi, excelle en mathématiques, en programmation et en logique complexedeepseek-v4-flash-vision-exp: modèle expérimental basé sur Flash avec compréhension native des images ; ses capacités textuelles, paramètres et tarifs sont identiques à ceux de Flash
Astuce : Les trois modèles ont thinking activé par défaut et les réponses incluent reasoning_content. Définissez thinking.type="disabled" pour le désactiver et réduire le coût des tokens de sortie.
Les images ne sont prises en charge que par deepseek-v4-flash-vision-exp : envoyer des images à deepseek-v4-flash / deepseek-v4-pro renvoie HTTP 400 avec This model does not support image.
Avis expérimental : -exp désigne une version expérimentale du fournisseur. Le nom et la disponibilité du modèle peuvent changer ; prévoyez une solution de repli en production.
deepseek-v4-flash, deepseek-v4-pro, deepseek-v4-flash-vision-exp "deepseek-v4-flash"
Liste des messages de conversation, prend en charge les dialogues multi-tours
Les messages de rôles différents ont des structures de champs différentes, veuillez sélectionner le rôle correspondant
1- System Message
- User Message
- Assistant Message
- Tool Message
Show child attributes
Show child attributes
Contrôle du mode de réflexion (nouveauté V4)
Remarque :
- Utilisé pour contrôler la fonctionnalité de réflexion approfondie (Chain of Thought)
- Activé par défaut pour les deux modèles (
type=enabled) - Une fois activé, le processus de raisonnement est retourné via
choices[].message.reasoning_contentet facturé au tarif des tokens de sortie
Attention pour les conversations multi-tours / appels d'outils : si la réponse de ce tour contient reasoning_content, le message assistant correspondant dans l'historique messages de la requête suivante doit retourner ce champ tel quel, sinon l'API renverra 400 The reasoning_content in the thinking mode must be passed back to the API. Si vous ne souhaitez pas le gérer, vous pouvez définir explicitement thinking.type="disabled" pour toute la session.
Show child attributes
Show child attributes
Température d'échantillonnage, contrôle le caractère aléatoire de la sortie
Remarque :
- Valeurs basses (ex. 0.2) : sortie plus déterministe et ciblée
- Valeurs élevées (ex. 1.5) : sortie plus aléatoire et créative
- Valeur par défaut : 1
0 <= x <= 21
Paramètre d'échantillonnage nucleus (Nucleus Sampling)
Remarque :
- Contrôle l'échantillonnage à partir des tokens avec une probabilité cumulative
- Par exemple, 0.9 signifie un échantillonnage parmi les tokens ayant 90 % de probabilité cumulative
- Valeur par défaut : 1.0 (considère tous les tokens)
Suggestion : Ne pas ajuster simultanément temperature et top_p
0 <= x <= 11
Limite le nombre maximum de tokens générés
Remarque :
- La série V4 peut atteindre 384 000 tokens
- Lorsque thinking est activé, reasoning_tokens sont également comptés dans la limite max_tokens
- Si non défini, le modèle décide lui-même de la longueur générée
1 <= x <= 3840004096
Spécifier le format de la réponse
Remarque :
- Définir sur
{"type": "json_object"}pour activer le mode JSON - En mode JSON, le modèle produira un contenu au format JSON valide
- Il est recommandé de demander explicitement une sortie JSON dans le message system ou user pour obtenir les meilleurs résultats
Show child attributes
Show child attributes
Séquences d'arrêt, le modèle arrête la génération lorsqu'il rencontre ces chaînes
Remarque :
- Peut être une chaîne unique ou un tableau de chaînes
- Prend en charge jusqu'à 16 séquences d'arrêt
Indique si la réponse doit être retournée en streaming
true: retour en streaming, le contenu est renvoyé bloc par bloc en temps réel via SSE (Server-Sent Events)false: attendre la réponse complète et la retourner en une seule fois (par défaut)
false
Options de réponse en streaming
Valide uniquement lorsque stream=true
Show child attributes
Show child attributes
Liste des définitions d'outils, utilisée pour Function Calling
Remarque :
- Prend en charge jusqu'à 128 définitions d'outils
- Chaque outil doit définir un nom, une description et un schéma de paramètres
128Show child attributes
Show child attributes
Contrôle le comportement d'appel des outils
Valeurs possibles :
none: n'appeler aucun outilauto: le modèle décide automatiquement d'appeler ou non un outil (par défaut lorsque tools est fourni)required: force le modèle à appeler un ou plusieurs outils- Forme objet
{"type":"function","function":{"name":"xxx"}}: spécifier un outil particulier à appeler
Valeur par défaut : none si tools n'est pas fourni, auto si tools est fourni
none, auto, required Retourner ou non la probabilité logarithmique des tokens
Remarque :
- Lorsque défini sur
true, la réponse inclura les informations de probabilité logarithmique de chaque token
Retourner la probabilité logarithmique des N tokens avec la probabilité la plus élevée
Remarque :
- Nécessite
logprobsdéfini surtrue - Plage de valeurs :
[0, 20]
0 <= x <= 20Réponse
Génération de conversation réussie
Identifiant unique de la complétion de conversation
"53c548dc-ec02-4a2f-bbb6-eca4184630b8"
Nom du modèle réellement utilisé
"deepseek-v4-flash"
Type de réponse
chat.completion "chat.completion"
Horodatage de création (Unix en secondes)
1777021417
Liste des choix de génération de conversation
Show child attributes
Show child attributes
Statistiques d'utilisation des tokens (avec détail du cache et du raisonnement)
Show child attributes
Show child attributes
Identifiant d'empreinte système
"fp_evolink_v4_20260402"