curl --request POST \
--url https://direct.evolink.ai/v1/chat/completions \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "deepseek-chat",
"messages": [
{
"role": "user",
"content": "Tell me about yourself"
}
]
}
'{
"id": "930c60df-bf64-41c9-a88e-3ec75f81e00e",
"model": "deepseek-chat",
"object": "chat.completion",
"created": 1770617860,
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Hello! I'm DeepSeek, a powerful AI assistant. I excel at general conversation, code generation, mathematical reasoning and many other tasks.",
"reasoning_content": "Let me analyze this problem...",
"tool_calls": [
{
"id": "<string>",
"type": "function",
"function": {
"name": "<string>",
"arguments": "<string>"
}
}
]
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 16,
"completion_tokens": 10,
"total_tokens": 26,
"prompt_cache_hit_tokens": 0,
"prompt_cache_miss_tokens": 16
},
"system_fingerprint": "fp_eaab8d114b_prod0820_fp8_kvcache"
}{
"error": {
"code": 400,
"message": "Paramètres de requête invalides",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Quota insuffisant",
"type": "insufficient_quota_error"
}
}{
"error": {
"code": 403,
"message": "Access denied for this model",
"type": "permission_error",
"param": "model"
}
}{
"error": {
"code": 404,
"message": "Specified model not found",
"type": "not_found_error",
"param": "model"
}
}{
"error": {
"code": 413,
"message": "Corps de la requête trop volumineux",
"type": "request_too_large_error",
"param": "messages"
}
}{
"error": {
"code": 429,
"message": "Limite de débit dépassée",
"type": "rate_limit_error"
}
}{
"error": {
"code": 500,
"message": "Erreur interne du serveur",
"type": "internal_server_error"
}
}{
"error": {
"code": 502,
"message": "Upstream AI service unavailable",
"type": "upstream_error"
}
}{
"error": {
"code": 503,
"message": "Service temporairement indisponible",
"type": "service_unavailable_error"
}
}DeepSeek - Référence API complète
- Appeler les modèles DeepSeek au format OpenAI SDK
- Mode de traitement synchrone, réponse en temps réel
- Prend en charge les modèles
deepseek-chat(conversation générale) etdeepseek-reasoner(raisonnement approfondi) - Chat textuel : Conversation contextuelle à un ou plusieurs tours
- Prompts système : Personnaliser le rôle et le comportement de l’IA
- Streaming : Prise en charge de la sortie en streaming SSE
- Appel d’outils : Prise en charge du Function Calling
curl --request POST \
--url https://direct.evolink.ai/v1/chat/completions \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "deepseek-chat",
"messages": [
{
"role": "user",
"content": "Tell me about yourself"
}
]
}
'{
"id": "930c60df-bf64-41c9-a88e-3ec75f81e00e",
"model": "deepseek-chat",
"object": "chat.completion",
"created": 1770617860,
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Hello! I'm DeepSeek, a powerful AI assistant. I excel at general conversation, code generation, mathematical reasoning and many other tasks.",
"reasoning_content": "Let me analyze this problem...",
"tool_calls": [
{
"id": "<string>",
"type": "function",
"function": {
"name": "<string>",
"arguments": "<string>"
}
}
]
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 16,
"completion_tokens": 10,
"total_tokens": 26,
"prompt_cache_hit_tokens": 0,
"prompt_cache_miss_tokens": 16
},
"system_fingerprint": "fp_eaab8d114b_prod0820_fp8_kvcache"
}{
"error": {
"code": 400,
"message": "Paramètres de requête invalides",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Quota insuffisant",
"type": "insufficient_quota_error"
}
}{
"error": {
"code": 403,
"message": "Access denied for this model",
"type": "permission_error",
"param": "model"
}
}{
"error": {
"code": 404,
"message": "Specified model not found",
"type": "not_found_error",
"param": "model"
}
}{
"error": {
"code": 413,
"message": "Corps de la requête trop volumineux",
"type": "request_too_large_error",
"param": "messages"
}
}{
"error": {
"code": 429,
"message": "Limite de débit dépassée",
"type": "rate_limit_error"
}
}{
"error": {
"code": 500,
"message": "Erreur interne du serveur",
"type": "internal_server_error"
}
}{
"error": {
"code": 502,
"message": "Upstream AI service unavailable",
"type": "upstream_error"
}
}{
"error": {
"code": 503,
"message": "Service temporairement indisponible",
"type": "service_unavailable_error"
}
}https://direct.evolink.ai, qui offre une meilleure prise en charge des modèles de texte et des connexions persistantes. https://api.evolink.ai est le point d’accès principal pour les services multimodaux et sert d’adresse de secours pour les modèles de texte.Autorisations
##Toutes les API nécessitent une authentification Bearer Token##
Obtenir une clé API :
Visitez la Page de gestion des clés API pour obtenir votre clé API
Ajouter à l'en-tête de requête :
Authorization: Bearer YOUR_API_KEY
Corps
Nom du modèle de chat
deepseek-chat: Modèle de conversation généraledeepseek-reasoner: Modèle de raisonnement profond, excelle en mathématiques, codage et raisonnement logique complexe
Remarque : deepseek-reasoner ne prend pas en charge les paramètres temperature, top_p, tools, tool_choice, response_format. Leur transmission sera rejetée par l'amont
deepseek-chat, deepseek-reasoner "deepseek-chat"
Liste de messages de conversation, prend en charge les conversations multi-tours
Différents rôles ont différentes structures de champs, sélectionnez le rôle correspondant pour voir
1- Message système
- Message utilisateur
- Message de l'assistant
- Message d'outil
Show child attributes
Show child attributes
Contrôle du mode de réflexion (Bêta)
Détails :
- Contrôle la fonctionnalité de réflexion approfondie du modèle
deepseek-reasoner - Lorsqu'il est activé, le modèle effectuera un raisonnement approfondi avant de répondre
Show child attributes
Show child attributes
Paramètre de pénalité de fréquence pour réduire le contenu répétitif
Détails :
- Les valeurs positives pénalisent les tokens en fonction de leur fréquence dans le texte généré
- Des valeurs plus élevées rendent moins probable la répétition du contenu existant
- Par défaut : 0 (aucune pénalité)
-2 <= x <= 20
Nombre maximum de tokens à générer
Détails :
- Le modèle arrêtera de générer lorsque cette limite est atteinte
- Si non défini, le modèle décide de la longueur de génération
x >= 14096
Paramètre de pénalité de présence pour encourager de nouveaux sujets
Détails :
- Les valeurs positives pénalisent les tokens en fonction de leur apparition dans le texte
- Des valeurs plus élevées encouragent la discussion de nouveaux sujets
- Par défaut : 0 (aucune pénalité)
-2 <= x <= 20
Spécifier le format de réponse
Détails :
- Définir sur
{"type": "json_object"}pour activer le mode JSON - En mode JSON, le modèle produira un contenu JSON valide
Show child attributes
Show child attributes
Séquences d'arrêt. Le modèle arrêtera de générer lorsqu'il rencontrera ces chaînes
Détails :
- Peut être une chaîne unique ou un tableau de chaînes
- Maximum 16 séquences d'arrêt
S'il faut diffuser la réponse en streaming
true: Streaming via SSE (Server-Sent Events), retournant le contenu en morceaux en temps réelfalse: Attendre la réponse complète avant de retourner
false
Options de réponse en streaming
Effectives uniquement lorsque stream=true
Show child attributes
Show child attributes
Température d'échantillonnage, contrôle le caractère aléatoire de la sortie
Détails :
- Valeurs basses (ex. 0.2) : Sortie plus déterministe et ciblée
- Valeurs élevées (ex. 1.5) : Sortie plus aléatoire et créative
- Par défaut : 1
0 <= x <= 21
Paramètre de Nucleus Sampling
Détails :
- Contrôle l'échantillonnage à partir de tokens dont la probabilité cumulative atteint le seuil
- Par exemple, 0.9 signifie échantillonner parmi les tokens atteignant 90% de probabilité cumulative
- Par défaut : 1.0 (considère tous les tokens)
Conseil : Éviter d'ajuster à la fois temperature et top_p simultanément
0 <= x <= 11
Liste de définitions d'outils pour Function Calling
Détails :
- Maximum 128 définitions d'outils
- Chaque outil nécessite un nom, une description et un schéma de paramètres
128Show child attributes
Show child attributes
Contrôle le comportement d'appel d'outils
Options :
none: N'appeler aucun outilauto: Le modèle décide d'appeler ou non des outilsrequired: Forcer le modèle à appeler un ou plusieurs outils
Par défaut : none si aucun outil fourni, auto si des outils sont fournis
none, auto, required S'il faut retourner les probabilités logarithmiques des tokens
Détails :
- Lorsque défini sur
true, la réponse inclura les informations de probabilité logarithmique pour chaque token
Renvoyer les probabilités logarithmiques des N tokens les plus probables
Détails :
- Nécessite que
logprobssoit défini surtrue - Plage :
[0, 20]
0 <= x <= 20Réponse
Complétion de chat générée avec succès
Identifiant unique pour la complétion de chat
"930c60df-bf64-41c9-a88e-3ec75f81e00e"
Nom du modèle réellement utilisé
"deepseek-chat"
Type de réponse
chat.completion "chat.completion"
Horodatage de création
1770617860
Liste des choix de complétion de chat
Show child attributes
Show child attributes
Statistiques d'utilisation des jetons
Show child attributes
Show child attributes
Identifiant d'empreinte système
"fp_eaab8d114b_prod0820_fp8_kvcache"