Passer au contenu principal
POST
À propos de la BaseURL : la BaseURL par défaut est https://direct.evolink.ai, qui offre une meilleure prise en charge des modèles de texte et des connexions longues ; https://api.evolink.ai est l’adresse principale multimodale, à utiliser en cas d’entrée image / audio / vidéo.

Autorisations

Authorization
string
header
requis

##Toutes les API nécessitent une authentification Bearer Token##

Obtenir une clé API :

Visitez la Page de gestion des clés API pour obtenir votre clé API

Ajouter à l'en-tête de requête :

Corps

application/json
model
enum<string>
requis

Nom du modèle de conversation

Options disponibles:
qwen3.8-max-preview
Exemple:

"qwen3.8-max-preview"

messages
(System Message · object | User Message · object | Assistant Message · object | Tool Message · object)[]
requis

Liste des messages de conversation, prend en charge la conversation multi-tour. Les champs de message diffèrent selon le rôle (system / user / assistant / tool), veuillez sélectionner le rôle correspondant pour les consulter.

enable_thinking
boolean
défaut:false

Activer ou non la réflexion approfondie

  • true : le modèle produit son processus de réflexion, renvoyé via reasoning_content
  • false (par défaut) : ne produit pas le processus de réflexion

Remarque : certains modèles nécessitent de définir explicitement true en appel non-streaming pour renvoyer le contenu de réflexion.

temperature
number

Température d'échantillonnage, contrôle le caractère aléatoire de la sortie. Les valeurs plus basses sont plus déterministes, les plus élevées plus variées. Plage [0, 2]. Il est recommandé de ne pas ajuster temperature et top_p en même temps.

Plage requise: 0 <= x <= 2
top_p
number

Paramètre d'échantillonnage nucleus (Nucleus Sampling), échantillonne parmi les premiers tokens cumulant la probabilité. Plage (0, 1]. Il est recommandé de ne pas ajuster temperature et top_p en même temps.

Plage requise: 0 <= x <= 1
max_completion_tokens
integer

Limite supérieure de longueur du contenu généré (nombre de tokens), incluant la chaîne de réflexion et la réponse. Ce paramètre est recommandé pour les modèles de réflexion. La valeur par défaut et la valeur maximale correspondent à la longueur de sortie maximale du modèle ; au-delà, la génération s'arrête prématurément avec finish_reason=length.

max_tokens
integer

Ancien paramètre de limitation de longueur de génération.

Déprécié : pour les nouvelles intégrations, utilisez plutôt max_completion_tokens. Ce paramètre ne limite que la partie réponse (hors chaîne de réflexion).

stream
boolean
défaut:false

Renvoyer ou non la réponse en streaming.

  • true : retour bloc par bloc via SSE (Server-Sent Events)
  • false (par défaut) : renvoie la réponse complète en une seule fois
stream_options
object

Options de réponse en streaming, valides uniquement lorsque stream=true.

tools
object[]

Liste de définitions d'outils, utilisée pour Function Calling. Chaque outil doit définir un nom, une description et un schéma de paramètres.

Réponse

Génération de la conversation réussie

id
string

Identifiant unique de cette conversation

Exemple:

"chatcmpl-xxxxxxxx"

object
string
Exemple:

"chat.completion"

created
integer

Heure de création (secondes Unix)

Exemple:

1735120033

model
string
Exemple:

"qwen3.8-max-preview"

choices
object[]
usage
object

Statistiques d'utilisation des tokens.