Passer au contenu principal
POST
À propos de la BaseURL : la BaseURL par défaut est https://direct.evolink.ai, qui offre une meilleure prise en charge des modèles de texte et des connexions longues ; https://api.evolink.ai est l’adresse principale multimodale, à utiliser en cas d’entrée image.Mise en cache de session : l’interface Responses active la mise en cache de session côté serveur via l’en-tête de requête x-dashscope-session-cache: enable afin de réduire la latence et le coût des tours multiples.

Autorisations

Authorization
string
header
requis

##Toutes les API nécessitent une authentification Bearer Token##

Obtenir une clé API :

Visitez la Page de gestion des clés API pour obtenir votre clé API

Ajouter à l'en-tête de requête :

En-têtes

x-dashscope-session-cache
enum<string>
défaut:disable

Interrupteur de mise en cache de session. Défini sur enable, le serveur met automatiquement en cache le contexte de conversation pour réduire la latence et le coût de l'inférence multi-tour.

Options disponibles:
enable,
disable

Corps

application/json
model
enum<string>
requis

Nom du modèle de conversation

Options disponibles:
qwen3.8-max-preview
Exemple:

"qwen3.8-max-preview"

input
requis

Entrée du modèle. Peut recevoir une chaîne (texte brut), ou un tableau de messages au format Chat (prenant en charge le multimodal input_text / input_image).

instructions
string

Inséré au début du contexte en tant qu'instruction système. Lors de l'utilisation de previous_response_id, les instructions du tour précédent ne sont pas transmises au tour actuel.

previous_response_id
string

ID unique de la réponse du tour précédent (l'id de réponse, valable 7 jours). Utilisé pour associer une conversation multi-tour, le serveur récupère et combine automatiquement l'entrée et la sortie de ce tour comme contexte.

max_output_tokens
integer

Nombre maximal de tokens du contenu de sortie généré cette fois (réflexion incluse).

reasoning
object

Contrôle de la réflexion.

store
boolean
défaut:true

Stocker ou non cette réponse.

  • true (par défaut) : peut être référencée par previous_response_id
  • false : non stockée, ne peut pas être référencée ultérieurement
stream
boolean
défaut:false

Renvoyer ou non un flux d'événements Responses.

temperature
number

Température d'échantillonnage, plage [0, 2].

Plage requise: 0 <= x <= 2
top_p
number

Paramètre d'échantillonnage nucleus, plage (0, 1].

Plage requise: 0 <= x <= 1
tools
object[]

Liste d'outils. Prend en charge les outils intégrés (web_search recherche web, web_extractor extraction de pages web, code_interpreter interpréteur de code) ainsi que les function personnalisées.

Réponse

Génération réussie

id
string

ID unique de cette réponse (valable 7 jours, peut servir de previous_response_id)

Exemple:

"resp_xxxxxxxx"

object
string
Exemple:

"response"

status
string

Statut de la réponse

Exemple:

"completed"

model
string
Exemple:

"qwen3.8-max-preview"

output
object[]

Tableau d'éléments de sortie (contenant message / reasoning / appels d'outils intégrés, etc.)

usage
object

Statistiques d'utilisation des tokens.