Saltar al contenido principal
POST
Nota sobre la BaseURL: la BaseURL predeterminada es https://direct.evolink.ai, que ofrece mejor soporte para modelos de texto y admite conexiones persistentes; https://api.evolink.ai es la dirección principal multimodal, úsala cuando incluyas entrada de imagen.Caché de sesión: la interfaz Responses activa la caché de sesión del servidor mediante el encabezado x-dashscope-session-cache: enable para reducir la latencia y el coste de varios turnos.

Autorizaciones

Authorization
string
header
requerido

##Todas las API requieren autenticación con Bearer Token##

Obtener la API Key:

Visita la página de gestión de API Keys para obtener tu API Key

Añadir al encabezado de la solicitud:

Encabezados

x-dashscope-session-cache
enum<string>
predeterminado:disable

Interruptor de caché de sesión. Cuando se establece en enable, el servidor almacena automáticamente en caché el contexto de la conversación para reducir la latencia y el coste de la inferencia de varios turnos.

Opciones disponibles:
enable,
disable

Cuerpo

application/json
model
enum<string>
requerido

Nombre del modelo de chat

Opciones disponibles:
qwen3.8-max-preview
Ejemplo:

"qwen3.8-max-preview"

input
requerido

Entrada del modelo. Acepta una cadena (texto plano) o un array de mensajes en formato Chat (admite multimodal input_text / input_image).

instructions
string

Se inserta como instrucción de sistema al inicio del contexto. Cuando se usa previous_response_id, las instructions del turno anterior no se transfieren al turno actual.

previous_response_id
string

ID único de la respuesta del turno anterior (el id de la respuesta, válido durante 7 días). Sirve para relacionar conversaciones de varios turnos; el servidor recupera y combina automáticamente la entrada y la salida de ese turno como contexto.

max_output_tokens
integer

Número máximo de tokens del contenido de salida de esta generación (incluye pensamiento).

reasoning
object

Control del pensamiento.

store
boolean
predeterminado:true

Indica si se almacena esta respuesta.

  • true (predeterminado): puede referenciarse mediante previous_response_id
  • false: no se almacena y no podrá referenciarse después
stream
boolean
predeterminado:false

Indica si se devuelve en streaming como eventos de Responses.

temperature
number

Temperatura de muestreo, rango [0, 2].

Rango requerido: 0 <= x <= 2
top_p
number

Parámetro de muestreo de núcleo, rango (0, 1].

Rango requerido: 0 <= x <= 1
tools
object[]

Lista de herramientas. Admite herramientas integradas (web_search búsqueda web, web_extractor extracción de páginas web, code_interpreter intérprete de código) y function personalizadas.

Respuesta

Generado correctamente

id
string

ID único de esta respuesta (válido durante 7 días, puede usarse como previous_response_id)

Ejemplo:

"resp_xxxxxxxx"

object
string
Ejemplo:

"response"

status
string

Estado de la respuesta

Ejemplo:

"completed"

model
string
Ejemplo:

"qwen3.8-max-preview"

output
object[]

Array de elementos de salida (incluye message / reasoning / llamadas a herramientas integradas, etc.)

usage
object

Estadísticas de uso de tokens.