curl --request POST \
--url https://direct.evolink.ai/v1/responses \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "qwen3.8-max",
"input": "¿Qué puedes hacer?"
}
'{
"id": "resp_xxxxxxxx",
"object": "response",
"status": "completed",
"model": "qwen3.8-max",
"output": [
{}
],
"usage": {
"input_tokens": 45,
"output_tokens": 63,
"total_tokens": 108,
"input_tokens_details": {
"cached_tokens": 0
},
"output_tokens_details": {
"reasoning_tokens": 0
},
"prompt_tokens_details": {
"cached_tokens": 0,
"cache_creation_input_tokens": 0
}
}
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient credits",
"type": "insufficient_quota"
}
}{
"error": {
"code": 123,
"message": "<string>",
"type": "<string>",
"param": "<string>"
}
}{
"error": {
"code": 123,
"message": "<string>",
"type": "<string>",
"param": "<string>"
}
}Qwen3.8-Max - API Responses
- Llama a Qwen3.8-Max mediante el protocolo OpenAI Responses
- Entrada flexible:
inputacepta una cadena o un array de mensajes en formato Chat (admite multimodalinput_text/input_image) - Conversación de varios turnos: pasa
previous_response_idpara relacionar la respuesta del turno anterior; el servidor compone automáticamente el contexto (elidde la respuesta es válido durante 7 días) - Caché de sesión: se activa añadiendo el encabezado
x-dashscope-session-cache: enable(disable por defecto); consulta los aciertos enusage.input_tokens_details.cached_tokens - Intensidad de pensamiento: se controla mediante
reasoning.effort - Salida en streaming: cuando
stream=true, se devuelve según los eventos de Responses (response.output_text.delta/response.completed, etc.)
curl --request POST \
--url https://direct.evolink.ai/v1/responses \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "qwen3.8-max",
"input": "¿Qué puedes hacer?"
}
'{
"id": "resp_xxxxxxxx",
"object": "response",
"status": "completed",
"model": "qwen3.8-max",
"output": [
{}
],
"usage": {
"input_tokens": 45,
"output_tokens": 63,
"total_tokens": 108,
"input_tokens_details": {
"cached_tokens": 0
},
"output_tokens_details": {
"reasoning_tokens": 0
},
"prompt_tokens_details": {
"cached_tokens": 0,
"cache_creation_input_tokens": 0
}
}
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient credits",
"type": "insufficient_quota"
}
}{
"error": {
"code": 123,
"message": "<string>",
"type": "<string>",
"param": "<string>"
}
}{
"error": {
"code": 123,
"message": "<string>",
"type": "<string>",
"param": "<string>"
}
}https://direct.evolink.ai, que ofrece mejor soporte para modelos de texto y admite conexiones persistentes; https://api.evolink.ai es la dirección principal multimodal, úsala cuando incluyas entrada de imagen.Caché de sesión: la interfaz Responses activa la caché de sesión del servidor mediante el encabezado x-dashscope-session-cache: enable para reducir la latencia y el coste de varios turnos.Autorizaciones
##Todas las API requieren autenticación con Bearer Token##
Obtener la API Key:
Visita la página de gestión de API Keys para obtener tu API Key
Añadir al encabezado de la solicitud:
Authorization: Bearer YOUR_API_KEY
Encabezados
Interruptor de caché de sesión. Cuando se establece en enable, el servidor almacena automáticamente en caché el contexto de la conversación para reducir la latencia y el coste de la inferencia de varios turnos.
enable, disable Cuerpo
Nombre del modelo de chat
qwen3.8-max "qwen3.8-max"
Entrada del modelo. Acepta una cadena (texto plano) o un array de mensajes en formato Chat (admite multimodal input_text / input_image).
Se inserta como instrucción de sistema al inicio del contexto. Cuando se usa previous_response_id, las instructions del turno anterior no se transfieren al turno actual.
ID único de la respuesta del turno anterior (el id de la respuesta, válido durante 7 días). Sirve para relacionar conversaciones de varios turnos; el servidor recupera y combina automáticamente la entrada y la salida de ese turno como contexto.
Número máximo de tokens del contenido de salida de esta generación (incluye pensamiento).
Control del pensamiento.
Show child attributes
Show child attributes
Indica si se almacena esta respuesta.
true(predeterminado): puede referenciarse medianteprevious_response_idfalse: no se almacena y no podrá referenciarse después
Indica si se devuelve en streaming como eventos de Responses.
Temperatura de muestreo, rango [0, 2].
0 <= x <= 2Parámetro de muestreo de núcleo, rango (0, 1].
0 <= x <= 1Lista de herramientas. Admite herramientas integradas (web_search búsqueda web, web_extractor extracción de páginas web, code_interpreter intérprete de código) y function personalizadas.
Show child attributes
Show child attributes
Respuesta
Generado correctamente
ID único de esta respuesta (válido durante 7 días, puede usarse como previous_response_id)
"resp_xxxxxxxx"
"response"
Estado de la respuesta
"completed"
"qwen3.8-max"
Array de elementos de salida (incluye message / reasoning / llamadas a herramientas integradas, etc.)
Estadísticas de uso de tokens.
Show child attributes
Show child attributes