Saltar al contenido principal
POST
Nota sobre la BaseURL: la BaseURL predeterminada es https://direct.evolink.ai, que ofrece mejor soporte para modelos de texto y admite conexiones persistentes; https://api.evolink.ai es la dirección principal multimodal, úsala cuando incluyas entrada de imagen / audio / video.

Autorizaciones

Authorization
string
header
requerido

##Todas las API requieren autenticación con Bearer Token##

Obtener la API Key:

Visita la página de gestión de API Keys para obtener tu API Key

Añadir al encabezado de la solicitud:

Cuerpo

application/json
model
enum<string>
requerido

Nombre del modelo de chat

Opciones disponibles:
qwen3.8-max-preview
Ejemplo:

"qwen3.8-max-preview"

messages
(Mensaje de sistema · object | Mensaje de usuario · object | Mensaje de asistente · object | Mensaje de herramienta · object)[]
requerido

Lista de mensajes de la conversación, admite conversación de varios turnos. Los distintos roles (system / user / assistant / tool) tienen estructuras de campos diferentes; selecciona el rol correspondiente para ver los detalles.

enable_thinking
boolean
predeterminado:false

Indica si se activa el pensamiento profundo

  • true: el modelo devuelve el proceso de pensamiento mediante reasoning_content
  • false (predeterminado): no devuelve el proceso de pensamiento

Nota: algunos modelos requieren establecerlo explícitamente en true para devolver el contenido del pensamiento en llamadas sin streaming.

temperature
number

Temperatura de muestreo, controla la aleatoriedad de la salida. Los valores más bajos son más deterministas y los más altos, más variados. Rango [0, 2]. Se recomienda no ajustar temperature y top_p a la vez.

Rango requerido: 0 <= x <= 2
top_p
number

Parámetro de muestreo de núcleo (Nucleus Sampling), muestrea de los primeros tokens por probabilidad acumulada. Rango (0, 1]. Se recomienda no ajustar temperature y top_p a la vez.

Rango requerido: 0 <= x <= 1
max_completion_tokens
integer

Límite de longitud del contenido generado (número de tokens), incluye la cadena de pensamiento y la respuesta. Se recomienda este parámetro para los modelos de pensamiento. El valor predeterminado y el máximo coinciden con la longitud máxima de salida del modelo; al superarlo se detiene anticipadamente con finish_reason=length.

max_tokens
integer

Parámetro heredado de límite de longitud de generación.

Obsoleto: para nuevas integraciones usa max_completion_tokens. Este parámetro solo limita la parte de la respuesta (sin la cadena de pensamiento).

stream
boolean
predeterminado:false

Indica si la respuesta se devuelve en streaming.

  • true: se devuelve por bloques mediante SSE (Server-Sent Events)
  • false (predeterminado): se devuelve la respuesta completa de una sola vez
stream_options
object

Opciones de respuesta en streaming, solo válidas cuando stream=true.

tools
object[]

Lista de definiciones de herramientas para Function Calling. Cada herramienta debe definir un nombre, una descripción y un schema de parámetros.

Respuesta

Chat generado correctamente

id
string

Identificador único de esta conversación

Ejemplo:

"chatcmpl-xxxxxxxx"

object
string
Ejemplo:

"chat.completion"

created
integer

Hora de creación (segundos Unix)

Ejemplo:

1735120033

model
string
Ejemplo:

"qwen3.8-max-preview"

choices
object[]
usage
object

Estadísticas de uso de tokens.