Skip to main content
POST
BaseURL: La BaseURL predeterminada es https://direct.evolink.ai, que ofrece mejor compatibilidad con modelos de texto y admite conexiones persistentes. https://api.evolink.ai es el endpoint principal para servicios multimodales y actúa como dirección de respaldo para los modelos de texto.

Autorizaciones

Authorization
string
header
requerido

##Todas las interfaces requieren autenticación mediante Bearer Token##

Obtención de la API Key:

Visita la página de gestión de API Key para obtener tu API Key

Al usarla, añádela en la cabecera de la solicitud:

Cuerpo

application/json
model
enum<string>
predeterminado:deepseek-v4-flash
requerido

ID del modelo

  • deepseek-v4-flash: rápido y de uso general, adecuado para conversación cotidiana, resumen y extracción
  • deepseek-v4-pro: razonamiento profundo, adecuado para matemáticas complejas, código y planificación en varios pasos
Opciones disponibles:
deepseek-v4-flash,
deepseek-v4-pro
Ejemplo:

"deepseek-v4-flash"

input

Entrada del modelo. Debe proporcionarse al menos uno de input e instructions.

  • Forma de cadena: todo el texto se trata como un único mensaje user
  • Forma de arreglo: lista de elementos de entrada que admite cinco tipos: message, function_call, function_call_output, reasoning y web_search_call

Conversaciones de varios turnos: el endpoint no tiene estado, por lo que continuar una conversación obliga a incluir el historial completo en el arreglo.

Ejemplo:

"Presenta Hangzhou en una sola frase."

instructions
string

Instrucciones a nivel de sistema, equivalentes a un mensaje system insertado al principio; sirven para fijar el rol, el tono y las restricciones de salida.

Ejemplo:

"Eres un redactor técnico riguroso. Mantén las respuestas concisas."

stream
boolean
predeterminado:false

Si la respuesta se devuelve en streaming

  • false (predeterminado): devuelve el objeto de respuesta completo de una vez
  • true: envía eventos SSE semánticos; el evento final es response.completed / response.incomplete / response.failed, y no se envía [DONE]
Ejemplo:

false

max_output_tokens
integer

Número máximo de tokens de salida de esta generación (incluidos los tokens de razonamiento). Rango de 1 a 393216 (384K). Si se deja vacío, lo decide el modelo.

Rango requerido: 1 <= x <= 393216
Ejemplo:

4096

temperature
number
predeterminado:1

Temperatura de muestreo; cuanto mayor sea, más aleatoria será la salida. No tiene efecto en modo de razonamiento.

Rango requerido: 0 <= x <= 2
Ejemplo:

1

top_p
number
predeterminado:1

Umbral de muestreo por núcleo; se recomienda ajustar solo este o temperature. No tiene efecto en modo de razonamiento.

Rango requerido: x <= 1
Ejemplo:

1

top_logprobs
integer

Devuelve en cada posición los tokens candidatos más probables y sus probabilidades logarítmicas.

Rango requerido: 0 <= x <= 20
Ejemplo:

0

reasoning
object

Configuración del modo de razonamiento. DeepSeek V4 activa el razonamiento de forma predeterminada; el contenido de razonamiento se devuelve como elemento de salida reasoning y sus tokens cuentan como salida y se facturan a la tarifa de salida.

text
object

Configuración del formato de salida de texto.

tools
Definición de herramienta · object[]

Lista de herramientas que el modelo puede invocar. Las herramientas de tipo función las ejecuta el cliente, que devuelve el resultado como function_call_output; web_search se ejecuta directamente en el servidor, sin intervención del cliente.

tool_choice

Estrategia de llamada a herramientas

  • none: prohíbe llamar herramientas
  • auto (predeterminado): lo decide el modelo
  • required: debe llamarse al menos una herramienta
  • {"type": "function", "name": "get_weather"}: fuerza la llamada a una función concreta
  • {"type": "web_search"}: fuerza una búsqueda web
Ejemplo:

"auto"

Respuesta

Generación correcta

Objeto de respuesta del endpoint Responses.

id
string

Identificador único de esta respuesta

Ejemplo:

"resp_9f2c1a4b8e7d"

object
string

Tipo de objeto, siempre response

Ejemplo:

"response"

created_at
integer

Fecha de creación como marca de tiempo Unix (segundos)

Ejemplo:

1755000000

status
enum<string>

Estado de la respuesta

  • completed: finalizada correctamente
  • in_progress: en proceso de generación
  • incomplete: truncada, por ejemplo por longitud; consulta incomplete_details
  • failed: la generación falló; consulta error
Opciones disponibles:
in_progress,
completed,
incomplete,
failed
Ejemplo:

"completed"

model
string

ID del modelo que realmente generó esta respuesta

Ejemplo:

"deepseek-v4-flash"

output
object[]

Lista de elementos de salida en orden de generación. Campos por tipo:

  • reasoning: el proceso de razonamiento, con id, status, content (lista de bloques reasoning_text) y summary
  • message: la respuesta final, con id, status, role y content (lista de bloques output_text)
  • function_call: una llamada a función del modelo, con id, status, call_id, name y arguments; el cliente la ejecuta y devuelve el resultado como function_call_output
  • web_search_call: un registro de búsqueda web ejecutada en el servidor, con id, status y action (que describe la búsqueda realizada)
error
object | null

Motivo del fallo; null si tuvo éxito

incomplete_details
object | null

Motivo del truncado; null si no se truncó

usage
object

Estadísticas de uso de tokens (con desglose de caché y razonamiento)