DeepSeek V4 - API Responses
- Llamada a los modelos DeepSeek V4 mediante el protocolo OpenAI Responses
- Admite
deepseek-v4-flash(rápido y de uso general) ydeepseek-v4-pro(razonamiento profundo) - Formas de entrada:
inputpuede ser texto plano o un arreglo de elementos de entrada (mensaje, llamada a función, resultado de función, razonamiento, registro de búsqueda) - Instrucciones de sistema: se envían con
instructionsy equivalen a un mensaje system al principio - Modo de razonamiento: se controla con
reasoning.effort; el contenido de razonamiento se devuelve como elemento de salidareasoning - Salida en streaming: admite eventos SSE semánticos y termina con
response.completed; no se envía[DONE] - Llamada a herramientas: admite Function Calling y la búsqueda web integrada
web_search - Salida estructurada: se habilita con
text.formatcomo objeto JSON o JSON Schema - Caché de contexto: las solicitudes que comparten prefijo aciertan la caché automáticamente y reducen mucho el coste de entrada
Eventos de streaming: response.created, response.output_item.added, response.reasoning_text.delta, response.output_text.delta; los eventos finales son response.completed / response.incomplete / response.failed. Cada evento incluye un sequence_number para ordenarlos.
Campos sin efecto: los siguientes campos de OpenAI pueden enviarse sin error, pero no producen ningún efecto real.
| Campo | Comportamiento |
|---|---|
store | Siempre false, las respuestas no se almacenan |
previous_response_id | Siempre null, no se admite continuar una conversación |
conversation | No admitido |
background / metadata / include | Ignorado |
prompt / truncation / service_tier | Ignorado |
safety_identifier / context_management | Ignorado |
stream_options | Ignorado |
parallel_tool_calls | Ignorado, las llamadas paralelas a herramientas están siempre activas |
max_tool_calls | Ignorado |
Herramientas file_search / code_interpreter / mcp | Ignorado |
Otras limitaciones:
- Las herramientas personalizadas (
type: custom) solo admitenapply_patch - La herramienta
web_searchignorasearch_context_sizeyuser_location - Los bloques de contenido de imagen y archivo se convierten en marcadores de posición; DeepSeek V4 no es un modelo de visión
- Si la entrada supera la ventana de contexto se devuelve 400 directamente, sin truncado automático
https://direct.evolink.ai, que ofrece mejor compatibilidad con modelos de texto y admite conexiones persistentes. https://api.evolink.ai es el endpoint principal para servicios multimodales y actúa como dirección de respaldo para los modelos de texto.Autorizaciones
##Todas las interfaces requieren autenticación mediante Bearer Token##
Obtención de la API Key:
Visita la página de gestión de API Key para obtener tu API Key
Al usarla, añádela en la cabecera de la solicitud:
Cuerpo
ID del modelo
deepseek-v4-flash: rápido y de uso general, adecuado para conversación cotidiana, resumen y extraccióndeepseek-v4-pro: razonamiento profundo, adecuado para matemáticas complejas, código y planificación en varios pasos
deepseek-v4-flash, deepseek-v4-pro "deepseek-v4-flash"
Entrada del modelo. Debe proporcionarse al menos uno de input e instructions.
- Forma de cadena: todo el texto se trata como un único mensaje
user - Forma de arreglo: lista de elementos de entrada que admite cinco tipos:
message,function_call,function_call_output,reasoningyweb_search_call
Conversaciones de varios turnos: el endpoint no tiene estado, por lo que continuar una conversación obliga a incluir el historial completo en el arreglo.
"Presenta Hangzhou en una sola frase."
Instrucciones a nivel de sistema, equivalentes a un mensaje system insertado al principio; sirven para fijar el rol, el tono y las restricciones de salida.
"Eres un redactor técnico riguroso. Mantén las respuestas concisas."
Si la respuesta se devuelve en streaming
false(predeterminado): devuelve el objeto de respuesta completo de una veztrue: envía eventos SSE semánticos; el evento final esresponse.completed/response.incomplete/response.failed, y no se envía[DONE]
false
Número máximo de tokens de salida de esta generación (incluidos los tokens de razonamiento). Rango de 1 a 393216 (384K). Si se deja vacío, lo decide el modelo.
1 <= x <= 3932164096
Temperatura de muestreo; cuanto mayor sea, más aleatoria será la salida. No tiene efecto en modo de razonamiento.
0 <= x <= 21
Umbral de muestreo por núcleo; se recomienda ajustar solo este o temperature. No tiene efecto en modo de razonamiento.
x <= 11
Devuelve en cada posición los tokens candidatos más probables y sus probabilidades logarítmicas.
0 <= x <= 200
Configuración del modo de razonamiento. DeepSeek V4 activa el razonamiento de forma predeterminada; el contenido de razonamiento se devuelve como elemento de salida reasoning y sus tokens cuentan como salida y se facturan a la tarifa de salida.
Configuración del formato de salida de texto.
Lista de herramientas que el modelo puede invocar. Las herramientas de tipo función las ejecuta el cliente, que devuelve el resultado como function_call_output; web_search se ejecuta directamente en el servidor, sin intervención del cliente.
Estrategia de llamada a herramientas
none: prohíbe llamar herramientasauto(predeterminado): lo decide el modelorequired: debe llamarse al menos una herramienta{"type": "function", "name": "get_weather"}: fuerza la llamada a una función concreta{"type": "web_search"}: fuerza una búsqueda web
"auto"
Respuesta
Generación correcta
Objeto de respuesta del endpoint Responses.
Identificador único de esta respuesta
"resp_9f2c1a4b8e7d"
Tipo de objeto, siempre response
"response"
Fecha de creación como marca de tiempo Unix (segundos)
1755000000
Estado de la respuesta
completed: finalizada correctamentein_progress: en proceso de generaciónincomplete: truncada, por ejemplo por longitud; consultaincomplete_detailsfailed: la generación falló; consultaerror
in_progress, completed, incomplete, failed "completed"
ID del modelo que realmente generó esta respuesta
"deepseek-v4-flash"
Lista de elementos de salida en orden de generación. Campos por tipo:
reasoning: el proceso de razonamiento, conid,status,content(lista de bloquesreasoning_text) ysummarymessage: la respuesta final, conid,status,roleycontent(lista de bloquesoutput_text)function_call: una llamada a función del modelo, conid,status,call_id,nameyarguments; el cliente la ejecuta y devuelve el resultado comofunction_call_outputweb_search_call: un registro de búsqueda web ejecutada en el servidor, conid,statusyaction(que describe la búsqueda realizada)
Motivo del fallo; null si tuvo éxito
Motivo del truncado; null si no se truncó
Estadísticas de uso de tokens (con desglose de caché y razonamiento)