DeepSeek V4 - API compatible con OpenAI
- Llama al modelo DeepSeek V4 usando el protocolo OpenAI Chat Completions
- Admite tres modelos:
deepseek-v4-flash(rápido y general),deepseek-v4-pro(razonamiento profundo) ydeepseek-v4-flash-vision-exp(comprensión de imágenes) - Conversación de texto puro: diálogo de uno o varios turnos con soporte para contexto ultra largo de 1M
- Comprensión de imágenes:
deepseek-v4-flash-vision-expacepta texto e imágenes mezclados en un mismo mensaje y admite varias imágenes - Prompt de sistema: personaliza el rol y el comportamiento de la IA
- Modo de pensamiento: controla el razonamiento profundo mediante
thinking.type; el contenido de pensamiento dedeepseek-v4-prose devuelve enreasoning_content - Salida en streaming: soporta respuestas SSE en streaming
- Llamada a herramientas: soporta Function Calling (hasta 128 herramientas)
- Modo JSON: se habilita mediante
response_format - Caché de contexto: las solicitudes con el mismo prefijo alcanzan automáticamente la caché, reduciendo notablemente el coste de entrada
Comportamiento de parámetros desconocidos: El proveedor ignora silenciosamente y sin error los campos de nivel superior no reconocidos del cuerpo de la solicitud. Los nombres de parámetros mal escritos no generan ninguna advertencia; utiliza solo los campos de esta referencia.
https://direct.evolink.ai, que ofrece mejor compatibilidad con modelos de texto y admite conexiones persistentes. https://api.evolink.ai es el endpoint principal para servicios multimodales y actúa como dirección de respaldo para los modelos de texto.Autorizaciones
##Todas las interfaces requieren autenticación mediante Bearer Token##
Obtención de la API Key:
Visita la página de gestión de API Key para obtener tu API Key
Al usarla, añádela en la cabecera de la solicitud:
Authorization: Bearer YOUR_API_KEY
Cuerpo
Nombre del modelo de conversación
deepseek-v4-flash: modelo rápido y general, contexto de 1Mdeepseek-v4-pro: modelo de razonamiento profundo, destaca en matemáticas, programación y lógica complejadeepseek-v4-flash-vision-exp: modelo experimental basado en Flash con comprensión nativa de imágenes; sus capacidades de texto, parámetros y precios son iguales a los de Flash
Nota: los tres modelos tienen thinking habilitado por defecto y las respuestas incluyen reasoning_content. Establece thinking.type="disabled" para desactivarlo y reducir el coste de tokens de salida.
Solo deepseek-v4-flash-vision-exp admite imágenes: enviar imágenes a deepseek-v4-flash / deepseek-v4-pro devuelve HTTP 400 con This model does not support image.
Aviso experimental: -exp identifica una versión experimental del proveedor. El nombre y la disponibilidad del modelo pueden cambiar; implementa una alternativa para producción.
deepseek-v4-flash, deepseek-v4-pro, deepseek-v4-flash-vision-exp "deepseek-v4-flash"
Lista de mensajes de la conversación, con soporte para diálogo multi-turno
Los mensajes de distintos roles tienen estructuras de campos diferentes; selecciona el rol correspondiente para ver su detalle
1- System Message
- User Message
- Assistant Message
- Tool Message
Show child attributes
Show child attributes
Control del modo de pensamiento (novedad en V4)
Descripción:
- Controla la funcionalidad de pensamiento profundo (Chain of Thought)
- Habilitado por defecto en ambos modelos (
type=enabled) - Al estar habilitado, el proceso de razonamiento se devuelve en
choices[].message.reasoning_contenty se factura como tokens de salida
Aviso para multi-turno / llamadas a herramientas: si la respuesta de este turno incluye reasoning_content, el mensaje assistant correspondiente en el historial de messages de la siguiente solicitud debe devolver este campo tal cual; de lo contrario, la API devolverá 400 The reasoning_content in the thinking mode must be passed back to the API. Si no deseas gestionarlo, puedes establecer explícitamente thinking.type="disabled" para toda la sesión.
Show child attributes
Show child attributes
Temperatura de muestreo, controla la aleatoriedad de la salida
Descripción:
- Valores bajos (p. ej. 0.2): salida más determinista y enfocada
- Valores altos (p. ej. 1.5): salida más aleatoria y creativa
- Valor por defecto: 1
0 <= x <= 21
Parámetro de muestreo por núcleo (Nucleus Sampling)
Descripción:
- Controla el muestreo desde los tokens cuya probabilidad acumulada alcanza cierto umbral
- Por ejemplo, 0.9 significa seleccionar entre los tokens que alcancen el 90% de probabilidad acumulada
- Valor por defecto: 1.0 (considera todos los tokens)
Recomendación: no ajustes simultáneamente temperature y top_p
0 <= x <= 11
Limita el número máximo de tokens a generar
Descripción:
- La serie V4 admite hasta 384,000 tokens
- Cuando
thinkingestá activado, los reasoning_tokens también cuentan para el límite demax_tokens - Si no se define, el modelo decide la longitud por sí mismo
1 <= x <= 3840004096
Especifica el formato de la respuesta
Descripción:
- Establecer
{"type": "json_object"}habilita el modo JSON - En modo JSON el modelo generará contenido con formato JSON válido
- Se recomienda indicar explícitamente en el mensaje
systemouserque se desea salida JSON para obtener los mejores resultados
Show child attributes
Show child attributes
Secuencias de parada; el modelo detiene la generación al encontrar estas cadenas
Descripción:
- Puede ser una cadena única o un array de cadenas
- Admite hasta 16 secuencias de parada
Si la respuesta debe devolverse en streaming
true: devolución en streaming, se envía el contenido por partes mediante SSE (Server-Sent Events)false: espera a la respuesta completa y la devuelve de una vez (por defecto)
false
Opciones de respuesta en streaming
Solo son efectivas cuando stream=true
Show child attributes
Show child attributes
Lista de definiciones de herramientas, usada para Function Calling
Descripción:
- Admite hasta 128 definiciones de herramientas
- Cada herramienta debe definir nombre, descripción y esquema de parámetros
128Show child attributes
Show child attributes
Controla el comportamiento de llamada a herramientas
Valores posibles:
none: no llamar a ninguna herramientaauto: el modelo decide automáticamente si llamar a una herramienta (por defecto cuando se proporcionantools)required: obliga al modelo a llamar a una o más herramientas- Forma de objeto
{"type":"function","function":{"name":"xxx"}}: especifica la herramienta concreta a llamar
Valor por defecto: none si no hay tools, auto si hay tools
none, auto, required Si se devuelven las probabilidades logarítmicas de los tokens
Descripción:
- Al establecerlo en
true, la respuesta incluirá la probabilidad logarítmica de cada token
Devuelve las probabilidades logarítmicas de los N tokens con mayor probabilidad
Descripción:
- Requiere que
logprobsseatrue - Rango admitido:
[0, 20]
0 <= x <= 20Respuesta
Conversación generada con éxito
Identificador único de la completación de conversación
"53c548dc-ec02-4a2f-bbb6-eca4184630b8"
Nombre del modelo realmente utilizado
"deepseek-v4-flash"
Tipo de respuesta
chat.completion "chat.completion"
Marca de tiempo de creación (Unix en segundos)
1777021417
Lista de opciones generadas por la conversación
Show child attributes
Show child attributes
Estadísticas de uso de tokens (incluye desglose de caché y razonamiento)
Show child attributes
Show child attributes
Identificador de huella del sistema
"fp_evolink_v4_20260402"