Accede a V4 Pro de DeepSeek —también buscado como DeepSeek V4— a través de la API de chat unificada de EvoLink. Prueba el razonamiento, la programación con contexto largo, la caché de prompts antes de integrar.
Programación con contexto largoModo thinkingCaché de promptsChat + Messages + Responses
Ruta de producciónEsta tasa refleja la disponibilidad del lado de la plataforma: solo los errores de servidor confirmados (HTTP 500 / respuesta vacía) cuentan como fallos. Los problemas del lado del usuario (moderación de contenido, parámetros inválidos, cancelación), así como los límites de tasa, timeouts y errores de autenticación quedan excluidos. Antes de que llegue tráfico real, los intervalos vacíos pueden mostrarse como disponibles.Live
Live
Contexto
1M de contexto · 384K de salida máx.
Ideal para
Razonamiento más profundo, programación compleja y agentes cuando Flash no basta
Entrada
Texto
Salida
Texto · JSON (salida estructurada)
DeepSeek prevé cambiar deepseek-v4-pro a V4.1 Flash en su API directa el 14 de septiembre de 2026; en EvoLink, deepseek-v4-pro no se ve afectado y sigue sirviendo V4 Pro. Consulta la guía de migración a V4.1 Flash.
Una ruta de evaluación para programación, razonamiento y contexto largo, disponible en Chat Completions, Messages y Responses.
DeepSeek V4 Pro
Modelo de DeepSeek para razonamiento y uso de herramientas
Seleccionado
ID del modelo
deepseek-v4-pro
Ideal para
Cargas grandes de programación, razonamiento, análisis de documentos largos y agentes que necesitan una ruta económica con precio de entrada en caché.
Entrada
$1.324 / 1M
90 cr / 1M
Acierto de caché
$0.045 / 1M
3 cr / 1M
Salida
$3.971 / 1M
270 cr / 1M
Todas las tarifas son por 1M de tokens, en USD y créditos, y reflejan los precios actuales de tu cuenta.
Precios de DeepSeek V4 Pro
Estima el coste de una solicitud de DeepSeek V4 Pro antes de integrar. La calculadora usa las tarifas actuales de tu cuenta; los precios oficiales sirven de referencia.
Calculadora de solicitud
Introduce la combinación de tokens de una solicitud y el número de llamadas a herramientas exitosas.
Coste estimado por solicitud
DeepSeek V4 Pro
USD$0.0026
Créditos0.1716
Tokens de entrada0.09 cr
Tokens de acierto de caché0.0006 cr
Tokens de salida0.081 cr
Cargo mínimo: 0.01 créditos por solicitud.
Guía de presupuesto
Solicitudes aproximadas con la combinación actual de tokens.
Solo las llamadas exitosas del lado del servidor se facturan por llamada; los intentos fallidos no tienen tarifa de herramienta, pero los tokens sí se cobran.
Búsqueda web$0.010/ llamada·0.68 cr / llamada
¿Qué es la API de DeepSeek V4 Pro?
DeepSeek V4 Pro es el nivel más potente de DeepSeek: arquitectura Mixture-of-Experts de 1,6 billones de parámetros (49B activos por token), contexto de 1 M de tokens, salida máxima de 384K y modo thinking activado por defecto. En EvoLink está disponible en /v1/chat/completions (estilo OpenAI) y /v1/messages (estilo Anthropic) con el ID deepseek-v4-pro. Consulta límites de precio, flujos admitidos y configuración en las secciones Pricing y API. DeepSeek prevé reenviar deepseek-v4-pro a V4.1 Flash en su API directa a partir del 14 de septiembre de 2026 a las 12:00, hora de Pekín (04:00 UTC); en EvoLink, deepseek-v4-pro no se ve afectado y sigue sirviendo V4 Pro.
DeepSeek V4 Pro se sirve en EvoLink con el ID de modelo deepseek-v4-pro mediante Chat Completions · Anthropic Messages · Responses, con la misma clave API y saldo que usas para cualquier otro modelo. Ofrece una ventana de contexto de 1M y hasta 384K tokens de salida, además de el razonamiento, la programación con contexto largo, la caché de prompts.
Especificaciones y capacidades de DeepSeek V4 Pro
Las cifras proceden de la configuración de ruta de EvoLink; las capacidades son las que la API expone hoy.
Ventana de contexto
1M tokens
Salida máx.
384K tokens
Entrada
Texto
Salida
Texto · JSON (salida estructurada)
Razonamiento
Modo de pensamiento (activado por defecto)
Caché de prompts
Lecturas de caché automáticas a tarifa reducida
Herramientas del servidor
Búsqueda web, facturadas por llamada exitosa
Protocolos
Chat Completions · Anthropic Messages · Responses
ID del modelo
deepseek-v4-pro
Las solicitudes de Chat Completions, Messages y Responses deben usar el ID exacto que se muestra aquí.
¿Para qué tareas es adecuada la API de DeepSeek V4 Pro?
DeepSeek V4 Pro combina una ventana de contexto de 1.000.000 tokens, razonamiento configurable y llamadas a herramientas para trabajos que deben conservar evidencia, llamar a sistemas externos y entregar resultados verificables. El modelo es solo de texto: no acepta entrada de imágenes. Estos casos de uso explican dónde puede aportar valor y qué confirmar antes de la integración.
Programación y revisión a escala de repositorio
Reúne código fuente, issues, resultados de pruebas y cambios anteriores para investigar problemas entre archivos, preparar implementaciones y revisar modificaciones. Antes del despliegue, usa tareas fijas para comprobar pruebas superadas, pasos omitidos, resultados estructurados y correcciones humanas necesarias.
Documentos largos y análisis de varias fuentes
La ventana de 1.000.000 tokens puede contener informes, contratos, fragmentos de bases de conocimiento, historial y fuentes recuperadas. Más contexto no garantiza una respuesta mejor: comprueba que se conserve la evidencia clave y usa las tarifas en tiempo real y el mecanismo de aciertos de caché de Pricing para calcular el coste por resultado aceptable.
Agentes de larga duración y flujos de terminal
La versión GA 0813 mejoró notablemente la programación agéntica y las tareas de terminal, justo donde los comentarios de la comunidad (una señal de demanda, no una conclusión verificada) sitúan con más frecuencia el valor de V4 Pro frente a modelos cerrados. Conecta tus propias herramientas de búsqueda y ejecución mediante function calling y valida la tasa de finalización de tareas de varios pasos con tus cargas reales antes de escalar.
Salida estructurada y orquestación de agentes
Las entradas de texto pueden alimentar JSON Schema, llamadas a funciones y agentes de varios pasos para extracción, revisión y automatización. Antes de producción, prueba la validez del esquema, los argumentos, el cierre del streaming y la recuperación segura tras un fallo de herramienta.
¿Qué cambia al usar DeepSeek V4 Pro mediante distintas plataformas?
Aunque el modelo sea el mismo, la configuración de contexto, las herramientas, los datos de uso y la facturación pueden variar. EvoLink reúne configuración y consumo tras una sola API para simplificar futuros cambios de modelo.
Usar el ID de modelo API correcto
La URL de la página y el ID de modelo que se envía en la API son la misma cadena: deepseek-v4-pro. Las aplicaciones existentes con Chat Completions o Responses pueden cambiar la configuración del modelo. Los campos exactos siguen en la sección API.
Seguir la configuración del canal API actual
DeepSeek documenta una ventana de 1.000.000 tokens, pero cada plataforma puede ofrecer opciones de contexto, herramientas y límites distintos. En EvoLink, toma como referencia la configuración, las funciones disponibles y los datos usage mostrados para el canal actual.
Elegir Chat o Responses según el flujo
Empieza con Chat Completions para chat, streaming y funciones del cliente. Evalúa Responses, el protocolo añadido en la versión 0813, cuando necesites flujos de agentes largos de varios pasos; sus herramientas de servidor documentadas son function calling, web search y apply_patch, y code interpreter se ignora en esta ruta. Así conservas una integración de estilo OpenAI sin complejidad innecesaria.
Mantener abierta la elección de modelo
Una cuenta, saldo y patrón de API de EvoLink sirven para Grok, GPT, Claude y Kimi. Si el modelo permanece en configuración, el equipo puede enrutar por calidad, coste y disponibilidad sin reconstruir la aplicación para cada proveedor.
¿Cómo controlar mejor el coste de la API de DeepSeek V4 Pro?
Pricing muestra las tarifas actuales de tokens (entrada, acierto de caché, salida). La caché, la gestión del contexto, el nivel de razonamiento y el enrutamiento reducen consumo innecesario y relacionan el gasto con tareas terminadas.
Preparar el contexto repetido para la caché
Los prompts de sistema estables, esquemas de herramientas y contexto compartido son más fáciles de reutilizar. Configura el identificador de caché o conversación compatible con el protocolo y revisa cached tokens en usage para confirmar el beneficio real.
Enviar solo el contexto que necesita la tarea
La ventana de 1.000.000 tokens ayuda con repositorios y documentos grandes, pero no hay que llenarla siempre. Seleccionar archivos, mensajes y fragmentos relevantes reduce el coste de entrada y ayuda al modelo a centrarse en la evidencia decisiva.
Ajustar razonamiento, salida y herramientas
Las tareas sencillas pueden comenzar con reasoning effort bajo y una salida corta; aumenta el presupuesto en análisis difíciles. En investigación y agentes, controla también el número de herramientas para evitar búsquedas repetidas, ejecuciones inútiles o bucles.
Comparar modelos por coste total de la tarea
Evalúa tokens, entrada en caché, herramientas de servidor y reintentos dentro de la misma tarea completada. EvoLink centraliza modelos y uso para comparar el coste total del mismo trabajo con DeepSeek V4 Pro y otras rutas.
Dos formas de usar DeepSeek V4 Pro: API de EvoLink o Agente
Usa la API de EvoLink para backends de producto y trabajos por lotes, o llama a DeepSeek V4 Pro desde Codex, Claude o Gemini para flujos de código y análisis. Ambas vías comparten la misma clave API de EvoLink, saldo, ID de modelo e historial de solicitudes.
Opción 1
Integrar con la API de EvoLink
Ideal para: backends de producto, trabajos por lotes, pipelines automatizados
Envía a EvoLink solicitudes Chat Completions compatibles con OpenAI (o Anthropic Messages) y controla el ID de modelo, el prompt de sistema, el presupuesto de salida, las herramientas y la salida estructurada.
1Crea una clave API de EvoLink en la consola
2Apunta tu SDK de OpenAI o Anthropic a la URL base de EvoLink y selecciona el ID de modelo mostrado arriba
3Envía una solicitud representativa y lee el campo usage para tokens de entrada, en caché y de salida
4Define max_tokens y reintentos por tarea; conserva los ID y resultados de llamadas a herramientas entre turnos
Ideal para: tareas de código, revisión y análisis en Codex, Claude y Gemini
Dale al Agente la tarea, las entradas a incluir y los criterios de aceptación. Él arma la solicitud, llama a DeepSeek V4 Pro a través de EvoLink y devuelve la respuesta con el uso de tokens.
1Define EVOLINK_API_KEY en tu entorno local; nunca en código ni en un prompt
2Describe la tarea, las entradas a incluir y el formato de salida esperado
3Pide al Agente que llame a DeepSeek V4 Pro a través de EvoLink y muestre la solicitud antes de enviarla
4Deja que el Agente informe la respuesta, el uso de tokens y cualquier cuerpo de error
Ejemplo de código de la API de DeepSeek V4 Pro y manejo de errores
Este ejemplo muestra la solicitud ejecutable más corta: una llamada Chat Completions compatible con OpenAI con prompt de sistema, mensaje de usuario y presupuesto de salida. Abre la pestaña API para la referencia completa de parámetros y respuestas.
curl -X POST https://api.evolink.ai/v1/chat/completions \
-H "Authorization: Bearer $EVOLINK_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-pro",
"messages": [
{ "role": "system", "content": "You are a senior engineer reviewing a pull request." },
{ "role": "user", "content": "Review this diff and list every risky change with file and line:\n<diff>" }
],
"max_tokens": 4096,
"temperature": 0.2
}'
# Anthropic Messages (/v1/messages) and Responses (/v1/responses) accept the
# same model ID.
# The response includes choices[0].message and a usage object (prompt,
# cached, and completion tokens).
Solicitud inválida o parámetro no admitido
Comprueba el ID de modelo, el array messages y los rangos de parámetros en la referencia de la API; elimina los campos que esta ruta no admite.
Problema de autenticación o saldo
Comprueba el token Bearer de Authorization y confirma el saldo disponible en la consola.
Longitud de contexto excedida
Los tokens del prompt superan la ventana de contexto de DeepSeek V4 Pro. Recorta o recupera solo la evidencia relevante y reutiliza prefijos en caché.
Límite de tasa (429)
Espera y reintenta con jitter; agrupa o encola las solicitudes en lugar de ráfagas paralelas.
Contenido o llamada a herramienta rechazados
Revisa contenido sensible, argumentos de llamada a herramienta mal formados y desajustes del esquema JSON antes de reintentar.
¿Cómo elegir Chat Completions, Responses y el tráfico de producción para DeepSeek V4 Pro?
Cada protocolo sirve a flujos distintos. Este resumen ayuda a elegir; los campos exactos están en API y la documentación de EvoLink, y las tarifas de tokens en Pricing; al presupuestar, incluye las rondas de llamadas a herramientas en el coste total de la tarea.
01
Chat estándar y funciones del cliente: Chat Completions
Si ya usas chat compatible con OpenAI, streaming o funciones ejecutadas por el cliente, empieza con Chat Completions. Confirma formato de mensajes, cierre del flujo, argumentos de función y usage según lo que espera el cliente actual.
Chat y funciones del cliente
02
Flujos de agentes: Responses
Evalúa la API Responses, añadida en la versión 0813, para flujos de agentes de varios pasos más largos e integraciones de tipo Codex. Antes de integrar, confirma los campos admitidos, los estados de fallo y los límites de reintento en la documentación actual de EvoLink.
Flujos de agentes
03
Contexto grande: observar caché y coste total
Los documentos, repositorios y conversaciones largos no deben enviarse completos por defecto. Compara tamaños representativos, aciertos y fallos de caché, longitud de salida y reintentos, y usa el cargo final para calcular el coste de una tarea correcta.
Coste de contexto
04
Producción: empezar poco a poco y conservar respaldo
Envía primero un grupo pequeño y observable a DeepSeek V4 Pro y conserva una ruta GPT, Claude o Kimi ya probada. La API unificada de EvoLink centraliza modelo, uso y saldo y facilita cambiar tras límites, timeouts o fallos de esquema o herramienta.
Despliegue gradual
Los aciertos de caché cuestan una fracción de la entrada nueva
El caché de prefijo es automático: un prompt de sistema estable, las instrucciones del repositorio y las definiciones de herramientas se facturan como aciertos de caché en las solicitudes posteriores en lugar de entrada completa. Mide la tasa real de aciertos en tus registros antes de estimar el coste de un bucle de agente.
Contexto de 1M tokens con un techo de salida de 384K
Mantén archivos relacionados, especificaciones y estado del agente en un mismo contexto de trabajo, pero trata el techo como capacidad y no como objetivo: recupera lo relevante, mantén el prefijo estable para que cachee y fija un presupuesto de salida por tarea.
Compara DeepSeek V4 Pro con Qwen 3.8 Max y GLM-5.3
EvoLink
Compara precios de entrada/salida, contexto, caché y casos de uso. Prueba las mismas solicitudes antes de elegir una ruta; abajo se muestran las tarifas actuales de tu cuenta.
Cargas grandes de programación, razonamiento, análisis de documentos largos y agentes que necesitan una ruta económica con precio de entrada en caché.
Ingeniería a escala de repositorio, síntesis multidocumento, agentes con uso intensivo de herramientas
Agentes de programación, cadenas de tareas largas, flujos con muchas herramientas
DeepSeek V4 Pro
Entrada / Salida$1.324 / $3.971
Contexto1M
CachéAciertos de caché automáticos
Ideal paraCargas grandes de programación, razonamiento, análisis de documentos largos y agentes que necesitan una ruta económica con precio de entrada en caché.
Ideal paraAgentes de programación, cadenas de tareas largas, flujos con muchas herramientas
¿Qué conviene confirmar antes de usar DeepSeek V4 Pro en producción?
Empieza con unas pocas cargas reales para confirmar calidad, latencia, coste y fiabilidad antes de trasladar más tráfico.
La integración y el uso son claros
Confirma el ID deepseek-v4-pro, el protocolo previsto y la devolución de respuestas, datos usage y caché. Un uso claro permite analizar costes y observar de forma coherente los flujos Chat y Responses.
Las salidas cumplen el requisito de negocio
Prueba cambios de código, documentos, investigación o extracción estructurada reales. Además de la respuesta, comprueba pruebas, fiabilidad de citas, argumentos de funciones y si el JSON Schema puede consumirse directamente en sistemas posteriores.
La latencia y los errores se pueden gestionar
Observa tiempos de respuesta con carga representativa y prepara reintentos para límites, timeouts, salidas estructuradas inválidas y fallos de herramientas. Un modelo configurable en EvoLink facilita cambiar a una alternativa verificada si una ruta no está disponible.
El coste y la elección del modelo siguen controlados
Calcula el coste total de la misma clase de tarea con Pricing, usage y el cargo final. Decide después si DeepSeek V4 Pro debe ser ruta predeterminada, modelo para tareas difíciles o respaldo. La gateway unificada separa esa decisión del trabajo de integración.
Empieza con un conjunto pequeño, observable y reversible de tareas en DeepSeek V4 Pro. Amplía solo cuando calidad, latencia y coste cumplan lo esperado. Mantener varios modelos tras la API unificada de EvoLink simplifica escalar, cambiar y optimizar costes.
Familia de modelos DeepSeek V4
Misma clave API y saldo: cambia de nivel sin tocar la integración.
DeepSeek V4.1 Flash
El modelo Flash multimodal de DeepSeek para cargas de texto e imagen
¿Ya está disponible la API de DeepSeek V4 Pro mediante EvoLink?
Sí. DeepSeek V4 Pro está disponible en la ruta de producción de EvoLink y no se ve afectado por el cambio del 14 de septiembre, que reenvía deepseek-v4-pro a V4.1 Flash en la API propia de DeepSeek. Envía solicitudes con el ID deepseek-v4-pro mediante Chat Completions o Responses; el ID, los precios, el contexto y los flujos compatibles figuran en esta página.
¿deepseek-v4-pro es el ID del modelo API?
Sí. El ID que se envía en la solicitud es deepseek-v4-pro, la misma cadena que la URL de esta página. Desde el 13 de agosto de 2026, ese mismo ID apunta automáticamente a la versión GA 0813 actualizada; no hay que cambiar el ID para obtener la nueva versión.
¿Qué cambió en la versión 0813 de DeepSeek V4 Pro?
La versión GA 0813 (publicada el 13 de agosto de 2026) mejoró de forma sustancial los benchmarks de programación agéntica y tareas de terminal respecto a la preview de abril y añadió soporte de la API Responses. El ID invocable sigue siendo deepseek-v4-pro. Los alias antiguos deepseek-chat y deepseek-reasoner se retiraron en origen el 24 de julio de 2026.
¿Qué entradas y salidas admite DeepSeek V4 Pro?
Solo entrada de texto y salida de texto. DeepSeek V4 Pro no tiene capacidad de visión en ningún protocolo, pero los límites varían según la ruta: Messages rechaza los tipos de contenido de imagen y documento, mientras que Responses convierte los adjuntos de imagen y archivo en marcadores de posición en lugar de comprenderlos. Envía las tareas de comprensión de capturas o documentos a un modelo con visión en la misma gateway de EvoLink.
¿Debo usar Chat Completions o la API Responses?
Chat Completions sirve para chat, streaming y funciones del cliente. Evalúa Responses, añadida en la versión 0813, para flujos de agentes de larga duración. Los campos exactos se mantienen en API y la documentación de EvoLink.
¿Cómo se debe elegir el reasoning effort?
Los niveles válidos son low, high y max, y el predeterminado es high: medium se acepta pero se asigna en silencio a high, por lo que comparar medium con high no produce ninguna diferencia real. Empieza el trabajo rutinario con low, compara low y high en las mismas tareas y reserva max para los problemas más difíciles, donde un intento fallido cuesta más que los tokens de razonamiento adicionales.
¿Cómo afecta la entrada en caché al precio de DeepSeek V4 Pro?
Puede reducir el coste del contexto repetido, pero los fallos de caché, salidas largas, reintentos y herramientas repetidas aumentan el total. Usa Pricing y el cargo final para calcular el coste por tarea correcta.
¿Cuáles son los límites de velocidad de DeepSeek V4 Pro?
La documentación de V4 de DeepSeek describía un tope de concurrencia por cuenta en su API directa, en lugar de límites RPM o TPM por token: unas 500 solicitudes simultáneas para Pro, con 429 al superar el tope y desconexión de las solicitudes en cola tras unos 10 minutos. Esas cifras describen la API propia de DeepSeek, no la capacidad de las rutas de EvoLink. Mide los límites de tu cuenta de EvoLink, mantén las solicitudes en curso por debajo de ellos y usa backoff exponencial.
¿Cómo comparar DeepSeek V4 Pro con GPT, Claude o Kimi?
Ejecuta las mismas tareas reales con contexto, herramientas y razonamiento iguales. Compara calidad, tiempo de respuesta, mezcla de tokens, rendimiento de herramientas y coste total para asignar cada tráfico a una ruta de EvoLink.
¿DeepSeek V4 Pro es de código abierto?
Los pesos de la preview de abril están publicados con licencia MIT en Hugging Face; a 13 de agosto de 2026, los pesos de la versión GA 0813 aún no se habían publicado. Los pesos abiertos y la API alojada son vías de acceso independientes: la ruta de EvoLink sirve la API alojada, y que esos mismos pesos MIT estén disponibles en alojamientos de terceros es lo que hace posible el respaldo mediante un host de terceros.
¿Existe un modelo DeepSeek V4 Pro Max?
No. No existe un modelo «Pro Max» separado: «max» es el nivel máximo de thinking sobre el mismo ID de modelo deepseek-v4-pro. Si ves mencionado «Pro-Max», se refiere a ejecutar este modelo con el esfuerzo de razonamiento máximo, no a otro producto.
¿Qué modelo de respaldo conviene conservar?
Conserva un modelo que ya gestione la misma carga con fiabilidad y mantén la ruta configurable. Ante límites, timeouts o salidas inválidas, EvoLink puede cambiar a GPT, Claude, Kimi u otra alternativa adecuada.