GPT Image 2.5 Flare & Sunburst ya están disponibles en EvoLinkProbar GPT Image 2.5

DeepSeek V4.1 Flash API

Accede a V4.1 Flash de DeepSeek —también buscado como DeepSeek V4.1 / DeepSeek Flash— a través de la API de chat unificada de EvoLink. Prueba la programación con contexto largo, la entrada de imágenes, el modo de pensamiento antes de integrar.

DeepSeekGeneración de textoDisponible
desde $0.442 / 1 M de tokens de entrada
Programación de contexto largoEntrada de imagenModo de razonamientoCaché de promptsChat + Messages + Responses
Ruta de producciónLive
Contexto
1M de contexto · 384K de salida máx.
Ideal para
Programación de contexto largo y bucles de agentes que además leen imágenes
Entrada
Texto + imágenes
Salida
Texto · JSON (salida estructurada)

Elegir DeepSeek V4.1 Flash

Tareas de texto, imagen y contexto largo con un solo ID de modelo, deepseek-v4.1-flash. Consulta las tarifas actuales en Pricing y prueba tu protocolo antes de producción.

DeepSeek V4.1 Flash

El modelo Flash multimodal de DeepSeek para cargas de texto e imagen

Seleccionado
ID del modelo
deepseek-v4.1-flash
Ideal para

Programación, bucles de agentes, extracción de documentos y comprensión de capturas con una ventana de contexto de 1 M; evalúa la calidad y el coste por resultado aceptado con tus propias tareas.

Entrada
$0.442 / 1M
30 cr / 1M
Acierto de caché
$0.015 / 1M
1 cr / 1M
Salida
$1.324 / 1M
90 cr / 1M

Todas las tarifas son por 1M de tokens, en USD y créditos, y reflejan los precios actuales de tu cuenta.

Precios de DeepSeek V4.1 Flash

Estima el coste de una solicitud de DeepSeek V4.1 Flash antes de integrar. La calculadora usa las tarifas actuales de tu cuenta; los precios oficiales sirven de referencia.

Calculadora de solicitud

Introduce la combinación de tokens de una solicitud.

Coste estimado por solicitud

DeepSeek V4.1 Flash
USD$0.0009
Créditos0.0572
Tokens de entrada0.03 cr
Tokens de acierto de caché0.0002 cr
Tokens de salida0.027 cr

Cargo mínimo: 0.01 créditos por solicitud.

Guía de presupuesto

Solicitudes aproximadas con la combinación actual de tokens.
Añadir créditos
$10
Unas 11888 solicitudes

Para pruebas rápidas

$50
Unas 59440 solicitudes

Para el desarrollo habitual

$100
Unas 118881 solicitudes

Para la evaluación en producción

API de DeepSeek V4.1 Flash

DeepSeek V4.1 Flash combina entrada nativa de texto e imagen con una ventana de contexto de 1 M de tokens y hasta 384K tokens de salida. Evalúa capturas, documentos y tareas de programación mediante la API unificada de EvoLink con el ID de modelo deepseek-v4.1-flash. Revisa los precios actuales y los requisitos del protocolo, y valida tu carga antes de mover tráfico de producción.

DeepSeek V4.1 Flash se sirve en EvoLink con el ID de modelo deepseek-v4.1-flash mediante Chat Completions · Anthropic Messages · Responses, con la misma clave API y saldo que usas para cualquier otro modelo. Ofrece una ventana de contexto de 1M y hasta 384K tokens de salida, además de la programación con contexto largo, la entrada de imágenes, el modo de pensamiento.

DeepSeek V4.1 Flash

Especificaciones y capacidades de DeepSeek V4.1 Flash

Las cifras proceden de la configuración de ruta de EvoLink; las capacidades son las que la API expone hoy.

Ventana de contexto
1M tokens
Salida máx.
384K tokens
Entrada
Texto + imágenes
Salida
Texto · JSON (salida estructurada)
Razonamiento
Modo de pensamiento opcional
Caché de prompts
Lecturas de caché automáticas a tarifa reducida
Protocolos
Chat Completions · Anthropic Messages · Responses
ID del modelo
deepseek-v4.1-flash
Entrada de imagen
PNG · JPEG · WebP · GIF

El ID de modelo de la API es deepseek-v4.1-flash, escrito con punto; la URL de esta página usa guion. La API directa de DeepSeek usa otro nombre, deepseek-flash.

¿Para qué sirve mejor la API de DeepSeek V4.1 Flash?

Evalúa V4.1 Flash en programación, bucles de agentes y tareas que combinan una pregunta con evidencia en imágenes. En EvoLink, DeepSeek V4 Flash sigue disponible como modelo independiente de solo texto, así que puedes probar V4.1 Flash con las mismas tareas antes de mover tráfico. Las peticiones a deepseek-v4-flash-vision-exp ahora redirigen a V4.1 Flash.

Programación y revisión con contexto largo

Carga archivos fuente relacionados, especificaciones y diffs en un mismo contexto de trabajo y pide una revisión, un parche o una lista de riesgos. Selecciona solo el contexto relevante y revisa los aciertos de caché informados antes de estimar el coste de los turnos repetidos.

Bucles de agentes con prefijo estable

En agentes de varios pasos, el prompt de sistema, los esquemas de herramientas y el contexto compartido permanecen idénticos entre turnos. Un prefijo reutilizable puede reducir el coste de la entrada repetida cuando se informa un acierto de caché, pero ese acierto no está garantizado en cada petición. Mide la tasa real en tus propios registros antes de proyectar el coste del bucle.

Documentos y capturas en la misma petición

Envía un formulario escaneado, una factura, una captura de panel o un gráfico junto con la pregunta y pide campos estructurados de vuelta. Prueba texto pequeño, campos ausentes y gráficos ambiguos con ejemplos etiquetados antes de automatizar una decisión posterior.

Extracción estructurada a gran escala

Clasificación, extracción de campos y resumen por lotes a un precio por token bajo, con salida en forma de JSON para el procesamiento posterior. Valida el esquema en cada respuesta y envía a revisión los resultados de baja confianza en lugar de confiar en el formato sin comprobarlo.

¿Qué cambia al pasar de DeepSeek V4 Flash a V4.1 Flash?

En EvoLink ambos modelos siguen disponibles: deepseek-v4-flash continúa sirviendo V4 Flash y deepseek-v4.1-flash es el modelo nuevo, así que puedes compararlos con las mismas peticiones. Que el formato de petición sea compatible no garantiza salidas, comportamiento de razonamiento, uso de tokens ni ejecución de herramientas idénticos; compruébalos antes de cambiar.

El ID de modelo lleva punto; la URL, no

El ID de modelo de la API es deepseek-v4.1-flash, con punto. Esta página vive en /deepseek-v4-1-flash. Copia el ID desde la tarjeta Models en lugar de deducirlo de la barra de direcciones; la API directa de DeepSeek usa otro nombre, deepseek-flash.

Revisa tarifas y coste por tarea aceptada

Consulta las tarifas actuales de EvoLink en la sección Pricing y comprueba los cargos finales en tu cuenta. No deduzcas el precio del nombre del modelo: el razonamiento, los tokens de imagen, los reintentos y la tasa de aceptación cambian la factura.

Mide el uso de imágenes antes de escalar

La sección Pricing muestra las tarifas de entrada, entrada en caché y salida. Revisa el uso y los cargos finales con imágenes representativas antes de proyectar el coste de un lote.

Usa el protocolo que ya habla tu stack

Chat Completions, Messages y Responses usan el mismo ID de modelo. Usa el protocolo que ya habla tu aplicación y confirma en él los eventos de streaming, el manejo de herramientas y el informe de uso antes de mover tráfico.

¿Cómo mantener predecible el coste de la API de DeepSeek V4.1 Flash?

La sección Pricing de arriba contiene las tarifas en vivo y la calculadora de peticiones. Úsala como estimación y después concilia las categorías de tokens informadas con los cargos finales y los resultados aceptados.

Diseña el prefijo para que entre en caché

DeepSeek documenta caché de prefijo automática. Coloca las instrucciones reutilizables y las definiciones de herramientas antes del contenido que cambia, y revisa el campo de tokens en caché. Un sufijo modificado no invalida necesariamente todo el prefijo compartido; el beneficio real depende de la disponibilidad de la caché y del uso informado.

Trata la ventana de 1 M como capacidad, no como objetivo

Un contexto amplio sirve cuando la tarea lo necesita de verdad, pero cada token enviado se factura. Recuperar los archivos y pasajes relevantes en vez de pegar el repositorio entero suele reducir el coste por tarea sin perder calidad.

Mide las imágenes con tu propio contenido

El recuento de tokens de una imagen varía con la resolución y el contenido, así que una cifra citada para capturas ajenas no predice las tuyas. Ejecuta una muestra representativa, lee los tokens de entrada del objeto usage y usa ese valor en la calculadora de arriba.

Fija un presupuesto de salida por tarea

El techo de 384K tokens de salida es un límite, no un valor por defecto. Fija un límite de salida adecuado a la tarea con el protocolo elegido. Detecta los truncamientos y acota los reintentos: repetir una tarea fallida puede costar más que permitir una respuesta suficiente en el primer intento.

Dos formas de usar DeepSeek V4.1 Flash: API de EvoLink o Agente

Usa la API de EvoLink para backends de producto y trabajos por lotes, o llama a DeepSeek V4.1 Flash desde Codex, Claude o Gemini para flujos de código y análisis. Ambas vías comparten la misma clave API de EvoLink, saldo, ID de modelo e historial de solicitudes.

Opción 1

Integrar con la API de EvoLink

Ideal para: backends de producto, trabajos por lotes, pipelines automatizados

Envía a EvoLink solicitudes Chat Completions compatibles con OpenAI (o Anthropic Messages) y controla el ID de modelo, el prompt de sistema, el presupuesto de salida, las herramientas y la salida estructurada.

  1. 1Crea una clave API de EvoLink en la consola
  2. 2Apunta tu SDK de OpenAI o Anthropic a la URL base de EvoLink y selecciona el ID de modelo mostrado arriba
  3. 3Envía una solicitud representativa y lee el campo usage para tokens de entrada, en caché y de salida
  4. 4Define max_tokens y reintentos por tarea; conserva los ID y resultados de llamadas a herramientas entre turnos
Opción 2

Llamarlo con un Agente

Ideal para: tareas de código, revisión y análisis en Codex, Claude y Gemini

Dale al Agente la tarea, las entradas a incluir y los criterios de aceptación. Él arma la solicitud, llama a DeepSeek V4.1 Flash a través de EvoLink y devuelve la respuesta con el uso de tokens.

  1. 1Define EVOLINK_API_KEY en tu entorno local; nunca en código ni en un prompt
  2. 2Describe la tarea, las entradas a incluir y el formato de salida esperado
  3. 3Pide al Agente que llame a DeepSeek V4.1 Flash a través de EvoLink y muestre la solicitud antes de enviarla
  4. 4Deja que el Agente informe la respuesta, el uso de tokens y cualquier cuerpo de error

Ejemplo de código de la API de DeepSeek V4.1 Flash y manejo de errores

Este ejemplo muestra la solicitud ejecutable más corta: una llamada Chat Completions compatible con OpenAI con prompt de sistema, mensaje de usuario y presupuesto de salida. Abre la pestaña API para la referencia completa de parámetros y respuestas.

Ver documentación completa de la API
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4.1-flash",
    "messages": [
      { "role": "system", "content": "You are a senior engineer reviewing a pull request." },
      { "role": "user", "content": "Review this diff and list every risky change with file and line:\n<diff>" }
    ],
    "max_tokens": 4096,
    "temperature": 0.2
  }'

# Anthropic Messages (/v1/messages) and Responses (/v1/responses) accept the
# same model ID.
# The response includes choices[0].message and a usage object (prompt,
# cached, and completion tokens).

Solicitud inválida o parámetro no admitido

Comprueba el ID de modelo, el array messages y los rangos de parámetros en la referencia de la API; elimina los campos que esta ruta no admite.

Problema de autenticación o saldo

Comprueba el token Bearer de Authorization y confirma el saldo disponible en la consola.

Longitud de contexto excedida

Los tokens del prompt superan la ventana de contexto de DeepSeek V4.1 Flash. Recorta o recupera solo la evidencia relevante y reutiliza prefijos en caché.

Límite de tasa (429)

Espera y reintenta con jitter; agrupa o encola las solicitudes en lugar de ráfagas paralelas.

Contenido o llamada a herramienta rechazados

Revisa contenido sensible, argumentos de llamada a herramienta mal formados y desajustes del esquema JSON antes de reintentar.

¿Cómo enviar tu primera petición a DeepSeek V4.1 Flash?

Cuatro pasos desde la clave API hasta el tráfico de producción. El enlace API abre la documentación de EvoLink; los ejemplos de protocolos de V4.1 Flash se añadirán allí.

01

Copia el ID de modelo exacto

Usa deepseek-v4.1-flash, con punto, en la configuración del modelo. El botón de copiar de la tarjeta Models te da la cadena exacta; no sustituyas el ID de EvoLink por el slug de la página ni por el nombre oficial de la API directa.

Configuración del modelo
02

Envía una petición de texto por tu protocolo actual

Usa el ejemplo de petición actual de EvoLink para el protocolo elegido con una clave activa. Confirma endpoint, autenticación, lectura de la respuesta y uso con una petición de texto pequeña antes de añadir imágenes o llamadas a herramientas.

Primera petición
03

Añade imagen y vuelve a leer el uso

Comprueba el formato de imagen habilitado en el protocolo elegido: image_url en Chat, un bloque image en Messages o input_image en Responses. Tras una petición con imagen correcta, compara el uso y el cargo final con la tarea equivalente solo de texto.

Entrada de imagen
04

Estabiliza el prefijo y luego escala

Mantén estables las instrucciones reutilizables y las definiciones de herramientas, mide los aciertos de caché en lugar de darlos por hechos y aumenta el tráfico cuando calidad, latencia y cargos finales superen tus criterios de aceptación.

Despliegue gradual

Los aciertos de caché cuestan una fracción de la entrada nueva

DeepSeek documenta caché de prefijo automática. Coloca primero las instrucciones reutilizables y las definiciones de herramientas y mide después los tokens de acierto de caché informados en usage. Reutilizar la caché puede reducir el coste de la entrada repetida, pero no todas las peticiones tienen garantizado un acierto.

Contexto de 1M tokens con un techo de salida de 384K

Mantén archivos relacionados, especificaciones y estado del agente en un mismo contexto de trabajo, pero trata el techo como capacidad y no como objetivo: recupera lo relevante, mantén el prefijo estable para que entre en caché y fija un presupuesto de salida por tarea, porque la salida es la más cara de las tres dimensiones facturadas.

DeepSeek V4.1 Flash frente a Qwen 3.8 Max y GLM-5.3

EvoLink

Compara tarifas de entrada/salida, contexto, caché y encaje con la carga. Prueba las mismas peticiones antes de elegir ruta; los precios de abajo siguen las tarifas actuales de tu cuenta.

DeepSeek V4.1 Flash
Entrada / salida$0.442 / $1.324
Contexto1M
CachéAciertos de caché automáticos
Ideal paraProgramación, bucles de agentes, extracción de documentos y comprensión de capturas con una ventana de contexto de 1 M; evalúa la calidad y el coste por resultado aceptado con tus propias tareas.
Qwen 3.8 Max
Entrada / salida$1.765 / $5.295
Contexto1.05M
CachéCaché de prompt explícita
Ideal paraIngeniería a escala de repositorio, síntesis multidocumento, agentes con uso intensivo de herramientas
GLM-5.3
Entrada / salida$1.4 / $4.4
Contexto1M
CachéAciertos de caché automáticos
Ideal paraAgentes de programación, cadenas de tareas largas, flujos con muchas herramientas

¿Qué conviene confirmar antes de poner tráfico de producción en DeepSeek V4.1 Flash?

Verifica la calidad de salida, los controles admitidos y los cargos reales. En EvoLink puedes reproducir las mismas peticiones reales en V4 Flash y V4.1 Flash y compararlas en paralelo; si vienes de Vision Exp, compara con los resultados que guardaste antes de la redirección.

El ID de modelo y el protocolo están bien conectados

Confirma que la petición envía deepseek-v4.1-flash, que las respuestas llegan por el protocolo esperado y que el objeto usage informa por separado de tokens de entrada, de caché y de salida. Sin ese desglose no puedes imputar costes ni verificar que la caché funciona.

La calidad se sostiene con tus prompts actuales

Reproduce un conjunto fijo de peticiones reales en deepseek-v4-flash y deepseek-v4.1-flash en EvoLink y compara los resultados en paralelo. Comprueba el seguimiento de instrucciones, la validez del formato, los resultados de herramientas y el comportamiento del razonamiento en vez de suponer que los prompts ajustados para V4 Flash se trasladan sin cambios.

Los resultados con imagen llegan a tu umbral

Si vas a añadir entrada de imagen, crea un conjunto de evaluación fijo con las capturas, formularios y gráficos que procesas realmente. Comprueba exactitud de campos, valores ausentes, texto pequeño y detalles inventados, y decide a partir de qué confianza revisa una persona.

La latencia y el manejo de errores aguantan bajo carga

Observa el tiempo de respuesta con tráfico representativo y prepara la reacción ante límites de tasa, tiempos de espera y salidas estructuradas inválidas. Mantener el nombre del modelo en configuración y no en el código convierte el cambio de ruta en un ajuste de configuración.

Empieza con tareas representativas y una parte pequeña del tráfico. Amplía cuando calidad, latencia y coste por resultado aceptado alcancen tu listón. Para tareas solo de texto, conserva deepseek-v4-flash como fallback: en EvoLink sigue sirviendo V4 Flash. Es solo de texto, así que las tareas con imágenes necesitan otro modelo que haya superado la misma evaluación visual, o una revisión humana. deepseek-v4-flash-vision-exp redirige a V4.1 Flash y no sirve como fallback.

Familia de modelos DeepSeek V4

Misma clave API y saldo: cambia de nivel sin tocar la integración.

DeepSeek V4 Flash Vision

DeepSeek V4 Flash Vision

ID anterior de Vision Exp, ahora redirigido a DeepSeek V4.1 Flash

Ver modelo
DeepSeek V4 Pro

DeepSeek V4 Pro

Modelo de DeepSeek para razonamiento y uso de herramientas

Ver modelo
DeepSeek V4 Flash

DeepSeek V4 Flash

Modelo de DeepSeek para razonamiento y uso de herramientas

Ver modelo

Otros modelos de texto en EvoLink además de DeepSeek V4.1 Flash

GPT-5.6

GPT-5.6

La familia de vanguardia por niveles de OpenAI, útil como techo de calidad cuando quieres saber cuánto cuesta la misma tarea en una ruta premium.

Ver modelo
Claude Opus 5

Claude Opus 5

La ruta premium de Anthropic para agentes de larga duración, fiabilidad de herramientas y revisión de código compleja.

Ver modelo
Kimi K3

Kimi K3

La ruta de contexto largo de Moonshot, con tarifa aparte para la entrada en caché: una comparación cercana para cargas de agentes.

Ver modelo
GLM-5.3

GLM-5.3

La ruta insignia de Zhipu, también con caché automática; la alternativa más cercana para obtener una segunda opinión sobre los mismos prompts.

Ver modelo

Lecturas relacionadas sobre DeepSeek V4.1 Flash

API de DeepSeek V4: Flash o Pro

API de DeepSeek V4: Flash o Pro

Comparación de los dos niveles V4 en coste, modo de razonamiento y lista de comprobación de despliegue; ambos siguen disponibles en EvoLink.

Leer la guía
Guía de migración a DeepSeek V4.1 Flash

Guía de migración a DeepSeek V4.1 Flash

Relaciona los IDs anteriores, revisa el calendario de retirada de Pro en la API directa y valida un despliegue por fases.

Leer la guía
DeepSeek Vision Exp frente a Flash

DeepSeek Vision Exp frente a Flash

La decisión anterior entre ruta de imagen y de texto: en EvoLink, el trabajo con imágenes pasa a V4.1 Flash y el tráfico de solo texto puede seguir en V4 Flash.

Leer la guía
DeepSeek V4 frente a GPT-5.4 y Claude Opus 4.6

DeepSeek V4 frente a GPT-5.4 y Claude Opus 4.6

Comparativa de precios oficiales y capacidades entre tres rutas de primera línea.

Leer la guía

Preguntas frecuentes sobre la API de DeepSeek V4.1 Flash

¿Cuál es el ID de modelo de DeepSeek V4.1 Flash?

El ID de modelo en EvoLink es deepseek-v4.1-flash, con punto; esta página usa /deepseek-v4-1-flash. La API directa oficial de DeepSeek usa deepseek-flash. Usa el identificador documentado para tu proveedor y tu endpoint.

¿En qué se diferencia V4.1 Flash de V4 Flash?

V4.1 Flash admite entrada de imagen nativa; V4 Flash es solo de texto. Ambos tienen una ventana de contexto de 1 M de tokens y un techo de salida de 384K. En EvoLink, deepseek-v4-flash no se ve afectado por la retirada del modelo original en la API directa de DeepSeek y sigue sirviendo V4 Flash, así que puedes ejecutar ambos en paralelo.

¿Cuesta más que V4 Flash?

Compara las tarifas que muestra la sección Pricing de cada página de modelo y confírmalas con los cargos finales de tu cuenta; no deduzcas el precio del nombre del modelo. El coste por tarea también depende de la longitud de salida, el razonamiento, las imágenes, los aciertos de caché y los reintentos. Los precios oficiales de DeepSeek en horas punta y valle son una tabla de precios aparte.

¿Por qué protocolos puedo llamarlo?

Usa el mismo ID de modelo con Chat Completions (/v1/chat/completions), Messages (/v1/messages) o Responses (/v1/responses). Valida el protocolo elegido con tu clave, incluidos streaming, herramientas y uso, antes de producción; los campos de imagen cambian según el protocolo.

¿Cómo se facturan las imágenes?

Consulta en la sección Pricing las tarifas de entrada, entrada en caché y salida, mide después peticiones con imágenes representativas y concilia el uso informado con el cargo final antes de proyectar el coste de un lote.

¿Cómo funciona la caché?

DeepSeek documenta caché de prefijo automática. Coloca primero el contexto reutilizable y revisa los aciertos de caché informados. Reutilizar un prompt no garantiza un acierto de caché, y cambiar un sufijo no descarta necesariamente todos los tokens de prefijo en caché.

¿El modo de razonamiento está activo por defecto?

DeepSeek documenta que el razonamiento está activado por defecto en su API directa, con un modo sin razonamiento disponible. Confirma el valor predeterminado de EvoLink y los controles admitidos en el protocolo que usas; que se pueda desactivar no significa que esté desactivado por defecto. Mide su efecto en el uso de salida.

¿Basta con cambiar el nombre para migrar desde V4 Flash?

El nombre del modelo es el principal cambio de código, pero no toda la migración. En EvoLink, mantén deepseek-v4-flash en marcha, reproduce las mismas peticiones en deepseek-v4.1-flash, compara salidas, resultados de herramientas y uso, y mueve el tráfico de forma gradual.

¿Cuánto contexto conviene enviar realmente?

Envía la evidencia que la tarea necesita y fija un límite de salida adecuado. Mide resultados aceptados, reutilización de caché y cargo total con tamaños de contexto representativos en lugar de llenar la ventana de 1 M en cada petición.

¿Qué ruta alternativa conviene mantener?

Mantén una ruta que siga sirviendo un modelo que hayas verificado para la misma carga y separa las tareas de texto de las de imagen. Para texto, deepseek-v4-flash y deepseek-v4-pro en EvoLink no se ven afectados por los cambios de la API directa de DeepSeek y siguen siendo modelos distintos; que los modelos sean distintos no garantiza fallos independientes, así que comprueba si comparten proveedor o cuota. Para imágenes, ambos son solo de texto: usa otro modelo que haya superado la misma evaluación visual, o una revisión humana. deepseek-v4-flash-vision-exp ahora redirige a V4.1 Flash, así que no sirve como fallback.