GPT Image 2.5 Flare & Sunburst ya están disponibles en EvoLinkProbar GPT Image 2.5

GPT-5.6 API

Accede a GPT-5.6 de OpenAI —también buscado como GPT 5.6 / gpt-5.6-sol / terra / luna— a través de la API de chat unificada de EvoLink. Prueba el razonamiento, el uso de herramientas, la salida estructurada antes de integrar.

OpenAIGeneración de textoDisponible
desde $0.181 / 1M tokens de entrada$0.200 precio oficial-10%
Chat CompletionsResponses APIEsfuerzo de razonamientoCaché de promptsUso de herramientas
Ruta de producciónLive
Contexto
1.05M de contexto · 128K de salida máx.
Ideal para
Programación, agentes en producción, razonamiento complejo
Entrada
Texto
Salida
Texto · JSON (salida estructurada) · llamadas a herramientas

Elegir GPT-5.6

Las tres variantes usan la misma integración compatible con OpenAI. Cambia capacidad y coste con un único ID de modelo exacto.

GPT-5.6 Sol

Nivel insignia para la máxima profundidad de razonamiento y capacidad de Agent.

Seleccionado
ID del modelo
gpt-5.6-sol
Ideal para

Razonamiento complejo, Agents de programación y flujos de alto valor

< 272K
Entrada
$3.600 / 1M-10%
244.8 cr / 1M$4.000precio oficial
Lectura de caché
$0.361 / 1M-10%
24.5 cr / 1M$0.400precio oficial
Escritura de caché
$4.500 / 1M-10%
306 cr / 1M$5.000precio oficial
Salida
$18.000 / 1M-10%
1224 cr / 1M$20.000precio oficial
≥ 272K
Entrada
$7.200 / 1M-10%
489.6 cr / 1M$8.000precio oficial
Lectura de caché
$0.721 / 1M-10%
49 cr / 1M$0.800precio oficial
Escritura de caché
$9.000 / 1M-10%
612 cr / 1M$10.000precio oficial
Salida
$27.000 / 1M-10%
1836 cr / 1M$30.000precio oficial

GPT-5.6 Terra

Nivel equilibrado para razonamiento y programación fiables en producción.

ID del modelo
gpt-5.6-terra
Ideal para

Funciones de producto, análisis, chat y Agents del día a día

< 272K
Entrada
$1.800 / 1M-10%
122.4 cr / 1M$2.000precio oficial
Lectura de caché
$0.181 / 1M-10%
12.3 cr / 1M$0.200precio oficial
Escritura de caché
$2.250 / 1M-10%
153 cr / 1M$2.500precio oficial
Salida
$10.800 / 1M-10%
734.4 cr / 1M$12.000precio oficial
≥ 272K
Entrada
$3.600 / 1M-10%
244.8 cr / 1M$4.000precio oficial
Lectura de caché
$0.362 / 1M-10%
24.6 cr / 1M$0.400precio oficial
Escritura de caché
$4.500 / 1M-10%
306 cr / 1M$5.000precio oficial
Salida
$16.200 / 1M-10%
1101.6 cr / 1M$18.000precio oficial

GPT-5.6 Luna

Nivel rápido y rentable para aplicaciones de gran volumen.

ID del modelo
gpt-5.6-luna
Ideal para

Chat sensible a la latencia, extracción y automatización a escala

< 272K
Entrada
$0.181 / 1M-10%
12.3 cr / 1M$0.200precio oficial
Lectura de caché
$0.020 / 1M-4%
1.3 cr / 1M$0.020precio oficial
Escritura de caché
$0.225 / 1M-10%
15.3 cr / 1M$0.250precio oficial
Salida
$1.081 / 1M-10%
73.5 cr / 1M$1.200precio oficial
≥ 272K
Entrada
$0.362 / 1M-10%
24.6 cr / 1M$0.400precio oficial
Lectura de caché
$0.039 / 1M-4%
2.6 cr / 1M$0.040precio oficial
Escritura de caché
$0.450 / 1M-10%
30.6 cr / 1M$0.500precio oficial
Salida
$1.622 / 1M-10%
110.25 cr / 1M$1.800precio oficial

Todas las tarifas son por 1M de tokens, en USD y créditos, y reflejan los precios actuales de tu cuenta. A partir de 272K tokens de prompt se aplica el nivel de contexto largo: ×2 para la entrada y los roles de caché, ×1.5 para la salida.

Precios de GPT-5.6

Estima el coste de una solicitud de GPT-5.6 antes de integrar. La calculadora usa las tarifas actuales de tu cuenta; los precios oficiales sirven de referencia.

Calculadora de solicitud

Introduce la combinación de tokens de una solicitud.

Coste estimado por solicitud

GPT-5.6 Sol
Tarifa de contexto corto
USD$0.0091
Créditos0.6169

Estimación oficial $0.011 · ahorras $0.0011 (10%)

Tokens de entrada0.2448 cr
Tokens de lectura de caché0.0049 cr
Tokens de escritura de caché0 cr
Tokens de salida0.3672 cr

Cargo mínimo: 0.01 créditos por solicitud. A partir de 272K tokens de prompt, la entrada y los roles de caché se facturan ×2 y la salida ×1.5. Las llamadas a herramientas no se multiplican.

Guía de presupuesto

Solicitudes aproximadas con la combinación actual de tokens.
Añadir créditos
$10
Unas 1053 solicitudes

Para pruebas rápidas

$50
Unas 5511 solicitudes

Para el desarrollo habitual

$100
Unas 11022 solicitudes

Para la evaluación en producción

API GPT-5.6 — Sol, Terra y Luna

Usa las tres variantes GPT-5.6 con una sola clave de EvoLink: Sol para máxima capacidad, Terra para producción equilibrada y Luna para escalar con rapidez y bajo coste.

GPT-5.6 se sirve en EvoLink con el ID de modelo gpt-5.6-sol mediante Chat Completions · Responses, con la misma clave API y saldo que usas para cualquier otro modelo. Ofrece una ventana de contexto de 1.05M y hasta 128K tokens de salida, además de el razonamiento, el uso de herramientas, la salida estructurada.

GPT-5.6

Especificaciones y capacidades de GPT-5.6

Las cifras proceden de la configuración de ruta de EvoLink; las capacidades son las que la API expone hoy.

Ventana de contexto
1.05M tokens
Salida máx.
128K tokens
Entrada
Texto
Salida
Texto · JSON (salida estructurada) · llamadas a herramientas
Uso de herramientas
Llamadas a funciones con secuencias de herramientas de varios pasos
Caché de prompts
Tarifas de escritura + lectura de caché
Nivel de contexto largo
×2 entrada / ×1.5 salida a partir de 272K tokens de prompt
Protocolos
Chat Completions · Responses
ID del modelo
gpt-5.6-sol

Para qué es mejor GPT-5.6

Elige el nivel según la carga: Sol para profundidad, Terra para la producción diaria, Luna para volumen.

Programación agéntica y grandes refactorizaciones con GPT-5.6 Sol

Cambios en varios archivos, revisión de código y bucles de agente con muchas herramientas, donde la profundidad de razonamiento compensa.

Asistentes de producción en GPT-5.6 Terra

Chat con clientes, preguntas sobre documentos y extracción estructurada con un equilibrio entre precio y calidad.

Clasificación y enrutamiento de alto volumen con GPT-5.6 Luna

Etiquetado, triaje y resúmenes ligeros donde manda el coste por token.

Análisis de contexto largo hasta 1M de tokens

Carga repositorios o lotes de documentos completos y usa la caché de prompts para abaratar el contexto repetido.

Dos formas de usar GPT-5.6: API de EvoLink o Agente

Usa la API de EvoLink para backends de producto y trabajos por lotes, o llama a GPT-5.6 desde Codex, Claude o Gemini para flujos de código y análisis. Ambas vías comparten la misma clave API de EvoLink, saldo, ID de modelo e historial de solicitudes.

Opción 1

Integrar con la API de EvoLink

Ideal para: backends de producto, trabajos por lotes, pipelines automatizados

Envía a EvoLink solicitudes Chat Completions compatibles con OpenAI (o Anthropic Messages) y controla el ID de modelo, el prompt de sistema, el presupuesto de salida, las herramientas y la salida estructurada.

  1. 1Crea una clave API de EvoLink en la consola
  2. 2Apunta tu SDK de OpenAI o Anthropic a la URL base de EvoLink y selecciona el ID de modelo mostrado arriba
  3. 3Envía una solicitud representativa y lee el campo usage para tokens de entrada, en caché y de salida
  4. 4Define max_tokens y reintentos por tarea; conserva los ID y resultados de llamadas a herramientas entre turnos
Opción 2

Llamarlo con un Agente

Ideal para: tareas de código, revisión y análisis en Codex, Claude y Gemini

Dale al Agente la tarea, las entradas a incluir y los criterios de aceptación. Él arma la solicitud, llama a GPT-5.6 a través de EvoLink y devuelve la respuesta con el uso de tokens.

  1. 1Define EVOLINK_API_KEY en tu entorno local; nunca en código ni en un prompt
  2. 2Describe la tarea, las entradas a incluir y el formato de salida esperado
  3. 3Pide al Agente que llame a GPT-5.6 a través de EvoLink y muestre la solicitud antes de enviarla
  4. 4Deja que el Agente informe la respuesta, el uso de tokens y cualquier cuerpo de error

Ejemplo de código de la API de GPT-5.6 y manejo de errores

Este ejemplo muestra la solicitud ejecutable más corta: una llamada Chat Completions compatible con OpenAI con prompt de sistema, mensaje de usuario y presupuesto de salida. Abre la pestaña API para la referencia completa de parámetros y respuestas.

Ver documentación completa de la API
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-sol",
    "messages": [
      { "role": "system", "content": "You are a senior engineer reviewing a pull request." },
      { "role": "user", "content": "Review this diff and list the blocking issues with file and line:\n<diff>" }
    ],
    "max_tokens": 4096,
    "temperature": 0.2
  }'

# Swap the model ID for gpt-5.6-terra or gpt-5.6-luna to change the tier.
# The response includes choices[0].message and a usage object
# (prompt_tokens, completion_tokens, and cached tokens when a prefix is
# reused).

Solicitud inválida o parámetro no admitido

Comprueba el ID de modelo, el array messages y los rangos de parámetros en la referencia de la API; elimina los campos que esta ruta no admite.

Problema de autenticación o saldo

Comprueba el token Bearer de Authorization y confirma el saldo disponible en la consola.

Longitud de contexto excedida

Los tokens del prompt superan la ventana de contexto de GPT-5.6. Recorta o recupera solo la evidencia relevante y reutiliza prefijos en caché.

Límite de tasa (429)

Espera y reintenta con jitter; agrupa o encola las solicitudes en lugar de ráfagas paralelas.

Contenido o llamada a herramienta rechazados

Revisa contenido sensible, argumentos de llamada a herramienta mal formados y desajustes del esquema JSON antes de reintentar.

Antes de llevar GPT-5.6 a producción

Cuatro comprobaciones que deciden coste y estabilidad.

01

Elegir el ID de modelo GPT-5.6 exacto

Usa gpt-5.6-sol, gpt-5.6-terra o gpt-5.6-luna; no existe un alias genérico gpt-5.6.

Obligatorio
02

Presupuestar el umbral de contexto largo de 272K

Por encima de 272K tokens de prompt toda la solicitud usa tarifas de contexto largo; quédate por debajo cuando puedas.

Recomendado
03

Estructurar los prompts para lecturas de caché

Pon primero las instrucciones estables y el material de referencia para que las lecturas de caché sustituyan la entrada a precio completo.

Recomendado
04

Medir con usage, no con el precio de lista

Concilia el coste desde el objeto usage (entrada sin caché, lectura, escritura, salida) antes de escalar tráfico.

Obligatorio

Caché de prompts en cuatro segmentos

La entrada sin caché, las lecturas de caché, las escrituras de caché y la salida se liquidan por separado a partir del objeto usage final. Las escrituras de caché no se cobran de nuevo como entrada ordinaria.

Umbral de contexto largo

Con más de 272K prompt tokens, la entrada y ambos roles de caché usan tarifas 2x y la salida tarifas 1.5x para toda la solicitud.

GPT-5.6 vs otros modelos de texto

EvoLink

Compara la variante GPT-5.6 seleccionada con modelos de texto frontier similares usando precios de EvoLink por 1M de tokens.

GPT-5.6 Sol
Precio EvoLink / 1M (entrada / salida)$3.6 / $18
Ventana de contexto1.05M
Caché de promptsLectura + escritura de caché
Ideal paraRazonamiento complejo, Agents de programación y flujos de alto valor
Claude Opus 4.8
Precio EvoLink / 1M (entrada / salida)$4.5 / $22.5
Ventana de contexto1M
Caché de promptsLectura + escritura de caché
Ideal paraModelo insignia de Anthropic para razonamiento profundo, programación y Agents de larga duración.
Gemini 3.1 Pro
Precio EvoLink / 1M (entrada / salida)$1.865 / $11.183
Ventana de contexto1M
Caché de promptsCaché de contexto
Ideal paraModelo insignia de Google para razonamiento multimodal y cargas de trabajo de gran contexto.

Los precios de contexto base usan el grupo actual de EvoLink. Los usuarios conectados ven la tarifa de su grupo; los demás ven la tarifa Default. Los multiplicadores de contexto largo se muestran en Pricing de cada modelo.

Familia de modelos GPT

Misma clave API y saldo: cambia de nivel sin tocar la integración.

Comparar todos los modelos GPT
GPT-6.1 Sol

GPT-6.1 Sol

Nuevo Sol para código en varios archivos y agentes con Responses

Ver modelo
GPT-6 Astra

GPT-6 Astra

Compare las rutas invocables de GPT-5.6 con las especificaciones publicadas de GPT-6 Astra y defina las puertas de coste, evaluación y despliegue antes de actualizar

Ver modelo
GPT-6 Sol

GPT-6 Sol

Modelo GPT-6 creado para la programación compleja y los flujos de trabajo agénticos

Ver modelo

Otros modelos de texto en EvoLink además de GPT-5.6

Claude Opus 4.8

Claude Opus 4.8

Modelo insignia de Anthropic para razonamiento profundo, programación y Agents de larga duración.

Ver modelo
Gemini 3.1 Pro

Gemini 3.1 Pro

Modelo insignia de Google para razonamiento multimodal y cargas de trabajo de gran contexto.

Ver modelo
Grok 4.5

Grok 4.5

La ruta de razonamiento y herramientas de xAI con contexto de 500K y búsqueda del lado del servidor.

Ver modelo
Kimi K3

Kimi K3

La ruta de razonamiento de contexto largo de Moonshot para programación a escala de repositorio y trabajo multidocumento.

Ver modelo

API de GPT-5.6 - Preguntas frecuentes

¿Qué ID de modelo están disponibles?

Usa gpt-5.6-sol, gpt-5.6-terra o gpt-5.6-luna. No hay disponible un alias genérico gpt-5.6.

¿Cómo se factura la entrada en caché?

Las lecturas y las escrituras de caché son segmentos de tokens independientes. Ninguno se factura de nuevo como entrada ordinaria.

¿Cuándo se aplican las tarifas de contexto largo?

Cuando el total de prompt tokens supera 272.000, toda la solicitud usa los multiplicadores de contexto largo mostrados en la tabla de precios.

¿Puedo usar el SDK de OpenAI con GPT-5.6 en EvoLink?

Sí. Apunta el SDK a la URL base de EvoLink con tu clave API de EvoLink y selecciona uno de los tres ID de modelo GPT-5.6.

¿Con qué nivel de GPT-5.6 debería empezar?

Terra para la mayoría del trabajo de producción, Sol cuando la tarea exija más razonamiento y Luna para solicitudes masivas y sensibles al coste.

¿GPT-5.6 admite llamadas a herramientas y salida estructurada?

Sí. Los tres niveles admiten llamadas a funciones y salida JSON estructurada mediante los campos estándar de Chat Completions.