GPT Image 2.5 Flare & Sunburst ya están disponibles en EvoLinkProbar GPT Image 2.5

Grok 4.5 API

Accede a Grok 4.5 de xAI —también buscado como grok-4-5— a través de la API de chat unificada de EvoLink. Prueba el razonamiento, el uso de herramientas, las herramientas del lado del servidor antes de integrar.

xAIGeneración de textoDisponible
desde $1.700 / 1M tokens de entrada$2.000 precio oficial-15%
Análisis de documentos largosRazonamiento configurableUso de herramientasCaché de promptsChat + Responses
Ruta de producciónLive
Contexto
500K de contexto · 450K de salida máx.
Ideal para
Investigación, programación, análisis de documentos, agentes
Entrada
Texto + imágenes
Salida
Texto · JSON (salida estructurada) · llamadas a herramientas

Elegir Grok 4.5

Una ruta de evaluación para razonamiento complejo, contexto largo, investigación y flujos con herramientas de servidor de xAI.

Grok 4.5

Modelo de xAI para razonamiento y uso de herramientas

Seleccionado
ID del modelo
grok-4.5
Ideal para

Investigación con búsqueda web y X, análisis asistido por código, búsqueda en documentos y colecciones, razonamiento complejo y enrutamiento entre proveedores.

< 200K
Entrada
$1.700 / 1M-15%
115.6 cr / 1M$2.000precio oficial
Lectura de caché
$0.256 / 1M-15%
17.4 cr / 1M$0.300precio oficial
Salida
$5.100 / 1M-15%
346.8 cr / 1M$6.000precio oficial
≥ 200K
Entrada
$3.400 / 1M-15%
231.2 cr / 1M$4.000precio oficial
Lectura de caché
$0.512 / 1M-15%
34.8 cr / 1M$0.600precio oficial
Salida
$10.200 / 1M-15%
693.6 cr / 1M$12.000precio oficial

Todas las tarifas son por 1M de tokens, en USD y créditos, y reflejan los precios actuales de tu cuenta. A partir de 200K tokens de prompt se aplica el nivel de contexto largo (×2) a cada rol de token.

Precios de Grok 4.5

Estima el coste de una solicitud de Grok 4.5 antes de integrar. La calculadora usa las tarifas actuales de tu cuenta; los precios oficiales sirven de referencia.

Calculadora de solicitud

Introduce la combinación de tokens de una solicitud y el número de llamadas a herramientas exitosas.

Coste estimado por solicitud

Grok 4.5
Tarifa de contexto corto
USD$0.0033
Créditos0.2232

Estimación oficial $0.0039 · ahorras $0.0006 (15%)

Tokens de entrada0.1156 cr
Tokens de lectura de caché0.0035 cr
Tokens de salida0.1041 cr

Cargo mínimo: 0.01 créditos por solicitud. A partir de 200K tokens de prompt, cada rol de token se factura ×2. Las llamadas a herramientas no se multiplican.

Guía de presupuesto

Solicitudes aproximadas con la combinación actual de tokens.
Añadir créditos
$10
Unas 3046 solicitudes

Para pruebas rápidas

$50
Unas 15232 solicitudes

Para el desarrollo habitual

$100
Unas 30465 solicitudes

Para la evaluación en producción

Tarifas de herramientas del servidor

Solo las llamadas exitosas del lado del servidor se facturan por llamada; los intentos fallidos no tienen tarifa de herramienta, pero los tokens sí se cobran.
  • Búsqueda web$0.0050/ llamada0.34 cr / llamada
  • Búsqueda en X$0.0050/ llamada0.34 cr / llamada
  • Ejecución de código$0.0050/ llamada0.34 cr / llamada
  • Búsqueda en adjuntos$0.010/ llamada0.68 cr / llamada
  • Búsqueda en colecciones$0.0025/ llamada0.17 cr / llamada

¿Qué es la API de Grok 4.5?

Grok 4.5 es el modelo de razonamiento de xAI para agentes de programación, investigación conectada, documentos largos y flujos con herramientas. La URL usa grok-4-5 y las solicitudes API usan el ID grok-4.5. Grok 4.5 está disponible en la ruta de producción de EvoLink; consulta límites de precio, flujos compatibles y configuración en las secciones Pricing y API.

Grok 4.5 se sirve en EvoLink con el ID de modelo grok-4.5 mediante Chat Completions · Responses, con la misma clave API y saldo que usas para cualquier otro modelo. Ofrece una ventana de contexto de 500K y hasta 450K tokens de salida, además de el razonamiento, el uso de herramientas, las herramientas del lado del servidor.

Grok 4.5

Especificaciones y capacidades de Grok 4.5

Las cifras proceden de la configuración de ruta de EvoLink; las capacidades son las que la API expone hoy.

Ventana de contexto
500K tokens
Salida máx.
450K tokens
Entrada
Texto + imágenes
Salida
Texto · JSON (salida estructurada) · llamadas a herramientas
Razonamiento
Esfuerzo de razonamiento configurable
Uso de herramientas
Llamadas a funciones con secuencias de herramientas de varios pasos
Caché de prompts
Lecturas de caché automáticas a tarifa reducida
Herramientas del servidor
Búsqueda web, Búsqueda en X, Ejecución de código, Búsqueda en adjuntos, Búsqueda en colecciones, facturadas por llamada exitosa
Nivel de contexto largo
×2 a partir de 200K tokens de prompt
Protocolos
Chat Completions · Responses
ID del modelo
grok-4.5

grok-4-5 es la URL de la página. Las solicitudes de Chat Completions y Responses deben usar el ID exacto que se muestra aquí.

¿Para qué tareas es adecuada la API de Grok 4.5?

Grok 4.5 combina una ventana de contexto de 500.000 tokens, razonamiento configurable, entrada de imágenes y herramientas. Resulta útil cuando el trabajo debe conservar evidencia, llamar a sistemas externos y entregar resultados verificables.

Programación y revisión a escala de repositorio

Reúne código fuente, issues, resultados de pruebas y cambios anteriores para investigar problemas entre archivos, preparar implementaciones y revisar modificaciones. Antes del despliegue, usa tareas fijas para comprobar pruebas superadas, pasos omitidos, resultados estructurados y correcciones humanas necesarias.

Documentos largos y análisis de varias fuentes

La ventana de 500.000 tokens puede contener informes, contratos, fragmentos de bases de conocimiento, historial y fuentes recuperadas. Más contexto no garantiza una respuesta mejor: comprueba que se conserve la evidencia clave y usa los tramos de contexto largo y entrada en caché de Pricing para calcular el coste por resultado aceptable.

Investigación conectada y flujos con herramientas

Grok 4.5 puede combinar búsquedas web y en X, ejecución de código y búsquedas en adjuntos o colecciones para producir investigación con fuentes. Con EvoLink, revisa disponibilidad, tokens y precio por llamada en API y Pricing, y prueba las citas y la calidad en tu flujo real.

Salida estructurada y orquestación de agentes

Las entradas de texto e imagen pueden alimentar JSON Schema, llamadas a funciones y agentes de varios pasos para extracción, revisión y automatización. Antes de producción, prueba la validez del esquema, los argumentos, el cierre del streaming y la recuperación segura tras un fallo de herramienta.

¿Qué cambia al usar Grok 4.5 mediante distintas plataformas?

Aunque el modelo sea el mismo, la configuración de contexto, las herramientas, los datos de uso y la facturación pueden variar. EvoLink reúne configuración y consumo tras una sola API para simplificar futuros cambios de modelo.

Usar el ID de modelo API correcto

grok-4-5 es la URL y una forma de búsqueda habitual; el ID que se envía en la API es grok-4.5. Las aplicaciones existentes con Chat Completions o Responses pueden cambiar la configuración del modelo. Los campos exactos siguen en la sección API.

Seguir la configuración del canal API actual

xAI documenta una ventana de 500.000 tokens, pero cada plataforma puede ofrecer opciones de contexto, herramientas y límites distintos. En EvoLink, toma como referencia la configuración, las funciones disponibles y los datos usage mostrados para el canal actual.

Elegir Chat o Responses según el flujo

Empieza con Chat Completions para chat, streaming y funciones del cliente. Usa Responses cuando necesites agentes de investigación, búsquedas del servidor o ejecución de código. Así conservas una integración de estilo OpenAI sin complejidad innecesaria.

Mantener abierta la elección de modelo

Una cuenta, saldo y patrón de API de EvoLink sirven para Grok, GPT, Claude y Kimi. Si el modelo permanece en configuración, el equipo puede enrutar por calidad, coste y disponibilidad sin reconstruir la aplicación para cada proveedor.

¿Cómo controlar mejor el coste de la API de Grok 4.5?

Pricing muestra las tarifas actuales de tokens y herramientas. La caché, la gestión del contexto, el nivel de razonamiento y el enrutamiento reducen consumo innecesario y relacionan el gasto con tareas terminadas.

Preparar el contexto repetido para la caché

Los prompts de sistema estables, esquemas de herramientas y contexto compartido son más fáciles de reutilizar. Configura el identificador de caché o conversación compatible con el protocolo y revisa cached tokens en usage para confirmar el beneficio real.

Enviar solo el contexto que necesita la tarea

La ventana de 500.000 tokens ayuda con repositorios y documentos grandes, pero no hay que llenarla siempre. Seleccionar archivos, mensajes y fragmentos relevantes reduce el coste de entrada y ayuda al modelo a centrarse en la evidencia decisiva.

Ajustar razonamiento, salida y herramientas

Las tareas sencillas pueden comenzar con reasoning effort bajo y una salida corta; aumenta el presupuesto en análisis difíciles. En investigación y agentes, controla también el número de herramientas para evitar búsquedas repetidas, ejecuciones inútiles o bucles.

Comparar modelos por coste total de la tarea

Evalúa tokens, entrada en caché, herramientas de servidor y reintentos dentro de la misma tarea completada. EvoLink centraliza modelos y uso para comparar el coste total del mismo trabajo con Grok 4.5 y otras rutas.

Dos formas de usar Grok 4.5: API de EvoLink o Agente

Usa la API de EvoLink para backends de producto y trabajos por lotes, o llama a Grok 4.5 desde Codex, Claude o Gemini para flujos de código y análisis. Ambas vías comparten la misma clave API de EvoLink, saldo, ID de modelo e historial de solicitudes.

Opción 1

Integrar con la API de EvoLink

Ideal para: backends de producto, trabajos por lotes, pipelines automatizados

Envía a EvoLink solicitudes Chat Completions compatibles con OpenAI (o Anthropic Messages) y controla el ID de modelo, el prompt de sistema, el presupuesto de salida, las herramientas y la salida estructurada.

  1. 1Crea una clave API de EvoLink en la consola
  2. 2Apunta tu SDK de OpenAI o Anthropic a la URL base de EvoLink y selecciona el ID de modelo mostrado arriba
  3. 3Envía una solicitud representativa y lee el campo usage para tokens de entrada, en caché y de salida
  4. 4Define max_tokens y reintentos por tarea; conserva los ID y resultados de llamadas a herramientas entre turnos
Opción 2

Llamarlo con un Agente

Ideal para: tareas de código, revisión y análisis en Codex, Claude y Gemini

Dale al Agente la tarea, las entradas a incluir y los criterios de aceptación. Él arma la solicitud, llama a Grok 4.5 a través de EvoLink y devuelve la respuesta con el uso de tokens.

  1. 1Define EVOLINK_API_KEY en tu entorno local; nunca en código ni en un prompt
  2. 2Describe la tarea, las entradas a incluir y el formato de salida esperado
  3. 3Pide al Agente que llame a Grok 4.5 a través de EvoLink y muestre la solicitud antes de enviarla
  4. 4Deja que el Agente informe la respuesta, el uso de tokens y cualquier cuerpo de error

Ejemplo de código de la API de Grok 4.5 y manejo de errores

Este ejemplo muestra la solicitud ejecutable más corta: una llamada Chat Completions compatible con OpenAI con prompt de sistema, mensaje de usuario y presupuesto de salida. Abre la pestaña API para la referencia completa de parámetros y respuestas.

Ver documentación completa de la API
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.5",
    "messages": [
      { "role": "system", "content": "You are a research assistant. Cite sources." },
      { "role": "user", "content": "Summarize the three most important changes in <topic> this month." }
    ],
    "max_tokens": 2048,
    "temperature": 0.2
  }'

# Server-side tools (web search, X search, code execution, attachment /
# collections search)
# run on /v1/responses with the same model ID and are billed per successful
# call.
# The response includes choices[0].message and a usage object (prompt,
# cached, and completion tokens).

Solicitud inválida o parámetro no admitido

Comprueba el ID de modelo, el array messages y los rangos de parámetros en la referencia de la API; elimina los campos que esta ruta no admite.

Problema de autenticación o saldo

Comprueba el token Bearer de Authorization y confirma el saldo disponible en la consola.

Longitud de contexto excedida

Los tokens del prompt superan la ventana de contexto de Grok 4.5. Recorta o recupera solo la evidencia relevante y reutiliza prefijos en caché.

Límite de tasa (429)

Espera y reintenta con jitter; agrupa o encola las solicitudes en lugar de ráfagas paralelas.

Contenido o llamada a herramienta rechazados

Revisa contenido sensible, argumentos de llamada a herramienta mal formados y desajustes del esquema JSON antes de reintentar.

¿Cómo elegir Chat Completions, Responses y el tráfico de producción para Grok 4.5?

Cada protocolo sirve a flujos distintos. Este resumen ayuda a elegir; los campos exactos están en API y la documentación de EvoLink, y los precios de tokens y herramientas en Pricing.

01

Chat estándar y funciones del cliente: Chat Completions

Si ya usas chat compatible con OpenAI, streaming o funciones ejecutadas por el cliente, empieza con Chat Completions. Confirma formato de mensajes, cierre del flujo, argumentos de función y usage según lo que espera el cliente actual.

Chat y funciones del cliente
02

Agentes de investigación y herramientas: Responses

Evalúa Responses para búsquedas web o en X, ejecución de código, búsqueda en adjuntos o colecciones y agentes más largos. Confirma disponibilidad, precio de llamadas, citas, estados de fallo y límites de reintento.

Herramientas del servidor
03

Contexto grande: observar caché y coste total

Los documentos, repositorios y conversaciones largos no deben enviarse completos por defecto. Compara tamaños representativos, aciertos y fallos de caché, longitud de salida y reintentos, y usa el cargo final para calcular el coste de una tarea correcta.

Coste de contexto
04

Producción: empezar poco a poco y conservar respaldo

Envía primero un grupo pequeño y observable a Grok 4.5 y conserva una ruta GPT, Claude o Kimi ya probada. La API unificada de EvoLink centraliza modelo, uso y saldo y facilita cambiar tras límites, timeouts o fallos de esquema o herramienta.

Despliegue gradual

La entrada en caché se factura con su propia tarifa reducida

Los prefijos estables (prompts de sistema, esquemas de herramientas, contexto compartido) se cachean automáticamente en solicitudes repetidas y se facturan como lecturas de caché en lugar de entrada nueva. Mantén el prefijo idéntico entre turnos y revisa los tokens cacheados en usage para confirmar el ahorro.

Contexto de 500K tokens con nivel de contexto largo a partir de 200K tokens de prompt

Llena la ventana solo cuando la tarea lo necesite. En cuanto un prompt alcanza 200K tokens, el nivel de contexto largo se aplica a todos los roles de token: recorta pasajes recuperados e historial antes de escalar y vigila la etiqueta de nivel en el estimador al planificar presupuestos.

Compara Grok 4.5 con GPT-5.6 y Claude Opus 5

EvoLink

Compara precios de entrada/salida, contexto, caché y casos de uso. Prueba las mismas solicitudes antes de elegir una ruta; abajo se muestran las tarifas actuales de tu cuenta.

Grok 4.5
Entrada / Salida$1.7 / $5.1
Contexto500K
CachéLecturas de caché automáticas
Ideal paraInvestigación con búsqueda web y X, análisis asistido por código, búsqueda en documentos y colecciones, razonamiento complejo y enrutamiento entre proveedores.
GPT-5.6
Entrada / Salida$0.181 / $1.081
Contexto1.05M
CachéLectura / escritura de caché
Ideal paraProgramación, agentes en producción, razonamiento complejo
Claude Opus 5
Entrada / Salida$4.75 / $23.75
Contexto1M
CachéLectura / escritura de caché
Ideal paraProgramación a escala de repositorio, agentes de larga duración, revisiones críticas

¿Qué conviene confirmar antes de usar Grok 4.5 en producción?

Empieza con unas pocas cargas reales para confirmar calidad, latencia, coste y fiabilidad antes de trasladar más tráfico.

La integración y el uso son claros

Confirma el ID grok-4.5, el protocolo previsto y la devolución de respuestas, datos usage y caché. Un uso claro permite analizar costes y observar de forma coherente los flujos Chat y Responses.

Las salidas cumplen el requisito de negocio

Prueba cambios de código, documentos, investigación o extracción estructurada reales. Además de la respuesta, comprueba pruebas, fiabilidad de citas, argumentos de funciones y si el JSON Schema puede consumirse directamente en sistemas posteriores.

La latencia y los errores se pueden gestionar

Observa tiempos de respuesta con carga representativa y prepara reintentos para límites, timeouts, salidas estructuradas inválidas y fallos de herramientas. Un modelo configurable en EvoLink facilita cambiar a una alternativa verificada si una ruta no está disponible.

El coste y la elección del modelo siguen controlados

Calcula el coste total de la misma clase de tarea con Pricing, usage y el cargo final. Decide después si Grok 4.5 debe ser ruta predeterminada, modelo para tareas difíciles o respaldo. La gateway unificada separa esa decisión del trabajo de integración.

Empieza con un conjunto pequeño, observable y reversible de tareas en Grok 4.5. Amplía solo cuando calidad, latencia y coste cumplan lo esperado. Mantener varios modelos tras la API unificada de EvoLink simplifica escalar, cambiar y optimizar costes.

Familia de modelos Grok

Misma clave API y saldo: cambia de nivel sin tocar la integración.

Grok 4.5

Grok 4.5

Modelo actual

Modelo de xAI para razonamiento y uso de herramientas

Grok 4.6

Grok 4.6

Modelo de xAI para razonamiento y uso de herramientas

Ver modelo

Otros modelos de texto en EvoLink además de Grok 4.5

GPT-5.6

GPT-5.6

La familia frontier escalonada de OpenAI para comparar capacidad, latencia y flexibilidad del enrutamiento por coste.

Ver modelo
Claude Opus 5

Claude Opus 5

La ruta premium de Anthropic para agentes de larga duración, uso de herramientas y revisiones complejas.

Ver modelo
Kimi K3

Kimi K3

La ruta de razonamiento con contexto largo de Moonshot y una tarifa separada para entrada en caché.

Ver modelo
DeepSeek V4 Flash

DeepSeek V4 Flash

Una ruta open model de bajo coste para grandes cargas de programación, razonamiento y agentes.

Ver modelo

Lecturas relacionadas sobre Grok 4.5

Grok 4.6 vs Grok 4.5

Grok 4.6 vs Grok 4.5

Revisa hechos confirmados, condiciones de migración y pruebas comparables antes de mover cargas existentes de Grok 4.5.

Leer la guía
Estado del lanzamiento de Grok 4.6

Estado del lanzamiento de Grok 4.6

Sigue lanzamiento oficial, ID del modelo, disponibilidad API y precios; mientras no se confirmen, usa Grok 4.5 como base reproducible.

Leer la guía

Preguntas frecuentes de la API de Grok 4.5

¿Ya está disponible la API de Grok 4.5 mediante EvoLink?

Sí. Grok 4.5 está disponible en la ruta de producción de EvoLink. Envía solicitudes con el ID grok-4.5 mediante Chat Completions o Responses; el ID, los precios, el contexto y los flujos compatibles figuran en esta página.

¿grok-4-5 es el ID del modelo API?

No. grok-4-5 es la URL de la página y una forma de búsqueda. El ID real que se envía en solicitudes API es grok-4.5.

¿Cuál es la ventana de contexto y el límite de precio para contexto largo?

xAI documenta 500.000 tokens. Al alcanzar el umbral de tokens de prompt mostrado en Pricing, se aplica el tramo de contexto largo. Prueba tamaños representativos y entrada en caché en vez de usar siempre toda la ventana.

¿Qué entradas y salidas admite Grok 4.5?

La documentación de origen indica texto e imágenes como entrada y texto como salida. La imagen sirve para comprensión visual y no convierte a Grok 4.5 en generador de imágenes. Consulta el soporte actual en API.

¿Debo usar Chat Completions o la API Responses?

Chat Completions sirve para chat, streaming y funciones del cliente. Evalúa Responses para agentes largos y herramientas de servidor de xAI. Los campos exactos se mantienen en API y la documentación de EvoLink.

¿Cómo se debe elegir el reasoning effort?

Empieza con el nivel más bajo que cumpla la calidad requerida y compara medium y high en las mismas tareas. El trabajo complejo puede necesitar más razonamiento; el sencillo puede priorizar tiempo y coste.

¿Cómo afecta la entrada en caché al precio de Grok 4.5?

Puede reducir el coste del contexto repetido, pero los fallos de caché, salidas largas, reintentos y herramientas repetidas aumentan el total. Usa Pricing y el cargo final para calcular el coste por tarea correcta.

¿Qué diferencia hay entre herramientas del servidor y funciones del cliente?

Las funciones del cliente se ejecutan en tu aplicación. Las búsquedas web y en X, ejecución de código y búsquedas en adjuntos o colecciones son herramientas del servidor de xAI. Cambian la ejecución, los errores y la facturación; consulta API y Pricing.

¿Cómo comparar Grok 4.5 con GPT, Claude o Kimi?

Ejecuta las mismas tareas reales con contexto, herramientas y razonamiento iguales. Compara calidad, tiempo de respuesta, mezcla de tokens, rendimiento de herramientas y coste total para asignar cada tráfico a una ruta de EvoLink.

¿Qué modelo de respaldo conviene conservar?

Conserva un modelo que ya gestione la misma carga con fiabilidad y mantén la ruta configurable. Ante límites, timeouts o salidas inválidas, EvoLink puede cambiar a GPT, Claude, Kimi u otra alternativa adecuada.