Grok 4.5 API
Elegir Grok 4.5
Una ruta de evaluación para razonamiento complejo, contexto largo, investigación y flujos con herramientas de servidor de xAI.
Grok 4.5
Modelo de xAI para razonamiento y uso de herramientas
grok-4.5Investigación con búsqueda web y X, análisis asistido por código, búsqueda en documentos y colecciones, razonamiento complejo y enrutamiento entre proveedores.
Grok 4.5 Precios
Estimate token and successful server-side tool usage together. Live prices for your user group override the contract-backed fallback rates.
Request calculator
Enter uncached input, cached input, output, and successful tool calls.Estimated request cost
Grok 4.5At 200,000 prompt tokens (uncached + cached input), every token role is billed at 2×. Minimum total charge: 0.01 credits. Tool calls are not multiplied.
Budget guide
Approximate requests using the current mix.For quick testing
For regular development
For production evaluation
Token rates
| Model | Prompt tokens | Uncached input tokens | Cached input tokens | Output tokens |
|---|---|---|---|---|
Grok 4.5grok-4.5 | < 200K | $1.700 / 1M-15% 115.6 cr / 1M$2.000precio oficial de xAI | $0.256 / 1M-15% 17.4 cr / 1M$0.300precio oficial de xAI | $5.100 / 1M-15% 346.8 cr / 1M$6.000precio oficial de xAI |
Grok 4.5grok-4.5 | ≥ 200K | $3.400 / 1M-15% 231.2 cr / 1M$4.000precio oficial de xAI | $0.512 / 1M-15% 34.8 cr / 1M$0.600precio oficial de xAI | $10.200 / 1M-15% 693.6 cr / 1M$12.000precio oficial de xAI |
USD and credits are shown per 1M tokens. The long-context tier starts inclusively at 200,000 prompt tokens and applies 2× to input, cached input, and output.
Herramientas de servidor Responses
Only successful server-side calls on /v1/responses are billed per call. Ordinary client function calls and failed attempts have no server-tool fee; tokens still apply.
¿Qué es la API de Grok 4.5?
Grok 4.5 es el modelo de razonamiento de xAI para agentes de programación, investigación conectada, documentos largos y flujos con herramientas. La URL usa grok-4-5 y las solicitudes API usan el ID grok-4.5. Grok 4.5 está disponible en la ruta de producción de EvoLink; consulta límites de precio, flujos compatibles y configuración en las secciones Pricing y API.
¿Para qué tareas es adecuada la API de Grok 4.5?
Grok 4.5 combina una ventana de contexto de 500.000 tokens, razonamiento configurable, entrada de imágenes y herramientas. Resulta útil cuando el trabajo debe conservar evidencia, llamar a sistemas externos y entregar resultados verificables.
Programación y revisión a escala de repositorio
Reúne código fuente, issues, resultados de pruebas y cambios anteriores para investigar problemas entre archivos, preparar implementaciones y revisar modificaciones. Antes del despliegue, usa tareas fijas para comprobar pruebas superadas, pasos omitidos, resultados estructurados y correcciones humanas necesarias.
Documentos largos y análisis de varias fuentes
La ventana de 500.000 tokens puede contener informes, contratos, fragmentos de bases de conocimiento, historial y fuentes recuperadas. Más contexto no garantiza una respuesta mejor: comprueba que se conserve la evidencia clave y usa los tramos de contexto largo y entrada en caché de Pricing para calcular el coste por resultado aceptable.
Investigación conectada y flujos con herramientas
Grok 4.5 puede combinar búsquedas web y en X, ejecución de código y búsquedas en adjuntos o colecciones para producir investigación con fuentes. Con EvoLink, revisa disponibilidad, tokens y precio por llamada en API y Pricing, y prueba las citas y la calidad en tu flujo real.
Salida estructurada y orquestación de agentes
Las entradas de texto e imagen pueden alimentar JSON Schema, llamadas a funciones y agentes de varios pasos para extracción, revisión y automatización. Antes de producción, prueba la validez del esquema, los argumentos, el cierre del streaming y la recuperación segura tras un fallo de herramienta.
¿Qué cambia al usar Grok 4.5 mediante distintas plataformas?
Aunque el modelo sea el mismo, la configuración de contexto, las herramientas, los datos de uso y la facturación pueden variar. EvoLink reúne configuración y consumo tras una sola API para simplificar futuros cambios de modelo.
Usar el ID de modelo API correcto
grok-4-5 es la URL y una forma de búsqueda habitual; el ID que se envía en la API es grok-4.5. Las aplicaciones existentes con Chat Completions o Responses pueden cambiar la configuración del modelo. Los campos exactos siguen en la sección API.
Seguir la configuración del canal API actual
xAI documenta una ventana de 500.000 tokens, pero cada plataforma puede ofrecer opciones de contexto, herramientas y límites distintos. En EvoLink, toma como referencia la configuración, las funciones disponibles y los datos usage mostrados para el canal actual.
Elegir Chat o Responses según el flujo
Empieza con Chat Completions para chat, streaming y funciones del cliente. Usa Responses cuando necesites agentes de investigación, búsquedas del servidor o ejecución de código. Así conservas una integración de estilo OpenAI sin complejidad innecesaria.
Mantener abierta la elección de modelo
Una cuenta, saldo y patrón de API de EvoLink sirven para Grok, GPT, Claude y Kimi. Si el modelo permanece en configuración, el equipo puede enrutar por calidad, coste y disponibilidad sin reconstruir la aplicación para cada proveedor.
¿Cómo controlar mejor el coste de la API de Grok 4.5?
Pricing muestra las tarifas actuales de tokens y herramientas. La caché, la gestión del contexto, el nivel de razonamiento y el enrutamiento reducen consumo innecesario y relacionan el gasto con tareas terminadas.
Preparar el contexto repetido para la caché
Los prompts de sistema estables, esquemas de herramientas y contexto compartido son más fáciles de reutilizar. Configura el identificador de caché o conversación compatible con el protocolo y revisa cached tokens en usage para confirmar el beneficio real.
Enviar solo el contexto que necesita la tarea
La ventana de 500.000 tokens ayuda con repositorios y documentos grandes, pero no hay que llenarla siempre. Seleccionar archivos, mensajes y fragmentos relevantes reduce el coste de entrada y ayuda al modelo a centrarse en la evidencia decisiva.
Ajustar razonamiento, salida y herramientas
Las tareas sencillas pueden comenzar con reasoning effort bajo y una salida corta; aumenta el presupuesto en análisis difíciles. En investigación y agentes, controla también el número de herramientas para evitar búsquedas repetidas, ejecuciones inútiles o bucles.
Comparar modelos por coste total de la tarea
Evalúa tokens, entrada en caché, herramientas de servidor y reintentos dentro de la misma tarea completada. EvoLink centraliza modelos y uso para comparar el coste total del mismo trabajo con Grok 4.5 y otras rutas.
¿Cómo elegir Chat Completions, Responses y el tráfico de producción?
Cada protocolo sirve a flujos distintos. Este resumen ayuda a elegir; los campos exactos están en API y la documentación de EvoLink, y los precios de tokens y herramientas en Pricing.
Chat estándar y funciones del cliente: Chat Completions
Si ya usas chat compatible con OpenAI, streaming o funciones ejecutadas por el cliente, empieza con Chat Completions. Confirma formato de mensajes, cierre del flujo, argumentos de función y usage según lo que espera el cliente actual.
Agentes de investigación y herramientas: Responses
Evalúa Responses para búsquedas web o en X, ejecución de código, búsqueda en adjuntos o colecciones y agentes más largos. Confirma disponibilidad, precio de llamadas, citas, estados de fallo y límites de reintento.
Contexto grande: observar caché y coste total
Los documentos, repositorios y conversaciones largos no deben enviarse completos por defecto. Compara tamaños representativos, aciertos y fallos de caché, longitud de salida y reintentos, y usa el cargo final para calcular el coste de una tarea correcta.
Producción: empezar poco a poco y conservar respaldo
Envía primero un grupo pequeño y observable a Grok 4.5 y conserva una ruta GPT, Claude o Kimi ya probada. La API unificada de EvoLink centraliza modelo, uso y saldo y facilita cambiar tras límites, timeouts o fallos de esquema o herramienta.
¿Qué conviene confirmar antes de usar Grok 4.5 en producción?
Empieza con unas pocas cargas reales para confirmar calidad, latencia, coste y fiabilidad antes de trasladar más tráfico.
La integración y el uso son claros
Confirma el ID grok-4.5, el protocolo previsto y la devolución de respuestas, datos usage y caché. Un uso claro permite analizar costes y observar de forma coherente los flujos Chat y Responses.
Las salidas cumplen el requisito de negocio
Prueba cambios de código, documentos, investigación o extracción estructurada reales. Además de la respuesta, comprueba pruebas, fiabilidad de citas, argumentos de funciones y si el JSON Schema puede consumirse directamente en sistemas posteriores.
La latencia y los errores se pueden gestionar
Observa tiempos de respuesta con carga representativa y prepara reintentos para límites, timeouts, salidas estructuradas inválidas y fallos de herramientas. Un modelo configurable en EvoLink facilita cambiar a una alternativa verificada si una ruta no está disponible.
El coste y la elección del modelo siguen controlados
Calcula el coste total de la misma clase de tarea con Pricing, usage y el cargo final. Decide después si Grok 4.5 debe ser ruta predeterminada, modelo para tareas difíciles o respaldo. La gateway unificada separa esa decisión del trabajo de integración.
Empieza con un conjunto pequeño, observable y reversible de tareas en Grok 4.5. Amplía solo cuando calidad, latencia y coste cumplan lo esperado. Mantener varios modelos tras la API unificada de EvoLink simplifica escalar, cambiar y optimizar costes.
ID del modelo API
grok-4.5grok-4-5 es la URL de la página. Las solicitudes de Chat Completions y Responses deben usar el ID exacto que se muestra aquí.
Modelos relacionados

GPT-5.6
La familia frontier escalonada de OpenAI para comparar capacidad, latencia y flexibilidad del enrutamiento por coste.
Ver modelo
Claude Opus 5
La ruta premium de Anthropic para agentes de larga duración, uso de herramientas y revisiones complejas.
Ver modelo
Kimi K3
La ruta de razonamiento con contexto largo de Moonshot y una tarifa separada para entrada en caché.
Ver modelo
DeepSeek V4
Una ruta open model de bajo coste para grandes cargas de programación, razonamiento y agentes.
Ver modeloGuías relacionadas y actualización de Grok 4.5

Grok 4.6 vs Grok 4.5
Revisa hechos confirmados, condiciones de migración y pruebas comparables antes de mover cargas existentes de Grok 4.5.
Leer la guía
Estado del lanzamiento de Grok 4.6
Sigue lanzamiento oficial, ID del modelo, disponibilidad API y precios; mientras no se confirmen, usa Grok 4.5 como base reproducible.
Leer la guíaPreguntas frecuentes de la API de Grok 4.5
¿Ya está disponible la API de Grok 4.5 mediante EvoLink?
Sí. Grok 4.5 está disponible en la ruta de producción de EvoLink. Envía solicitudes con el ID grok-4.5 mediante Chat Completions o Responses; el ID, los precios, el contexto y los flujos compatibles figuran en esta página.
¿grok-4-5 es el ID del modelo API?
No. grok-4-5 es la URL de la página y una forma de búsqueda. El ID real que se envía en solicitudes API es grok-4.5.
¿Cuál es la ventana de contexto y el límite de precio para contexto largo?
xAI documenta 500.000 tokens. Al alcanzar el umbral de tokens de prompt mostrado en Pricing, se aplica el tramo de contexto largo. Prueba tamaños representativos y entrada en caché en vez de usar siempre toda la ventana.
¿Qué entradas y salidas admite Grok 4.5?
La documentación de origen indica texto e imágenes como entrada y texto como salida. La imagen sirve para comprensión visual y no convierte a Grok 4.5 en generador de imágenes. Consulta el soporte actual en API.
¿Debo usar Chat Completions o la API Responses?
Chat Completions sirve para chat, streaming y funciones del cliente. Evalúa Responses para agentes largos y herramientas de servidor de xAI. Los campos exactos se mantienen en API y la documentación de EvoLink.
¿Cómo se debe elegir el reasoning effort?
Empieza con el nivel más bajo que cumpla la calidad requerida y compara medium y high en las mismas tareas. El trabajo complejo puede necesitar más razonamiento; el sencillo puede priorizar tiempo y coste.
¿Cómo afecta la entrada en caché al precio de Grok 4.5?
Puede reducir el coste del contexto repetido, pero los fallos de caché, salidas largas, reintentos y herramientas repetidas aumentan el total. Usa Pricing y el cargo final para calcular el coste por tarea correcta.
¿Qué diferencia hay entre herramientas del servidor y funciones del cliente?
Las funciones del cliente se ejecutan en tu aplicación. Las búsquedas web y en X, ejecución de código y búsquedas en adjuntos o colecciones son herramientas del servidor de xAI. Cambian la ejecución, los errores y la facturación; consulta API y Pricing.
¿Cómo comparar Grok 4.5 con GPT, Claude o Kimi?
Ejecuta las mismas tareas reales con contexto, herramientas y razonamiento iguales. Compara calidad, tiempo de respuesta, mezcla de tokens, rendimiento de herramientas y coste total para asignar cada tráfico a una ruta de EvoLink.
¿Qué modelo de respaldo conviene conservar?
Conserva un modelo que ya gestione la misma carga con fiabilidad y mantén la ruta configurable. Ante límites, timeouts o salidas inválidas, EvoLink puede cambiar a GPT, Claude, Kimi u otra alternativa adecuada.