Seedance 2.5 ya está disponible en EvoLinkProbar Seedance 2.5

Grok 4.5 API

xAI-Generación de texto-desde $1.700 / 1 M de tokens de entrada-15%$2.000 precio oficial de xAI-Disponible
Contexto de 500KTramo de contexto largo en 200KRazonamiento configurableChat + Responses
Production routeLive
Proveedor
xAI
Modelo
Grok 4.5
Ventana de contexto
500.000 tokens
Protocolos
Chat + Responses

Elegir Grok 4.5

Una ruta de evaluación para razonamiento complejo, contexto largo, investigación y flujos con herramientas de servidor de xAI.

Grok 4.5

Modelo de xAI para razonamiento y uso de herramientas

Seleccionado
Desde $1.700 / 1 M de tokens de entrada$2.000precio oficial de xAI-15%grok-4.5
Ideal para

Investigación con búsqueda web y X, análisis asistido por código, búsqueda en documentos y colecciones, razonamiento complejo y enrutamiento entre proveedores.

Entrada
$1.700 / 1M-15%
115.6 cr / 1M$2.000precio oficial de xAI
Entrada en caché
$0.256 / 1M-15%
17.4 cr / 1M$0.300precio oficial de xAI
Salida
$5.100 / 1M-15%
346.8 cr / 1M$6.000precio oficial de xAI

Grok 4.5 Precios

Estimate token and successful server-side tool usage together. Live prices for your user group override the contract-backed fallback rates.

Grok 4.5

Request calculator

Enter uncached input, cached input, output, and successful tool calls.

Estimated request cost

Grok 4.5
Short-context rate
USD$0.0033
Credits0.2232
xAI oficial$0.0039
Ahorras$0.0006
Uncached input tokens0.1156 cr
Cached input tokens0.0035 cr
Output tokens0.1041 cr

At 200,000 prompt tokens (uncached + cached input), every token role is billed at 2×. Minimum total charge: 0.01 credits. Tool calls are not multiplied.

Budget guide

Approximate requests using the current mix.
Add credits
$10
About 3046 requests

For quick testing

$50
About 15232 requests

For regular development

$100
About 30465 requests

For production evaluation

Token rates

ModelPrompt tokensUncached input tokensCached input tokensOutput tokens
Grok 4.5grok-4.5< 200K
$1.700 / 1M-15%
115.6 cr / 1M$2.000precio oficial de xAI
$0.256 / 1M-15%
17.4 cr / 1M$0.300precio oficial de xAI
$5.100 / 1M-15%
346.8 cr / 1M$6.000precio oficial de xAI
Grok 4.5grok-4.5≥ 200K
$3.400 / 1M-15%
231.2 cr / 1M$4.000precio oficial de xAI
$0.512 / 1M-15%
34.8 cr / 1M$0.600precio oficial de xAI
$10.200 / 1M-15%
693.6 cr / 1M$12.000precio oficial de xAI

USD and credits are shown per 1M tokens. The long-context tier starts inclusively at 200,000 prompt tokens and applies 2× to input, cached input, and output.

Herramientas de servidor Responses

Web search
$0.0050 / llamada
0.34 cr / llamada
X search
$0.0050 / llamada
0.34 cr / llamada
Code execution
$0.0050 / llamada
0.34 cr / llamada
Attachment search
$0.010 / llamada
0.68 cr / llamada
Collections search
$0.0025 / llamada
0.17 cr / llamada

Only successful server-side calls on /v1/responses are billed per call. Ordinary client function calls and failed attempts have no server-tool fee; tokens still apply.

¿Qué es la API de Grok 4.5?

Grok 4.5 es el modelo de razonamiento de xAI para agentes de programación, investigación conectada, documentos largos y flujos con herramientas. La URL usa grok-4-5 y las solicitudes API usan el ID grok-4.5. Grok 4.5 está disponible en la ruta de producción de EvoLink; consulta límites de precio, flujos compatibles y configuración en las secciones Pricing y API.

Grok 4.5
Tareas y flujos de trabajo

¿Para qué tareas es adecuada la API de Grok 4.5?

Grok 4.5 combina una ventana de contexto de 500.000 tokens, razonamiento configurable, entrada de imágenes y herramientas. Resulta útil cuando el trabajo debe conservar evidencia, llamar a sistemas externos y entregar resultados verificables.

Programación y revisión a escala de repositorio

Reúne código fuente, issues, resultados de pruebas y cambios anteriores para investigar problemas entre archivos, preparar implementaciones y revisar modificaciones. Antes del despliegue, usa tareas fijas para comprobar pruebas superadas, pasos omitidos, resultados estructurados y correcciones humanas necesarias.

Documentos largos y análisis de varias fuentes

La ventana de 500.000 tokens puede contener informes, contratos, fragmentos de bases de conocimiento, historial y fuentes recuperadas. Más contexto no garantiza una respuesta mejor: comprueba que se conserve la evidencia clave y usa los tramos de contexto largo y entrada en caché de Pricing para calcular el coste por resultado aceptable.

Investigación conectada y flujos con herramientas

Grok 4.5 puede combinar búsquedas web y en X, ejecución de código y búsquedas en adjuntos o colecciones para producir investigación con fuentes. Con EvoLink, revisa disponibilidad, tokens y precio por llamada en API y Pricing, y prueba las citas y la calidad en tu flujo real.

Salida estructurada y orquestación de agentes

Las entradas de texto e imagen pueden alimentar JSON Schema, llamadas a funciones y agentes de varios pasos para extracción, revisión y automatización. Antes de producción, prueba la validez del esquema, los argumentos, el cierre del streaming y la recuperación segura tras un fallo de herramienta.

Elección del acceso API

¿Qué cambia al usar Grok 4.5 mediante distintas plataformas?

Aunque el modelo sea el mismo, la configuración de contexto, las herramientas, los datos de uso y la facturación pueden variar. EvoLink reúne configuración y consumo tras una sola API para simplificar futuros cambios de modelo.

Usar el ID de modelo API correcto

grok-4-5 es la URL y una forma de búsqueda habitual; el ID que se envía en la API es grok-4.5. Las aplicaciones existentes con Chat Completions o Responses pueden cambiar la configuración del modelo. Los campos exactos siguen en la sección API.

Seguir la configuración del canal API actual

xAI documenta una ventana de 500.000 tokens, pero cada plataforma puede ofrecer opciones de contexto, herramientas y límites distintos. En EvoLink, toma como referencia la configuración, las funciones disponibles y los datos usage mostrados para el canal actual.

Elegir Chat o Responses según el flujo

Empieza con Chat Completions para chat, streaming y funciones del cliente. Usa Responses cuando necesites agentes de investigación, búsquedas del servidor o ejecución de código. Así conservas una integración de estilo OpenAI sin complejidad innecesaria.

Mantener abierta la elección de modelo

Una cuenta, saldo y patrón de API de EvoLink sirven para Grok, GPT, Claude y Kimi. Si el modelo permanece en configuración, el equipo puede enrutar por calidad, coste y disponibilidad sin reconstruir la aplicación para cada proveedor.

Control de costes

¿Cómo controlar mejor el coste de la API de Grok 4.5?

Pricing muestra las tarifas actuales de tokens y herramientas. La caché, la gestión del contexto, el nivel de razonamiento y el enrutamiento reducen consumo innecesario y relacionan el gasto con tareas terminadas.

Preparar el contexto repetido para la caché

Los prompts de sistema estables, esquemas de herramientas y contexto compartido son más fáciles de reutilizar. Configura el identificador de caché o conversación compatible con el protocolo y revisa cached tokens en usage para confirmar el beneficio real.

Enviar solo el contexto que necesita la tarea

La ventana de 500.000 tokens ayuda con repositorios y documentos grandes, pero no hay que llenarla siempre. Seleccionar archivos, mensajes y fragmentos relevantes reduce el coste de entrada y ayuda al modelo a centrarse en la evidencia decisiva.

Ajustar razonamiento, salida y herramientas

Las tareas sencillas pueden comenzar con reasoning effort bajo y una salida corta; aumenta el presupuesto en análisis difíciles. En investigación y agentes, controla también el número de herramientas para evitar búsquedas repetidas, ejecuciones inútiles o bucles.

Comparar modelos por coste total de la tarea

Evalúa tokens, entrada en caché, herramientas de servidor y reintentos dentro de la misma tarea completada. EvoLink centraliza modelos y uso para comparar el coste total del mismo trabajo con Grok 4.5 y otras rutas.

Elección de protocolo y ruta

¿Cómo elegir Chat Completions, Responses y el tráfico de producción?

Cada protocolo sirve a flujos distintos. Este resumen ayuda a elegir; los campos exactos están en API y la documentación de EvoLink, y los precios de tokens y herramientas en Pricing.

01

Chat estándar y funciones del cliente: Chat Completions

Si ya usas chat compatible con OpenAI, streaming o funciones ejecutadas por el cliente, empieza con Chat Completions. Confirma formato de mensajes, cierre del flujo, argumentos de función y usage según lo que espera el cliente actual.

Chat y funciones del cliente
02

Agentes de investigación y herramientas: Responses

Evalúa Responses para búsquedas web o en X, ejecución de código, búsqueda en adjuntos o colecciones y agentes más largos. Confirma disponibilidad, precio de llamadas, citas, estados de fallo y límites de reintento.

Herramientas del servidor
03

Contexto grande: observar caché y coste total

Los documentos, repositorios y conversaciones largos no deben enviarse completos por defecto. Compara tamaños representativos, aciertos y fallos de caché, longitud de salida y reintentos, y usa el cargo final para calcular el coste de una tarea correcta.

Coste de contexto
04

Producción: empezar poco a poco y conservar respaldo

Envía primero un grupo pequeño y observable a Grok 4.5 y conserva una ruta GPT, Claude o Kimi ya probada. La API unificada de EvoLink centraliza modelo, uso y saldo y facilita cambiar tras límites, timeouts o fallos de esquema o herramienta.

Despliegue gradual
Recomendaciones para producción

¿Qué conviene confirmar antes de usar Grok 4.5 en producción?

Empieza con unas pocas cargas reales para confirmar calidad, latencia, coste y fiabilidad antes de trasladar más tráfico.

La integración y el uso son claros

Confirma el ID grok-4.5, el protocolo previsto y la devolución de respuestas, datos usage y caché. Un uso claro permite analizar costes y observar de forma coherente los flujos Chat y Responses.

Las salidas cumplen el requisito de negocio

Prueba cambios de código, documentos, investigación o extracción estructurada reales. Además de la respuesta, comprueba pruebas, fiabilidad de citas, argumentos de funciones y si el JSON Schema puede consumirse directamente en sistemas posteriores.

La latencia y los errores se pueden gestionar

Observa tiempos de respuesta con carga representativa y prepara reintentos para límites, timeouts, salidas estructuradas inválidas y fallos de herramientas. Un modelo configurable en EvoLink facilita cambiar a una alternativa verificada si una ruta no está disponible.

El coste y la elección del modelo siguen controlados

Calcula el coste total de la misma clase de tarea con Pricing, usage y el cargo final. Decide después si Grok 4.5 debe ser ruta predeterminada, modelo para tareas difíciles o respaldo. La gateway unificada separa esa decisión del trabajo de integración.

Empieza con un conjunto pequeño, observable y reversible de tareas en Grok 4.5. Amplía solo cuando calidad, latencia y coste cumplan lo esperado. Mantener varios modelos tras la API unificada de EvoLink simplifica escalar, cambiar y optimizar costes.

ID del modelo API

grok-4.5

grok-4-5 es la URL de la página. Las solicitudes de Chat Completions y Responses deben usar el ID exacto que se muestra aquí.

Modelos relacionados

GPT-5.6

GPT-5.6

La familia frontier escalonada de OpenAI para comparar capacidad, latencia y flexibilidad del enrutamiento por coste.

Ver modelo
Claude Opus 5

Claude Opus 5

La ruta premium de Anthropic para agentes de larga duración, uso de herramientas y revisiones complejas.

Ver modelo
Kimi K3

Kimi K3

La ruta de razonamiento con contexto largo de Moonshot y una tarifa separada para entrada en caché.

Ver modelo
DeepSeek V4

DeepSeek V4

Una ruta open model de bajo coste para grandes cargas de programación, razonamiento y agentes.

Ver modelo

Guías relacionadas y actualización de Grok 4.5

Grok 4.6 vs Grok 4.5

Grok 4.6 vs Grok 4.5

Revisa hechos confirmados, condiciones de migración y pruebas comparables antes de mover cargas existentes de Grok 4.5.

Leer la guía
Estado del lanzamiento de Grok 4.6

Estado del lanzamiento de Grok 4.6

Sigue lanzamiento oficial, ID del modelo, disponibilidad API y precios; mientras no se confirmen, usa Grok 4.5 como base reproducible.

Leer la guía

Preguntas frecuentes de la API de Grok 4.5

¿Ya está disponible la API de Grok 4.5 mediante EvoLink?

Sí. Grok 4.5 está disponible en la ruta de producción de EvoLink. Envía solicitudes con el ID grok-4.5 mediante Chat Completions o Responses; el ID, los precios, el contexto y los flujos compatibles figuran en esta página.

¿grok-4-5 es el ID del modelo API?

No. grok-4-5 es la URL de la página y una forma de búsqueda. El ID real que se envía en solicitudes API es grok-4.5.

¿Cuál es la ventana de contexto y el límite de precio para contexto largo?

xAI documenta 500.000 tokens. Al alcanzar el umbral de tokens de prompt mostrado en Pricing, se aplica el tramo de contexto largo. Prueba tamaños representativos y entrada en caché en vez de usar siempre toda la ventana.

¿Qué entradas y salidas admite Grok 4.5?

La documentación de origen indica texto e imágenes como entrada y texto como salida. La imagen sirve para comprensión visual y no convierte a Grok 4.5 en generador de imágenes. Consulta el soporte actual en API.

¿Debo usar Chat Completions o la API Responses?

Chat Completions sirve para chat, streaming y funciones del cliente. Evalúa Responses para agentes largos y herramientas de servidor de xAI. Los campos exactos se mantienen en API y la documentación de EvoLink.

¿Cómo se debe elegir el reasoning effort?

Empieza con el nivel más bajo que cumpla la calidad requerida y compara medium y high en las mismas tareas. El trabajo complejo puede necesitar más razonamiento; el sencillo puede priorizar tiempo y coste.

¿Cómo afecta la entrada en caché al precio de Grok 4.5?

Puede reducir el coste del contexto repetido, pero los fallos de caché, salidas largas, reintentos y herramientas repetidas aumentan el total. Usa Pricing y el cargo final para calcular el coste por tarea correcta.

¿Qué diferencia hay entre herramientas del servidor y funciones del cliente?

Las funciones del cliente se ejecutan en tu aplicación. Las búsquedas web y en X, ejecución de código y búsquedas en adjuntos o colecciones son herramientas del servidor de xAI. Cambian la ejecución, los errores y la facturación; consulta API y Pricing.

¿Cómo comparar Grok 4.5 con GPT, Claude o Kimi?

Ejecuta las mismas tareas reales con contexto, herramientas y razonamiento iguales. Compara calidad, tiempo de respuesta, mezcla de tokens, rendimiento de herramientas y coste total para asignar cada tráfico a una ruta de EvoLink.

¿Qué modelo de respaldo conviene conservar?

Conserva un modelo que ya gestione la misma carga con fiabilidad y mantén la ruta configurable. Ante límites, timeouts o salidas inválidas, EvoLink puede cambiar a GPT, Claude, Kimi u otra alternativa adecuada.