Interfaz de todos los modelos Grok - Referencia completa de Responses
- Endpoint Responses compatible con OpenAI para los modelos de texto xAI Grok; selecciona el modelo con el parámetro
model(todos los valores están en la tabla del parámetromodel) grok-4.5: ventana de contexto de 500K tokens; a partir de 200K tokens en el prompt, todos los tipos de token se facturan al doble- El almacenamiento en caché del prompt es automático: los tokens de entrada servidos desde la caché se facturan a la tarifa de caché, más baja
- Modos sincrónico y streaming (SSE)
- Las herramientas del lado del servidor de xAI se ejecutan en la infraestructura de xAI y se facturan por llamada exitosa:
web_search,x_search,code_execution,attachment_search,collections_search - También se admiten las herramientas
functionnormales (llamadas a funciones del lado del cliente), que no generan coste por llamada
https://direct.evolink.ai, que ofrece mejor compatibilidad con modelos de texto y admite conexiones persistentes. https://api.evolink.ai es el endpoint principal para servicios multimodales y actúa como dirección de respaldo para los modelos de texto.Autorizaciones
##Todas las APIs requieren autenticación Bearer Token##
Obtener API Key:
Visita la Página de gestión de API Key para obtener tu API Key
Agregar al encabezado de la solicitud:
Cuerpo
Modelo a invocar:
grok-4.5 "grok-4.5"
Entrada para el modelo: una cadena simple, o un arreglo de elementos de entrada de OpenAI Responses (p. ej. {"role":"user","content":[...]}), que se transmite tal cual.
"Search the web for the latest SpaceX launch and summarize it in one sentence."
Indica si se devuelve una respuesta en streaming (eventos SSE que terminan con response.completed). Predeterminado false.
false
Número máximo de tokens a generar (incluidos los tokens de razonamiento).
2048
Declaraciones de herramientas. Herramientas del lado del servidor de xAI (facturadas por llamada exitosa; las tarifas no se ven afectadas por el multiplicador de contexto largo):
También se admiten las herramientas function normales (llamadas a funciones del lado del cliente), que no generan coste por llamada.
⚠️ image_generation no está disponible actualmente: su declaración se acepta por compatibilidad, pero la herramienta se elimina antes de que la solicitud llegue al modelo. Los tipos de herramienta no reconocidos se rechazan con 400.
Controla la selección de la herramienta: "auto" (predeterminado) / "none" / "required", o un objeto que fija una herramienta concreta, p. ej. {"type": "web_search"}.
auto, none, required Número máximo de llamadas a herramientas del lado del servidor para esta solicitud. Si se omite (o se establece en null), la plataforma aplica automáticamente un límite de hasta 10 llamadas según tu saldo disponible. Las herramientas de pago declaradas reservan por adelantado su presupuesto en el peor de los casos; la parte no utilizada se reembolsa en la liquidación.
5
Respuesta
Respuesta generada con éxito (objeto JSON, o un flujo de eventos SSE que termina con response.completed cuando stream=true)
Identificador único de la respuesta
"55d44212-8d5e-90cc-975f-36d341ce21f5"
Tipo de respuesta
response "response"
Estado de la respuesta
completed, incomplete, failed "completed"
Nombre del modelo realmente utilizado
"grok-4.5"
Marca de tiempo de creación
1786538000
Elementos de salida en orden de generación: elementos reasoning (resumen del razonamiento), elementos de llamada a herramientas del lado del servidor como web_search_call / code_interpreter_call (el estado completed indica una llamada exitosa y facturable) y, por último, un elemento message con contenido output_text.
Estadísticas de uso de tokens y herramientas. Los prompts de 200K tokens o más se facturan al doble en todos los tipos de token; las tarifas de herramientas no se ven afectadas por el multiplicador.