Interfaz de todos los modelos Grok - Referencia completa de Chat Completions
- Endpoint Chat Completions compatible con OpenAI para los modelos de texto xAI Grok; selecciona el modelo con el parámetro
model(todos los valores están en la tabla del parámetromodel) grok-4.5: ventana de contexto de 500K tokens; a partir de 200K tokens en el prompt, todos los tipos de token se facturan al doble- El almacenamiento en caché del prompt es automático: los tokens de entrada servidos desde la caché se facturan a la tarifa de caché, más baja
- Modos sincrónico y streaming (SSE)
- Se admiten las llamadas a herramientas
functionnormales; las herramientas del lado del servidor de xAI solo están disponibles en la Responses API
https://direct.evolink.ai, que ofrece mejor compatibilidad con modelos de texto y admite conexiones persistentes. https://api.evolink.ai es el endpoint principal para servicios multimodales y actúa como dirección de respaldo para los modelos de texto.function normales.Autorizaciones
##Todas las APIs requieren autenticación Bearer Token##
Obtener API Key:
Visita la Página de gestión de API Key para obtener tu API Key
Agregar al encabezado de la solicitud:
Cuerpo
Modelo a invocar:
grok-4.5 "grok-4.5"
Lista de mensajes de chat. Admite los roles system, user y assistant.
1Indica si se devuelve una respuesta en streaming (SSE, eventos chat.completion.chunk). Predeterminado false.
false
Número máximo de tokens a generar. Se transmite al modelo tal cual.
1024
Temperatura de muestreo (0-2). Los valores más altos producen una salida más aleatoria.
0.7
Parámetro de muestreo nucleus (0-1).
0.95
Definiciones de herramientas function normales de OpenAI (llamadas a funciones del lado del cliente, sin coste adicional por llamada). Las herramientas del lado del servidor de xAI solo están disponibles en la Responses API.
Controla la selección de la función: "auto" / "none" / "required", o un objeto que fija una función concreta.
auto, none, required Respuesta
Completado de chat generado exitosamente (objeto JSON, o un flujo SSE de eventos chat.completion.chunk cuando stream=true)
Identificador único para la completación de chat
"chatcmpl-20260812164515123456789AbCdEfGh"
Nombre del modelo realmente utilizado
"grok-4.5"
Tipo de respuesta
chat.completion "chat.completion"
Marca de tiempo de creación
1786538000
Lista de opciones de completado de chat
Estadísticas de uso de tokens. Los prompts de 200K tokens o más se facturan al doble en todos los tipos de token (entrada, entrada en caché, salida).