Skip to main content
POST
Completado de chat Grok (todos los modelos, parámetros completos)
BaseURL: La BaseURL predeterminada es https://direct.evolink.ai, que ofrece mejor compatibilidad con modelos de texto y admite conexiones persistentes. https://api.evolink.ai es el endpoint principal para servicios multimodales y actúa como dirección de respaldo para los modelos de texto.
Esta página describe las llamadas function normales. Para herramientas del servidor (búsqueda web, búsqueda en X, ejecución de código, búsqueda de adjuntos y de colecciones), se recomienda la Responses API, donde se explican su configuración y facturación.

Usar Grok 4.7

Establece model en grok-4.7 y conserva el formato de solicitud messages. La ventana de contexto es de 500 000 tokens y el conocimiento llega hasta mayo de 2026. Usa el parámetro de nivel superior reasoning_effort. Nivel de razonamiento: low / medium / high (predeterminado) / xhigh. El razonamiento no se puede desactivar. grok-4.7 y grok-4.6 admiten xhigh; grok-4.5 lo acepta pero lo trata como high. Los tokens de razonamiento se facturan como tokens de salida. prompt_cache_key ofrece una indicación estable de enrutamiento de caché para solicitudes con el mismo prefijo de prompt; no garantiza aciertos. Consulta usage.prompt_tokens_details.cached_tokens para ver los aciertos reales. Para conservar el razonamiento cifrado entre turnos, usa la Responses API.

Autorizaciones

Authorization
string
header
requerido

##Todas las APIs requieren autenticación Bearer Token##

Obtener API Key:

Visita la Página de gestión de API Key para obtener tu API Key

Agregar al encabezado de la solicitud:

Cuerpo

application/json
model
enum<string>
requerido

Modelo a invocar:

Opciones disponibles:
grok-4.7,
grok-4.6,
grok-4.5
Ejemplo:

"grok-4.7"

messages
object[]
requerido

Lista de mensajes de chat. Admite los roles system, user y assistant.

Minimum array length: 1
Ejemplo:
stream
boolean
predeterminado:false

Indica si se devuelve una respuesta en streaming (SSE, eventos chat.completion.chunk). Predeterminado false.

Ejemplo:

false

max_tokens
integer

Número máximo de tokens a generar.

Ejemplo:

1024

reasoning_effort
enum<string>
predeterminado:high

Nivel de razonamiento: low / medium / high (predeterminado) / xhigh. El razonamiento no se puede desactivar. grok-4.7 y grok-4.6 admiten xhigh; grok-4.5 lo acepta pero lo trata como high. Los tokens de razonamiento se facturan como tokens de salida.

Opciones disponibles:
low,
medium,
high,
xhigh
temperature
number

Temperatura de muestreo (0-2). Los valores más altos producen una salida más aleatoria.

Ejemplo:

0.7

top_p
number

Parámetro de muestreo nucleus (0-1).

Ejemplo:

0.95

tools
object[]

Esta página describe las herramientas OpenAI normales de tipo function (llamadas a funciones del cliente sin tarifa de llamada a herramientas del servidor). Consulta la Responses API para configurar herramientas del servidor, como búsqueda web y búsqueda en X, y revisar su uso.

tool_choice

Controla la selección de la función: "auto" / "none" / "required", o un objeto que fija una función concreta.

Opciones disponibles:
auto,
none,
required
prompt_cache_key
string

Clave opcional de enrutamiento de caché. Un valor estable para la misma conversación o para solicitudes con el mismo prefijo de prompt puede mejorar la probabilidad de acierto. No se garantiza el acierto ni cambian las reglas de facturación de caché. Consulta cached_tokens en usage para conocer los aciertos reales.

Ejemplo:

"grok-session-001"

Respuesta

Completado de chat generado exitosamente (objeto JSON, o un flujo SSE de eventos chat.completion.chunk cuando stream=true)

id
string

Identificador único para la completación de chat

Ejemplo:

"chatcmpl-20260812164515123456789AbCdEfGh"

model
string

Nombre del modelo realmente utilizado

Ejemplo:

"grok-4.7"

object
enum<string>

Tipo de respuesta

Opciones disponibles:
chat.completion
Ejemplo:

"chat.completion"

created
integer

Marca de tiempo de creación

Ejemplo:

1786538000

choices
object[]

Lista de opciones de completado de chat

usage
object

Estadísticas de uso de tokens. Los prompts de 200K tokens o más se facturan al doble en todos los tipos de token (entrada, entrada en caché, salida).