Skip to main content
POST
Grok Responses (todos los modelos, parámetros completos)
BaseURL: La BaseURL predeterminada es https://direct.evolink.ai, que ofrece mejor compatibilidad con modelos de texto y admite conexiones persistentes. https://api.evolink.ai es el endpoint principal para servicios multimodales y actúa como dirección de respaldo para los modelos de texto.
Las herramientas del lado del servidor se ejecutan en la infraestructura de xAI y se facturan por llamada exitosa, además del consumo de tokens: búsqueda web / búsqueda en X / ejecución de código 0.005porllamada,buˊsquedadeadjuntos0.005 por llamada, búsqueda de adjuntos 0.01 por llamada, búsqueda de colecciones $0.0025 por llamada. Las tarifas de herramientas no se ven afectadas por el multiplicador de contexto largo.
image_generation no está disponible actualmente en Grok 4.5: su declaración se acepta por compatibilidad, pero la herramienta se elimina antes de que la solicitud llegue al modelo. Los valores tools[].type no reconocidos se rechazan con 400.

Autorizaciones

Authorization
string
header
requerido

##Todas las APIs requieren autenticación Bearer Token##

Obtener API Key:

Visita la Página de gestión de API Key para obtener tu API Key

Agregar al encabezado de la solicitud:

Cuerpo

application/json
model
enum<string>
requerido

Modelo a invocar:

Opciones disponibles:
grok-4.5
Ejemplo:

"grok-4.5"

input
requerido

Entrada para el modelo: una cadena simple, o un arreglo de elementos de entrada de OpenAI Responses (p. ej. {"role":"user","content":[...]}), que se transmite tal cual.

Ejemplo:

"Search the web for the latest SpaceX launch and summarize it in one sentence."

stream
boolean
predeterminado:false

Indica si se devuelve una respuesta en streaming (eventos SSE que terminan con response.completed). Predeterminado false.

Ejemplo:

false

max_output_tokens
integer

Número máximo de tokens a generar (incluidos los tokens de razonamiento).

Ejemplo:

2048

tools
object[]

Declaraciones de herramientas. Herramientas del lado del servidor de xAI (facturadas por llamada exitosa; las tarifas no se ven afectadas por el multiplicador de contexto largo):

También se admiten las herramientas function normales (llamadas a funciones del lado del cliente), que no generan coste por llamada.

⚠️ image_generation no está disponible actualmente: su declaración se acepta por compatibilidad, pero la herramienta se elimina antes de que la solicitud llegue al modelo. Los tipos de herramienta no reconocidos se rechazan con 400.

Ejemplo:
tool_choice

Controla la selección de la herramienta: "auto" (predeterminado) / "none" / "required", o un objeto que fija una herramienta concreta, p. ej. {"type": "web_search"}.

Opciones disponibles:
auto,
none,
required
max_tool_calls
integer

Número máximo de llamadas a herramientas del lado del servidor para esta solicitud. Si se omite (o se establece en null), la plataforma aplica automáticamente un límite de hasta 10 llamadas según tu saldo disponible. Las herramientas de pago declaradas reservan por adelantado su presupuesto en el peor de los casos; la parte no utilizada se reembolsa en la liquidación.

Ejemplo:

5

Respuesta

Respuesta generada con éxito (objeto JSON, o un flujo de eventos SSE que termina con response.completed cuando stream=true)

id
string

Identificador único de la respuesta

Ejemplo:

"55d44212-8d5e-90cc-975f-36d341ce21f5"

object
enum<string>

Tipo de respuesta

Opciones disponibles:
response
Ejemplo:

"response"

status
enum<string>

Estado de la respuesta

Opciones disponibles:
completed,
incomplete,
failed
Ejemplo:

"completed"

model
string

Nombre del modelo realmente utilizado

Ejemplo:

"grok-4.5"

created_at
integer

Marca de tiempo de creación

Ejemplo:

1786538000

output
object[]

Elementos de salida en orden de generación: elementos reasoning (resumen del razonamiento), elementos de llamada a herramientas del lado del servidor como web_search_call / code_interpreter_call (el estado completed indica una llamada exitosa y facturable) y, por último, un elemento message con contenido output_text.

usage
object

Estadísticas de uso de tokens y herramientas. Los prompts de 200K tokens o más se facturan al doble en todos los tipos de token; las tarifas de herramientas no se ven afectadas por el multiplicador.