Skip to main content
POST
Grok Responses (todos los modelos, parámetros completos)
BaseURL: La BaseURL predeterminada es https://direct.evolink.ai, que ofrece mejor compatibilidad con modelos de texto y admite conexiones persistentes. https://api.evolink.ai es el endpoint principal para servicios multimodales y actúa como dirección de respaldo para los modelos de texto.
Las herramientas del lado del servidor se ejecutan en la infraestructura de xAI y se facturan por llamada exitosa, además del consumo de tokens: búsqueda web / búsqueda en X / ejecución de código 0.005porllamada,buˊsquedadeadjuntos0.005 por llamada, búsqueda de adjuntos 0.01 por llamada, búsqueda de colecciones $0.0025 por llamada. Las tarifas de herramientas no se ven afectadas por el multiplicador de contexto largo.
image_generation no está disponible actualmente en Grok 4.5 ni en Grok 4.6: su declaración se acepta por compatibilidad, pero la herramienta se elimina antes de que la solicitud llegue al modelo. Los valores tools[].type no reconocidos se rechazan con 400.

Autorizaciones

Authorization
string
header
requerido

##Todas las APIs requieren autenticación Bearer Token##

Obtener API Key:

Visita la Página de gestión de API Key para obtener tu API Key

Agregar al encabezado de la solicitud:

Cuerpo

application/json
model
enum<string>
requerido

Modelo a invocar:

Opciones disponibles:
grok-4.6,
grok-4.5
Ejemplo:

"grok-4.6"

input
requerido

Entrada para el modelo: una cadena simple, o un arreglo de elementos de entrada de OpenAI Responses (p. ej. {"role":"user","content":[...]}).

Ejemplo:

"Search the web for the latest SpaceX launch and summarize it in one sentence."

stream
boolean
predeterminado:false

Indica si se devuelve una respuesta en streaming (eventos SSE que terminan con response.completed). Predeterminado false.

Ejemplo:

false

max_output_tokens
integer

Número máximo de tokens a generar (incluidos los tokens de razonamiento).

Ejemplo:

2048

reasoning
object

Control de la profundidad de razonamiento, forma de objeto: {"effort": "low" | "medium" | "high" | "xhigh"}. Por defecto high; el razonamiento no se puede desactivar. xhigh solo lo admite grok-4.6: grok-4.5 acepta el valor pero lo degrada a high. Los tokens de razonamiento se facturan como tokens de salida y se informan en usage.output_tokens_details.reasoning_tokens.

tools
object[]

Declaraciones de herramientas. Herramientas del lado del servidor de xAI (facturadas por llamada exitosa; las tarifas no se ven afectadas por el multiplicador de contexto largo):

También se admiten las herramientas function normales (llamadas a funciones del lado del cliente), que no generan coste por llamada.

image_generation no está disponible actualmente: su declaración se acepta por compatibilidad, pero la herramienta se elimina antes de que la solicitud llegue al modelo. Los tipos de herramienta no reconocidos se rechazan con 400.

Ejemplo:
tool_choice

Controla la selección de la herramienta: "auto" (predeterminado) / "none" / "required", o un objeto que fija una herramienta concreta, p. ej. {"type": "web_search"}.

Opciones disponibles:
auto,
none,
required

Respuesta

Respuesta generada con éxito (objeto JSON, o un flujo de eventos SSE que termina con response.completed cuando stream=true)

id
string

Identificador único de la respuesta

Ejemplo:

"55d44212-8d5e-90cc-975f-36d341ce21f5"

object
enum<string>

Tipo de respuesta

Opciones disponibles:
response
Ejemplo:

"response"

status
enum<string>

Estado de la respuesta

Opciones disponibles:
completed,
incomplete,
failed
Ejemplo:

"completed"

model
string

Nombre del modelo realmente utilizado

Ejemplo:

"grok-4.6"

created_at
integer

Marca de tiempo de creación

Ejemplo:

1786538000

output
object[]

Elementos de salida en orden de generación: elementos reasoning (resumen del razonamiento), elementos de llamada a herramientas del lado del servidor como web_search_call / code_interpreter_call (el estado completed indica una llamada exitosa y facturable) y, por último, un elemento message con contenido output_text.

usage
object

Estadísticas de uso de tokens y herramientas. Los prompts de 200K tokens o más se facturan al doble en todos los tipos de token; las tarifas de herramientas no se ven afectadas por el multiplicador.