Skip to main content
POST
BaseURL: La BaseURL predeterminada es https://direct.evolink.ai, que ofrece mejor compatibilidad con modelos de texto y admite conexiones persistentes. https://api.evolink.ai es el endpoint principal para servicios multimodales y actúa como dirección de respaldo para los modelos de texto.
Las herramientas del servidor se facturan aparte de los tokens: búsqueda web / ejecución de código a 0.005 USD por llamada exitosa, búsqueda de adjuntos a 0.01 USD por llamada y búsqueda de colecciones a 0.0025 USD por llamada. X Search cuesta 0.005 USD por publicación obtenida y 0.01 USD por perfil obtenido. El multiplicador de contexto largo no se aplica a las herramientas.

Usar Grok 4.7

Establece model en grok-4.7. La ventana de contexto es de 500 000 tokens y el conocimiento llega hasta mayo de 2026. Configura el razonamiento con reasoning.effort: low, medium, high (predeterminado) o xhigh. El razonamiento no se puede desactivar. Según la especificación de razonamiento cifrado de xAI, 4.7 devuelve por defecto elementos reasoning con encrypted_content en output, sin include explícito. Si gestionas el historial, devuelve los elementos reasoning completos y sin cambios en el siguiente input, junto con las demás salidas anteriores. No decodifiques ni modifiques el contenido cifrado. Comprueba los campos presentes en la respuesta real. Las nuevas reglas de facturación de X Search se aplican a Grok 4.5, 4.6 y 4.7. Una búsqueda puede obtener varias publicaciones y perfiles; también cuentan las publicaciones superiores y citadas. Por ejemplo, 30 publicaciones y 3 perfiles cuestan 30 × 0.005 USD + 3 × 0.01 USD = 0.18 USD en herramientas, además de los tokens. Consulta usage.server_side_tool_usage_details.x_posts_fetched y x_users_fetched para conocer las cantidades obtenidas. Si faltan ambos campos, se factura por llamadas exitosas por compatibilidad. x_search_calls es el número de llamadas; max_tool_calls es un valor de control cuya aplicación real depende de la ruta. Ninguno limita la cantidad obtenida ni el gasto. x_users_fetched es un campo de uso y no requiere declarar otra herramienta.
image_generation no está disponible actualmente en Grok 4.5, 4.6 ni 4.7: se acepta la declaración por compatibilidad, pero la herramienta se elimina antes de que la solicitud llegue al modelo. Los valores desconocidos de tools[].type devuelven 400.

Autorizaciones

Authorization
string
header
requerido

##Todas las APIs requieren autenticación Bearer Token##

Obtener API Key:

Visita la Página de gestión de API Key para obtener tu API Key

Agregar al encabezado de la solicitud:

Cuerpo

application/json
model
enum<string>
requerido

Modelo a invocar:

Opciones disponibles:
grok-4.7,
grok-4.6,
grok-4.5
Ejemplo:

"grok-4.7"

input
requerido

Entrada para el modelo: una cadena simple, o un arreglo de elementos de entrada de OpenAI Responses (p. ej. {"role":"user","content":[...]}).

Ejemplo:

"Search the web for the latest SpaceX launch and summarize it in one sentence."

stream
boolean
predeterminado:false

Indica si la respuesta se transmite por SSE. Por defecto, false. Lee status y usage en la respuesta final: completed indica generación completada; los límites de salida y situaciones similares pueden producir incomplete. No esperes únicamente un evento response.completed.

Ejemplo:

false

max_output_tokens
integer

Número máximo de tokens a generar (incluidos los tokens de razonamiento).

Ejemplo:

2048

reasoning
object

El nivel de razonamiento se indica mediante un objeto: {"effort": "low" | "medium" | "high" | "xhigh"}. El valor predeterminado es high; el razonamiento no se puede desactivar. grok-4.7 y grok-4.6 admiten xhigh; grok-4.5 lo trata como high. Los tokens de razonamiento se facturan como tokens de salida y aparecen en usage.output_tokens_details.reasoning_tokens.

tools
object[]

Declaraciones de herramientas. Las tarifas de herramientas del servidor se suman a las de tokens y no se ven afectadas por el multiplicador de contexto largo:

La nueva facturación de X Search se aplica a grok-4.5, grok-4.6 y grok-4.7. Una llamada puede devolver varias publicaciones; también cuentan las publicaciones superiores y citadas de búsquedas o hilos. Consulta el uso real en usage.server_side_tool_usage_details. Si faltan ambos contadores de elementos obtenidos, se factura por llamada exitosa por compatibilidad.

También se admiten herramientas function normales (llamadas a funciones del cliente sin tarifa de llamada a herramientas del servidor).

image_generation no está disponible actualmente en Grok 4.5, 4.6 ni 4.7: se acepta la declaración por compatibilidad, pero la herramienta se elimina antes de que la solicitud llegue al modelo. Los valores desconocidos de tools[].type devuelven 400.

Ejemplo:
tool_choice

Controla la selección de la herramienta: "auto" (predeterminado) / "none" / "required", o un objeto que fija una herramienta concreta, p. ej. {"type": "web_search"}.

Opciones disponibles:
auto,
none,
required
prompt_cache_key
string

Clave opcional de enrutamiento de caché. Un valor estable para la misma conversación o para solicitudes con el mismo prefijo de prompt puede mejorar la probabilidad de acierto. No se garantiza el acierto ni cambian las reglas de facturación de caché. Consulta cached_tokens en usage para conocer los aciertos reales.

Ejemplo:

"grok-session-001"

include
string[]

Campos adicionales que se solicitan en la respuesta. Por ejemplo, grok-4.6 puede solicitar razonamiento cifrado con ["reasoning.encrypted_content"]. Según la especificación de xAI, grok-4.7 lo devuelve por defecto sin include explícito.

Ejemplo:
max_tool_calls
integer

Valor de control del número de llamadas a herramientas. La pasarela lo reenvía y lo usa para estimar la reserva de tarifas de herramientas; la aplicación estricta del límite depende del comportamiento real de la ruta. Este valor no limita las publicaciones ni los perfiles obtenidos de X y no es un tope de gasto.

Ejemplo:

1

Respuesta

Se ha devuelto una respuesta; comprueba también status: completed si la generación terminó, incomplete en casos como límites de salida y failed si falló. Con stream=true, la respuesta es un flujo SSE; lee status y usage en la respuesta final.

id
string

Identificador único de la respuesta

Ejemplo:

"55d44212-8d5e-90cc-975f-36d341ce21f5"

object
enum<string>

Tipo de respuesta

Opciones disponibles:
response
Ejemplo:

"response"

status
enum<string>

Estado de la respuesta

Opciones disponibles:
completed,
incomplete,
failed
Ejemplo:

"completed"

model
string

Nombre del modelo realmente utilizado

Ejemplo:

"grok-4.7"

created_at
integer

Marca de tiempo de creación

Ejemplo:

1786538000

output
object[]

Elementos en orden de generación: reasoning (puede incluir razonamiento cifrado), llamadas a herramientas del servidor, function_call y message con output_text. El uso de herramientas se indica en usage; una llamada x_search puede generar cargos por varias publicaciones y perfiles.

usage
object

Estadísticas de uso de tokens y herramientas. Los prompts de 200K tokens o más se facturan al doble en todos los tipos de token; las tarifas de herramientas no se ven afectadas por el multiplicador.