curl --request POST \
--url https://direct.evolink.ai/v1/responses \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "grok-4.7",
"input": "Explica el almacenamiento en caché de prompts en una frase.",
"reasoning": {
"effort": "xhigh"
},
"max_output_tokens": 2048,
"prompt_cache_key": "grok-session-001"
}
'{
"id": "55d44212-8d5e-90cc-975f-36d341ce21f5",
"object": "response",
"status": "completed",
"model": "grok-4.7",
"created_at": 1786538000,
"output": [
{
"id": "<string>",
"type": "web_search_call",
"status": "completed",
"content": [
{}
],
"encrypted_content": "<string>"
}
],
"usage": {
"input_tokens": 10329,
"output_tokens": 299,
"total_tokens": 10628,
"input_tokens_details": {
"cached_tokens": 6016
},
"output_tokens_details": {
"reasoning_tokens": 128
},
"num_server_side_tools_used": 2,
"server_side_tool_usage_details": {
"web_search_calls": 2,
"x_search_calls": 0,
"code_interpreter_calls": 0,
"document_search_calls": 0,
"file_search_calls": 0,
"mcp_calls": 0,
"x_posts_fetched": 0,
"x_users_fetched": 0
}
}
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient quota",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/billing"
}
}{
"error": {
"code": 429,
"message": "Rate limit exceeded",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Internal server error",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 503,
"message": "Service temporarily unavailable",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}Interfaz de todos los modelos Grok - Referencia completa de Responses
- Endpoint Responses compatible con OpenAI para los modelos de texto xAI Grok; selecciona el modelo con el parámetro
model(todos los valores están en la tabla del parámetromodel) - Ventana de contexto de 500K tokens; a partir de 200K tokens en el prompt, todos los tipos de token se facturan al doble
- El almacenamiento en caché del prompt es automático: los tokens de entrada servidos desde la caché se facturan a la tarifa de caché, más baja
- Modos sincrónico y streaming (SSE)
- Las herramientas del servidor se ejecutan en la infraestructura de xAI:
web_search,x_search,code_execution,attachment_searchycollections_search. X Search se factura por publicaciones y perfiles obtenidos; las demás herramientas, por llamada exitosa. - También se admiten las herramientas
functionnormales (llamadas a funciones del lado del cliente), que no generan coste por llamada - Según la especificación oficial de xAI,
grok-4.7devuelve por defecto elementosreasoningconencrypted_content; los campos realmente devueltos dependen de la ruta utilizada.
curl --request POST \
--url https://direct.evolink.ai/v1/responses \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "grok-4.7",
"input": "Explica el almacenamiento en caché de prompts en una frase.",
"reasoning": {
"effort": "xhigh"
},
"max_output_tokens": 2048,
"prompt_cache_key": "grok-session-001"
}
'{
"id": "55d44212-8d5e-90cc-975f-36d341ce21f5",
"object": "response",
"status": "completed",
"model": "grok-4.7",
"created_at": 1786538000,
"output": [
{
"id": "<string>",
"type": "web_search_call",
"status": "completed",
"content": [
{}
],
"encrypted_content": "<string>"
}
],
"usage": {
"input_tokens": 10329,
"output_tokens": 299,
"total_tokens": 10628,
"input_tokens_details": {
"cached_tokens": 6016
},
"output_tokens_details": {
"reasoning_tokens": 128
},
"num_server_side_tools_used": 2,
"server_side_tool_usage_details": {
"web_search_calls": 2,
"x_search_calls": 0,
"code_interpreter_calls": 0,
"document_search_calls": 0,
"file_search_calls": 0,
"mcp_calls": 0,
"x_posts_fetched": 0,
"x_users_fetched": 0
}
}
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient quota",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/billing"
}
}{
"error": {
"code": 429,
"message": "Rate limit exceeded",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Internal server error",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 503,
"message": "Service temporarily unavailable",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}https://direct.evolink.ai, que ofrece mejor compatibilidad con modelos de texto y admite conexiones persistentes. https://api.evolink.ai es el endpoint principal para servicios multimodales y actúa como dirección de respaldo para los modelos de texto.Usar Grok 4.7
Establecemodel en grok-4.7. La ventana de contexto es de 500 000 tokens y el conocimiento llega hasta mayo de 2026. Configura el razonamiento con reasoning.effort: low, medium, high (predeterminado) o xhigh. El razonamiento no se puede desactivar.
Según la especificación de razonamiento cifrado de xAI, 4.7 devuelve por defecto elementos reasoning con encrypted_content en output, sin include explícito. Si gestionas el historial, devuelve los elementos reasoning completos y sin cambios en el siguiente input, junto con las demás salidas anteriores. No decodifiques ni modifiques el contenido cifrado. Comprueba los campos presentes en la respuesta real.
Facturación de X Search
Las nuevas reglas de facturación de X Search se aplican a Grok 4.5, 4.6 y 4.7. Una búsqueda puede obtener varias publicaciones y perfiles; también cuentan las publicaciones superiores y citadas. Por ejemplo, 30 publicaciones y 3 perfiles cuestan30 × 0.005 USD + 3 × 0.01 USD = 0.18 USD en herramientas, además de los tokens.
Consulta usage.server_side_tool_usage_details.x_posts_fetched y x_users_fetched para conocer las cantidades obtenidas. Si faltan ambos campos, se factura por llamadas exitosas por compatibilidad. x_search_calls es el número de llamadas; max_tool_calls es un valor de control cuya aplicación real depende de la ruta. Ninguno limita la cantidad obtenida ni el gasto. x_users_fetched es un campo de uso y no requiere declarar otra herramienta.
image_generation no está disponible actualmente en Grok 4.5, 4.6 ni 4.7: se acepta la declaración por compatibilidad, pero la herramienta se elimina antes de que la solicitud llegue al modelo. Los valores desconocidos de tools[].type devuelven 400.Autorizaciones
##Todas las APIs requieren autenticación Bearer Token##
Obtener API Key:
Visita la Página de gestión de API Key para obtener tu API Key
Agregar al encabezado de la solicitud:
Authorization: Bearer YOUR_API_KEY
Cuerpo
Modelo a invocar:
| ID del modelo | Posicionamiento |
|---|---|
grok-4.7 | Modelo xAI de razonamiento y uso de herramientas; contexto de 500K tokens; admite xhigh; conocimiento hasta 2026-05 |
grok-4.6 | Modelo xAI de razonamiento y uso de herramientas, ventana de contexto de 500K; añade el nivel de razonamiento xhigh; corte de conocimiento 2026-02-01 |
grok-4.5 | Modelo xAI de razonamiento y uso de herramientas, ventana de contexto de 500K; niveles de razonamiento hasta high (xhigh se acepta pero se degrada a high) |
grok-4.7, grok-4.6, grok-4.5 "grok-4.7"
Entrada para el modelo: una cadena simple, o un arreglo de elementos de entrada de OpenAI Responses (p. ej. {"role":"user","content":[...]}).
"Search the web for the latest SpaceX launch and summarize it in one sentence."
Indica si la respuesta se transmite por SSE. Por defecto, false. Lee status y usage en la respuesta final: completed indica generación completada; los límites de salida y situaciones similares pueden producir incomplete. No esperes únicamente un evento response.completed.
false
Número máximo de tokens a generar (incluidos los tokens de razonamiento).
2048
El nivel de razonamiento se indica mediante un objeto: {"effort": "low" | "medium" | "high" | "xhigh"}. El valor predeterminado es high; el razonamiento no se puede desactivar. grok-4.7 y grok-4.6 admiten xhigh; grok-4.5 lo trata como high. Los tokens de razonamiento se facturan como tokens de salida y aparecen en usage.output_tokens_details.reasoning_tokens.
Show child attributes
Show child attributes
Declaraciones de herramientas. Las tarifas de herramientas del servidor se suman a las de tokens y no se ven afectadas por el multiplicador de contexto largo:
| Tipo de herramienta | Función | Unidad de facturación y precio |
|---|---|---|
web_search | Buscar y consultar páginas web | 0.005 USD por llamada exitosa |
x_search | Buscar publicaciones, cuentas y temas en X | 0.005 USD por publicación obtenida + 0.01 USD por perfil obtenido |
code_execution | Ejecutar Python en un entorno aislado (alias: code_interpreter) | 0.005 USD por llamada exitosa |
attachment_search | Buscar en archivos adjuntos de la conversación (puede activarse automáticamente con entradas de archivos) | 0.01 USD por llamada exitosa |
collections_search | Buscar en colecciones de documentos cargados (alias: file_search) | 0.0025 USD por llamada exitosa |
La nueva facturación de X Search se aplica a grok-4.5, grok-4.6 y grok-4.7. Una llamada puede devolver varias publicaciones; también cuentan las publicaciones superiores y citadas de búsquedas o hilos. Consulta el uso real en usage.server_side_tool_usage_details. Si faltan ambos contadores de elementos obtenidos, se factura por llamada exitosa por compatibilidad.
También se admiten herramientas function normales (llamadas a funciones del cliente sin tarifa de llamada a herramientas del servidor).
image_generation no está disponible actualmente en Grok 4.5, 4.6 ni 4.7: se acepta la declaración por compatibilidad, pero la herramienta se elimina antes de que la solicitud llegue al modelo. Los valores desconocidos de tools[].type devuelven 400.
Show child attributes
Show child attributes
[{ "type": "web_search" }]
Controla la selección de la herramienta: "auto" (predeterminado) / "none" / "required", o un objeto que fija una herramienta concreta, p. ej. {"type": "web_search"}.
auto, none, required Clave opcional de enrutamiento de caché. Un valor estable para la misma conversación o para solicitudes con el mismo prefijo de prompt puede mejorar la probabilidad de acierto. No se garantiza el acierto ni cambian las reglas de facturación de caché. Consulta cached_tokens en usage para conocer los aciertos reales.
"grok-session-001"
Campos adicionales que se solicitan en la respuesta. Por ejemplo, grok-4.6 puede solicitar razonamiento cifrado con ["reasoning.encrypted_content"]. Según la especificación de xAI, grok-4.7 lo devuelve por defecto sin include explícito.
["reasoning.encrypted_content"]
Valor de control del número de llamadas a herramientas. La pasarela lo reenvía y lo usa para estimar la reserva de tarifas de herramientas; la aplicación estricta del límite depende del comportamiento real de la ruta. Este valor no limita las publicaciones ni los perfiles obtenidos de X y no es un tope de gasto.
1
Respuesta
Se ha devuelto una respuesta; comprueba también status: completed si la generación terminó, incomplete en casos como límites de salida y failed si falló. Con stream=true, la respuesta es un flujo SSE; lee status y usage en la respuesta final.
Identificador único de la respuesta
"55d44212-8d5e-90cc-975f-36d341ce21f5"
Tipo de respuesta
response "response"
Estado de la respuesta
completed, incomplete, failed "completed"
Nombre del modelo realmente utilizado
"grok-4.7"
Marca de tiempo de creación
1786538000
Elementos en orden de generación: reasoning (puede incluir razonamiento cifrado), llamadas a herramientas del servidor, function_call y message con output_text. El uso de herramientas se indica en usage; una llamada x_search puede generar cargos por varias publicaciones y perfiles.
Show child attributes
Show child attributes
Estadísticas de uso de tokens y herramientas. Los prompts de 200K tokens o más se facturan al doble en todos los tipos de token; las tarifas de herramientas no se ven afectadas por el multiplicador.
Show child attributes
Show child attributes