curl --request POST \
--url https://direct.evolink.ai/v1/responses \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "grok-4.7",
"input": "Explique la mise en cache des prompts en une phrase.",
"reasoning": {
"effort": "xhigh"
},
"max_output_tokens": 2048,
"prompt_cache_key": "grok-session-001"
}
'{
"id": "55d44212-8d5e-90cc-975f-36d341ce21f5",
"object": "response",
"status": "completed",
"model": "grok-4.7",
"created_at": 1786538000,
"output": [
{
"id": "<string>",
"type": "web_search_call",
"status": "completed",
"content": [
{}
],
"encrypted_content": "<string>"
}
],
"usage": {
"input_tokens": 10329,
"output_tokens": 299,
"total_tokens": 10628,
"input_tokens_details": {
"cached_tokens": 6016
},
"output_tokens_details": {
"reasoning_tokens": 128
},
"num_server_side_tools_used": 2,
"server_side_tool_usage_details": {
"web_search_calls": 2,
"x_search_calls": 0,
"code_interpreter_calls": 0,
"document_search_calls": 0,
"file_search_calls": 0,
"mcp_calls": 0,
"x_posts_fetched": 0,
"x_users_fetched": 0
}
}
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient quota",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/billing"
}
}{
"error": {
"code": 429,
"message": "Rate limit exceeded",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Internal server error",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 503,
"message": "Service temporarily unavailable",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}API tous modèles Grok - Référence complète Responses
- Point de terminaison Responses compatible OpenAI pour les modèles de texte xAI Grok ; sélection du modèle via le paramètre
model(toutes les valeurs figurent dans le tableau du paramètremodel) - Fenêtre de contexte de 500K tokens ; à partir de 200K tokens dans le prompt, tous les types de tokens sont facturés au double du tarif
- La mise en cache du prompt est automatique : les tokens servis depuis le cache sont facturés au tarif d’entrée en cache, moins élevé
- Modes synchrone et streaming (SSE)
- Les outils côté serveur s’exécutent sur l’infrastructure xAI :
web_search,x_search,code_execution,attachment_searchetcollections_search. X Search est facturé selon les publications et profils récupérés ; les autres outils sont facturés par appel réussi. - Les outils
functionclassiques (appels de fonctions côté client) sont également pris en charge et n’entraînent aucun frais par appel - Selon la spécification officielle de xAI,
grok-4.7renvoie par défaut des élémentsreasoningcontenantencrypted_content; les champs effectivement présents dépendent de la route utilisée.
curl --request POST \
--url https://direct.evolink.ai/v1/responses \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "grok-4.7",
"input": "Explique la mise en cache des prompts en une phrase.",
"reasoning": {
"effort": "xhigh"
},
"max_output_tokens": 2048,
"prompt_cache_key": "grok-session-001"
}
'{
"id": "55d44212-8d5e-90cc-975f-36d341ce21f5",
"object": "response",
"status": "completed",
"model": "grok-4.7",
"created_at": 1786538000,
"output": [
{
"id": "<string>",
"type": "web_search_call",
"status": "completed",
"content": [
{}
],
"encrypted_content": "<string>"
}
],
"usage": {
"input_tokens": 10329,
"output_tokens": 299,
"total_tokens": 10628,
"input_tokens_details": {
"cached_tokens": 6016
},
"output_tokens_details": {
"reasoning_tokens": 128
},
"num_server_side_tools_used": 2,
"server_side_tool_usage_details": {
"web_search_calls": 2,
"x_search_calls": 0,
"code_interpreter_calls": 0,
"document_search_calls": 0,
"file_search_calls": 0,
"mcp_calls": 0,
"x_posts_fetched": 0,
"x_users_fetched": 0
}
}
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient quota",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/billing"
}
}{
"error": {
"code": 429,
"message": "Rate limit exceeded",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Internal server error",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 503,
"message": "Service temporarily unavailable",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}https://direct.evolink.ai, qui offre une meilleure prise en charge des modèles de texte et des connexions persistantes. https://api.evolink.ai est le point d’accès principal pour les services multimodaux et sert d’adresse de secours pour les modèles de texte.Utiliser Grok 4.7
Définissezmodel sur grok-4.7. La fenêtre de contexte est de 500 000 tokens et les connaissances sont arrêtées à mai 2026. Réglez le raisonnement avec reasoning.effort : low, medium, high (par défaut) ou xhigh. Le raisonnement ne peut pas être désactivé.
Selon la spécification de xAI sur le raisonnement chiffré, 4.7 renvoie par défaut des éléments reasoning avec encrypted_content dans output, sans include explicite. Si vous gérez l’historique vous-même, renvoyez les éléments reasoning complets et inchangés dans le prochain input, avec les autres sorties de l’historique. Ne décodez pas et ne modifiez pas le contenu chiffré. Fiez-vous aux champs présents dans la réponse réelle.
Facturation de X Search
Les nouvelles règles de facturation X Search s’appliquent à Grok 4.5, 4.6 et 4.7. Une recherche peut récupérer plusieurs publications et profils ; les publications parentes et citées comptent aussi. Par exemple, 30 publications et 3 profils coûtent30 × 0.005 USD + 3 × 0.01 USD = 0.18 USD en frais d’outils, auxquels s’ajoutent les tokens.
Consultez usage.server_side_tool_usage_details.x_posts_fetched et x_users_fetched pour les quantités récupérées. Sans ces deux champs, la facturation repose sur les appels réussis pour compatibilité. x_search_calls est le nombre d’appels ; max_tool_calls est une valeur de contrôle dont l’application effective dépend de la route. Aucun des deux ne plafonne les quantités récupérées ni les dépenses. x_users_fetched est un champ d’utilisation et ne nécessite pas de déclaration d’outil supplémentaire.
image_generation est actuellement indisponible sur Grok 4.5, 4.6 et 4.7 : la déclaration est acceptée pour compatibilité, mais l’outil est retiré avant que la requête n’atteigne le modèle. Les valeurs de tools[].type non reconnues renvoient 400.Autorisations
##Toutes les API nécessitent une authentification Bearer Token##
Obtenir une clé API :
Visitez la Page de gestion des clés API pour obtenir votre clé API
Ajouter à l'en-tête de requête :
Authorization: Bearer YOUR_API_KEY
Corps
Modèle à appeler :
| ID du modèle | Positionnement |
|---|---|
grok-4.7 | Modèle xAI de raisonnement et d'appel d'outils ; contexte de 500K tokens ; prend en charge xhigh ; connaissances arrêtées à 2026-05 |
grok-4.6 | Modèle xAI de raisonnement et d'appel d'outils, fenêtre de contexte de 500K ; ajoute le niveau de raisonnement xhigh ; connaissances arrêtées au 2026-02-01 |
grok-4.5 | Modèle xAI de raisonnement et d'appel d'outils, fenêtre de contexte de 500K ; niveaux de raisonnement jusqu'à high (xhigh est accepté mais rétrogradé en high) |
grok-4.7, grok-4.6, grok-4.5 "grok-4.7"
Entrée pour le modèle : une chaîne simple, ou un tableau d'éléments d'entrée OpenAI Responses (par ex. {"role":"user","content":[...]}).
"Search the web for the latest SpaceX launch and summarize it in one sentence."
Active le streaming SSE. Valeur par défaut : false. Lisez status et usage dans la réponse terminale : completed indique une génération achevée ; une limite de sortie, entre autres, peut entraîner incomplete. N'attendez pas exclusivement un événement response.completed.
false
Nombre maximal de tokens à générer (tokens de raisonnement inclus).
2048
Le niveau de raisonnement se définit par un objet : {"effort": "low" | "medium" | "high" | "xhigh"}. La valeur par défaut est high ; le raisonnement ne peut pas être désactivé. grok-4.7 et grok-4.6 prennent en charge xhigh ; grok-4.5 le traite comme high. Les tokens de raisonnement sont facturés comme des tokens de sortie et indiqués dans usage.output_tokens_details.reasoning_tokens.
Show child attributes
Show child attributes
Déclarations d'outils. Les frais des outils côté serveur s'ajoutent aux frais de tokens et ne sont pas affectés par le multiplicateur de contexte long :
| Type d'outil | Fonction | Unité de facturation et tarif |
|---|---|---|
web_search | Rechercher sur le web et consulter des pages | 0.005 USD par appel réussi |
x_search | Rechercher des publications, comptes et sujets sur X | 0.005 USD par publication récupérée + 0.01 USD par profil récupéré |
code_execution | Exécuter Python dans un bac à sable (alias : code_interpreter) | 0.005 USD par appel réussi |
attachment_search | Rechercher dans les pièces jointes (activation automatique possible avec une entrée fichier) | 0.01 USD par appel réussi |
collections_search | Rechercher dans des collections de documents importés (alias : file_search) | 0.0025 USD par appel réussi |
La nouvelle facturation X Search s'applique à grok-4.5, grok-4.6 et grok-4.7. Un appel peut renvoyer plusieurs publications ; les publications parentes et citées issues des recherches ou fils de discussion sont également comptées. Consultez usage.server_side_tool_usage_details pour l'utilisation réelle. En l'absence des deux compteurs de récupération, la facturation par appel réussi est conservée pour compatibilité.
Les outils function classiques sont également pris en charge (appels de fonctions côté client, sans frais d'appel d'outil côté serveur).
image_generation est actuellement indisponible sur Grok 4.5, 4.6 et 4.7 : la déclaration est acceptée pour compatibilité, mais l'outil est retiré avant que la requête n'atteigne le modèle. Les valeurs de tools[].type non reconnues renvoient 400.
Show child attributes
Show child attributes
[{ "type": "web_search" }]
Contrôle la sélection de l'outil : "auto" (par défaut) / "none" / "required", ou un objet imposant un outil précis, par ex. {"type": "web_search"}.
auto, none, required Clé facultative de routage du cache. Une valeur stable pour une même conversation ou des requêtes partageant le même préfixe de prompt peut améliorer les chances de réutilisation du cache. Aucun résultat n'est garanti et les règles de facturation du cache restent inchangées. Consultez cached_tokens dans usage pour connaître les résultats réels.
"grok-session-001"
Champs supplémentaires à inclure dans la réponse. Par exemple, grok-4.6 peut demander le raisonnement chiffré avec ["reasoning.encrypted_content"]. Selon la spécification de xAI, grok-4.7 le renvoie par défaut, sans include explicite.
["reasoning.encrypted_content"]
Valeur de contrôle du nombre d'appels d'outils. La passerelle la transmet et l'utilise pour estimer les frais d'outils à réserver ; le respect strict de ce nombre dépend du comportement réel de la route utilisée. Cette valeur ne limite ni les publications X ni les profils récupérés et ne constitue pas un plafond de dépenses.
1
Réponse
Une réponse a été renvoyée ; vérifiez aussi status : completed si la génération est achevée, incomplete notamment en cas de limite de sortie, et failed en cas d'échec. Avec stream=true, la réponse est un flux SSE ; lisez status et usage dans la réponse terminale.
Identifiant unique de la réponse
"55d44212-8d5e-90cc-975f-36d341ce21f5"
Type de réponse
response "response"
Statut de la réponse
completed, incomplete, failed "completed"
Nom du modèle réellement utilisé
"grok-4.7"
Horodatage de création
1786538000
Éléments dans l'ordre de génération : reasoning (pouvant contenir du raisonnement chiffré), appels d'outils côté serveur, function_call et message contenant output_text. L'utilisation des outils est indiquée dans usage ; un appel x_search peut entraîner des frais pour plusieurs publications et profils.
Show child attributes
Show child attributes
Statistiques d'utilisation des tokens et des outils. À partir de 200K tokens dans le prompt, tous les types de tokens sont facturés au double ; les frais d'outils ne sont pas affectés par ce multiplicateur.
Show child attributes
Show child attributes