Skip to main content
POST
BaseURL : La BaseURL par défaut est https://direct.evolink.ai, qui offre une meilleure prise en charge des modèles de texte et des connexions persistantes. https://api.evolink.ai est le point d’accès principal pour les services multimodaux et sert d’adresse de secours pour les modèles de texte.
Les outils côté serveur sont facturés en plus des tokens : recherche web / exécution de code à 0.005 USD par appel réussi, recherche de pièces jointes à 0.01 USD par appel et recherche de collections à 0.0025 USD par appel. X Search coûte 0.005 USD par publication récupérée et 0.01 USD par profil récupéré. Le multiplicateur de contexte long ne s’applique pas aux outils.

Utiliser Grok 4.7

Définissez model sur grok-4.7. La fenêtre de contexte est de 500 000 tokens et les connaissances sont arrêtées à mai 2026. Réglez le raisonnement avec reasoning.effort : low, medium, high (par défaut) ou xhigh. Le raisonnement ne peut pas être désactivé. Selon la spécification de xAI sur le raisonnement chiffré, 4.7 renvoie par défaut des éléments reasoning avec encrypted_content dans output, sans include explicite. Si vous gérez l’historique vous-même, renvoyez les éléments reasoning complets et inchangés dans le prochain input, avec les autres sorties de l’historique. Ne décodez pas et ne modifiez pas le contenu chiffré. Fiez-vous aux champs présents dans la réponse réelle. Les nouvelles règles de facturation X Search s’appliquent à Grok 4.5, 4.6 et 4.7. Une recherche peut récupérer plusieurs publications et profils ; les publications parentes et citées comptent aussi. Par exemple, 30 publications et 3 profils coûtent 30 × 0.005 USD + 3 × 0.01 USD = 0.18 USD en frais d’outils, auxquels s’ajoutent les tokens. Consultez usage.server_side_tool_usage_details.x_posts_fetched et x_users_fetched pour les quantités récupérées. Sans ces deux champs, la facturation repose sur les appels réussis pour compatibilité. x_search_calls est le nombre d’appels ; max_tool_calls est une valeur de contrôle dont l’application effective dépend de la route. Aucun des deux ne plafonne les quantités récupérées ni les dépenses. x_users_fetched est un champ d’utilisation et ne nécessite pas de déclaration d’outil supplémentaire.
image_generation est actuellement indisponible sur Grok 4.5, 4.6 et 4.7 : la déclaration est acceptée pour compatibilité, mais l’outil est retiré avant que la requête n’atteigne le modèle. Les valeurs de tools[].type non reconnues renvoient 400.

Autorisations

Authorization
string
header
requis

##Toutes les API nécessitent une authentification Bearer Token##

Obtenir une clé API :

Visitez la Page de gestion des clés API pour obtenir votre clé API

Ajouter à l'en-tête de requête :

Corps

application/json
model
enum<string>
requis

Modèle à appeler :

Options disponibles:
grok-4.7,
grok-4.6,
grok-4.5
Exemple:

"grok-4.7"

input
requis

Entrée pour le modèle : une chaîne simple, ou un tableau d'éléments d'entrée OpenAI Responses (par ex. {"role":"user","content":[...]}).

Exemple:

"Search the web for the latest SpaceX launch and summarize it in one sentence."

stream
boolean
défaut:false

Active le streaming SSE. Valeur par défaut : false. Lisez status et usage dans la réponse terminale : completed indique une génération achevée ; une limite de sortie, entre autres, peut entraîner incomplete. N'attendez pas exclusivement un événement response.completed.

Exemple:

false

max_output_tokens
integer

Nombre maximal de tokens à générer (tokens de raisonnement inclus).

Exemple:

2048

reasoning
object

Le niveau de raisonnement se définit par un objet : {"effort": "low" | "medium" | "high" | "xhigh"}. La valeur par défaut est high ; le raisonnement ne peut pas être désactivé. grok-4.7 et grok-4.6 prennent en charge xhigh ; grok-4.5 le traite comme high. Les tokens de raisonnement sont facturés comme des tokens de sortie et indiqués dans usage.output_tokens_details.reasoning_tokens.

tools
object[]

Déclarations d'outils. Les frais des outils côté serveur s'ajoutent aux frais de tokens et ne sont pas affectés par le multiplicateur de contexte long :

La nouvelle facturation X Search s'applique à grok-4.5, grok-4.6 et grok-4.7. Un appel peut renvoyer plusieurs publications ; les publications parentes et citées issues des recherches ou fils de discussion sont également comptées. Consultez usage.server_side_tool_usage_details pour l'utilisation réelle. En l'absence des deux compteurs de récupération, la facturation par appel réussi est conservée pour compatibilité.

Les outils function classiques sont également pris en charge (appels de fonctions côté client, sans frais d'appel d'outil côté serveur).

image_generation est actuellement indisponible sur Grok 4.5, 4.6 et 4.7 : la déclaration est acceptée pour compatibilité, mais l'outil est retiré avant que la requête n'atteigne le modèle. Les valeurs de tools[].type non reconnues renvoient 400.

Exemple:
tool_choice

Contrôle la sélection de l'outil : "auto" (par défaut) / "none" / "required", ou un objet imposant un outil précis, par ex. {"type": "web_search"}.

Options disponibles:
auto,
none,
required
prompt_cache_key
string

Clé facultative de routage du cache. Une valeur stable pour une même conversation ou des requêtes partageant le même préfixe de prompt peut améliorer les chances de réutilisation du cache. Aucun résultat n'est garanti et les règles de facturation du cache restent inchangées. Consultez cached_tokens dans usage pour connaître les résultats réels.

Exemple:

"grok-session-001"

include
string[]

Champs supplémentaires à inclure dans la réponse. Par exemple, grok-4.6 peut demander le raisonnement chiffré avec ["reasoning.encrypted_content"]. Selon la spécification de xAI, grok-4.7 le renvoie par défaut, sans include explicite.

Exemple:
max_tool_calls
integer

Valeur de contrôle du nombre d'appels d'outils. La passerelle la transmet et l'utilise pour estimer les frais d'outils à réserver ; le respect strict de ce nombre dépend du comportement réel de la route utilisée. Cette valeur ne limite ni les publications X ni les profils récupérés et ne constitue pas un plafond de dépenses.

Exemple:

1

Réponse

Une réponse a été renvoyée ; vérifiez aussi status : completed si la génération est achevée, incomplete notamment en cas de limite de sortie, et failed en cas d'échec. Avec stream=true, la réponse est un flux SSE ; lisez status et usage dans la réponse terminale.

id
string

Identifiant unique de la réponse

Exemple:

"55d44212-8d5e-90cc-975f-36d341ce21f5"

object
enum<string>

Type de réponse

Options disponibles:
response
Exemple:

"response"

status
enum<string>

Statut de la réponse

Options disponibles:
completed,
incomplete,
failed
Exemple:

"completed"

model
string

Nom du modèle réellement utilisé

Exemple:

"grok-4.7"

created_at
integer

Horodatage de création

Exemple:

1786538000

output
object[]

Éléments dans l'ordre de génération : reasoning (pouvant contenir du raisonnement chiffré), appels d'outils côté serveur, function_call et message contenant output_text. L'utilisation des outils est indiquée dans usage ; un appel x_search peut entraîner des frais pour plusieurs publications et profils.

usage
object

Statistiques d'utilisation des tokens et des outils. À partir de 200K tokens dans le prompt, tous les types de tokens sont facturés au double ; les frais d'outils ne sont pas affectés par ce multiplicateur.