Skip to main content
POST
Complétion de conversation Grok (tous modèles, paramètres complets)
BaseURL : La BaseURL par défaut est https://direct.evolink.ai, qui offre une meilleure prise en charge des modèles de texte et des connexions persistantes. https://api.evolink.ai est le point d’accès principal pour les services multimodaux et sert d’adresse de secours pour les modèles de texte.
Cette page décrit les appels function classiques. Pour les outils côté serveur (recherche web, recherche X, exécution de code, recherche de pièces jointes et de collections), utilisez de préférence la Responses API, qui présente leur configuration et leur facturation.

Utiliser Grok 4.7

Définissez model sur grok-4.7 en conservant le format de requête messages. La fenêtre de contexte est de 500 000 tokens et les connaissances sont arrêtées à mai 2026. Utilisez le paramètre de premier niveau reasoning_effort. Niveau de raisonnement : low / medium / high (par défaut) / xhigh. Le raisonnement ne peut pas être désactivé. grok-4.7 et grok-4.6 prennent en charge xhigh ; grok-4.5 accepte cette valeur mais la traite comme high. Les tokens de raisonnement sont facturés comme des tokens de sortie. prompt_cache_key fournit une indication stable de routage du cache aux requêtes partageant le même préfixe de prompt ; il ne garantit pas une réutilisation du cache. Consultez usage.prompt_tokens_details.cached_tokens pour les résultats réels. Pour conserver le raisonnement chiffré entre les tours de conversation, utilisez la Responses API.

Autorisations

Authorization
string
header
requis

##Toutes les API nécessitent une authentification Bearer Token##

Obtenir une clé API :

Visitez la Page de gestion des clés API pour obtenir votre clé API

Ajouter à l'en-tête de requête :

Corps

application/json
model
enum<string>
requis

Modèle à appeler :

Options disponibles:
grok-4.7,
grok-4.6,
grok-4.5
Exemple:

"grok-4.7"

messages
object[]
requis

Liste des messages de chat. Prend en charge les rôles system, user et assistant.

Minimum array length: 1
Exemple:
stream
boolean
défaut:false

Indique s'il faut renvoyer une réponse en streaming (SSE, événements chat.completion.chunk). Par défaut false.

Exemple:

false

max_tokens
integer

Nombre maximal de tokens à générer.

Exemple:

1024

reasoning_effort
enum<string>
défaut:high

Niveau de raisonnement : low / medium / high (par défaut) / xhigh. Le raisonnement ne peut pas être désactivé. grok-4.7 et grok-4.6 prennent en charge xhigh ; grok-4.5 accepte cette valeur mais la traite comme high. Les tokens de raisonnement sont facturés comme des tokens de sortie.

Options disponibles:
low,
medium,
high,
xhigh
temperature
number

Température d'échantillonnage (0-2). Des valeurs plus élevées produisent une sortie plus aléatoire.

Exemple:

0.7

top_p
number

Paramètre d'échantillonnage nucleus (0-1).

Exemple:

0.95

tools
object[]

Cette page décrit les outils OpenAI classiques de type function (appels de fonctions côté client, sans frais d'appel d'outil côté serveur). Consultez la Responses API pour configurer les outils côté serveur, notamment les recherches web et X, et comprendre leur utilisation.

tool_choice

Contrôle la sélection de la fonction : "auto" / "none" / "required", ou un objet imposant une fonction précise.

Options disponibles:
auto,
none,
required
prompt_cache_key
string

Clé facultative de routage du cache. Une valeur stable pour une même conversation ou des requêtes partageant le même préfixe de prompt peut améliorer les chances de réutilisation du cache. Aucun résultat n'est garanti et les règles de facturation du cache restent inchangées. Consultez cached_tokens dans usage pour connaître les résultats réels.

Exemple:

"grok-session-001"

Réponse

Complétion de chat générée avec succès (objet JSON, ou flux SSE d'événements chat.completion.chunk lorsque stream=true)

id
string

Identifiant unique pour la complétion de chat

Exemple:

"chatcmpl-20260812164515123456789AbCdEfGh"

model
string

Nom du modèle réellement utilisé

Exemple:

"grok-4.7"

object
enum<string>

Type de réponse

Options disponibles:
chat.completion
Exemple:

"chat.completion"

created
integer

Horodatage de création

Exemple:

1786538000

choices
object[]

Liste des choix de complétion de chat

usage
object

Statistiques d'utilisation des tokens. À partir de 200K tokens dans le prompt, tous les types de tokens (entrée, entrée en cache, sortie) sont facturés au double.