API tous modèles Grok - Référence complète Chat Completions
- Point de terminaison Chat Completions compatible OpenAI pour les modèles de texte xAI Grok ; sélection du modèle via le paramètre
model(toutes les valeurs figurent dans le tableau du paramètremodel) grok-4.5: fenêtre de contexte de 500K tokens ; à partir de 200K tokens dans le prompt, tous les types de tokens sont facturés au double du tarif- La mise en cache du prompt est automatique : les tokens servis depuis le cache sont facturés au tarif d’entrée en cache, moins élevé
- Modes synchrone et streaming (SSE)
- Les appels d’outils
functionclassiques sont pris en charge ; les outils côté serveur de xAI sont disponibles uniquement via la Responses API
https://direct.evolink.ai, qui offre une meilleure prise en charge des modèles de texte et des connexions persistantes. https://api.evolink.ai est le point d’accès principal pour les services multimodaux et sert d’adresse de secours pour les modèles de texte.function classiques.Autorisations
##Toutes les API nécessitent une authentification Bearer Token##
Obtenir une clé API :
Visitez la Page de gestion des clés API pour obtenir votre clé API
Ajouter à l'en-tête de requête :
Corps
Modèle à appeler :
grok-4.5 "grok-4.5"
Liste des messages de chat. Prend en charge les rôles system, user et assistant.
1Indique s'il faut renvoyer une réponse en streaming (SSE, événements chat.completion.chunk). Par défaut false.
false
Nombre maximal de tokens à générer. Transmis tel quel au modèle.
1024
Température d'échantillonnage (0-2). Des valeurs plus élevées produisent une sortie plus aléatoire.
0.7
Paramètre d'échantillonnage nucleus (0-1).
0.95
Définitions d'outils function OpenAI classiques (appels de fonctions côté client, sans frais supplémentaires par appel). Les outils côté serveur de xAI sont disponibles uniquement via la Responses API.
Contrôle la sélection de la fonction : "auto" / "none" / "required", ou un objet imposant une fonction précise.
auto, none, required Réponse
Complétion de chat générée avec succès (objet JSON, ou flux SSE d'événements chat.completion.chunk lorsque stream=true)
Identifiant unique pour la complétion de chat
"chatcmpl-20260812164515123456789AbCdEfGh"
Nom du modèle réellement utilisé
"grok-4.5"
Type de réponse
chat.completion "chat.completion"
Horodatage de création
1786538000
Liste des choix de complétion de chat
Statistiques d'utilisation des tokens. À partir de 200K tokens dans le prompt, tous les types de tokens (entrée, entrée en cache, sortie) sont facturés au double.