API tous modèles Grok - Référence complète Responses
- Point de terminaison Responses compatible OpenAI pour les modèles de texte xAI Grok ; sélection du modèle via le paramètre
model(toutes les valeurs figurent dans le tableau du paramètremodel) grok-4.5: fenêtre de contexte de 500K tokens ; à partir de 200K tokens dans le prompt, tous les types de tokens sont facturés au double du tarif- La mise en cache du prompt est automatique : les tokens servis depuis le cache sont facturés au tarif d’entrée en cache, moins élevé
- Modes synchrone et streaming (SSE)
- Les outils côté serveur de xAI s’exécutent sur l’infrastructure xAI et sont facturés par appel réussi :
web_search,x_search,code_execution,attachment_search,collections_search - Les outils
functionclassiques (appels de fonctions côté client) sont également pris en charge et n’entraînent aucun frais par appel
https://direct.evolink.ai, qui offre une meilleure prise en charge des modèles de texte et des connexions persistantes. https://api.evolink.ai est le point d’accès principal pour les services multimodaux et sert d’adresse de secours pour les modèles de texte.Autorisations
##Toutes les API nécessitent une authentification Bearer Token##
Obtenir une clé API :
Visitez la Page de gestion des clés API pour obtenir votre clé API
Ajouter à l'en-tête de requête :
Corps
Modèle à appeler :
grok-4.5 "grok-4.5"
Entrée pour le modèle : une chaîne simple, ou un tableau d'éléments d'entrée OpenAI Responses (par ex. {"role":"user","content":[...]}), transmis tel quel.
"Search the web for the latest SpaceX launch and summarize it in one sentence."
Indique s'il faut renvoyer une réponse en streaming (événements SSE, se terminant par response.completed). Par défaut false.
false
Nombre maximal de tokens à générer (tokens de raisonnement inclus).
2048
Déclarations d'outils. Outils côté serveur de xAI (facturés par appel réussi, frais non affectés par le multiplicateur de contexte long) :
Les outils function classiques (appels de fonctions côté client) sont également pris en charge et n'entraînent aucun frais par appel.
⚠️ image_generation n'est actuellement pas disponible : sa déclaration est acceptée par compatibilité, mais l'outil est supprimé avant que la requête n'atteigne le modèle. Les types d'outils non reconnus sont rejetés avec un 400.
Contrôle la sélection de l'outil : "auto" (par défaut) / "none" / "required", ou un objet imposant un outil précis, par ex. {"type": "web_search"}.
auto, none, required Nombre maximal d'appels d'outils côté serveur pour cette requête. En l'absence de valeur (ou avec null), la plateforme applique automatiquement un plafond pouvant aller jusqu'à 10 appels selon votre solde disponible. Les outils payants déclarés réservent à l'avance leur budget dans le pire des cas ; la partie non utilisée est remboursée lors du règlement.
5
Réponse
Réponse générée avec succès (objet JSON, ou flux d'événements SSE se terminant par response.completed lorsque stream=true)
Identifiant unique de la réponse
"55d44212-8d5e-90cc-975f-36d341ce21f5"
Type de réponse
response "response"
Statut de la réponse
completed, incomplete, failed "completed"
Nom du modèle réellement utilisé
"grok-4.5"
Horodatage de création
1786538000
Éléments de sortie dans l'ordre de génération : éléments reasoning (résumé du raisonnement), éléments d'appel d'outils côté serveur tels que web_search_call / code_interpreter_call (le statut completed indique un appel réussi et facturable), puis un élément message final avec un contenu output_text.
Statistiques d'utilisation des tokens et des outils. À partir de 200K tokens dans le prompt, tous les types de tokens sont facturés au double ; les frais d'outils ne sont pas affectés par ce multiplicateur.