GPT Image 2.5 Flare & Sunburst sont disponibles sur EvoLinkEssayer GPT Image 2.5

Grok 4.5 API

Accédez à Grok 4.5 de xAI — aussi recherché sous grok-4-5 — via l'API de chat unifiée d'EvoLink. Testez le raisonnement, l'usage d'outils, les outils côté serveur avant d'intégrer.

xAIGénération de texteDisponible
à partir de $1.700 / 1M tokens d’entrée$2.000 prix officiel-15%
Documentation API
Analyse de longs documentsRaisonnement configurableAppel d'outilsCache de promptsChat + Responses
Route productionLive
Contexte
500K de contexte · 450K de sortie max.
Idéal pour
Recherche, codage, analyse de documents, agents
Entrée
Texte + images
Sortie
Texte · JSON (sortie structurée) · appels d'outils

Choisir Grok 4.5

Une route d’évaluation pour le raisonnement complexe, les longs contextes, la recherche et les workflows avec les outils serveur de xAI.

Grok 4.5

Modèle xAI de raisonnement et d’utilisation d’outils

Sélectionné
ID du modèle
grok-4.5
Idéal pour

Recherche web et X, analyse assistée par code, recherche dans les documents et collections, raisonnement complexe et routage multi-fournisseur.

< 200K
Entrée
$1.700 / 1M-15%
115.6 cr / 1M$2.000prix officiel
Lecture cache
$0.256 / 1M-15%
17.4 cr / 1M$0.300prix officiel
Sortie
$5.100 / 1M-15%
346.8 cr / 1M$6.000prix officiel
≥ 200K
Entrée
$3.400 / 1M-15%
231.2 cr / 1M$4.000prix officiel
Lecture cache
$0.512 / 1M-15%
34.8 cr / 1M$0.600prix officiel
Sortie
$10.200 / 1M-15%
693.6 cr / 1M$12.000prix officiel

Tous les tarifs sont par 1M de tokens, en USD et en crédits, et reflètent la tarification actuelle de votre compte. Au-delà de 200K tokens de prompt, le palier long contexte (×2) s'applique à chaque rôle de token.

Tarifs Grok 4.5

Estimez le coût d'une requête Grok 4.5 avant l'intégration. Le calculateur utilise les tarifs actuels de votre compte ; les prix officiels servent de référence.

Calculateur de requête

Saisissez la répartition des tokens d'une requête et le nombre d'appels d'outils réussis.

Coût estimé par requête

Grok 4.5
Tarif contexte court
USD$0.0033
Crédits0.2232

Estimation officielle $0.0039 · économie $0.0006 (15%)

Tokens d'entrée0.1156 cr
Tokens lus en cache0.0035 cr
Tokens de sortie0.1041 cr

Facturation minimale : 0.01 crédit par requête. À partir de 200K tokens de prompt, chaque rôle de token est facturé ×2. Les appels d'outils ne sont pas multipliés.

Guide budgétaire

Nombre approximatif de requêtes avec la répartition actuelle.
Ajouter des crédits
$10
Environ 3046 requêtes

Pour des tests rapides

$50
Environ 15232 requêtes

Pour le développement courant

$100
Environ 30465 requêtes

Pour l'évaluation en production

Tarifs des outils côté serveur

Seuls les appels côté serveur réussis sont facturés à l'appel ; les tentatives échouées n'ont pas de frais d'outil, mais les tokens restent facturés.
  • Recherche web$0.0050/ appel0.34 cr / appel
  • Recherche X$0.0050/ appel0.34 cr / appel
  • Exécution de code$0.0050/ appel0.34 cr / appel
  • Recherche dans les pièces jointes$0.010/ appel0.68 cr / appel
  • Recherche dans les collections$0.0025/ appel0.17 cr / appel

Qu’est-ce que l’API Grok 4.5 ?

Grok 4.5 est le modèle de raisonnement de xAI pour les agents de code, la recherche connectée, l’analyse de longs documents et les workflows avec outils. L’URL utilise grok-4-5, tandis que les requêtes API utilisent l’identifiant grok-4.5. Grok 4.5 est disponible sur la route de production EvoLink ; consultez les limites tarifaires, les workflows pris en charge et la configuration dans les sections Pricing et API.

Grok 4.5 est servi sur EvoLink sous l'ID de modèle grok-4.5 via Chat Completions · Responses, avec la même clé API et le même solde que tous les autres modèles. Il offre une fenêtre de contexte de 500K et jusqu'à 450K tokens de sortie, ainsi que le raisonnement, l'usage d'outils, les outils côté serveur.

Grok 4.5

Spécifications et capacités de Grok 4.5

Les chiffres proviennent de la configuration de route EvoLink ; les capacités sont celles que l'API expose aujourd'hui.

Fenêtre de contexte
500K tokens
Sortie max.
450K tokens
Entrée
Texte + images
Sortie
Texte · JSON (sortie structurée) · appels d'outils
Raisonnement
Effort de raisonnement configurable
Usage d'outils
Appels de fonctions avec séquences d'outils multi-étapes
Cache de prompt
Lectures de cache automatiques à tarif réduit
Outils côté serveur
Recherche web, Recherche X, Exécution de code, Recherche dans les pièces jointes, Recherche dans les collections, facturés par appel réussi
Palier long contexte
×2 au-delà de 200K tokens de prompt
Protocoles
Chat Completions · Responses
ID du modèle
grok-4.5

grok-4-5 est l’URL de la page. Les requêtes Chat Completions et Responses doivent utiliser l’ID exact affiché ici.

Pour quelles tâches l’API Grok 4.5 est-elle adaptée ?

Grok 4.5 associe une fenêtre de contexte de 500 000 tokens, un niveau de raisonnement configurable, l’entrée d’images et des outils. Il vise les tâches qui doivent conserver des preuves, appeler des systèmes externes et fournir des résultats vérifiables.

Code à l’échelle d’un dépôt et revue

Réunissez le code source utile, les issues, les résultats de tests et les modifications précédentes pour diagnostiquer plusieurs fichiers, préparer une implémentation ou relire un changement. Avant le déploiement, mesurez sur des tâches fixes le taux de réussite des tests, les étapes omises, la structure des résultats et les corrections humaines nécessaires.

Longs documents et analyse multi-source

La fenêtre de 500 000 tokens peut contenir rapports, contrats, extraits de base de connaissances, historique et sources récupérées. Davantage de contexte n’améliore pas automatiquement la réponse : vérifiez la conservation des preuves importantes et utilisez les tarifs de contexte long et d’entrée en cache de Pricing pour calculer le coût par résultat acceptable.

Recherche connectée et workflows avec outils

Grok 4.5 peut combiner recherche Web et X, exécution de code, recherche dans les pièces jointes et les collections pour produire une analyse sourcée. Avec EvoLink, vérifiez la disponibilité des outils, les tokens et le prix par appel dans API et Pricing, puis testez les citations et la qualité sur votre workflow réel.

Sortie structurée et orchestration d’agents

Les entrées texte et image peuvent alimenter JSON Schema, les appels de fonction et les agents en plusieurs étapes pour l’extraction, la revue et l’automatisation. Avant la production, testez la validité du schéma, les arguments, la fin du streaming et la reprise sûre après l’échec d’un outil.

Qu’est-ce qui change selon la plateforme utilisée pour Grok 4.5 ?

Pour un même modèle, la configuration du contexte, les outils, l’affichage de l’usage et la facturation peuvent varier. EvoLink réunit configuration et consommation derrière une API unique afin de simplifier les futurs changements de modèle.

Utiliser le bon identifiant de modèle API

grok-4-5 est l’URL de la page et une forme de recherche courante ; l’identifiant à envoyer dans l’API est grok-4.5. Une application Chat Completions ou Responses existante utilise cet ID dans sa configuration. Les champs exacts restent dans la section API.

Suivre la configuration du canal API actif

xAI documente une fenêtre de 500 000 tokens, mais les plateformes peuvent proposer des réglages de contexte, des outils et des limites différents. Avec EvoLink, référez-vous à la configuration, aux fonctions disponibles et aux données usage du canal actuel.

Choisir Chat ou Responses selon le workflow

Commencez par Chat Completions pour le chat, le streaming et les fonctions exécutées côté client. Choisissez Responses pour les agents de recherche, la recherche côté serveur ou l’exécution de code. Vous conservez ainsi une intégration de style OpenAI sans complexité inutile.

Conserver le choix du modèle dans une passerelle

Un compte, un solde et un format d’API EvoLink permettent d’utiliser Grok, GPT, Claude et Kimi. Lorsque le modèle reste configurable, le routage peut évoluer selon la qualité, le coût et la disponibilité sans reconstruire l’intégration pour chaque fournisseur.

Comment mieux contrôler le coût de l’API Grok 4.5 ?

La section Pricing affiche les tarifs actuels des tokens et des outils. En pratique, le cache, la gestion du contexte, le réglage du raisonnement et le routage limitent la consommation inutile et rattachent la dépense aux tâches terminées.

Rendre le contexte répété compatible avec le cache

Les prompts système stables, les schémas d’outils et le contexte partagé sont plus faciles à réutiliser. Configurez l’identifiant de cache ou de conversation pris en charge par le protocole choisi et consultez les cached tokens dans usage pour vérifier le gain réel.

N’envoyer que le contexte utile à la tâche

Une fenêtre de 500 000 tokens aide sur de grands dépôts et documents, mais ne doit pas être remplie à chaque requête. Sélectionner les fichiers, messages et passages pertinents réduit le coût d’entrée et concentre le modèle sur les preuves importantes.

Adapter raisonnement, sortie et outils à la tâche

Pour une tâche simple, commencez avec un reasoning effort plus faible et une sortie courte, puis augmentez le budget pour les analyses difficiles. Suivez aussi le nombre d’appels d’outils dans les agents afin d’éviter recherches répétées, exécutions inutiles et boucles improductives.

Comparer les modèles par coût total de la tâche

Évaluez ensemble tokens, entrée en cache, outils serveur et nouvelles tentatives nécessaires. EvoLink centralise les modèles et la consommation afin de comparer le coût total d’un même travail avec Grok 4.5 et d’autres routes.

Deux façons d'utiliser Grok 4.5 : API EvoLink ou Agent

Utilisez l'API EvoLink pour les backends produit et les traitements par lots, ou appelez Grok 4.5 depuis Codex, Claude ou Gemini pour vos workflows de code et d'analyse. Les deux voies partagent la même clé API EvoLink, le même solde, le même ID de modèle et le même historique de requêtes.

Option 1

Intégrer avec l'API EvoLink

Idéal pour : backends produit, traitements par lots, pipelines automatisés

Envoyez à EvoLink des requêtes Chat Completions compatibles OpenAI (ou Anthropic Messages) et contrôlez l'ID de modèle, le prompt système, le budget de sortie, les outils et la sortie structurée.

  1. 1Créez une clé API EvoLink dans la console
  2. 2Pointez votre SDK OpenAI ou Anthropic vers l'URL de base EvoLink et sélectionnez l'ID de modèle affiché ci-dessus
  3. 3Envoyez une requête représentative et lisez le champ usage pour les tokens d'entrée, en cache et de sortie
  4. 4Définissez max_tokens et les réessais par tâche ; conservez les ID et résultats des appels d'outils entre les tours
Option 2

L'appeler avec un Agent

Idéal pour : tâches de code, de revue et d'analyse dans Codex, Claude et Gemini

Donnez à l'Agent la tâche, les entrées à inclure et les critères d'acceptation. Il assemble la requête, appelle Grok 4.5 via EvoLink et renvoie la réponse avec la consommation de tokens.

  1. 1Définissez EVOLINK_API_KEY dans votre environnement local ; jamais dans le code ni dans un prompt
  2. 2Décrivez la tâche, les entrées à inclure et le format de sortie attendu
  3. 3Demandez à l'Agent d'appeler Grok 4.5 via EvoLink et d'afficher la requête avant l'envoi
  4. 4Laissez l'Agent rapporter la réponse, la consommation de tokens et tout corps d'erreur

Exemple de code API Grok 4.5 et gestion des erreurs

Cet exemple montre la requête exécutable la plus courte : un appel Chat Completions compatible OpenAI avec un prompt système, un message utilisateur et un budget de sortie. Ouvrez l'onglet API pour la référence complète des paramètres et réponses.

Voir la documentation API complète
cURL
curl -X POST https://api.evolink.ai/v1/chat/completions \
  -H "Authorization: Bearer $EVOLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.5",
    "messages": [
      { "role": "system", "content": "You are a research assistant. Cite sources." },
      { "role": "user", "content": "Summarize the three most important changes in <topic> this month." }
    ],
    "max_tokens": 2048,
    "temperature": 0.2
  }'

# Server-side tools (web search, X search, code execution, attachment /
# collections search)
# run on /v1/responses with the same model ID and are billed per successful
# call.
# The response includes choices[0].message and a usage object (prompt,
# cached, and completion tokens).

Requête invalide ou paramètre non pris en charge

Vérifiez l'ID de modèle, le tableau messages et les plages de paramètres dans la référence API ; retirez les champs que cette route ne prend pas en charge.

Problème d'authentification ou de solde

Vérifiez le jeton Bearer Authorization et confirmez le solde disponible dans la console.

Longueur de contexte dépassée

Les tokens du prompt dépassent la fenêtre de contexte de Grok 4.5. Réduisez ou ne récupérez que les éléments pertinents et réutilisez les préfixes en cache.

Limite de débit (429)

Attendez et réessayez avec un délai aléatoire ; regroupez ou mettez en file d'attente les requêtes au lieu de rafales parallèles.

Contenu ou appel d'outil rejeté

Vérifiez le contenu sensible, les arguments d'appel d'outil mal formés et les écarts de schéma JSON avant de réessayer.

Comment choisir Chat Completions, Responses et le trafic de production pour Grok 4.5 ?

Les deux protocoles répondent à des workflows différents. Ce résumé aide au choix ; les champs exacts restent dans la section API et la documentation EvoLink, les tarifs des tokens et outils dans Pricing.

01

Chat standard et fonctions client : Chat Completions

Si vous utilisez déjà un chat compatible OpenAI, le streaming ou des fonctions côté client, commencez par Chat Completions. Vérifiez le format des messages, la fin du flux, les arguments de fonction et usage par rapport au comportement attendu du client.

Chat et fonctions client
02

Agents de recherche et outils serveur : Responses

Évaluez Responses pour la recherche Web ou X, l’exécution de code, la recherche dans les pièces jointes ou collections et les agents plus longs. Confirmez disponibilité, prix des appels, citations, états d’échec et limites des nouvelles tentatives.

Outils serveur
03

Grand contexte : observer cache et coût total

Les longs documents, dépôts et conversations ne doivent pas être envoyés intégralement par défaut. Comparez tailles de contexte représentatives, succès et échecs du cache, longueur de sortie et nouvelles tentatives, puis calculez le coût d’une tâche réussie avec la facture finale.

Coût du contexte
04

Production : commencer petit et garder un secours

Envoyez d’abord un petit groupe de tâches observables à Grok 4.5 et conservez une route GPT, Claude ou Kimi éprouvée. L’API unifiée EvoLink centralise modèle, usage et solde et facilite le changement après une limite, un timeout ou un échec de schéma ou d’outil.

Déploiement progressif

L'entrée en cache est facturée à son propre tarif réduit

Les préfixes stables – prompts système, schémas d'outils, contexte partagé – sont mis en cache automatiquement sur les requêtes répétées et facturés comme lectures de cache plutôt que comme entrée neuve. Gardez le préfixe identique d'un tour à l'autre et vérifiez les tokens en cache dans usage pour confirmer l'économie.

Contexte de 500K tokens, palier long contexte dès 200K tokens de prompt

Ne remplissez la fenêtre que si la tâche l'exige. Dès qu'un prompt atteint 200K tokens, le palier long contexte s'applique à chaque rôle de token : élaguez les passages récupérés et l'historique avant de monter en charge, et surveillez le badge de palier dans l'estimateur pour planifier le budget.

Comparez Grok 4.5 à GPT-5.6 et Claude Opus 5

EvoLink

Comparez les tarifs d’entrée/sortie, le contexte, le cache et les usages. Testez les mêmes requêtes avant de choisir une route ; les prix ci-dessous suivent les tarifs actuels de votre compte.

Grok 4.5
Entrée / Sortie$1.7 / $5.1
Contexte500K
CacheLectures de cache automatiques
Idéal pourRecherche web et X, analyse assistée par code, recherche dans les documents et collections, raisonnement complexe et routage multi-fournisseur.
GPT-5.6
Entrée / Sortie$0.181 / $1.081
Contexte1.05M
CacheLecture / écriture du cache
Idéal pourCodage, agents en production, raisonnement complexe
Claude Opus 5
Entrée / Sortie$4.75 / $23.75
Contexte1M
CacheLecture / écriture du cache
Idéal pourCodage à l’échelle d’un dépôt, agents longue durée, revues critiques

Que vérifier avant d’utiliser Grok 4.5 en production ?

Commencez par quelques workloads réels afin de confirmer la qualité, la latence, le coût et la fiabilité avant de déplacer davantage de trafic.

L’intégration et l’usage sont lisibles

Vérifiez l’identifiant grok-4.5, le protocole voulu et le retour des réponses, des données usage et du cache. Des données claires facilitent l’analyse des coûts et donnent aux workflows Chat et Responses une observation cohérente.

Les sorties répondent au besoin métier

Testez des modifications de code, analyses de documents, recherches ou extractions structurées réelles. Au-delà de la réponse, vérifiez les tests, la fiabilité des citations, les arguments de fonction et la possibilité de consommer directement le JSON Schema en aval.

La latence et les erreurs sont gérables

Observez le temps de réponse sous une charge représentative et préparez les nouvelles tentatives pour limites, timeouts, sorties structurées invalides et échecs d’outils. Un modèle configurable dans EvoLink facilite le passage à une solution déjà vérifiée si une route devient indisponible.

Le coût et le choix du modèle restent contrôlables

Calculez le coût total d’une même catégorie de tâche à partir de Pricing, usage et du montant final. Décidez ensuite si Grok 4.5 doit servir de route par défaut, de modèle pour les tâches difficiles ou de secours. La passerelle unifiée sépare ce choix du travail d’intégration.

Commencez avec un petit ensemble de tâches Grok 4.5 observable et réversible. Élargissez seulement lorsque qualité, latence et coût répondent aux attentes. Plusieurs modèles derrière l’API unifiée EvoLink simplifient ensuite la montée en charge, le changement de route et l’optimisation des coûts.

Famille de modèles Grok

Même clé API, même solde : changez de palier sans toucher à l’intégration.

Grok 4.5

Grok 4.5

Modèle actuel

Modèle xAI de raisonnement et d’utilisation d’outils

Grok 4.6

Grok 4.6

Modèle xAI de raisonnement et d’utilisation d’outils

Voir le modèle

Autres modèles texte sur EvoLink en plus de Grok 4.5

GPT-5.6

GPT-5.6

La gamme frontier d’OpenAI pour comparer capacités, latence et flexibilité du routage des coûts.

Voir le modèle
Claude Opus 5

Claude Opus 5

La route premium d’Anthropic pour les agents longs, l’utilisation d’outils et les revues complexes.

Voir le modèle
Kimi K3

Kimi K3

La route de raisonnement long contexte de Moonshot avec un tarif distinct pour l’entrée en cache.

Voir le modèle
DeepSeek V4 Flash

DeepSeek V4 Flash

Une route open model économique pour les charges importantes de code, raisonnement et agents.

Voir le modèle

Pour aller plus loin avec Grok 4.5

Grok 4.6 vs Grok 4.5

Grok 4.6 vs Grok 4.5

Examinez les faits confirmés, les conditions de migration et les tests appariés avant de déplacer vos workloads Grok 4.5.

Lire le guide
État de sortie de Grok 4.6

État de sortie de Grok 4.6

Suivez la sortie officielle, l’identifiant du modèle, la disponibilité API et les tarifs ; tant que ces faits ne sont pas confirmés, gardez Grok 4.5 comme base de test reproductible.

Lire le guide

FAQ de l’API Grok 4.5

L’API Grok 4.5 est-elle déjà disponible via EvoLink ?

Oui. Grok 4.5 est disponible sur la route de production EvoLink. Envoyez vos requêtes avec l’identifiant grok-4.5 via Chat Completions ou Responses ; l’identifiant, les tarifs, le contexte et les workflows pris en charge figurent sur cette page.

grok-4-5 est-il l’identifiant du modèle API ?

Non. grok-4-5 est l’URL de la page et une écriture utilisée en recherche. L’identifiant à envoyer dans les requêtes API est grok-4.5.

Quelle est la fenêtre de contexte et la limite tarifaire du contexte long ?

xAI documente une fenêtre de 500 000 tokens. Au seuil de prompt affiché dans Pricing, la requête passe au tarif de contexte long. Testez donc des tailles représentatives et l’entrée en cache au lieu d’utiliser systématiquement toute la fenêtre.

Quelles entrées et sorties Grok 4.5 prend-il en charge ?

La documentation amont indique des entrées texte et image, avec une sortie texte. L’image sert à la compréhension visuelle et ne transforme pas Grok 4.5 en générateur d’images. Référez-vous au support actuel affiché dans API.

Faut-il choisir Chat Completions ou l’API Responses ?

Chat Completions convient au chat, au streaming et aux fonctions côté client. Évaluez Responses pour les agents plus longs et les outils serveur xAI. Les champs exacts restent dans API et la documentation EvoLink.

Comment choisir le reasoning effort ?

Commencez par le niveau le plus faible qui satisfait la qualité demandée, puis comparez medium et high sur les mêmes tâches. Les travaux complexes peuvent justifier plus de raisonnement ; les travaux simples peuvent privilégier temps de réponse et coût.

Comment l’entrée en cache modifie-t-elle le prix de Grok 4.5 ?

Le cache peut réduire le coût du contexte répété, mais les échecs de cache, sorties longues, nouvelles tentatives et appels d’outils répétés augmentent encore le total. Utilisez Pricing et le montant final pour calculer le coût d’une tâche réussie.

Quelle différence entre outils serveur et fonctions client ?

Les fonctions client s’exécutent dans votre application. La recherche Web ou X, l’exécution de code et la recherche dans les pièces jointes ou collections sont des outils serveur xAI. Exécution, gestion des échecs et facturation diffèrent ; consultez API et Pricing.

Comment comparer Grok 4.5 à GPT, Claude ou Kimi ?

Faites exécuter les mêmes tâches réelles avec un contexte, des outils et un raisonnement identiques. Qualité, temps de réponse, répartition des tokens, fonctionnement des outils et coût total indiquent quelle route EvoLink convient à chaque trafic.

Quel modèle de secours conserver pendant le déploiement ?

Conservez un modèle qui traite déjà le même workload de façon fiable et laissez le routage configurable. En cas de limite, timeout ou sortie invalide, EvoLink peut passer à GPT, Claude, Kimi ou une autre solution adaptée.