> ## Documentation Index
> Fetch the complete documentation index at: https://evolink.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# API tous modèles Grok - Référence complète Chat Completions

> - Point de terminaison Chat Completions compatible OpenAI pour les modèles de texte xAI Grok ; sélection du modèle via le paramètre `model` (toutes les valeurs figurent dans le tableau du paramètre `model`)
- `grok-4.5` : fenêtre de contexte de 500K tokens ; à partir de 200K tokens dans le prompt, tous les types de tokens sont facturés au double du tarif
- La mise en cache du prompt est automatique : les tokens servis depuis le cache sont facturés au tarif d'entrée en cache, moins élevé
- Modes synchrone et streaming (SSE)
- Les appels d'outils `function` classiques sont pris en charge ; les outils côté serveur de xAI sont disponibles uniquement via la [Responses API](../responses/responses-reference)

<Note>
  **BaseURL** : La BaseURL par défaut est `https://direct.evolink.ai`, qui offre une meilleure prise en charge des modèles de texte et des connexions persistantes. `https://api.evolink.ai` est le point d'accès principal pour les services multimodaux et sert d'adresse de secours pour les modèles de texte.
</Note>

<Note>
  **Les outils côté serveur** (recherche web, recherche X, exécution de code, recherche de pièces jointes, recherche de collections) sont disponibles uniquement via la [Responses API](../responses/responses-reference). Le point de terminaison Chat Completions ne prend en charge que les appels d'outils `function` classiques.
</Note>


## OpenAPI

````yaml fr/api-manual/language-series/grok/chat-completions/chat-completions-reference.json POST /v1/chat/completions
openapi: 3.1.0
info:
  title: API tous modèles Grok - Référence complète Chat Completions
  description: >-
    Référence complète des paramètres pour appeler les modèles de texte xAI Grok
    via l'API Chat Completions compatible OpenAI.
  license:
    name: MIT
  version: 1.0.0
servers:
  - url: https://direct.evolink.ai
    description: Production (recommandée)
  - url: https://api.evolink.ai
    description: URL alternative
security:
  - bearerAuth: []
tags:
  - name: Chat Completion
    description: APIs liées à la complétion de chat IA
paths:
  /v1/chat/completions:
    post:
      tags:
        - Complétion de chat
      summary: Complétion de conversation Grok (tous modèles, paramètres complets)
      description: >-
        - Point de terminaison Chat Completions compatible OpenAI pour les
        modèles de texte xAI Grok ; sélection du modèle via le paramètre `model`
        (toutes les valeurs figurent dans le tableau du paramètre `model`)

        - `grok-4.5` : fenêtre de contexte de 500K tokens ; à partir de 200K
        tokens dans le prompt, tous les types de tokens sont facturés au double
        du tarif

        - La mise en cache du prompt est automatique : les tokens servis depuis
        le cache sont facturés au tarif d'entrée en cache, moins élevé

        - Modes synchrone et streaming (SSE)

        - Les appels d'outils `function` classiques sont pris en charge ; les
        outils côté serveur de xAI sont disponibles uniquement via la [Responses
        API](../responses/responses-reference)
      operationId: grokChatCompletionsReference
      requestBody:
        required: true
        content:
          application/json:
            schema:
              $ref: '#/components/schemas/ChatCompletionRequest'
      responses:
        '200':
          description: >-
            Complétion de chat générée avec succès (objet JSON, ou flux SSE
            d'événements `chat.completion.chunk` lorsque `stream=true`)
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ChatCompletionResponse'
        '400':
          description: Paramètres de requête invalides
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 400
                  message: Invalid request parameters
                  type: invalid_request_error
        '401':
          description: Non autorisé, jeton invalide ou expiré
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 401
                  message: Invalid or expired token
                  type: authentication_error
        '402':
          description: Quota insuffisant, recharge requise
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 402
                  message: Insufficient quota
                  type: insufficient_quota_error
                  fallback_suggestion: https://evolink.ai/dashboard/billing
        '429':
          description: Limite de débit dépassée
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 429
                  message: Rate limit exceeded
                  type: rate_limit_error
                  fallback_suggestion: retry after 60 seconds
        '500':
          description: Erreur interne du serveur
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 500
                  message: Internal server error
                  type: internal_server_error
                  fallback_suggestion: try again later
        '503':
          description: Service temporairement indisponible
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 503
                  message: Service temporarily unavailable
                  type: service_unavailable_error
                  fallback_suggestion: retry after 30 seconds
components:
  schemas:
    ChatCompletionRequest:
      type: object
      required:
        - model
        - messages
      properties:
        model:
          type: string
          description: >-
            Modèle à appeler :


            | ID du modèle | Positionnement |

            |---|---|

            | `grok-4.5` | Modèle xAI de raisonnement et d'appel d'outils,
            fenêtre de contexte de 500K |
          enum:
            - grok-4.5
          example: grok-4.5
        messages:
          type: array
          description: >-
            Liste des messages de chat. Prend en charge les rôles `system`,
            `user` et `assistant`.
          items:
            $ref: '#/components/schemas/Message'
          minItems: 1
          example:
            - role: system
              content: You are a concise assistant.
            - role: user
              content: Explain prompt caching in one sentence.
        stream:
          type: boolean
          description: >-
            Indique s'il faut renvoyer une réponse en streaming (SSE, événements
            `chat.completion.chunk`). Par défaut `false`.
          default: false
          example: false
        max_tokens:
          type: integer
          description: Nombre maximal de tokens à générer. Transmis tel quel au modèle.
          example: 1024
        temperature:
          type: number
          description: >-
            Température d'échantillonnage (0-2). Des valeurs plus élevées
            produisent une sortie plus aléatoire.
          example: 0.7
        top_p:
          type: number
          description: Paramètre d'échantillonnage nucleus (0-1).
          example: 0.95
        tools:
          type: array
          description: >-
            Définitions d'outils `function` OpenAI classiques (appels de
            fonctions côté client, sans frais supplémentaires par appel). Les
            outils côté serveur de xAI sont disponibles uniquement via la
            Responses API.
          items:
            $ref: '#/components/schemas/FunctionTool'
        tool_choice:
          description: >-
            Contrôle la sélection de la fonction : `"auto"` / `"none"` /
            `"required"`, ou un objet imposant une fonction précise.
          oneOf:
            - type: string
              enum:
                - auto
                - none
                - required
            - type: object
    ChatCompletionResponse:
      type: object
      properties:
        id:
          type: string
          description: Identifiant unique pour la complétion de chat
          example: chatcmpl-20260812164515123456789AbCdEfGh
        model:
          type: string
          description: Nom du modèle réellement utilisé
          example: grok-4.5
        object:
          type: string
          enum:
            - chat.completion
          description: Type de réponse
          example: chat.completion
        created:
          type: integer
          description: Horodatage de création
          example: 1786538000
        choices:
          type: array
          description: Liste des choix de complétion de chat
          items:
            $ref: '#/components/schemas/Choice'
        usage:
          $ref: '#/components/schemas/Usage'
    ErrorResponse:
      type: object
      properties:
        error:
          type: object
          properties:
            code:
              type: integer
              description: Code d'erreur de statut HTTP
            message:
              type: string
              description: Description de l'erreur
            type:
              type: string
              description: Type d'erreur
            param:
              type: string
              description: Nom du paramètre concerné
            fallback_suggestion:
              type: string
              description: Suggestion lorsqu'une erreur se produit
    Message:
      type: object
      required:
        - role
        - content
      properties:
        role:
          type: string
          description: Rôle du message
          enum:
            - system
            - user
            - assistant
        content:
          type: string
          description: Contenu du message
    FunctionTool:
      type: object
      required:
        - type
        - function
      properties:
        type:
          type: string
          enum:
            - function
          description: >-
            Type d'outil ; le point de terminaison Chat Completions n'accepte
            que `function`
        function:
          type: object
          description: >-
            Définition de la fonction : `name`, `description` et un objet
            `parameters` au format JSON Schema
    Choice:
      type: object
      properties:
        index:
          type: integer
          description: Index du choix
          example: 0
        message:
          $ref: '#/components/schemas/AssistantMessage'
        finish_reason:
          type: string
          description: Raison de fin
          enum:
            - stop
            - length
            - tool_calls
            - content_filter
          example: stop
    Usage:
      type: object
      description: >-
        Statistiques d'utilisation des tokens. À partir de 200K tokens dans le
        prompt, tous les types de tokens (entrée, entrée en cache, sortie) sont
        facturés au double.
      properties:
        prompt_tokens:
          type: integer
          description: Nombre de tokens dans le contenu d'entrée
          example: 504
        completion_tokens:
          type: integer
          description: Nombre de tokens dans le contenu de sortie
          example: 2
        total_tokens:
          type: integer
          description: Nombre total de jetons
          example: 526
        prompt_tokens_details:
          type: object
          description: Informations détaillées sur les tokens d'entrée
          properties:
            cached_tokens:
              type: integer
              description: >-
                Nombre de tokens du prompt servis depuis le cache (facturés au
                tarif d'entrée en cache, moins élevé ; la mise en cache est
                automatique)
              example: 0
    AssistantMessage:
      type: object
      properties:
        role:
          type: string
          description: Rôle de l'expéditeur du message
          enum:
            - assistant
          example: assistant
        content:
          type: string
          description: Contenu du message de réponse de l'IA
          example: >-
            Prompt caching reuses previously processed prompt prefixes so
            repeated context is billed at a lower rate.
        tool_calls:
          type: array
          description: >-
            Appels de fonctions demandés par le modèle (présents lors de
            l'utilisation d'outils `function`)
          items:
            type: object
  securitySchemes:
    bearerAuth:
      type: http
      scheme: bearer
      description: >-
        ##Toutes les API nécessitent une authentification Bearer Token##


        **Obtenir une clé API :**


        Visitez la [Page de gestion des clés
        API](https://evolink.ai/dashboard/keys) pour obtenir votre clé API


        **Ajouter à l'en-tête de requête :**

        ```

        Authorization: Bearer YOUR_API_KEY

        ```

````