> ## Documentation Index
> Fetch the complete documentation index at: https://evolink.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# API tous modèles GPT - Démarrage rapide Responses

> - Appeler les modèles de texte de la série GPT au format OpenAI Responses (le modèle précis est choisi via le paramètre `model`)
- Modèles de raisonnement et d'appel d'outils, prenant en charge une entrée mixte texte et image
- Cette API prend en charge les outils côté serveur : recherche web, exécution de code et recherche documentaire
- Les conversations à plusieurs tours peuvent être enchaînées avec `previous_response_id`, sans retransmettre l'historique
- 💡 Besoin des outils et de tous les paramètres ? Consultez la [documentation complète des paramètres](./responses-reference)

<Note>
  **BaseURL** : La BaseURL par défaut est `https://direct.evolink.ai`, qui offre une meilleure prise en charge des modèles de texte et des connexions persistantes. `https://api.evolink.ai` est le point d'accès principal pour les services multimodaux et sert d'adresse de secours pour les modèles de texte.
</Note>


## OpenAPI

````yaml fr/api-manual/language-series/gpt/responses/responses-quickstart.json POST /v1/responses
openapi: 3.1.0
info:
  title: API tous modèles GPT - Démarrage rapide Responses
  description: >-
    Exemples de démarrage rapide pour appeler les modèles de texte de la série
    GPT via l'API Responses compatible OpenAI (les outils côté serveur sont
    proposés sur cette API).
  license:
    name: MIT
  version: 1.0.0
servers:
  - url: https://direct.evolink.ai
    description: Production (recommandée)
  - url: https://api.evolink.ai
    description: URL alternative
security:
  - bearerAuth: []
tags:
  - name: Responses
    description: API OpenAI Responses avec outils côté serveur
paths:
  /v1/responses:
    post:
      tags:
        - Responses
      summary: Réponse rapide GPT (tous modèles)
      description: >-
        - Appeler les modèles de texte de la série GPT au format OpenAI
        Responses (le modèle précis est choisi via le paramètre `model`)

        - Modèles de raisonnement et d'appel d'outils, prenant en charge une
        entrée mixte texte et image

        - Cette API prend en charge les outils côté serveur : recherche web,
        exécution de code et recherche documentaire

        - Les conversations à plusieurs tours peuvent être enchaînées avec
        `previous_response_id`, sans retransmettre l'historique

        - 💡 Besoin des outils et de tous les paramètres ? Consultez la
        [documentation complète des paramètres](./responses-reference)
      operationId: gptResponsesQuickstart
      requestBody:
        required: true
        content:
          application/json:
            schema:
              $ref: '#/components/schemas/ResponsesQuickRequest'
      responses:
        '200':
          description: Réponse générée avec succès
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ResponsesResponse'
        '400':
          description: Paramètres de requête invalides
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 400
                  message: Invalid request parameters
                  type: invalid_request_error
        '401':
          description: Non autorisé, jeton invalide ou expiré
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 401
                  message: Invalid or expired token
                  type: authentication_error
        '402':
          description: Quota insuffisant
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 402
                  message: Insufficient quota
                  type: insufficient_quota_error
                  fallback_suggestion: https://evolink.ai/dashboard/billing
        '429':
          description: Limite de débit dépassée
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 429
                  message: Rate limit exceeded
                  type: rate_limit_error
                  fallback_suggestion: retry after 60 seconds
        '500':
          description: Erreur interne du serveur
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 500
                  message: Internal server error
                  type: internal_server_error
                  fallback_suggestion: try again later
        '503':
          description: Service temporairement indisponible
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 503
                  message: Service temporarily unavailable
                  type: service_unavailable_error
                  fallback_suggestion: retry after 30 seconds
components:
  schemas:
    ResponsesQuickRequest:
      type: object
      required:
        - model
        - input
      properties:
        model:
          type: string
          description: >-
            Modèle à appeler :


            | ID du modèle | Fenêtre de contexte | Positionnement |

            |---|---|---|

            | `gpt-5.6-sol` | 1 050 000 | Famille GPT-5.6, raisonnement de
            pointe |

            | `gpt-5.6-terra` | 1 050 000 | Famille GPT-5.6, production
            équilibrée |

            | `gpt-5.6-luna` | 1 050 000 | Famille GPT-5.6, débit élevé et
            maîtrise des coûts |

            | `gpt-5.5` | 400 000 | Modèle de raisonnement polyvalent |

            | `gpt-5.4` | 128 000 | Modèle de raisonnement polyvalent |

            | `gpt-5.2` | 400 000 | Modèle de raisonnement polyvalent |

            | `gpt-5.1` | 400 000 | Modèle de raisonnement polyvalent |
          enum:
            - gpt-5.6-sol
            - gpt-5.6-terra
            - gpt-5.6-luna
            - gpt-5.5
            - gpt-5.4
            - gpt-5.2
            - gpt-5.1
          example: gpt-5.6-sol
        input:
          description: >-
            Entrée du modèle : une simple chaîne de caractères, ou un tableau
            d'éléments d'entrée.


            Pour la syntaxe complète du multimodal et des résultats d'outils,
            consultez la [documentation complète des
            paramètres](./responses-reference).


            ```json

            "input": [
              {
                "role": "user",
                "content": [
                  { "type": "input_text", "text": "Que voit-on sur cette image ?" },
                  { "type": "input_image", "image_url": "https://example.com/photo.png" }
                ]
              }
            ]

            ```
          oneOf:
            - type: string
            - type: array
              items:
                type: object
          example: Explain quantum entanglement in one sentence.
    ResponsesResponse:
      type: object
      properties:
        id:
          type: string
          description: >-
            Identifiant unique de cette réponse, utilisable comme
            `previous_response_id` au tour suivant
          example: resp_0f5c2b2c20c39e8a006a7ef545443081979e478b10927984b5
        object:
          type: string
          enum:
            - response
          description: Type de réponse
          example: response
        status:
          type: string
          description: Statut de la réponse
          enum:
            - completed
            - incomplete
            - failed
          example: completed
        model:
          type: string
          description: Nom du modèle réellement utilisé
          example: gpt-5.6-sol
        created_at:
          type: integer
          description: Horodatage de création
          example: 1786705221
        output:
          type: array
          description: >-
            Éléments de sortie classés dans l'ordre de génération : l'élément
            `reasoning` (résumé du raisonnement), les éléments d'appel d'outils,
            puis enfin l'élément `message` contenant le contenu `output_text`.
          items:
            $ref: '#/components/schemas/OutputItem'
        usage:
          $ref: '#/components/schemas/Usage'
    ErrorResponse:
      type: object
      properties:
        error:
          type: object
          properties:
            code:
              type: integer
              description: Code d'erreur de statut HTTP
            message:
              type: string
              description: Description de l'erreur
            type:
              type: string
              description: Type d'erreur
            param:
              type: string
              description: Nom du paramètre concerné
            fallback_suggestion:
              type: string
              description: Suggestion lorsqu'une erreur se produit
    OutputItem:
      type: object
      properties:
        id:
          type: string
          description: Identifiant de l'élément de sortie
        type:
          type: string
          description: Type de l'élément de sortie
          enum:
            - reasoning
            - message
            - web_search_call
            - code_interpreter_call
            - file_search_call
            - function_call
          example: message
        status:
          type: string
          description: Statut de l'élément de sortie
          example: completed
        content:
          type: array
          description: >-
            Parties du contenu du message (`output_text`), présentes sur les
            éléments `message`
          items:
            type: object
    Usage:
      type: object
      description: >-
        Statistiques d'utilisation des tokens. Le cache de prompts s'applique
        automatiquement ; les tokens d'entrée servis depuis le cache sont
        facturés au tarif de cache, plus bas.
      properties:
        input_tokens:
          type: integer
          description: Nombre de tokens d'entrée
          example: 18
        output_tokens:
          type: integer
          description: Nombre de tokens de sortie (tokens de raisonnement inclus)
          example: 42
        total_tokens:
          type: integer
          description: Nombre total de jetons
          example: 60
        input_tokens_details:
          type: object
          description: Informations détaillées sur les tokens d'entrée
          properties:
            cached_tokens:
              type: integer
              description: Nombre de tokens servis depuis le cache
              example: 0
        output_tokens_details:
          type: object
          description: Informations détaillées sur les tokens de sortie
          properties:
            reasoning_tokens:
              type: integer
              description: Nombre de tokens de raisonnement
              example: 16
  securitySchemes:
    bearerAuth:
      type: http
      scheme: bearer
      description: >-
        ##Toutes les API nécessitent une authentification Bearer Token##


        **Obtenir une clé API :**


        Visitez la [Page de gestion des clés
        API](https://evolink.ai/dashboard/keys) pour obtenir votre clé API


        **Ajouter à l'en-tête de requête :**

        ```

        Authorization: Bearer YOUR_API_KEY

        ```

````