> ## Documentation Index
> Fetch the complete documentation index at: https://evolink.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# Qwen3.8-Max-Preview - Interface Responses

> > 🚧 **Ce modele n'est pas encore disponible, restez a l'ecoute**

- Appelez Qwen3.8-Max-Preview avec le protocole OpenAI Responses
- **Entrée flexible** : `input` peut recevoir une chaîne, ou un tableau de messages au format Chat (prenant en charge le multimodal `input_text` / `input_image`)
- **Conversation multi-tour** : passez `previous_response_id` pour associer la réponse du tour précédent, le serveur combine automatiquement le contexte (l'`id` de réponse est valable 7 jours)
- **Mise en cache de session** : activée en ajoutant `x-dashscope-session-cache: enable` à l'en-tête de requête (disable par défaut), voir les correspondances dans `usage.input_tokens_details.cached_tokens`
- **Intensité de réflexion** : contrôlée via `reasoning.effort`
- **Sortie en streaming** : lorsque `stream=true`, le retour suit les événements Responses (`response.output_text.delta` / `response.completed`, etc.)

<Note>
  **À propos de la BaseURL** : la BaseURL par défaut est `https://direct.evolink.ai`, qui offre une meilleure prise en charge des modèles de texte et des connexions longues ; `https://api.evolink.ai` est l'adresse principale multimodale, à utiliser en cas d'entrée image.

  **Mise en cache de session** : l'interface Responses active la mise en cache de session côté serveur via l'en-tête de requête `x-dashscope-session-cache: enable` afin de réduire la latence et le coût des tours multiples.
</Note>


## OpenAPI

````yaml fr/api-manual/language-series/qwen3.8-max-preview/qwen3.8-max-preview-responses.json POST /v1/responses
openapi: 3.1.0
info:
  title: Qwen3.8-Max-Preview - Interface Responses
  description: >-
    Interface compatible OpenAI Responses de Qwen3.8-Max-Preview
    (`/v1/responses`).


    **Avantages par rapport à Chat Completions** :

    - **Gestion simplifiée du contexte** : associez le tour précédent via
    `previous_response_id`, sans avoir à assembler manuellement l'historique
    complet

    - **Outils intégrés** : recherche web, extraction de pages web, interpréteur
    de code, etc.

    - **Mise en cache de session pratique** : ajoutez
    `x-dashscope-session-cache: enable` à l'en-tête de requête, le serveur met
    automatiquement en cache le contexte de conversation, réduisant la latence
    et le coût des tours multiples


    **Capacités** : entrée multimodale (texte + image), contrôle de l'intensité
    de réflexion (`reasoning.effort`), sortie en streaming.
  license:
    name: MIT
  version: 1.0.0
servers:
  - url: https://direct.evolink.ai
    description: >-
      Environnement de production (recommandé, meilleure prise en charge des
      connexions longues pour les modèles de texte)
  - url: https://api.evolink.ai
    description: Adresse principale multimodale (à utiliser avec une entrée image)
security:
  - bearerAuth: []
tags: []
paths:
  /v1/responses:
    post:
      summary: Interface Responses Qwen3.8-Max-Preview (compatible OpenAI)
      description: >-
        > 🚧 **Ce modele n'est pas encore disponible, restez a l'ecoute**


        - Appelez Qwen3.8-Max-Preview avec le protocole OpenAI Responses

        - **Entrée flexible** : `input` peut recevoir une chaîne, ou un tableau
        de messages au format Chat (prenant en charge le multimodal `input_text`
        / `input_image`)

        - **Conversation multi-tour** : passez `previous_response_id` pour
        associer la réponse du tour précédent, le serveur combine
        automatiquement le contexte (l'`id` de réponse est valable 7 jours)

        - **Mise en cache de session** : activée en ajoutant
        `x-dashscope-session-cache: enable` à l'en-tête de requête (disable par
        défaut), voir les correspondances dans
        `usage.input_tokens_details.cached_tokens`

        - **Intensité de réflexion** : contrôlée via `reasoning.effort`

        - **Sortie en streaming** : lorsque `stream=true`, le retour suit les
        événements Responses (`response.output_text.delta` /
        `response.completed`, etc.)
      operationId: createResponseQwen38MaxPreview
      parameters:
        - name: x-dashscope-session-cache
          in: header
          required: false
          schema:
            type: string
            enum:
              - enable
              - disable
            default: disable
          description: >-
            Interrupteur de mise en cache de session. Défini sur `enable`, le
            serveur met automatiquement en cache le contexte de conversation
            pour réduire la latence et le coût de l'inférence multi-tour.
      requestBody:
        required: true
        content:
          application/json:
            schema:
              $ref: '#/components/schemas/ResponseRequest'
            examples:
              basic:
                summary: Appel de base (entrée en chaîne)
                value:
                  model: qwen3.8-max-preview
                  input: Que peux-tu faire ?
              multi_turn:
                summary: Conversation multi-tour (previous_response_id)
                value:
                  model: qwen3.8-max-preview
                  input: Quelle est la différence avec GBDT ?
                  previous_response_id: resp_xxxxxxxx
              multimodal:
                summary: Entrée multimodale (image)
                value:
                  model: qwen3.8-max-preview
                  input:
                    - role: user
                      content:
                        - type: input_text
                          text: Décris cette image
                        - type: input_image
                          image_url: https://example.com/image.jpg
      responses:
        '200':
          description: Génération réussie
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ResponseObject'
        '400':
          description: Paramètres de requête invalides
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 400
                  message: Invalid request parameters
                  type: invalid_request_error
        '401':
          description: Non authentifié, jeton invalide ou expiré
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 401
                  message: Invalid or expired token
                  type: authentication_error
        '402':
          description: Solde insuffisant
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 402
                  message: Insufficient credits
                  type: insufficient_quota
        '429':
          description: Requêtes trop fréquentes (limitation de débit)
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
        '500':
          description: Erreur interne du serveur
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
components:
  schemas:
    ResponseRequest:
      type: object
      required:
        - model
        - input
      properties:
        model:
          type: string
          enum:
            - qwen3.8-max-preview
          example: qwen3.8-max-preview
          description: Nom du modèle de conversation
        input:
          description: >-
            Entrée du modèle. Peut recevoir une chaîne (texte brut), ou un
            tableau de messages au format Chat (prenant en charge le multimodal
            `input_text` / `input_image`).
          oneOf:
            - type: string
            - type: array
              items:
                $ref: '#/components/schemas/InputItem'
        instructions:
          type: string
          description: >-
            Inséré au début du contexte en tant qu'instruction système. Lors de
            l'utilisation de `previous_response_id`, les `instructions` du tour
            précédent ne sont pas transmises au tour actuel.
        previous_response_id:
          type: string
          description: >-
            ID unique de la réponse du tour précédent (l'`id` de réponse,
            valable 7 jours). Utilisé pour associer une conversation multi-tour,
            le serveur récupère et combine automatiquement l'entrée et la sortie
            de ce tour comme contexte.
        max_output_tokens:
          type: integer
          description: >-
            Nombre maximal de tokens du contenu de sortie généré cette fois
            (réflexion incluse).
        reasoning:
          type: object
          description: Contrôle de la réflexion.
          properties:
            effort:
              type: string
              enum:
                - low
                - medium
                - high
              description: Intensité de réflexion
        store:
          type: boolean
          description: >-
            Stocker ou non cette réponse.


            - `true` (par défaut) : peut être référencée par
            `previous_response_id`

            - `false` : non stockée, ne peut pas être référencée ultérieurement
          default: true
        stream:
          type: boolean
          description: Renvoyer ou non un flux d'événements Responses.
          default: false
        temperature:
          type: number
          description: Température d'échantillonnage, plage `[0, 2]`.
          minimum: 0
          maximum: 2
        top_p:
          type: number
          description: Paramètre d'échantillonnage nucleus, plage `(0, 1]`.
          minimum: 0
          maximum: 1
        tools:
          type: array
          description: >-
            Liste d'outils. Prend en charge les outils intégrés (`web_search`
            recherche web, `web_extractor` extraction de pages web,
            `code_interpreter` interpréteur de code) ainsi que les `function`
            personnalisées.
          items:
            $ref: '#/components/schemas/Tool'
    ResponseObject:
      type: object
      properties:
        id:
          type: string
          description: >-
            ID unique de cette réponse (valable 7 jours, peut servir de
            `previous_response_id`)
          example: resp_xxxxxxxx
        object:
          type: string
          example: response
        status:
          type: string
          description: Statut de la réponse
          example: completed
        model:
          type: string
          example: qwen3.8-max-preview
        output:
          type: array
          description: >-
            Tableau d'éléments de sortie (contenant `message` / `reasoning` /
            appels d'outils intégrés, etc.)
          items:
            type: object
        usage:
          $ref: '#/components/schemas/Usage'
    ErrorResponse:
      type: object
      properties:
        error:
          type: object
          properties:
            code:
              type: integer
              description: Code d'erreur de statut HTTP
            message:
              type: string
              description: Description de l'erreur
            type:
              type: string
              description: Type d'erreur
            param:
              type: string
              description: Nom du paramètre concerné
    InputItem:
      type: object
      description: Élément de message d'entrée (format Chat).
      properties:
        role:
          type: string
          enum:
            - user
            - assistant
            - system
          description: Rôle du message
        content:
          description: >-
            Contenu du message. Passez une chaîne pour du texte brut ; passez un
            tableau de fragments de contenu pour le multimodal.
          oneOf:
            - type: string
            - type: array
              items:
                $ref: '#/components/schemas/InputContentPart'
    Tool:
      type: object
      description: >-
        Définition d'outil. Les outils intégrés n'ont besoin que de déclarer
        `type` ; les function personnalisées doivent fournir un nom et un schéma
        de paramètres.
      required:
        - type
      properties:
        type:
          type: string
          enum:
            - web_search
            - web_extractor
            - code_interpreter
            - function
          description: Type d'outil
        name:
          type: string
          description: Nom de la fonction lorsque `type=function`
        parameters:
          type: object
          description: JSON Schema des paramètres lorsque `type=function`
    Usage:
      type: object
      description: Statistiques d'utilisation des tokens.
      properties:
        input_tokens:
          type: integer
          description: Nombre de tokens d'entrée
          example: 45
        output_tokens:
          type: integer
          description: Nombre de tokens de sortie (réflexion incluse)
          example: 63
        total_tokens:
          type: integer
          description: Nombre total de tokens
          example: 108
        input_tokens_details:
          type: object
          description: Détail des tokens d'entrée
          properties:
            cached_tokens:
              type: integer
              description: >-
                Nombre de tokens d'entrée servis depuis le cache de session
                (lecture du cache)
              example: 0
        output_tokens_details:
          type: object
          description: Détail des tokens de sortie
          properties:
            reasoning_tokens:
              type: integer
              description: Nombre de tokens du processus de réflexion
              example: 0
        prompt_tokens_details:
          type: object
          description: >-
            Détails du cache renvoyés après activation de la mise en cache de
            session
          properties:
            cached_tokens:
              type: integer
              description: Nombre de tokens servis depuis le cache
              example: 0
            cache_creation_input_tokens:
              type: integer
              description: >-
                Nombre de tokens de cache nouvellement créés cette fois
                (écriture du cache)
              example: 0
    InputContentPart:
      type: object
      description: Fragment de contenu d'entrée Responses, le type est déclaré via `type`.
      required:
        - type
      properties:
        type:
          type: string
          enum:
            - input_text
            - input_image
          description: |-
            Type de contenu

            - `input_text` : texte
            - `input_image` : image
        text:
          type: string
          description: Contenu textuel lorsque `type=input_text`
        image_url:
          type: string
          description: >-
            URL de l'image lorsque `type=input_image`, ou data URL base64
            commençant par `data:`
  securitySchemes:
    bearerAuth:
      type: http
      scheme: bearer
      description: >-
        ##Toutes les API nécessitent une authentification Bearer Token##


        **Obtenir une clé API** :


        Visitez la [Page de gestion des clés
        API](https://evolink.ai/dashboard/keys) pour obtenir votre clé API


        **Ajouter à l'en-tête de requête** :

        ```

        Authorization: Bearer YOUR_API_KEY

        ```

````