> ## Documentation Index
> Fetch the complete documentation index at: https://evolink.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# Qwen3.8-Max-Preview - Documentation complète des paramètres

> > 🚧 **Ce modele n'est pas encore disponible, restez a l'ecoute**

- Appelez Qwen3.8-Max-Preview avec le protocole OpenAI Chat Completions
- **Conversation multi-tour** : prend en charge la conversation contextuelle à un ou plusieurs tours
- **Prompt système** : définissez le rôle et le comportement de l'IA via un message `role=system`
- **Entrée multimodale** : `content` reçoit un tableau de content part, prenant en charge `text` / `image_url` / `input_audio` / `video_url`
- **Mise en cache du contexte** : ajoutez `cache_control` sur un content part pour déclarer un cache explicite ; voir les correspondances dans la réponse `usage.prompt_tokens_details`
- **Mode réflexion** : activé avec `enable_thinking=true`, le contenu de réflexion est renvoyé via `reasoning_content`
- **Sortie en streaming** : lorsque `stream=true`, le retour se fait bloc par bloc via SSE

<Note>
  **À propos de la BaseURL** : la BaseURL par défaut est `https://direct.evolink.ai`, qui offre une meilleure prise en charge des modèles de texte et des connexions longues ; `https://api.evolink.ai` est l'adresse principale multimodale, à utiliser en cas d'entrée image / audio / vidéo.
</Note>


## OpenAPI

````yaml fr/api-manual/language-series/qwen3.8-max-preview/qwen3.8-max-preview-chat.json POST /v1/chat/completions
openapi: 3.1.0
info:
  title: >-
    Qwen3.8-Max-Preview - Documentation complète des paramètres (compatible
    OpenAI)
  description: >-
    Référence de l'API de l'interface de conversation Qwen3.8-Max-Preview
    (compatible OpenAI Chat Completions).


    **Capacités du modèle** :

    - Longueur de contexte : **1 000 000 tokens** (1M)

    - Mode réflexion : activé via `enable_thinking`, le contenu de réflexion est
    renvoyé via `reasoning_content`

    - Entrée multimodale : `content` prend en charge le mélange de texte + image
    / audio / vidéo

    - Mise en cache du contexte : prend en charge le cache explicite
    (`cache_control`) et le cache implicite, les correspondances réduisent
    considérablement les coûts

    - Appel d'outils : prend en charge Function Calling

    - Sortie en streaming : prend en charge le retour en flux SSE
  license:
    name: MIT
  version: 1.0.0
servers:
  - url: https://direct.evolink.ai
    description: >-
      Environnement de production (recommandé, meilleure prise en charge des
      connexions longues pour les modèles de texte)
  - url: https://api.evolink.ai
    description: >-
      Adresse principale multimodale (à utiliser avec une entrée image / audio /
      vidéo)
security:
  - bearerAuth: []
tags: []
paths:
  /v1/chat/completions:
    post:
      summary: Interface de conversation Qwen3.8-Max-Preview (compatible OpenAI)
      description: >-
        > 🚧 **Ce modele n'est pas encore disponible, restez a l'ecoute**


        - Appelez Qwen3.8-Max-Preview avec le protocole OpenAI Chat Completions

        - **Conversation multi-tour** : prend en charge la conversation
        contextuelle à un ou plusieurs tours

        - **Prompt système** : définissez le rôle et le comportement de l'IA via
        un message `role=system`

        - **Entrée multimodale** : `content` reçoit un tableau de content part,
        prenant en charge `text` / `image_url` / `input_audio` / `video_url`

        - **Mise en cache du contexte** : ajoutez `cache_control` sur un content
        part pour déclarer un cache explicite ; voir les correspondances dans la
        réponse `usage.prompt_tokens_details`

        - **Mode réflexion** : activé avec `enable_thinking=true`, le contenu de
        réflexion est renvoyé via `reasoning_content`

        - **Sortie en streaming** : lorsque `stream=true`, le retour se fait
        bloc par bloc via SSE
      operationId: createChatCompletionQwen38MaxPreview
      requestBody:
        required: true
        content:
          application/json:
            schema:
              $ref: '#/components/schemas/ChatCompletionRequest'
            examples:
              basic:
                summary: Conversation textuelle de base
                value:
                  model: qwen3.8-max-preview
                  messages:
                    - role: system
                      content: You are a helpful assistant.
                    - role: user
                      content: Bonjour, présente-toi
              multimodal:
                summary: Entrée multimodale (image)
                value:
                  model: qwen3.8-max-preview
                  messages:
                    - role: user
                      content:
                        - type: text
                          text: Décris le contenu de cette image
                        - type: image_url
                          image_url:
                            url: https://example.com/image.jpg
              explicit_cache:
                summary: Cache explicite (cache_control)
                value:
                  model: qwen3.8-max-preview
                  messages:
                    - role: system
                      content:
                        - type: text
                          text: <invite système stable de plus de 1024 tokens...>
                          cache_control:
                            type: ephemeral
                    - role: user
                      content: >-
                        Réponds à la question en te basant sur le contexte
                        ci-dessus
      responses:
        '200':
          description: Génération de la conversation réussie
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ChatCompletionResponse'
        '400':
          description: Paramètres de requête invalides
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 400
                  message: Invalid request parameters
                  type: invalid_request_error
        '401':
          description: Non authentifié, jeton invalide ou expiré
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 401
                  message: Invalid or expired token
                  type: authentication_error
        '402':
          description: Solde insuffisant
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 402
                  message: Insufficient credits
                  type: insufficient_quota
        '429':
          description: Requêtes trop fréquentes (limitation de débit)
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 429
                  message: Rate limit exceeded
                  type: rate_limit_error
        '500':
          description: Erreur interne du serveur
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 500
                  message: Internal server error
                  type: server_error
components:
  schemas:
    ChatCompletionRequest:
      type: object
      required:
        - model
        - messages
      properties:
        model:
          type: string
          description: Nom du modèle de conversation
          enum:
            - qwen3.8-max-preview
          example: qwen3.8-max-preview
        messages:
          type: array
          description: >-
            Liste des messages de conversation, prend en charge la conversation
            multi-tour. Les champs de message diffèrent selon le rôle (system /
            user / assistant / tool), veuillez sélectionner le rôle
            correspondant pour les consulter.
          items:
            oneOf:
              - $ref: '#/components/schemas/SystemMessage'
              - $ref: '#/components/schemas/UserMessage'
              - $ref: '#/components/schemas/AssistantRequestMessage'
              - $ref: '#/components/schemas/ToolMessage'
        enable_thinking:
          type: boolean
          description: >-
            Activer ou non la réflexion approfondie


            - `true` : le modèle produit son processus de réflexion, renvoyé via
            `reasoning_content`

            - `false` (par défaut) : ne produit pas le processus de réflexion


            > Remarque : certains modèles nécessitent de définir explicitement
            `true` en appel non-streaming pour renvoyer le contenu de réflexion.
          default: false
        temperature:
          type: number
          description: >-
            Température d'échantillonnage, contrôle le caractère aléatoire de la
            sortie. Les valeurs plus basses sont plus déterministes, les plus
            élevées plus variées. Plage `[0, 2]`. Il est recommandé de ne pas
            ajuster temperature et top_p en même temps.
          minimum: 0
          maximum: 2
        top_p:
          type: number
          description: >-
            Paramètre d'échantillonnage nucleus (Nucleus Sampling),
            échantillonne parmi les premiers tokens cumulant la probabilité.
            Plage `(0, 1]`. Il est recommandé de ne pas ajuster temperature et
            top_p en même temps.
          minimum: 0
          maximum: 1
        max_completion_tokens:
          type: integer
          description: >-
            Limite supérieure de longueur du contenu généré (nombre de tokens),
            **incluant la chaîne de réflexion et la réponse**. Ce paramètre est
            recommandé pour les modèles de réflexion. La valeur par défaut et la
            valeur maximale correspondent à la longueur de sortie maximale du
            modèle ; au-delà, la génération s'arrête prématurément avec
            `finish_reason=length`.
        max_tokens:
          type: integer
          description: >-
            Ancien paramètre de limitation de longueur de génération.


            > **Déprécié** : pour les nouvelles intégrations, utilisez plutôt
            `max_completion_tokens`. Ce paramètre ne limite que la partie
            réponse (hors chaîne de réflexion).
        stream:
          type: boolean
          description: >-
            Renvoyer ou non la réponse en streaming.


            - `true` : retour bloc par bloc via SSE (Server-Sent Events)

            - `false` (par défaut) : renvoie la réponse complète en une seule
            fois
          default: false
        stream_options:
          type: object
          description: >-
            Options de réponse en streaming, valides uniquement lorsque
            `stream=true`.
          properties:
            include_usage:
              type: boolean
              description: >-
                Lorsque `true`, renvoie un bloc de données supplémentaire
                contenant uniquement `usage` avant la fin du flux.
        tools:
          type: array
          description: >-
            Liste de définitions d'outils, utilisée pour Function Calling.
            Chaque outil doit définir un nom, une description et un schéma de
            paramètres.
          items:
            $ref: '#/components/schemas/Tool'
    ChatCompletionResponse:
      type: object
      properties:
        id:
          type: string
          description: Identifiant unique de cette conversation
          example: chatcmpl-xxxxxxxx
        object:
          type: string
          example: chat.completion
        created:
          type: integer
          description: Heure de création (secondes Unix)
          example: 1735120033
        model:
          type: string
          example: qwen3.8-max-preview
        choices:
          type: array
          items:
            $ref: '#/components/schemas/Choice'
        usage:
          $ref: '#/components/schemas/Usage'
    ErrorResponse:
      type: object
      properties:
        error:
          type: object
          properties:
            code:
              type: integer
              description: Code d'erreur de statut HTTP
            message:
              type: string
              description: Description de l'erreur
            type:
              type: string
              description: Type d'erreur
            param:
              type: string
              description: Nom du paramètre concerné
    SystemMessage:
      type: object
      title: System Message
      required:
        - role
        - content
      properties:
        role:
          type: string
          enum:
            - system
          description: Rôle du message, fixé à `system`
        content:
          description: >-
            Instruction système. Passez une chaîne pour du texte brut ; passez
            un tableau de content part pour déclarer un cache explicite.
          oneOf:
            - type: string
            - type: array
              items:
                $ref: '#/components/schemas/ContentPart'
    UserMessage:
      type: object
      title: User Message
      required:
        - role
        - content
      properties:
        role:
          type: string
          enum:
            - user
          description: Rôle du message, fixé à `user`
        content:
          description: >-
            Contenu du message utilisateur.


            - Passez directement une chaîne pour du texte brut

            - Pour le multimodal ou un cache explicite, passez un tableau de
            content part, prenant en charge `text` / `image_url` / `input_audio`
            / `video_url`
          oneOf:
            - type: string
            - type: array
              items:
                $ref: '#/components/schemas/ContentPart'
    AssistantRequestMessage:
      type: object
      title: Assistant Message
      required:
        - role
      properties:
        role:
          type: string
          enum:
            - assistant
          description: Rôle du message, fixé à `assistant`
        content:
          description: >-
            Contenu des réponses historiques de l'assistant. Peut être une
            chaîne ou un tableau de content part.
          oneOf:
            - type: string
            - type: array
              items:
                $ref: '#/components/schemas/ContentPart'
        tool_calls:
          type: array
          description: >-
            Liste des appels d'outils initiés par l'assistant au tour précédent
            (pour reconstituer l'historique de Function Calling).
          items:
            type: object
    ToolMessage:
      type: object
      title: Tool Message
      required:
        - role
        - content
        - tool_call_id
      properties:
        role:
          type: string
          enum:
            - tool
          description: Rôle du message, fixé à `tool` (résultat d'exécution de l'outil)
        content:
          description: >-
            Contenu du résultat d'exécution de l'outil. Peut être une chaîne ou
            un tableau de content part.
          oneOf:
            - type: string
            - type: array
              items:
                $ref: '#/components/schemas/ContentPart'
        tool_call_id:
          type: string
          description: ID de l'appel d'outil correspondant
    Tool:
      type: object
      description: Définition d'outil Function Calling.
      required:
        - type
        - function
      properties:
        type:
          type: string
          enum:
            - function
          description: Type d'outil, fixé à `function`
        function:
          type: object
          required:
            - name
          properties:
            name:
              type: string
              description: Nom de la fonction
            description:
              type: string
              description: Description de l'usage de la fonction
            parameters:
              type: object
              description: JSON Schema des paramètres de la fonction
    Choice:
      type: object
      properties:
        index:
          type: integer
          example: 0
        message:
          $ref: '#/components/schemas/AssistantMessage'
        finish_reason:
          type: string
          description: |-
            Raison de l'arrêt

            - `stop` : fin normale
            - `length` : limite `max_completion_tokens` atteinte
            - `tool_calls` : appel d'outil nécessaire
          example: stop
    Usage:
      type: object
      description: Statistiques d'utilisation des tokens.
      properties:
        prompt_tokens:
          type: integer
          description: Nombre de tokens d'entrée
          example: 3019
        completion_tokens:
          type: integer
          description: Nombre de tokens de sortie (réflexion incluse)
          example: 104
        total_tokens:
          type: integer
          description: Nombre total de tokens
          example: 3123
        completion_tokens_details:
          type: object
          description: Détail des tokens de sortie
          properties:
            reasoning_tokens:
              type: integer
              description: Nombre de tokens du processus de réflexion
              example: 0
        prompt_tokens_details:
          type: object
          description: Détail du cache des tokens d'entrée
          properties:
            cached_tokens:
              type: integer
              description: >-
                Nombre de tokens d'entrée servis depuis le cache (lecture du
                cache)
              example: 2048
            cache_creation_input_tokens:
              type: integer
              description: >-
                Nombre de tokens de cache nouvellement créés cette fois
                (écriture du cache, renvoyé pour le cache explicite)
              example: 0
    ContentPart:
      type: object
      description: >-
        Fragment de contenu multimodal, le type est déclaré via `type`, ne
        remplissez que les champs correspondant à ce type. Vous pouvez attacher
        `cache_control` à n'importe quel fragment pour déclarer un cache
        explicite.
      required:
        - type
      properties:
        type:
          type: string
          enum:
            - text
            - image_url
            - input_audio
            - video_url
          description: |-
            Type de contenu

            - `text` : bloc de texte
            - `image_url` : entrée image
            - `input_audio` : entrée audio
            - `video_url` : entrée fichier vidéo
        text:
          type: string
          description: Contenu textuel lorsque `type=text`
        image_url:
          type: object
          description: >-
            Entrée image (lorsque `type=image_url`). Prend en charge JPEG / PNG
            / GIF / WEBP.
          required:
            - url
          properties:
            url:
              type: string
              description: URL de l'image, ou data URL base64 commençant par `data:`
            detail:
              type: string
              description: |-
                Précision d'analyse de l'image

                - `low` : basse précision, consomme moins de tokens
                - `high` : haute précision, reconnaissance plus fine
                - `auto` (par défaut) : déterminé automatiquement par le modèle
              enum:
                - low
                - high
                - auto
              default: auto
        input_audio:
          type: object
          description: Entrée audio (lorsque `type=input_audio`).
          required:
            - data
            - format
          properties:
            data:
              type: string
              description: URL audio, ou data URL base64 commençant par `data:`
            format:
              type: string
              description: Format audio, tel que `mp3`, `wav`, etc.
        video_url:
          type: object
          description: Entrée fichier vidéo (lorsque `type=video_url`).
          required:
            - url
          properties:
            url:
              type: string
              description: URL du fichier vidéo, ou data URL base64 commençant par `data:`
        cache_control:
          type: object
          description: >-
            Marqueur de cache explicite. Le système remonte en arrière à partir
            de la position de ce marqueur comme point final pour créer / faire
            correspondre un bloc de cache.


            - Longueur minimale pouvant être mise en cache **1024 tokens**,
            durée de validité **5 minutes** (réinitialisée après une
            correspondance)

            - Au maximum **4** marqueurs de cache par requête

            - Mutuellement exclusif avec le cache implicite, une seule des deux
            méthodes s'applique par requête


            Voir les correspondances / créations dans la réponse
            `usage.prompt_tokens_details`.
          required:
            - type
          properties:
            type:
              type: string
              enum:
                - ephemeral
              description: >-
                Type de cache, fixé à `ephemeral` (cache temporaire de 5
                minutes)
    AssistantMessage:
      type: object
      description: Message de réponse de l'assistant.
      properties:
        role:
          type: string
          example: assistant
        content:
          type: string
          description: Corps de la réponse
          example: Bonjour ! Je suis Qwen3.8-Max-Preview.
        reasoning_content:
          type: string
          description: >-
            Contenu du processus de réflexion (renvoyé lorsque
            `enable_thinking=true`)
        tool_calls:
          type: array
          description: Liste des appels d'outils initiés par le modèle
          items:
            type: object
  securitySchemes:
    bearerAuth:
      type: http
      scheme: bearer
      description: >-
        ##Toutes les API nécessitent une authentification Bearer Token##


        **Obtenir une clé API** :


        Visitez la [Page de gestion des clés
        API](https://evolink.ai/dashboard/keys) pour obtenir votre clé API


        **Ajouter à l'en-tête de requête** :

        ```

        Authorization: Bearer YOUR_API_KEY

        ```

````