> ## Documentation Index
> Fetch the complete documentation index at: https://evolink.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# Qwen3.8-Max-Preview - Anthropic-kompatible Schnittstelle

> > 🚧 **Dieses Modell ist noch nicht verfügbar, bleiben Sie gespannt**

- Qwen3.8-Max-Preview über das Anthropic-Messages-Protokoll aufrufen
- **System-Prompt**: über das `system`-Feld auf oberster Ebene festgelegt (nicht innerhalb von messages)
- **Multimodale Eingabe**: `content` übergibt ein Array von Inhaltsblöcken, unterstützt `text` / `image`
- **Kontext-Caching**: an einem Inhaltsblock `cache_control` hinzufügen, um explizites Caching zu deklarieren; Treffer / Erstellung siehe Antwort `usage.cache_read_input_tokens` / `usage.cache_creation_input_tokens`
- **Denkmodus**: über `thinking` aktiviert, Denken wird als `thinking`-Inhaltsblock gestreamt zurückgegeben
- **Streaming-Ausgabe**: bei `stream=true` als Anthropic-SSE-Ereignisse (`message_start` / `content_block_delta` / `message_delta` usw.) zurückgegeben

<Note>
  **BaseURL**: Die Standard-BaseURL ist `https://direct.evolink.ai`, die Textmodelle und langlebige Verbindungen besser unterstützt. `https://api.evolink.ai` ist der primäre Endpunkt für multimodale Dienste; verwenden Sie diese Adresse bei Eingaben mit Bild.
</Note>


## OpenAPI

````yaml de/api-manual/language-series/qwen3.8-max-preview/qwen3.8-max-preview-messages.json POST /v1/messages
openapi: 3.1.0
info:
  title: Qwen3.8-Max-Preview - Anthropic-kompatible Schnittstelle
  description: >-
    Anthropic-Messages-kompatible Schnittstelle von Tongyi Qianwen
    Qwen3.8-Max-Preview (`/v1/messages`).


    **Anwendungsfälle**: Clients, die das Anthropic-Messages-Protokoll
    verwenden, wie Claude Code, Claude Desktop usw.


    **Fähigkeiten**:

    - Kontextlänge **1.000.000 Token** (1M)

    - Multimodale Eingabe: `content` unterstützt Text + Bildblöcke

    - Kontext-Caching: `cache_control` als explizite Cache-Markierung, Treffer /
    Erstellung siehe Antwort `usage`

    - Denkmodus: über das Feld `thinking` gesteuert

    - Streaming-Ausgabe: inkrementelle SSE-Rückgabe
  license:
    name: MIT
  version: 1.0.0
servers:
  - url: https://direct.evolink.ai
    description: >-
      Produktionsumgebung (empfohlen, bessere Unterstützung für dauerhafte
      Verbindungen bei Textmodellen)
  - url: https://api.evolink.ai
    description: Haupt-Adresse für Multimodalität (bei Eingaben mit Bild verwenden)
security:
  - bearerAuth: []
tags: []
paths:
  /v1/messages:
    post:
      summary: Qwen3.8-Max-Preview Chat-Schnittstelle (Anthropic-Messages-kompatibel)
      description: >-
        > 🚧 **Dieses Modell ist noch nicht verfügbar, bleiben Sie gespannt**


        - Qwen3.8-Max-Preview über das Anthropic-Messages-Protokoll aufrufen

        - **System-Prompt**: über das `system`-Feld auf oberster Ebene
        festgelegt (nicht innerhalb von messages)

        - **Multimodale Eingabe**: `content` übergibt ein Array von
        Inhaltsblöcken, unterstützt `text` / `image`

        - **Kontext-Caching**: an einem Inhaltsblock `cache_control` hinzufügen,
        um explizites Caching zu deklarieren; Treffer / Erstellung siehe Antwort
        `usage.cache_read_input_tokens` / `usage.cache_creation_input_tokens`

        - **Denkmodus**: über `thinking` aktiviert, Denken wird als
        `thinking`-Inhaltsblock gestreamt zurückgegeben

        - **Streaming-Ausgabe**: bei `stream=true` als Anthropic-SSE-Ereignisse
        (`message_start` / `content_block_delta` / `message_delta` usw.)
        zurückgegeben
      operationId: createMessageQwen38MaxPreview
      requestBody:
        required: true
        content:
          application/json:
            schema:
              $ref: '#/components/schemas/CreateMessageRequest'
            examples:
              basic:
                summary: Grundlegendes Gespräch
                value:
                  model: qwen3.8-max-preview
                  max_tokens: 1024
                  system: You are a helpful assistant.
                  messages:
                    - role: user
                      content: Hallo, stell dich bitte vor
              explicit_cache:
                summary: Explizites Caching (system + cache_control)
                value:
                  model: qwen3.8-max-preview
                  max_tokens: 1024
                  system:
                    - type: text
                      text: <stabiler System-Prompt mit über 1024 Token ……>
                      cache_control:
                        type: ephemeral
                  messages:
                    - role: user
                      content: Beantworte die Frage auf Grundlage des obigen Kontexts
              multimodal:
                summary: Multimodale Eingabe (Bildblock)
                value:
                  model: qwen3.8-max-preview
                  max_tokens: 1024
                  messages:
                    - role: user
                      content:
                        - type: text
                          text: Beschreibe dieses Bild
                        - type: image
                          source:
                            type: url
                            url: https://example.com/image.jpg
      responses:
        '200':
          description: Erfolgreich generiert
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/MessageResponse'
        '400':
          description: Ungültige Anfrageparameter
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                type: error
                error:
                  type: invalid_request_error
                  message: max_tokens is required
        '401':
          description: Nicht autorisiert, ungültiges oder abgelaufenes Token
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                type: error
                error:
                  type: authentication_error
                  message: Invalid or expired token
        '402':
          description: Unzureichendes Guthaben
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                type: error
                error:
                  type: insufficient_quota
                  message: Insufficient credits
        '429':
          description: Zu viele Anfragen (Ratenbegrenzung)
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
        '500':
          description: Interner Serverfehler
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
components:
  schemas:
    CreateMessageRequest:
      type: object
      required:
        - model
        - max_tokens
        - messages
      properties:
        model:
          type: string
          enum:
            - qwen3.8-max-preview
          example: qwen3.8-max-preview
          description: Name des Chat-Modells
        max_tokens:
          type: integer
          description: >-
            Maximale Anzahl der Token für den generierten Inhalt.


            > **Erforderlich** (vom Anthropic-Protokoll vorgeschrieben). Wenn
            das Modell mehr als diesen Wert generiert, wird abgeschnitten.
          example: 1024
        messages:
          type: array
          description: >-
            Liste der Gesprächsnachrichten (ohne system). Jede Nachricht enthält
            `role` (`user` / `assistant`) und `content` (String oder Array von
            Inhaltsblöcken).
          items:
            $ref: '#/components/schemas/InputMessage'
        system:
          description: >-
            System-Prompt. Als Klartext einen String übergeben; zum Deklarieren
            von explizitem Caching ein Array von Inhaltsblöcken übergeben (mit
            `cache_control` am Block).
          oneOf:
            - type: string
            - type: array
              items:
                $ref: '#/components/schemas/ContentBlock'
        temperature:
          type: number
          description: Sampling-Temperatur, Wertebereich `[0, 2]`.
          minimum: 0
          maximum: 2
        top_p:
          type: number
          description: Nucleus-Sampling-Parameter, Wertebereich `(0, 1]`.
          minimum: 0
          maximum: 1
        top_k:
          type: integer
          description: Sampelt aus den K Token mit der höchsten Wahrscheinlichkeit.
        stop_sequences:
          type: array
          items:
            type: string
          description: >-
            Benutzerdefinierte Stoppsequenzen; bei Treffer wird die Generierung
            gestoppt.
        stream:
          type: boolean
          description: Ob als Anthropic-SSE-Ereignisse gestreamt zurückgegeben wird.
          default: false
        thinking:
          type: object
          description: >-
            Konfiguration für den Tiefdenkmodus. Nach Aktivierung gibt das
            Modell den Denkprozess als `thinking`-Inhaltsblock zurück.
          properties:
            type:
              type: string
              enum:
                - enabled
                - disabled
              description: Ob der Tiefdenkmodus aktiviert wird
        tools:
          type: array
          description: >-
            Liste der Werkzeugdefinitionen (Anthropic-tools-Format) für Function
            Calling.
          items:
            $ref: '#/components/schemas/Tool'
    MessageResponse:
      type: object
      properties:
        id:
          type: string
          example: msg_xxxxxxxx
        type:
          type: string
          example: message
        role:
          type: string
          example: assistant
        model:
          type: string
          example: qwen3.8-max-preview
        content:
          type: array
          description: Array von Antwort-Inhaltsblöcken
          items:
            $ref: '#/components/schemas/OutputContentBlock'
        stop_reason:
          type: string
          description: >-
            Grund für den Stopp: `end_turn` (normales Ende), `max_tokens`
            (Obergrenze erreicht), `stop_sequence` (Stoppsequenz getroffen),
            `tool_use` (Werkzeugaufruf erforderlich)
          example: end_turn
        usage:
          $ref: '#/components/schemas/AnthropicUsage'
    ErrorResponse:
      type: object
      properties:
        type:
          type: string
          example: error
        error:
          type: object
          properties:
            type:
              type: string
              description: Fehlertyp
            message:
              type: string
              description: Fehlerbeschreibung
    InputMessage:
      type: object
      required:
        - role
        - content
      properties:
        role:
          type: string
          enum:
            - user
            - assistant
          description: Nachrichtenrolle
        content:
          description: >-
            Nachrichteninhalt. Als Klartext einen String übergeben; bei
            Multimodalität oder explizitem Caching ein Array von Inhaltsblöcken
            übergeben.
          oneOf:
            - type: string
            - type: array
              items:
                $ref: '#/components/schemas/ContentBlock'
    ContentBlock:
      type: object
      description: >-
        Inhaltsblock, dessen Typ über `type` deklariert wird. An jedem Block
        kann `cache_control` zum Deklarieren von explizitem Caching angehängt
        werden.
      required:
        - type
      properties:
        type:
          type: string
          enum:
            - text
            - image
            - thinking
            - tool_use
            - tool_result
          description: |-
            Inhaltsblocktyp

            - `text`: Textblock
            - `image`: Bildblock
            - `thinking`: Denkblock (erscheint in der Antwort)
            - `tool_use` / `tool_result`: Werkzeugaufruf und Ergebnis
        text:
          type: string
          description: Textinhalt, wenn `type=text`
        source:
          type: object
          description: Bildquelle (wenn `type=image`). Unterstützt JPEG / PNG / GIF / WEBP.
          properties:
            type:
              type: string
              enum:
                - url
                - base64
              description: 'Quellentyp: `url` (Bildlink) oder `base64` (Inline-Daten)'
            url:
              type: string
              description: Bildlink, wenn `type=url`
            media_type:
              type: string
              description: MIME-Typ, wenn `type=base64`, z.B. `image/jpeg`
              example: image/jpeg
            data:
              type: string
              description: base64-Bilddaten, wenn `type=base64`
        cache_control:
          $ref: '#/components/schemas/CacheControl'
    Tool:
      type: object
      description: Anthropic-Werkzeugdefinition.
      required:
        - name
      properties:
        name:
          type: string
          description: Werkzeugname
        description:
          type: string
          description: Beschreibung des Werkzeugzwecks
        input_schema:
          type: object
          description: JSON-Schema der Werkzeugeingabeparameter
    OutputContentBlock:
      type: object
      properties:
        type:
          type: string
          description: 'Inhaltsblocktyp: `text` / `thinking` / `tool_use`'
          example: text
        text:
          type: string
          description: Textinhalt, wenn `type=text`
          example: Hallo! Ich bin Tongyi Qianwen Qwen3.8-Max-Preview.
    AnthropicUsage:
      type: object
      description: >-
        Statistik zur Token-Nutzung (Anthropic-Semantik: `input_tokens` enthält
        keinen Cache und wird disjunkt zu den Cache-Feldern addiert).
      properties:
        input_tokens:
          type: integer
          description: Anzahl der Eingabe-Token (ohne Cache-Anteil)
          example: 12
        output_tokens:
          type: integer
          description: Anzahl der Ausgabe-Token (einschließlich Denken)
          example: 104
        cache_creation_input_tokens:
          type: integer
          description: >-
            Anzahl der in diesem Aufruf neu erstellten Cache-Token
            (Cache-Schreiben)
          example: 0
        cache_read_input_tokens:
          type: integer
          description: Anzahl der aus dem Cache gelieferten Token (Cache-Lesen)
          example: 0
    CacheControl:
      type: object
      description: >-
        Explizite Cache-Markierung (Prompt-Caching). Das System erstellt /
        trifft Cache-Blöcke, indem es von der Position dieser Markierung aus
        rückwärts geht.


        - Minimale cachebare Länge **1024 Token**, Gültigkeit **5 Minuten**
        (wird bei Treffer zurückgesetzt)

        - Maximal **4** Cache-Markierungen pro Anfrage

        - Treffer siehe Antwort `usage.cache_read_input_tokens`, Erstellung
        siehe `usage.cache_creation_input_tokens`
      required:
        - type
      properties:
        type:
          type: string
          enum:
            - ephemeral
          description: Cache-Typ, fest auf `ephemeral` (5-minütiger temporärer Cache)
  securitySchemes:
    bearerAuth:
      type: http
      scheme: bearer
      description: >-
        ##Alle APIs erfordern eine Bearer-Token-Authentifizierung##


        **API-Schlüssel abrufen**:


        Besuchen Sie die
        [API-Schlüsselverwaltung](https://evolink.ai/dashboard/keys), um Ihren
        API-Schlüssel abzurufen


        **Zum Anfrage-Header hinzufügen**:

        ```

        Authorization: Bearer YOUR_API_KEY

        ```

````