> ## Documentation Index
> Fetch the complete documentation index at: https://evolink.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# EvoLink Auto - Intelligentes Modell-Routing

> Das System wählt automatisch das am besten geeignete Modell zur Verarbeitung der Anfrage aus

## Intelligentes Modell-Routing

EvoLink Auto ist eine intelligente Modell-Routing-Funktion, die automatisch ein geeignetes KI-Modell basierend auf Ihrem Anforderungsinhalt auswählt, ohne manuelle Modellspezifikation.

### Hauptvorteile

* **Intelligentes Matching**: Analysiert automatisch den Anforderungsinhalt und wählt ein geeignetes Modell aus
* **Kostenoptimierung**: Priorisiert kosteneffiziente Modelle bei gleichzeitiger Qualitätserhaltung
* **Lastverteilung**: Verteilt Anfragen automatisch auf mehrere Modelle für verbesserte Stabilität
* **Transparenz**: Gibt den tatsächlich verwendeten Modellnamen in der Antwort zurück für Tracking und Optimierung

### Funktionsweise

Das System wählt das am besten passende Modell aus dem Modellpool basierend auf Komplexität, Länge und Typ der Anfrage aus.

### Unterstützte Modelle

EvoLink Auto routet intelligent zwischen führenden KI-Modellen wie GPT-4, GPT-3.5, Claude, Gemini und mehr.

### Einschränkungen

* Nicht geeignet für Szenarien, die spezifische Modellfähigkeiten erfordern (z.B. GPT-4 Vision-Funktionen)
* Garantiert nicht dasselbe Modell für jede Anfrage

### Anwendungsfälle

Ideal für Szenarien, in denen Sie unsicher sind, welches Modell Sie verwenden sollen, oder wenn das System die Modellauswahl automatisch optimieren soll.

<Note>
  Setzen Sie einfach den `model`-Parameter auf `evolink/auto`, und das System wählt automatisch ein geeignetes Modell für Sie aus.
</Note>

<Note>
  **BaseURL**: Die Standard-BaseURL ist `https://direct.evolink.ai` und bietet bessere Unterstützung für Textmodelle sowie persistente Verbindungen. `https://api.evolink.ai` ist der primäre Endpunkt für multimodale Dienste und dient bei Textmodellen als Ausweichadresse.
</Note>


## OpenAPI

````yaml de/api-manual/language-series/evolink-auto/evolink-auto-quickstart.json POST /v1/chat/completions
openapi: 3.1.0
info:
  title: EvoLink Auto - Intelligente Modellauswahl
  description: >-
    Intelligente Modell-Routing-Funktion, das System wählt automatisch das am
    besten geeignete KI-Modell aus
  license:
    name: MIT
  version: 1.0.0
servers:
  - url: https://direct.evolink.ai
    description: Produktion (empfohlen)
  - url: https://api.evolink.ai
    description: Alternative URL
security:
  - bearerAuth: []
paths:
  /v1/chat/completions:
    post:
      tags:
        - Intelligentes Routing
      summary: Intelligentes Modell-Routing
      description: >-
        Das System wählt automatisch das am besten geeignete Modell zur
        Verarbeitung der Anfrage aus
      operationId: createChatCompletionAuto
      requestBody:
        required: true
        content:
          application/json:
            schema:
              $ref: '#/components/schemas/AutoRequest'
      responses:
        '200':
          description: Anfrage erfolgreich
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ChatCompletionResponse'
        '400':
          description: Ungültige Anfrageparameter
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 400
                  message: Invalid request parameters
                  type: invalid_request_error
        '401':
          description: Nicht authentifiziert, ungültiges oder abgelaufenes Token
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 401
                  message: Invalid or expired token
                  type: authentication_error
        '402':
          description: Unzureichendes Kontingent, Aufladung erforderlich
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 402
                  message: Insufficient quota
                  type: insufficient_quota_error
                  fallback_suggestion: https://evolink.ai/dashboard/billing
        '403':
          description: Zugriff verweigert
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 403
                  message: Access denied for this feature
                  type: permission_error
        '429':
          description: Ratenlimit überschritten
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 429
                  message: Rate limit exceeded
                  type: rate_limit_error
                  fallback_suggestion: retry after 60 seconds
        '500':
          description: Interner Serverfehler
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 500
                  message: Internal server error
                  type: internal_server_error
                  fallback_suggestion: try again later
        '502':
          description: Upstream-Dienstfehler
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 502
                  message: Upstream AI service unavailable
                  type: upstream_error
                  fallback_suggestion: try again later
        '503':
          description: Dienst vorübergehend nicht verfügbar
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 503
                  message: Service temporarily unavailable
                  type: service_unavailable_error
                  fallback_suggestion: retry after 30 seconds
components:
  schemas:
    AutoRequest:
      type: object
      required:
        - model
        - messages
      properties:
        model:
          type: string
          description: Intelligentes Routing verwenden
          enum:
            - evolink/auto
          default: evolink/auto
          example: evolink/auto
        messages:
          type: array
          description: Liste der Gesprächsnachrichten
          items:
            $ref: '#/components/schemas/MessageInput'
          minItems: 1
          example:
            - role: user
              content: >-
                Stellen Sie die Entwicklungsgeschichte der künstlichen
                Intelligenz vor
        temperature:
          type: number
          description: |-
            Sampling-Temperatur, steuert die Zufälligkeit der Ausgabe

            **Hinweis**:
            - Niedrigere Werte (z.B. 0.2): Bestimmtere, fokussiertere Ausgabe
            - Höhere Werte (z.B. 1.5): Zufälligere, kreativere Ausgabe
          minimum: 0
          maximum: 2
          example: 0.7
        top_p:
          type: number
          description: >-
            Nucleus-Sampling-Parameter


            **Hinweis**:

            - Steuert, aus wie vielen Tokens mit kumulierter Wahrscheinlichkeit
            gesampelt wird

            - Z.B. bedeutet 0.9, dass aus Tokens mit einer kumulierten
            Wahrscheinlichkeit von 90% ausgewählt wird

            - Standardwert: 1.0 (alle Tokens berücksichtigen)


            **Empfehlung**: Passen Sie temperature und top_p nicht gleichzeitig
            an
          minimum: 0
          maximum: 1
          example: 0.9
        top_k:
          type: integer
          description: >-
            Top-K-Sampling-Parameter


            **Hinweis**:

            - Z.B. bedeutet 10, dass beim Sampling nur die 10 wahrscheinlichsten
            Tokens berücksichtigt werden

            - Kleinere Werte erzeugen fokussiertere Ausgaben

            - Standardmäßig unbegrenzt
          minimum: 1
          example: 40
        stream:
          type: boolean
          description: >-
            Ob die Antwort als Stream zurückgegeben werden soll


            - `true`: Streaming-Rückgabe, Inhalt wird blockweise in Echtzeit
            zurückgegeben

            - `false`: Warten auf die vollständige Antwort und einmalige
            Rückgabe
          default: false
          example: false
    ChatCompletionResponse:
      type: object
      properties:
        id:
          type: string
          description: Eindeutiger Bezeichner für die Chat-Vervollständigung
          example: chatcmpl-20260308112637503180122ABCD1234
        model:
          type: string
          description: Name des tatsächlich verwendeten Modells
          example: gpt-5.4
        object:
          type: string
          enum:
            - chat.completion
          description: Antworttyp
          example: chat.completion
        created:
          type: integer
          description: Erstellungszeitstempel
          example: 1741428397
        choices:
          type: array
          description: Liste der generierten Vervollständigungsoptionen
          items:
            $ref: '#/components/schemas/Choice'
        usage:
          $ref: '#/components/schemas/Usage'
    ErrorResponse:
      type: object
      properties:
        error:
          type: object
          properties:
            code:
              type: integer
              description: HTTP-Status-Fehlercode
            message:
              type: string
              description: Fehlermeldung
            type:
              type: string
              description: Fehlertyp
            param:
              type: string
              description: Zugehöriger Parametername
            fallback_suggestion:
              type: string
              description: Vorschlag zur Fehlerbehebung
    MessageInput:
      type: object
      required:
        - role
        - content
      properties:
        role:
          type: string
          description: Nachrichtenrolle
          enum:
            - system
            - user
            - assistant
        content:
          type: string
          description: Nachrichteninhalt
    Choice:
      type: object
      properties:
        index:
          type: integer
          description: Index dieser Option
          example: 0
        message:
          $ref: '#/components/schemas/AssistantMessage'
        finish_reason:
          type: string
          description: Grund für den Abschluss
          enum:
            - stop
            - length
            - content_filter
          example: stop
    Usage:
      type: object
      description: Token-Nutzungsstatistiken
      properties:
        prompt_tokens:
          type: integer
          description: Anzahl der Tokens in der Eingabe
          example: 15
        completion_tokens:
          type: integer
          description: Anzahl der Tokens in der Ausgabe
          example: 120
        total_tokens:
          type: integer
          description: Gesamtanzahl der Tokens
          example: 135
    AssistantMessage:
      type: object
      properties:
        role:
          type: string
          description: Rolle des Nachrichtenabsenders
          enum:
            - assistant
          example: assistant
        content:
          type: string
          description: Antwortinhalt der KI
          example: >-
            Die Entwicklungsgeschichte der künstlichen Intelligenz reicht bis in
            die 1950er Jahre zurück...
  securitySchemes:
    bearerAuth:
      type: http
      scheme: bearer
      description: >-
        ## Alle APIs erfordern Bearer-Token-Authentifizierung ##


        **API-Schlüssel erhalten:**


        Besuchen Sie die
        [API-Schlüssel-Verwaltungsseite](https://evolink.ai/dashboard/keys), um
        Ihren API-Schlüssel zu erhalten


        **Zum Anfrage-Header hinzufügen:**

        ```

        Authorization: Bearer YOUR_API_KEY

        ```
      bearerFormat: sk-evo-xxxxxxxxxx

````