> ## Documentation Index
> Fetch the complete documentation index at: https://evolink.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# GPT Schnittstelle für alle Modelle - Schnellstart Responses

> - Aufruf von GPT-Textmodellen im OpenAI-Responses-Format (das konkrete Modell wird über den Parameter `model` gewählt)
- Modelle für Reasoning und Werkzeugaufrufe, unterstützen gemischte Text- und Bildeingaben
- Diese API unterstützt serverseitige Tools: Websuche, Codeausführung und Dokumentensuche
- Mehrere Gesprächsrunden lassen sich mit `previous_response_id` verketten, ohne den Verlauf erneut zu übertragen
- 💡 Sie benötigen Werkzeuge und alle Parameter? Siehe die [vollständige Parameterdokumentation](./responses-reference)

<Note>
  **BaseURL**: Die Standard-BaseURL ist `https://direct.evolink.ai` und bietet bessere Unterstützung für Textmodelle sowie persistente Verbindungen. `https://api.evolink.ai` ist der primäre Endpunkt für multimodale Dienste und dient bei Textmodellen als Ausweichadresse.
</Note>


## OpenAPI

````yaml de/api-manual/language-series/gpt/responses/responses-quickstart.json POST /v1/responses
openapi: 3.1.0
info:
  title: GPT Schnittstelle für alle Modelle - Schnellstart Responses
  description: >-
    Schnellstart-Beispiele für den Aufruf von GPT-Textmodellen über die
    OpenAI-kompatible Responses API (serverseitige Tools werden auf dieser API
    bereitgestellt).
  license:
    name: MIT
  version: 1.0.0
servers:
  - url: https://direct.evolink.ai
    description: Produktion (empfohlen)
  - url: https://api.evolink.ai
    description: Alternative URL
security:
  - bearerAuth: []
tags:
  - name: Responses
    description: OpenAI Responses API mit serverseitigen Tools
paths:
  /v1/responses:
    post:
      tags:
        - Responses
      summary: GPT Schnellantwort (alle Modelle)
      description: >-
        - Aufruf von GPT-Textmodellen im OpenAI-Responses-Format (das konkrete
        Modell wird über den Parameter `model` gewählt)

        - Modelle für Reasoning und Werkzeugaufrufe, unterstützen gemischte
        Text- und Bildeingaben

        - Diese API unterstützt serverseitige Tools: Websuche, Codeausführung
        und Dokumentensuche

        - Mehrere Gesprächsrunden lassen sich mit `previous_response_id`
        verketten, ohne den Verlauf erneut zu übertragen

        - 💡 Sie benötigen Werkzeuge und alle Parameter? Siehe die [vollständige
        Parameterdokumentation](./responses-reference)
      operationId: gptResponsesQuickstart
      requestBody:
        required: true
        content:
          application/json:
            schema:
              $ref: '#/components/schemas/ResponsesQuickRequest'
      responses:
        '200':
          description: Antwortgenerierung erfolgreich
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ResponsesResponse'
        '400':
          description: Ungültige Anfrageparameter
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 400
                  message: Invalid request parameters
                  type: invalid_request_error
        '401':
          description: Nicht autorisiert, ungültiges oder abgelaufenes Token
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 401
                  message: Invalid or expired token
                  type: authentication_error
        '402':
          description: Unzureichendes Kontingent
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 402
                  message: Insufficient quota
                  type: insufficient_quota_error
                  fallback_suggestion: https://evolink.ai/dashboard/billing
        '429':
          description: Ratenlimit überschritten
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 429
                  message: Rate limit exceeded
                  type: rate_limit_error
                  fallback_suggestion: retry after 60 seconds
        '500':
          description: Interner Serverfehler
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 500
                  message: Internal server error
                  type: internal_server_error
                  fallback_suggestion: try again later
        '503':
          description: Dienst vorübergehend nicht verfügbar
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 503
                  message: Service temporarily unavailable
                  type: service_unavailable_error
                  fallback_suggestion: retry after 30 seconds
components:
  schemas:
    ResponsesQuickRequest:
      type: object
      required:
        - model
        - input
      properties:
        model:
          type: string
          description: >-
            Aufzurufendes Modell:


            | Modell-ID | Kontextfenster | Positionierung |

            |---|---|---|

            | `gpt-5.6-sol` | 1.050.000 | GPT-5.6-Familie, Spitzen-Reasoning |

            | `gpt-5.6-terra` | 1.050.000 | GPT-5.6-Familie, ausgewogener
            Produktivbetrieb |

            | `gpt-5.6-luna` | 1.050.000 | GPT-5.6-Familie, hoher Durchsatz und
            Kostenkontrolle |

            | `gpt-5.5` | 400.000 | Allgemeines Reasoning-Modell |

            | `gpt-5.4` | 128.000 | Allgemeines Reasoning-Modell |

            | `gpt-5.2` | 400.000 | Allgemeines Reasoning-Modell |

            | `gpt-5.1` | 400.000 | Allgemeines Reasoning-Modell |
          enum:
            - gpt-5.6-sol
            - gpt-5.6-terra
            - gpt-5.6-luna
            - gpt-5.5
            - gpt-5.4
            - gpt-5.2
            - gpt-5.1
          example: gpt-5.6-sol
        input:
          description: >-
            Modelleingabe: eine reine Zeichenkette oder ein Array von
            Eingabeelementen.


            Die vollständige Schreibweise für multimodale Inhalte und
            Werkzeugergebnisse finden Sie in der [vollständigen
            Parameterdokumentation](./responses-reference).


            ```json

            "input": [
              {
                "role": "user",
                "content": [
                  { "type": "input_text", "text": "Was ist auf diesem Bild zu sehen?" },
                  { "type": "input_image", "image_url": "https://example.com/photo.png" }
                ]
              }
            ]

            ```
          oneOf:
            - type: string
            - type: array
              items:
                type: object
          example: Explain quantum entanglement in one sentence.
    ResponsesResponse:
      type: object
      properties:
        id:
          type: string
          description: >-
            Eindeutige ID dieser Antwort, kann als `previous_response_id` für
            die nächste Runde dienen
          example: resp_0f5c2b2c20c39e8a006a7ef545443081979e478b10927984b5
        object:
          type: string
          enum:
            - response
          description: Antworttyp
          example: response
        status:
          type: string
          description: Antwortstatus
          enum:
            - completed
            - incomplete
            - failed
          example: completed
        model:
          type: string
          description: Tatsächlich verwendeter Modellname
          example: gpt-5.6-sol
        created_at:
          type: integer
          description: Erstellungszeitstempel
          example: 1786705221
        output:
          type: array
          description: >-
            Ausgabeelemente in Generierungsreihenfolge: das `reasoning`-Element
            (Reasoning-Zusammenfassung), Werkzeugaufruf-Elemente und zuletzt das
            `message`-Element mit dem `output_text`-Inhalt.
          items:
            $ref: '#/components/schemas/OutputItem'
        usage:
          $ref: '#/components/schemas/Usage'
    ErrorResponse:
      type: object
      properties:
        error:
          type: object
          properties:
            code:
              type: integer
              description: HTTP-Status-Fehlercode
            message:
              type: string
              description: Fehlerbeschreibung
            type:
              type: string
              description: Fehlertyp
            param:
              type: string
              description: Zugehöriger Parametername
            fallback_suggestion:
              type: string
              description: Vorschlag bei Fehlerauftreten
    OutputItem:
      type: object
      properties:
        id:
          type: string
          description: Bezeichner des Ausgabeelements
        type:
          type: string
          description: Typ des Ausgabeelements
          enum:
            - reasoning
            - message
            - web_search_call
            - code_interpreter_call
            - file_search_call
            - function_call
          example: message
        status:
          type: string
          description: Status des Ausgabeelements
          example: completed
        content:
          type: array
          description: >-
            Inhaltsteile der Nachricht (`output_text`), vorhanden bei
            `message`-Elementen
          items:
            type: object
    Usage:
      type: object
      description: >-
        Statistik zum Token-Verbrauch. Prompt-Caching greift automatisch; im
        Cache getroffene Eingabe-Token werden zum günstigeren Cache-Preis
        abgerechnet.
      properties:
        input_tokens:
          type: integer
          description: Anzahl der Eingabe-Token
          example: 18
        output_tokens:
          type: integer
          description: Anzahl der Ausgabe-Token (einschließlich Reasoning-Token)
          example: 42
        total_tokens:
          type: integer
          description: Gesamtanzahl der Tokens
          example: 60
        input_tokens_details:
          type: object
          description: Detaillierte Eingabe-Token-Informationen
          properties:
            cached_tokens:
              type: integer
              description: Anzahl der aus dem Cache gelieferten Token
              example: 0
        output_tokens_details:
          type: object
          description: Detaillierte Ausgabe-Token-Informationen
          properties:
            reasoning_tokens:
              type: integer
              description: Anzahl der Reasoning-Tokens
              example: 16
  securitySchemes:
    bearerAuth:
      type: http
      scheme: bearer
      description: >-
        ##Alle APIs erfordern Bearer-Token-Authentifizierung##


        **API-Schlüssel erhalten:**


        Besuchen Sie die
        [API-Schlüsselverwaltungsseite](https://evolink.ai/dashboard/keys), um
        Ihren API-Schlüssel zu erhalten


        **Zum Anfrage-Header hinzufügen:**

        ```

        Authorization: Bearer YOUR_API_KEY

        ```

````