> ## Documentation Index
> Fetch the complete documentation index at: https://evolink.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# Grok Schnittstelle für alle Modelle - Responses vollständige Parameter

> - OpenAI-kompatibler Responses-Endpunkt für xAI-Grok-Textmodelle; Modellauswahl über den Parameter `model` (alle Werte siehe Tabelle beim Parameter `model`)
- `grok-4.5`: Kontextfenster von 500K Token; ab 200K Token im Prompt werden alle Token-Typen zum doppelten Preis abgerechnet
- Prompt-Caching greift automatisch: Token aus dem Cache werden zum günstigeren Cache-Eingabepreis abgerechnet
- Synchroner und Streaming-Modus (SSE)
- Serverseitige xAI-Tools laufen auf der xAI-Infrastruktur und werden pro erfolgreichem Aufruf abgerechnet: `web_search`, `x_search`, `code_execution`, `attachment_search`, `collections_search`
- Reguläre `function`-Tools (clientseitige Funktionsaufrufe) werden ebenfalls unterstützt und verursachen keine Gebühr pro Aufruf

<Note>
  **BaseURL**: Die Standard-BaseURL ist `https://direct.evolink.ai` und bietet bessere Unterstützung für Textmodelle sowie persistente Verbindungen. `https://api.evolink.ai` ist der primäre Endpunkt für multimodale Dienste und dient bei Textmodellen als Ausweichadresse.
</Note>

<Note>
  **Serverseitige Tools** laufen auf der Infrastruktur von xAI und werden zusätzlich zum Token-Verbrauch pro erfolgreichem Aufruf abgerechnet: Websuche / X-Suche / Codeausführung $0.005 pro Aufruf, Anhangsuche $0.01 pro Aufruf, Sammlungssuche \$0.0025 pro Aufruf. Tool-Gebühren sind vom Long-Context-Multiplikator nicht betroffen.
</Note>

<Warning>
  `image_generation` ist derzeit auf Grok 4.5 nicht verfügbar: Die Deklaration wird aus Kompatibilitätsgründen akzeptiert, das Tool aber entfernt, bevor die Anfrage das Modell erreicht. Nicht erkannte `tools[].type`-Werte werden mit `400` abgelehnt.
</Warning>


## OpenAPI

````yaml de/api-manual/language-series/grok/responses/responses-reference.json POST /v1/responses
openapi: 3.1.0
info:
  title: Grok Schnittstelle für alle Modelle - Responses vollständige Parameter
  description: >-
    Vollständige Parameterreferenz für den Aufruf von xAI-Grok-Textmodellen über
    die OpenAI-kompatible Responses-API, einschließlich serverseitiger Tools.
  license:
    name: MIT
  version: 1.0.0
servers:
  - url: https://direct.evolink.ai
    description: Produktion (empfohlen)
  - url: https://api.evolink.ai
    description: Alternative URL
security:
  - bearerAuth: []
tags:
  - name: Responses
    description: OpenAI Responses API mit serverseitigen xAI-Tools
paths:
  /v1/responses:
    post:
      tags:
        - Responses
      summary: Grok Responses (alle Modelle, vollständige Parameter)
      description: >-
        - OpenAI-kompatibler Responses-Endpunkt für xAI-Grok-Textmodelle;
        Modellauswahl über den Parameter `model` (alle Werte siehe Tabelle beim
        Parameter `model`)

        - `grok-4.5`: Kontextfenster von 500K Token; ab 200K Token im Prompt
        werden alle Token-Typen zum doppelten Preis abgerechnet

        - Prompt-Caching greift automatisch: Token aus dem Cache werden zum
        günstigeren Cache-Eingabepreis abgerechnet

        - Synchroner und Streaming-Modus (SSE)

        - Serverseitige xAI-Tools laufen auf der xAI-Infrastruktur und werden
        pro erfolgreichem Aufruf abgerechnet: `web_search`, `x_search`,
        `code_execution`, `attachment_search`, `collections_search`

        - Reguläre `function`-Tools (clientseitige Funktionsaufrufe) werden
        ebenfalls unterstützt und verursachen keine Gebühr pro Aufruf
      operationId: grokResponsesReference
      requestBody:
        required: true
        content:
          application/json:
            schema:
              $ref: '#/components/schemas/ResponsesRequest'
      responses:
        '200':
          description: >-
            Antwortgenerierung erfolgreich (JSON-Objekt oder – bei `stream=true`
            – ein SSE-Event-Stream, der mit `response.completed` endet)
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ResponsesResponse'
        '400':
          description: >-
            Ungültige Anfrageparameter (einschließlich nicht erkannter
            `tools[].type`-Werte, die abgelehnt werden, bevor die Anfrage das
            Modell erreicht)
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 400
                  message: Invalid request parameters
                  type: invalid_request_error
        '401':
          description: Nicht autorisiert, ungültiges oder abgelaufenes Token
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 401
                  message: Invalid or expired token
                  type: authentication_error
        '402':
          description: >-
            Unzureichendes Kontingent. Beim Deklarieren kostenpflichtiger
            serverseitiger Tools wird das Tool-Budget im Worst Case vorab
            reserviert; die nicht genutzte Reservierung wird bei der Abrechnung
            erstattet.
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 402
                  message: Insufficient quota
                  type: insufficient_quota_error
                  fallback_suggestion: https://evolink.ai/dashboard/billing
        '429':
          description: Ratenlimit überschritten
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 429
                  message: Rate limit exceeded
                  type: rate_limit_error
                  fallback_suggestion: retry after 60 seconds
        '500':
          description: Interner Serverfehler
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 500
                  message: Internal server error
                  type: internal_server_error
                  fallback_suggestion: try again later
        '503':
          description: Dienst vorübergehend nicht verfügbar
          content:
            application/json:
              schema:
                $ref: '#/components/schemas/ErrorResponse'
              example:
                error:
                  code: 503
                  message: Service temporarily unavailable
                  type: service_unavailable_error
                  fallback_suggestion: retry after 30 seconds
components:
  schemas:
    ResponsesRequest:
      type: object
      required:
        - model
        - input
      properties:
        model:
          type: string
          description: >-
            Aufzurufendes Modell:


            | Modell-ID | Positionierung |

            |---|---|

            | `grok-4.5` | xAI-Modell für Reasoning und Tool-Aufrufe,
            Kontextfenster von 500K |
          enum:
            - grok-4.5
          example: grok-4.5
        input:
          description: >-
            Eingabe für das Modell: eine einfache Zeichenkette oder ein Array
            von OpenAI-Responses-Eingabeelementen (z. B.
            `{"role":"user","content":[...]}`), das unverändert weitergegeben
            wird.
          oneOf:
            - type: string
            - type: array
              items:
                type: object
          example: >-
            Search the web for the latest SpaceX launch and summarize it in one
            sentence.
        stream:
          type: boolean
          description: >-
            Ob eine Streaming-Antwort zurückgegeben wird (SSE-Events, endend mit
            `response.completed`). Standard `false`.
          default: false
          example: false
        max_output_tokens:
          type: integer
          description: >-
            Maximale Anzahl der zu generierenden Token (einschließlich
            Reasoning-Token).
          example: 2048
        tools:
          type: array
          description: >-
            Tool-Deklarationen. Serverseitige xAI-Tools (Abrechnung pro
            erfolgreichem Aufruf, Gebühren sind vom Long-Context-Multiplikator
            nicht betroffen):


            | Tool-Typ | Funktion | Preis pro Aufruf |

            |---|---|---|

            | `web_search` | Im Internet suchen und Webseiten aufrufen | $0.005
            |

            | `x_search` | Beiträge, Profile und Threads auf X durchsuchen |
            $0.005 |

            | `code_execution` | Python in einer Sandbox ausführen
            (`code_interpreter` wird als Alias akzeptiert) | $0.005 |

            | `attachment_search` | An die Konversation angehängte Dateien
            durchsuchen (wird ggf. automatisch aktiviert, wenn die Eingabe
            Dateien enthält) | $0.01 |

            | `collections_search` | Hochgeladene Dokumentsammlungen abfragen
            (`file_search` wird als Alias akzeptiert) | $0.0025 |


            Reguläre `function`-Tools (clientseitige Funktionsaufrufe) werden
            ebenfalls unterstützt und verursachen keine Gebühr pro Aufruf.


            ⚠️ `image_generation` ist derzeit nicht verfügbar: Die Deklaration
            wird aus Kompatibilitätsgründen akzeptiert, das Tool aber entfernt,
            bevor die Anfrage das Modell erreicht. Nicht erkannte Tool-Typen
            werden mit `400` abgelehnt.
          items:
            $ref: '#/components/schemas/Tool'
          example:
            - type: web_search
        tool_choice:
          description: >-
            Steuert die Tool-Auswahl: `"auto"` (Standard) / `"none"` /
            `"required"` oder ein Objekt, das ein bestimmtes Tool festlegt, z.
            B. `{"type": "web_search"}`.
          oneOf:
            - type: string
              enum:
                - auto
                - none
                - required
            - type: object
        max_tool_calls:
          type: integer
          description: >-
            Maximale Anzahl serverseitiger Tool-Aufrufe für diese Anfrage. Ohne
            Angabe (oder bei `null`) setzt die Plattform automatisch eine
            Obergrenze von bis zu 10 Aufrufen, abhängig von Ihrem verfügbaren
            Guthaben. Deklarierte kostenpflichtige Tools reservieren ihr Budget
            im Worst Case vorab; der nicht genutzte Teil wird bei der Abrechnung
            erstattet.
          example: 5
    ResponsesResponse:
      type: object
      properties:
        id:
          type: string
          description: Eindeutiger Bezeichner der Antwort
          example: 55d44212-8d5e-90cc-975f-36d341ce21f5
        object:
          type: string
          enum:
            - response
          description: Antworttyp
          example: response
        status:
          type: string
          description: Antwortstatus
          enum:
            - completed
            - incomplete
            - failed
          example: completed
        model:
          type: string
          description: Tatsächlich verwendeter Modellname
          example: grok-4.5
        created_at:
          type: integer
          description: Erstellungszeitstempel
          example: 1786538000
        output:
          type: array
          description: >-
            Ausgabeelemente in Generierungsreihenfolge: `reasoning`-Elemente
            (zusammengefasster Denkprozess), Elemente serverseitiger
            Tool-Aufrufe wie `web_search_call` / `code_interpreter_call` (der
            Status `completed` kennzeichnet einen erfolgreichen, abrechenbaren
            Aufruf) und abschließend ein `message`-Element mit
            `output_text`-Inhalt.
          items:
            $ref: '#/components/schemas/OutputItem'
        usage:
          $ref: '#/components/schemas/Usage'
    ErrorResponse:
      type: object
      properties:
        error:
          type: object
          properties:
            code:
              type: integer
              description: HTTP-Status-Fehlercode
            message:
              type: string
              description: Fehlerbeschreibung
            type:
              type: string
              description: Fehlertyp
            param:
              type: string
              description: Zugehöriger Parametername
            fallback_suggestion:
              type: string
              description: Vorschlag bei Fehlerauftreten
    Tool:
      type: object
      required:
        - type
      properties:
        type:
          type: string
          description: Werkzeugtyp
          enum:
            - web_search
            - x_search
            - code_execution
            - code_interpreter
            - attachment_search
            - collections_search
            - file_search
            - function
          example: web_search
    OutputItem:
      type: object
      properties:
        id:
          type: string
          description: Bezeichner des Ausgabeelements
        type:
          type: string
          description: Typ des Ausgabeelements
          enum:
            - reasoning
            - message
            - web_search_call
            - x_search_call
            - code_interpreter_call
            - code_execution_call
            - attachment_search_call
            - file_search_call
            - function_call
          example: web_search_call
        status:
          type: string
          description: >-
            Status des Ausgabeelements; abgerechnet werden Tool-Aufrufe mit
            `completed`
          example: completed
        content:
          type: array
          description: >-
            Inhaltsteile der Nachricht (`output_text`), vorhanden bei
            `message`-Elementen
          items:
            type: object
    Usage:
      type: object
      description: >-
        Statistik zur Token- und Tool-Nutzung. Ab 200K Token im Prompt werden
        alle Token-Typen zum doppelten Preis abgerechnet; Tool-Gebühren sind vom
        Multiplikator nicht betroffen.
      properties:
        input_tokens:
          type: integer
          description: Anzahl der Eingabe-Token
          example: 10329
        output_tokens:
          type: integer
          description: Anzahl der Ausgabe-Token (einschließlich Reasoning-Token)
          example: 299
        total_tokens:
          type: integer
          description: Gesamtanzahl der Tokens
          example: 10628
        input_tokens_details:
          type: object
          description: Detaillierte Eingabe-Token-Informationen
          properties:
            cached_tokens:
              type: integer
              description: >-
                Anzahl der Prompt-Token aus dem Cache (Abrechnung zum
                günstigeren Cache-Eingabepreis; Caching greift automatisch)
              example: 6016
        output_tokens_details:
          type: object
          description: Detaillierte Ausgabe-Token-Informationen
          properties:
            reasoning_tokens:
              type: integer
              description: Anzahl der Reasoning-Tokens
              example: 128
        num_server_side_tools_used:
          type: integer
          description: Gesamtzahl der serverseitigen Tool-Aufrufe in dieser Antwort
          example: 2
        server_side_tool_usage_details:
          type: object
          description: >-
            Aufrufzahlen pro Tool (einzelne Drittanbieter-Routen liefern dieses
            Objekt möglicherweise nicht; die Abrechnung zählt dann die
            abgeschlossenen Tool-Aufruf-Ausgabeelemente)
          properties:
            web_search_calls:
              type: integer
              example: 2
            x_search_calls:
              type: integer
              example: 0
            code_interpreter_calls:
              type: integer
              example: 0
            document_search_calls:
              type: integer
              description: Aufrufe der Anhangsuche
              example: 0
            file_search_calls:
              type: integer
              description: Aufrufe der Sammlungssuche
              example: 0
            mcp_calls:
              type: integer
              example: 0
  securitySchemes:
    bearerAuth:
      type: http
      scheme: bearer
      description: >-
        ##Alle APIs erfordern Bearer-Token-Authentifizierung##


        **API-Schlüssel erhalten:**


        Besuchen Sie die
        [API-Schlüsselverwaltungsseite](https://evolink.ai/dashboard/keys), um
        Ihren API-Schlüssel zu erhalten


        **Zum Anfrage-Header hinzufügen:**

        ```

        Authorization: Bearer YOUR_API_KEY

        ```

````