Skip to main content
POST
Grok Responses (alle Modelle, vollständige Parameter)
BaseURL: Die Standard-BaseURL ist https://direct.evolink.ai und bietet bessere Unterstützung für Textmodelle sowie persistente Verbindungen. https://api.evolink.ai ist der primäre Endpunkt für multimodale Dienste und dient bei Textmodellen als Ausweichadresse.
Serverseitige Tools laufen auf der Infrastruktur von xAI und werden zusätzlich zum Token-Verbrauch pro erfolgreichem Aufruf abgerechnet: Websuche / X-Suche / Codeausführung 0.005proAufruf,Anhangsuche0.005 pro Aufruf, Anhangsuche 0.01 pro Aufruf, Sammlungssuche $0.0025 pro Aufruf. Tool-Gebühren sind vom Long-Context-Multiplikator nicht betroffen.
image_generation ist derzeit weder auf Grok 4.5 noch auf Grok 4.6 verfügbar: Die Deklaration wird aus Kompatibilitätsgründen akzeptiert, das Tool aber entfernt, bevor die Anfrage das Modell erreicht. Nicht erkannte tools[].type-Werte werden mit 400 abgelehnt.

Autorisierungen

Authorization
string
header
erforderlich

##Alle APIs erfordern Bearer-Token-Authentifizierung##

API-Schlüssel erhalten:

Besuchen Sie die API-Schlüsselverwaltungsseite, um Ihren API-Schlüssel zu erhalten

Zum Anfrage-Header hinzufügen:

Body

application/json
model
enum<string>
erforderlich

Aufzurufendes Modell:

Verfügbare Optionen:
grok-4.6,
grok-4.5
Beispiel:

"grok-4.6"

input
erforderlich

Eingabe für das Modell: eine einfache Zeichenkette oder ein Array von OpenAI-Responses-Eingabeelementen (z. B. {"role":"user","content":[...]}).

Beispiel:

"Search the web for the latest SpaceX launch and summarize it in one sentence."

stream
boolean
Standard:false

Ob eine Streaming-Antwort zurückgegeben wird (SSE-Events, endend mit response.completed). Standard false.

Beispiel:

false

max_output_tokens
integer

Maximale Anzahl der zu generierenden Token (einschließlich Reasoning-Token).

Beispiel:

2048

reasoning
object

Steuerung der Reasoning-Tiefe, Objektform: {"effort": "low" | "medium" | "high" | "xhigh"}. Standard ist high; Reasoning lässt sich nicht abschalten. xhigh wird nur von grok-4.6 unterstützt – grok-4.5 akzeptiert den Wert, stuft ihn aber auf high herab. Reasoning-Tokens werden als Ausgabe-Tokens abgerechnet und in usage.output_tokens_details.reasoning_tokens ausgewiesen.

tools
object[]

Tool-Deklarationen. Serverseitige xAI-Tools (Abrechnung pro erfolgreichem Aufruf, Gebühren sind vom Long-Context-Multiplikator nicht betroffen):

Reguläre function-Tools (clientseitige Funktionsaufrufe) werden ebenfalls unterstützt und verursachen keine Gebühr pro Aufruf.

image_generation ist derzeit nicht verfügbar: Die Deklaration wird aus Kompatibilitätsgründen akzeptiert, das Tool aber entfernt, bevor die Anfrage das Modell erreicht. Nicht erkannte Tool-Typen werden mit 400 abgelehnt.

Beispiel:
tool_choice

Steuert die Tool-Auswahl: "auto" (Standard) / "none" / "required" oder ein Objekt, das ein bestimmtes Tool festlegt, z. B. {"type": "web_search"}.

Verfügbare Optionen:
auto,
none,
required

Antwort

Antwortgenerierung erfolgreich (JSON-Objekt oder – bei stream=true – ein SSE-Event-Stream, der mit response.completed endet)

id
string

Eindeutiger Bezeichner der Antwort

Beispiel:

"55d44212-8d5e-90cc-975f-36d341ce21f5"

object
enum<string>

Antworttyp

Verfügbare Optionen:
response
Beispiel:

"response"

status
enum<string>

Antwortstatus

Verfügbare Optionen:
completed,
incomplete,
failed
Beispiel:

"completed"

model
string

Tatsächlich verwendeter Modellname

Beispiel:

"grok-4.6"

created_at
integer

Erstellungszeitstempel

Beispiel:

1786538000

output
object[]

Ausgabeelemente in Generierungsreihenfolge: reasoning-Elemente (zusammengefasster Denkprozess), Elemente serverseitiger Tool-Aufrufe wie web_search_call / code_interpreter_call (der Status completed kennzeichnet einen erfolgreichen, abrechenbaren Aufruf) und abschließend ein message-Element mit output_text-Inhalt.

usage
object

Statistik zur Token- und Tool-Nutzung. Ab 200K Token im Prompt werden alle Token-Typen zum doppelten Preis abgerechnet; Tool-Gebühren sind vom Multiplikator nicht betroffen.