Skip to main content
POST
Grok Responses (alle Modelle, vollständige Parameter)
BaseURL: Die Standard-BaseURL ist https://direct.evolink.ai und bietet bessere Unterstützung für Textmodelle sowie persistente Verbindungen. https://api.evolink.ai ist der primäre Endpunkt für multimodale Dienste und dient bei Textmodellen als Ausweichadresse.
Serverseitige Tools laufen auf der Infrastruktur von xAI und werden zusätzlich zum Token-Verbrauch pro erfolgreichem Aufruf abgerechnet: Websuche / X-Suche / Codeausführung 0.005proAufruf,Anhangsuche0.005 pro Aufruf, Anhangsuche 0.01 pro Aufruf, Sammlungssuche $0.0025 pro Aufruf. Tool-Gebühren sind vom Long-Context-Multiplikator nicht betroffen.
image_generation ist derzeit auf Grok 4.5 nicht verfügbar: Die Deklaration wird aus Kompatibilitätsgründen akzeptiert, das Tool aber entfernt, bevor die Anfrage das Modell erreicht. Nicht erkannte tools[].type-Werte werden mit 400 abgelehnt.

Autorisierungen

Authorization
string
header
erforderlich

##Alle APIs erfordern Bearer-Token-Authentifizierung##

API-Schlüssel erhalten:

Besuchen Sie die API-Schlüsselverwaltungsseite, um Ihren API-Schlüssel zu erhalten

Zum Anfrage-Header hinzufügen:

Body

application/json
model
enum<string>
erforderlich

Aufzurufendes Modell:

Verfügbare Optionen:
grok-4.5
Beispiel:

"grok-4.5"

input
erforderlich

Eingabe für das Modell: eine einfache Zeichenkette oder ein Array von OpenAI-Responses-Eingabeelementen (z. B. {"role":"user","content":[...]}), das unverändert weitergegeben wird.

Beispiel:

"Search the web for the latest SpaceX launch and summarize it in one sentence."

stream
boolean
Standard:false

Ob eine Streaming-Antwort zurückgegeben wird (SSE-Events, endend mit response.completed). Standard false.

Beispiel:

false

max_output_tokens
integer

Maximale Anzahl der zu generierenden Token (einschließlich Reasoning-Token).

Beispiel:

2048

tools
object[]

Tool-Deklarationen. Serverseitige xAI-Tools (Abrechnung pro erfolgreichem Aufruf, Gebühren sind vom Long-Context-Multiplikator nicht betroffen):

Reguläre function-Tools (clientseitige Funktionsaufrufe) werden ebenfalls unterstützt und verursachen keine Gebühr pro Aufruf.

⚠️ image_generation ist derzeit nicht verfügbar: Die Deklaration wird aus Kompatibilitätsgründen akzeptiert, das Tool aber entfernt, bevor die Anfrage das Modell erreicht. Nicht erkannte Tool-Typen werden mit 400 abgelehnt.

Beispiel:
tool_choice

Steuert die Tool-Auswahl: "auto" (Standard) / "none" / "required" oder ein Objekt, das ein bestimmtes Tool festlegt, z. B. {"type": "web_search"}.

Verfügbare Optionen:
auto,
none,
required
max_tool_calls
integer

Maximale Anzahl serverseitiger Tool-Aufrufe für diese Anfrage. Ohne Angabe (oder bei null) setzt die Plattform automatisch eine Obergrenze von bis zu 10 Aufrufen, abhängig von Ihrem verfügbaren Guthaben. Deklarierte kostenpflichtige Tools reservieren ihr Budget im Worst Case vorab; der nicht genutzte Teil wird bei der Abrechnung erstattet.

Beispiel:

5

Antwort

Antwortgenerierung erfolgreich (JSON-Objekt oder – bei stream=true – ein SSE-Event-Stream, der mit response.completed endet)

id
string

Eindeutiger Bezeichner der Antwort

Beispiel:

"55d44212-8d5e-90cc-975f-36d341ce21f5"

object
enum<string>

Antworttyp

Verfügbare Optionen:
response
Beispiel:

"response"

status
enum<string>

Antwortstatus

Verfügbare Optionen:
completed,
incomplete,
failed
Beispiel:

"completed"

model
string

Tatsächlich verwendeter Modellname

Beispiel:

"grok-4.5"

created_at
integer

Erstellungszeitstempel

Beispiel:

1786538000

output
object[]

Ausgabeelemente in Generierungsreihenfolge: reasoning-Elemente (zusammengefasster Denkprozess), Elemente serverseitiger Tool-Aufrufe wie web_search_call / code_interpreter_call (der Status completed kennzeichnet einen erfolgreichen, abrechenbaren Aufruf) und abschließend ein message-Element mit output_text-Inhalt.

usage
object

Statistik zur Token- und Tool-Nutzung. Ab 200K Token im Prompt werden alle Token-Typen zum doppelten Preis abgerechnet; Tool-Gebühren sind vom Multiplikator nicht betroffen.