Skip to main content
POST
Grok Chat-Vervollständigung (alle Modelle, vollständige Parameter)
BaseURL: Die Standard-BaseURL ist https://direct.evolink.ai und bietet bessere Unterstützung für Textmodelle sowie persistente Verbindungen. https://api.evolink.ai ist der primäre Endpunkt für multimodale Dienste und dient bei Textmodellen als Ausweichadresse.
Diese Seite beschreibt reguläre function-Aufrufe. Für serverseitige Tools (Websuche, X-Suche, Codeausführung, Anhangsuche und Sammlungssuche) wird die Responses API empfohlen. Dort finden Sie Konfiguration und Abrechnung der Tools.

Grok 4.7 verwenden

Setzen Sie model auf grok-4.7 und behalten Sie das vorhandene messages-Anfrageformat bei. Das Kontextfenster beträgt 500.000 Token; der Wissensstand ist Mai 2026. Verwenden Sie den Parameter reasoning_effort auf oberster Ebene. Reasoning-Tiefe: low / medium / high (Standard) / xhigh. Reasoning lässt sich nicht deaktivieren. grok-4.7 und grok-4.6 unterstützen xhigh; grok-4.5 akzeptiert den Wert, behandelt ihn aber als high. Reasoning-Token werden als Ausgabe-Token abgerechnet. prompt_cache_key gibt einen stabilen Routing-Hinweis für Anfragen mit gleichem Prompt-Präfix; ein Cache-Treffer ist nicht garantiert. Tatsächliche Treffer stehen unter usage.prompt_tokens_details.cached_tokens. Um verschlüsseltes Reasoning über mehrere Gesprächsrunden zu erhalten, verwenden Sie die Responses API.

Autorisierungen

Authorization
string
header
erforderlich

##Alle APIs erfordern Bearer-Token-Authentifizierung##

API-Schlüssel erhalten:

Besuchen Sie die API-Schlüsselverwaltungsseite, um Ihren API-Schlüssel zu erhalten

Zum Anfrage-Header hinzufügen:

Body

application/json
model
enum<string>
erforderlich

Aufzurufendes Modell:

Verfügbare Optionen:
grok-4.7,
grok-4.6,
grok-4.5
Beispiel:

"grok-4.7"

messages
object[]
erforderlich

Liste der Chat-Nachrichten. Unterstützt die Rollen system, user und assistant.

Minimum array length: 1
Beispiel:
stream
boolean
Standard:false

Ob eine Streaming-Antwort zurückgegeben wird (SSE, chat.completion.chunk-Events). Standard false.

Beispiel:

false

max_tokens
integer

Maximale Anzahl der zu generierenden Token.

Beispiel:

1024

reasoning_effort
enum<string>
Standard:high

Reasoning-Tiefe: low / medium / high (Standard) / xhigh. Reasoning lässt sich nicht deaktivieren. grok-4.7 und grok-4.6 unterstützen xhigh; grok-4.5 akzeptiert den Wert, behandelt ihn aber als high. Reasoning-Token werden als Ausgabe-Token abgerechnet.

Verfügbare Optionen:
low,
medium,
high,
xhigh
temperature
number

Sampling-Temperatur (0-2). Höhere Werte erzeugen zufälligere Ausgaben.

Beispiel:

0.7

top_p
number

Nucleus-Sampling-Parameter (0-1).

Beispiel:

0.95

tools
object[]

Diese Seite beschreibt reguläre OpenAI-Tool-Definitionen vom Typ function (clientseitige Funktionsaufrufe ohne Gebühr für serverseitige Tool-Aufrufe). Konfiguration und Nutzung serverseitiger Tools wie Websuche und X-Suche sind bei der Responses API beschrieben.

tool_choice

Steuert die Funktionsauswahl: "auto" / "none" / "required" oder ein Objekt, das eine bestimmte Funktion festlegt.

Verfügbare Optionen:
auto,
none,
required
prompt_cache_key
string

Optionaler Schlüssel für das Cache-Routing. Ein stabiler Wert für dieselbe Unterhaltung oder Anfragen mit gleichem Prompt-Präfix kann die Cache-Trefferchance erhöhen. Treffer sind nicht garantiert; die Cache-Abrechnung bleibt unverändert. Tatsächliche Treffer werden unter cached_tokens in usage ausgewiesen.

Beispiel:

"grok-session-001"

Antwort

Chat-Vervollständigung erfolgreich generiert (JSON-Objekt oder – bei stream=true – ein SSE-Stream von chat.completion.chunk-Events)

id
string

Eindeutiger Bezeichner für die Chat-Vervollständigung

Beispiel:

"chatcmpl-20260812164515123456789AbCdEfGh"

model
string

Tatsächlich verwendeter Modellname

Beispiel:

"grok-4.7"

object
enum<string>

Antworttyp

Verfügbare Optionen:
chat.completion
Beispiel:

"chat.completion"

created
integer

Erstellungszeitstempel

Beispiel:

1786538000

choices
object[]

Liste der Chat-Vervollständigungsoptionen

usage
object

Statistik zur Token-Nutzung. Ab 200K Token im Prompt werden alle Token-Typen (Eingabe, Cache-Eingabe, Ausgabe) zum doppelten Preis abgerechnet.