Skip to main content
POST
BaseURL: Die Standard-BaseURL ist https://direct.evolink.ai und bietet bessere Unterstützung für Textmodelle sowie persistente Verbindungen. https://api.evolink.ai ist der primäre Endpunkt für multimodale Dienste und dient bei Textmodellen als Ausweichadresse.
Serverseitige Tools werden zusätzlich zu Token abgerechnet: Websuche / Codeausführung kosten 0.005 USD pro erfolgreichem Aufruf, Anhangsuche 0.01 USD und Sammlungssuche 0.0025 USD pro Aufruf. X Search kostet 0.005 USD pro abgerufenem Beitrag und 0.01 USD pro abgerufenem Nutzerprofil. Der Multiplikator für lange Kontexte gilt nicht für Tool-Gebühren.

Grok 4.7 verwenden

Setzen Sie model auf grok-4.7. Das Kontextfenster beträgt 500.000 Token; der Wissensstand ist Mai 2026. Die Reasoning-Tiefe wird über reasoning.effort festgelegt: low, medium, high (Standard) oder xhigh. Reasoning lässt sich nicht deaktivieren. Laut xAI-Spezifikation für verschlüsseltes Reasoning liefert 4.7 standardmäßig reasoning-Elemente mit encrypted_content in output, ohne explizites include. Wenn Sie den Gesprächsverlauf selbst verwalten, senden Sie die vollständigen reasoning-Elemente zusammen mit den übrigen bisherigen Ausgaben unverändert im nächsten input zurück. Den verschlüsselten Inhalt nicht entschlüsseln oder verändern. Maßgeblich sind die tatsächlich zurückgegebenen Felder.

X-Search-Abrechnung

Die neuen X-Search-Abrechnungsregeln gelten für Grok 4.5, 4.6 und 4.7. Eine Suche kann mehrere Beiträge und Nutzerprofile abrufen; übergeordnete und zitierte Beiträge zählen ebenfalls. Bei 30 Beiträgen und 3 Nutzerprofilen entstehen beispielsweise Tool-Gebühren von 30 × 0.005 USD + 3 × 0.01 USD = 0.18 USD, zuzüglich Token-Gebühren. Die Abrufzahlen finden Sie unter usage.server_side_tool_usage_details.x_posts_fetched und x_users_fetched. Fehlen beide Felder, wird aus Kompatibilitätsgründen pro erfolgreichem Aufruf abgerechnet. x_search_calls ist die Aufrufzahl; max_tool_calls ist ein Steuerwert für die Aufrufzahl, dessen tatsächliche Durchsetzung vom Zugangsweg abhängt. Keiner der beiden Werte begrenzt die Abrufmenge oder die Kosten. x_users_fetched ist ein Nutzungsfeld und erfordert keine zusätzliche Tool-Deklaration.
image_generation ist derzeit für Grok 4.5, 4.6 und 4.7 nicht verfügbar: Die Deklaration wird aus Kompatibilitätsgründen akzeptiert, das Tool jedoch vor der Weiterleitung an das Modell entfernt. Unbekannte Werte für tools[].type führen zu 400.

Autorisierungen

Authorization
string
header
erforderlich

##Alle APIs erfordern Bearer-Token-Authentifizierung##

API-Schlüssel erhalten:

Besuchen Sie die API-Schlüsselverwaltungsseite, um Ihren API-Schlüssel zu erhalten

Zum Anfrage-Header hinzufügen:

Body

application/json
model
enum<string>
erforderlich

Aufzurufendes Modell:

Verfügbare Optionen:
grok-4.7,
grok-4.6,
grok-4.5
Beispiel:

"grok-4.7"

input
erforderlich

Eingabe für das Modell: eine einfache Zeichenkette oder ein Array von OpenAI-Responses-Eingabeelementen (z. B. {"role":"user","content":[...]}).

Beispiel:

"Search the web for the latest SpaceX launch and summarize it in one sentence."

stream
boolean
Standard:false

Streaming-Ausgabe per SSE; Standard ist false. Lesen Sie status und usage aus der abschließenden Antwort: completed bedeutet abgeschlossene Generierung; Ausgabelimits und ähnliche Fälle können incomplete ergeben. Warten Sie nicht ausschließlich auf ein response.completed-Ereignis.

Beispiel:

false

max_output_tokens
integer

Maximale Anzahl der zu generierenden Token (einschließlich Reasoning-Token).

Beispiel:

2048

reasoning
object

Die Reasoning-Tiefe wird als Objekt angegeben: {"effort": "low" | "medium" | "high" | "xhigh"}. Standard ist high; Reasoning lässt sich nicht deaktivieren. grok-4.7 und grok-4.6 unterstützen xhigh; grok-4.5 behandelt den Wert als high. Reasoning-Token werden als Ausgabe-Token abgerechnet und unter usage.output_tokens_details.reasoning_tokens ausgewiesen.

tools
object[]

Tool-Deklarationen. Serverseitige Tool-Gebühren fallen zusätzlich zu Token-Gebühren an und unterliegen nicht dem Multiplikator für lange Kontexte:

Die neue X-Search-Abrechnung gilt für grok-4.5, grok-4.6 und grok-4.7. Ein Aufruf kann mehrere Beiträge liefern; übergeordnete und zitierte Beiträge aus Suchergebnissen oder Threads zählen ebenfalls. Die tatsächliche Nutzung steht unter usage.server_side_tool_usage_details. Fehlen beide Abrufzählfelder, wird aus Kompatibilitätsgründen pro erfolgreichem Aufruf abgerechnet.

Reguläre function-Tools werden ebenfalls unterstützt (clientseitige Funktionsaufrufe ohne Gebühr für serverseitige Tool-Aufrufe).

image_generation ist derzeit für Grok 4.5, 4.6 und 4.7 nicht verfügbar: Die Deklaration wird aus Kompatibilitätsgründen akzeptiert, das Tool jedoch vor der Weiterleitung an das Modell entfernt. Unbekannte Werte für tools[].type führen zu 400.

Beispiel:
tool_choice

Steuert die Tool-Auswahl: "auto" (Standard) / "none" / "required" oder ein Objekt, das ein bestimmtes Tool festlegt, z. B. {"type": "web_search"}.

Verfügbare Optionen:
auto,
none,
required
prompt_cache_key
string

Optionaler Schlüssel für das Cache-Routing. Ein stabiler Wert für dieselbe Unterhaltung oder Anfragen mit gleichem Prompt-Präfix kann die Cache-Trefferchance erhöhen. Treffer sind nicht garantiert; die Cache-Abrechnung bleibt unverändert. Tatsächliche Treffer werden unter cached_tokens in usage ausgewiesen.

Beispiel:

"grok-session-001"

include
string[]

Zusätzlich angeforderte Antwortfelder. Beispielsweise kann grok-4.6 mit ["reasoning.encrypted_content"] verschlüsseltes Reasoning anfordern. Laut xAI-API-Spezifikation gibt grok-4.7 dieses Feld standardmäßig ohne explizites include zurück.

Beispiel:
max_tool_calls
integer

Steuerwert für die Anzahl der Tool-Aufrufe. Das Gateway leitet ihn weiter und schätzt damit die zu reservierenden Tool-Gebühren. Ob ein Zugangsweg die Anzahl strikt begrenzt, muss anhand seines tatsächlichen Verhaltens geprüft werden. Der Wert begrenzt weder abgerufene X-Beiträge noch Nutzerprofile und ist keine Kostenobergrenze.

Beispiel:

1

Antwort

Eine Antwort wurde zurückgegeben; prüfen Sie zusätzlich status: completed bei abgeschlossener Generierung, incomplete etwa bei Ausgabelimits und failed bei einem Fehler. Bei stream=true erfolgt die Ausgabe als SSE-Stream; lesen Sie status und usage aus der abschließenden Antwort.

id
string

Eindeutiger Bezeichner der Antwort

Beispiel:

"55d44212-8d5e-90cc-975f-36d341ce21f5"

object
enum<string>

Antworttyp

Verfügbare Optionen:
response
Beispiel:

"response"

status
enum<string>

Antwortstatus

Verfügbare Optionen:
completed,
incomplete,
failed
Beispiel:

"completed"

model
string

Tatsächlich verwendeter Modellname

Beispiel:

"grok-4.7"

created_at
integer

Erstellungszeitstempel

Beispiel:

1786538000

output
object[]

Ausgabeelemente in Generierungsreihenfolge: reasoning-Elemente (gegebenenfalls mit verschlüsseltem Reasoning), serverseitige Tool-Aufrufe, function_call-Elemente und message-Elemente mit output_text. Maßgeblich für die Tool-Nutzung ist usage; ein x_search-Aufruf kann Gebühren für mehrere Beiträge und Nutzerprofile verursachen.

usage
object

Statistik zur Token- und Tool-Nutzung. Ab 200K Token im Prompt werden alle Token-Typen zum doppelten Preis abgerechnet; Tool-Gebühren sind vom Multiplikator nicht betroffen.