curl --request POST \
--url https://direct.evolink.ai/v1/responses \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "grok-4.7",
"input": "Erkläre Prompt-Caching in einem Satz.",
"reasoning": {
"effort": "xhigh"
},
"max_output_tokens": 2048,
"prompt_cache_key": "grok-session-001"
}
'{
"id": "55d44212-8d5e-90cc-975f-36d341ce21f5",
"object": "response",
"status": "completed",
"model": "grok-4.7",
"created_at": 1786538000,
"output": [
{
"id": "<string>",
"type": "web_search_call",
"status": "completed",
"content": [
{}
],
"encrypted_content": "<string>"
}
],
"usage": {
"input_tokens": 10329,
"output_tokens": 299,
"total_tokens": 10628,
"input_tokens_details": {
"cached_tokens": 6016
},
"output_tokens_details": {
"reasoning_tokens": 128
},
"num_server_side_tools_used": 2,
"server_side_tool_usage_details": {
"web_search_calls": 2,
"x_search_calls": 0,
"code_interpreter_calls": 0,
"document_search_calls": 0,
"file_search_calls": 0,
"mcp_calls": 0,
"x_posts_fetched": 0,
"x_users_fetched": 0
}
}
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient quota",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/billing"
}
}{
"error": {
"code": 429,
"message": "Rate limit exceeded",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Internal server error",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 503,
"message": "Service temporarily unavailable",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}Grok Schnittstelle für alle Modelle - Responses vollständige Parameter
- OpenAI-kompatibler Responses-Endpunkt für xAI-Grok-Textmodelle; Modellauswahl über den Parameter
model(alle Werte siehe Tabelle beim Parametermodel) - Kontextfenster von 500K Token; ab 200K Token im Prompt werden alle Token-Typen zum doppelten Preis abgerechnet
- Prompt-Caching greift automatisch: Token aus dem Cache werden zum günstigeren Cache-Eingabepreis abgerechnet
- Synchroner und Streaming-Modus (SSE)
- Serverseitige xAI-Tools laufen auf der xAI-Infrastruktur:
web_search,x_search,code_execution,attachment_searchundcollections_search. X Search wird nach abgerufenen Beiträgen und Nutzerprofilen abgerechnet, andere Tools pro erfolgreichem Aufruf. - Reguläre
function-Tools (clientseitige Funktionsaufrufe) werden ebenfalls unterstützt und verursachen keine Gebühr pro Aufruf - Laut offizieller xAI-API-Spezifikation gibt
grok-4.7standardmäßigreasoning-Elemente mitencrypted_contentzurück; maßgeblich sind die tatsächlich über den jeweiligen Zugangsweg zurückgegebenen Felder.
curl --request POST \
--url https://direct.evolink.ai/v1/responses \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data '
{
"model": "grok-4.7",
"input": "Erkläre Prompt-Caching in einem Satz.",
"reasoning": {
"effort": "xhigh"
},
"max_output_tokens": 2048,
"prompt_cache_key": "grok-session-001"
}
'{
"id": "55d44212-8d5e-90cc-975f-36d341ce21f5",
"object": "response",
"status": "completed",
"model": "grok-4.7",
"created_at": 1786538000,
"output": [
{
"id": "<string>",
"type": "web_search_call",
"status": "completed",
"content": [
{}
],
"encrypted_content": "<string>"
}
],
"usage": {
"input_tokens": 10329,
"output_tokens": 299,
"total_tokens": 10628,
"input_tokens_details": {
"cached_tokens": 6016
},
"output_tokens_details": {
"reasoning_tokens": 128
},
"num_server_side_tools_used": 2,
"server_side_tool_usage_details": {
"web_search_calls": 2,
"x_search_calls": 0,
"code_interpreter_calls": 0,
"document_search_calls": 0,
"file_search_calls": 0,
"mcp_calls": 0,
"x_posts_fetched": 0,
"x_users_fetched": 0
}
}
}{
"error": {
"code": 400,
"message": "Invalid request parameters",
"type": "invalid_request_error"
}
}{
"error": {
"code": 401,
"message": "Invalid or expired token",
"type": "authentication_error"
}
}{
"error": {
"code": 402,
"message": "Insufficient quota",
"type": "insufficient_quota_error",
"fallback_suggestion": "https://evolink.ai/dashboard/billing"
}
}{
"error": {
"code": 429,
"message": "Rate limit exceeded",
"type": "rate_limit_error",
"fallback_suggestion": "retry after 60 seconds"
}
}{
"error": {
"code": 500,
"message": "Internal server error",
"type": "internal_server_error",
"fallback_suggestion": "try again later"
}
}{
"error": {
"code": 503,
"message": "Service temporarily unavailable",
"type": "service_unavailable_error",
"fallback_suggestion": "retry after 30 seconds"
}
}https://direct.evolink.ai und bietet bessere Unterstützung für Textmodelle sowie persistente Verbindungen. https://api.evolink.ai ist der primäre Endpunkt für multimodale Dienste und dient bei Textmodellen als Ausweichadresse.Grok 4.7 verwenden
Setzen Siemodel auf grok-4.7. Das Kontextfenster beträgt 500.000 Token; der Wissensstand ist Mai 2026. Die Reasoning-Tiefe wird über reasoning.effort festgelegt: low, medium, high (Standard) oder xhigh. Reasoning lässt sich nicht deaktivieren.
Laut xAI-Spezifikation für verschlüsseltes Reasoning liefert 4.7 standardmäßig reasoning-Elemente mit encrypted_content in output, ohne explizites include. Wenn Sie den Gesprächsverlauf selbst verwalten, senden Sie die vollständigen reasoning-Elemente zusammen mit den übrigen bisherigen Ausgaben unverändert im nächsten input zurück. Den verschlüsselten Inhalt nicht entschlüsseln oder verändern. Maßgeblich sind die tatsächlich zurückgegebenen Felder.
X-Search-Abrechnung
Die neuen X-Search-Abrechnungsregeln gelten für Grok 4.5, 4.6 und 4.7. Eine Suche kann mehrere Beiträge und Nutzerprofile abrufen; übergeordnete und zitierte Beiträge zählen ebenfalls. Bei 30 Beiträgen und 3 Nutzerprofilen entstehen beispielsweise Tool-Gebühren von30 × 0.005 USD + 3 × 0.01 USD = 0.18 USD, zuzüglich Token-Gebühren.
Die Abrufzahlen finden Sie unter usage.server_side_tool_usage_details.x_posts_fetched und x_users_fetched. Fehlen beide Felder, wird aus Kompatibilitätsgründen pro erfolgreichem Aufruf abgerechnet. x_search_calls ist die Aufrufzahl; max_tool_calls ist ein Steuerwert für die Aufrufzahl, dessen tatsächliche Durchsetzung vom Zugangsweg abhängt. Keiner der beiden Werte begrenzt die Abrufmenge oder die Kosten. x_users_fetched ist ein Nutzungsfeld und erfordert keine zusätzliche Tool-Deklaration.
image_generation ist derzeit für Grok 4.5, 4.6 und 4.7 nicht verfügbar: Die Deklaration wird aus Kompatibilitätsgründen akzeptiert, das Tool jedoch vor der Weiterleitung an das Modell entfernt. Unbekannte Werte für tools[].type führen zu 400.Autorisierungen
##Alle APIs erfordern Bearer-Token-Authentifizierung##
API-Schlüssel erhalten:
Besuchen Sie die API-Schlüsselverwaltungsseite, um Ihren API-Schlüssel zu erhalten
Zum Anfrage-Header hinzufügen:
Authorization: Bearer YOUR_API_KEY
Body
Aufzurufendes Modell:
| Modell-ID | Positionierung |
|---|---|
grok-4.7 | xAI-Modell für Reasoning und Tool-Aufrufe; Kontextfenster von 500K Token; unterstützt xhigh; Wissensstand: 2026-05 |
grok-4.6 | xAI-Modell für Reasoning und Tool-Aufrufe, Kontextfenster von 500K; zusätzlich mit Reasoning-Stufe xhigh; Wissensstand 2026-02-01 |
grok-4.5 | xAI-Modell für Reasoning und Tool-Aufrufe, Kontextfenster von 500K; Reasoning-Stufen bis high (xhigh wird akzeptiert, aber auf high herabgestuft) |
grok-4.7, grok-4.6, grok-4.5 "grok-4.7"
Eingabe für das Modell: eine einfache Zeichenkette oder ein Array von OpenAI-Responses-Eingabeelementen (z. B. {"role":"user","content":[...]}).
"Search the web for the latest SpaceX launch and summarize it in one sentence."
Streaming-Ausgabe per SSE; Standard ist false. Lesen Sie status und usage aus der abschließenden Antwort: completed bedeutet abgeschlossene Generierung; Ausgabelimits und ähnliche Fälle können incomplete ergeben. Warten Sie nicht ausschließlich auf ein response.completed-Ereignis.
false
Maximale Anzahl der zu generierenden Token (einschließlich Reasoning-Token).
2048
Die Reasoning-Tiefe wird als Objekt angegeben: {"effort": "low" | "medium" | "high" | "xhigh"}. Standard ist high; Reasoning lässt sich nicht deaktivieren. grok-4.7 und grok-4.6 unterstützen xhigh; grok-4.5 behandelt den Wert als high. Reasoning-Token werden als Ausgabe-Token abgerechnet und unter usage.output_tokens_details.reasoning_tokens ausgewiesen.
Show child attributes
Show child attributes
Tool-Deklarationen. Serverseitige Tool-Gebühren fallen zusätzlich zu Token-Gebühren an und unterliegen nicht dem Multiplikator für lange Kontexte:
| Tool-Typ | Funktion | Abrechnungseinheit und Preis |
|---|---|---|
web_search | Im Web suchen und Webseiten aufrufen | 0.005 USD pro erfolgreichem Aufruf |
x_search | X-Beiträge, Konten und Themen durchsuchen | 0.005 USD pro abgerufenem Beitrag + 0.01 USD pro abgerufenem Nutzerprofil |
code_execution | Python in einer Sandbox ausführen (Alias: code_interpreter) | 0.005 USD pro erfolgreichem Aufruf |
attachment_search | Gesprächsanhänge durchsuchen (bei Dateieingaben gegebenenfalls automatisch aktiviert) | 0.01 USD pro erfolgreichem Aufruf |
collections_search | Hochgeladene Dokumentensammlungen durchsuchen (Alias: file_search) | 0.0025 USD pro erfolgreichem Aufruf |
Die neue X-Search-Abrechnung gilt für grok-4.5, grok-4.6 und grok-4.7. Ein Aufruf kann mehrere Beiträge liefern; übergeordnete und zitierte Beiträge aus Suchergebnissen oder Threads zählen ebenfalls. Die tatsächliche Nutzung steht unter usage.server_side_tool_usage_details. Fehlen beide Abrufzählfelder, wird aus Kompatibilitätsgründen pro erfolgreichem Aufruf abgerechnet.
Reguläre function-Tools werden ebenfalls unterstützt (clientseitige Funktionsaufrufe ohne Gebühr für serverseitige Tool-Aufrufe).
image_generation ist derzeit für Grok 4.5, 4.6 und 4.7 nicht verfügbar: Die Deklaration wird aus Kompatibilitätsgründen akzeptiert, das Tool jedoch vor der Weiterleitung an das Modell entfernt. Unbekannte Werte für tools[].type führen zu 400.
Show child attributes
Show child attributes
[{ "type": "web_search" }]
Steuert die Tool-Auswahl: "auto" (Standard) / "none" / "required" oder ein Objekt, das ein bestimmtes Tool festlegt, z. B. {"type": "web_search"}.
auto, none, required Optionaler Schlüssel für das Cache-Routing. Ein stabiler Wert für dieselbe Unterhaltung oder Anfragen mit gleichem Prompt-Präfix kann die Cache-Trefferchance erhöhen. Treffer sind nicht garantiert; die Cache-Abrechnung bleibt unverändert. Tatsächliche Treffer werden unter cached_tokens in usage ausgewiesen.
"grok-session-001"
Zusätzlich angeforderte Antwortfelder. Beispielsweise kann grok-4.6 mit ["reasoning.encrypted_content"] verschlüsseltes Reasoning anfordern. Laut xAI-API-Spezifikation gibt grok-4.7 dieses Feld standardmäßig ohne explizites include zurück.
["reasoning.encrypted_content"]
Steuerwert für die Anzahl der Tool-Aufrufe. Das Gateway leitet ihn weiter und schätzt damit die zu reservierenden Tool-Gebühren. Ob ein Zugangsweg die Anzahl strikt begrenzt, muss anhand seines tatsächlichen Verhaltens geprüft werden. Der Wert begrenzt weder abgerufene X-Beiträge noch Nutzerprofile und ist keine Kostenobergrenze.
1
Antwort
Eine Antwort wurde zurückgegeben; prüfen Sie zusätzlich status: completed bei abgeschlossener Generierung, incomplete etwa bei Ausgabelimits und failed bei einem Fehler. Bei stream=true erfolgt die Ausgabe als SSE-Stream; lesen Sie status und usage aus der abschließenden Antwort.
Eindeutiger Bezeichner der Antwort
"55d44212-8d5e-90cc-975f-36d341ce21f5"
Antworttyp
response "response"
Antwortstatus
completed, incomplete, failed "completed"
Tatsächlich verwendeter Modellname
"grok-4.7"
Erstellungszeitstempel
1786538000
Ausgabeelemente in Generierungsreihenfolge: reasoning-Elemente (gegebenenfalls mit verschlüsseltem Reasoning), serverseitige Tool-Aufrufe, function_call-Elemente und message-Elemente mit output_text. Maßgeblich für die Tool-Nutzung ist usage; ein x_search-Aufruf kann Gebühren für mehrere Beiträge und Nutzerprofile verursachen.
Show child attributes
Show child attributes
Statistik zur Token- und Tool-Nutzung. Ab 200K Token im Prompt werden alle Token-Typen zum doppelten Preis abgerechnet; Tool-Gebühren sind vom Multiplikator nicht betroffen.
Show child attributes
Show child attributes