Grok Schnittstelle für alle Modelle - Responses vollständige Parameter
- OpenAI-kompatibler Responses-Endpunkt für xAI-Grok-Textmodelle; Modellauswahl über den Parameter
model(alle Werte siehe Tabelle beim Parametermodel) grok-4.5: Kontextfenster von 500K Token; ab 200K Token im Prompt werden alle Token-Typen zum doppelten Preis abgerechnet- Prompt-Caching greift automatisch: Token aus dem Cache werden zum günstigeren Cache-Eingabepreis abgerechnet
- Synchroner und Streaming-Modus (SSE)
- Serverseitige xAI-Tools laufen auf der xAI-Infrastruktur und werden pro erfolgreichem Aufruf abgerechnet:
web_search,x_search,code_execution,attachment_search,collections_search - Reguläre
function-Tools (clientseitige Funktionsaufrufe) werden ebenfalls unterstützt und verursachen keine Gebühr pro Aufruf
https://direct.evolink.ai und bietet bessere Unterstützung für Textmodelle sowie persistente Verbindungen. https://api.evolink.ai ist der primäre Endpunkt für multimodale Dienste und dient bei Textmodellen als Ausweichadresse.Autorisierungen
##Alle APIs erfordern Bearer-Token-Authentifizierung##
API-Schlüssel erhalten:
Besuchen Sie die API-Schlüsselverwaltungsseite, um Ihren API-Schlüssel zu erhalten
Zum Anfrage-Header hinzufügen:
Body
Aufzurufendes Modell:
grok-4.5 "grok-4.5"
Eingabe für das Modell: eine einfache Zeichenkette oder ein Array von OpenAI-Responses-Eingabeelementen (z. B. {"role":"user","content":[...]}), das unverändert weitergegeben wird.
"Search the web for the latest SpaceX launch and summarize it in one sentence."
Ob eine Streaming-Antwort zurückgegeben wird (SSE-Events, endend mit response.completed). Standard false.
false
Maximale Anzahl der zu generierenden Token (einschließlich Reasoning-Token).
2048
Tool-Deklarationen. Serverseitige xAI-Tools (Abrechnung pro erfolgreichem Aufruf, Gebühren sind vom Long-Context-Multiplikator nicht betroffen):
Reguläre function-Tools (clientseitige Funktionsaufrufe) werden ebenfalls unterstützt und verursachen keine Gebühr pro Aufruf.
⚠️ image_generation ist derzeit nicht verfügbar: Die Deklaration wird aus Kompatibilitätsgründen akzeptiert, das Tool aber entfernt, bevor die Anfrage das Modell erreicht. Nicht erkannte Tool-Typen werden mit 400 abgelehnt.
Steuert die Tool-Auswahl: "auto" (Standard) / "none" / "required" oder ein Objekt, das ein bestimmtes Tool festlegt, z. B. {"type": "web_search"}.
auto, none, required Maximale Anzahl serverseitiger Tool-Aufrufe für diese Anfrage. Ohne Angabe (oder bei null) setzt die Plattform automatisch eine Obergrenze von bis zu 10 Aufrufen, abhängig von Ihrem verfügbaren Guthaben. Deklarierte kostenpflichtige Tools reservieren ihr Budget im Worst Case vorab; der nicht genutzte Teil wird bei der Abrechnung erstattet.
5
Antwort
Antwortgenerierung erfolgreich (JSON-Objekt oder – bei stream=true – ein SSE-Event-Stream, der mit response.completed endet)
Eindeutiger Bezeichner der Antwort
"55d44212-8d5e-90cc-975f-36d341ce21f5"
Antworttyp
response "response"
Antwortstatus
completed, incomplete, failed "completed"
Tatsächlich verwendeter Modellname
"grok-4.5"
Erstellungszeitstempel
1786538000
Ausgabeelemente in Generierungsreihenfolge: reasoning-Elemente (zusammengefasster Denkprozess), Elemente serverseitiger Tool-Aufrufe wie web_search_call / code_interpreter_call (der Status completed kennzeichnet einen erfolgreichen, abrechenbaren Aufruf) und abschließend ein message-Element mit output_text-Inhalt.
Statistik zur Token- und Tool-Nutzung. Ab 200K Token im Prompt werden alle Token-Typen zum doppelten Preis abgerechnet; Tool-Gebühren sind vom Multiplikator nicht betroffen.