Grok Schnittstelle für alle Modelle - Chat Completions vollständige Parameter
- OpenAI-kompatibler Chat-Completions-Endpunkt für xAI-Grok-Textmodelle; Modellauswahl über den Parameter
model(alle Werte siehe Tabelle beim Parametermodel) grok-4.5: Kontextfenster von 500K Token; ab 200K Token im Prompt werden alle Token-Typen zum doppelten Preis abgerechnet- Prompt-Caching greift automatisch: Token aus dem Cache werden zum günstigeren Cache-Eingabepreis abgerechnet
- Synchroner und Streaming-Modus (SSE)
- Reguläre
function-Tool-Aufrufe werden unterstützt; serverseitige xAI-Tools stehen ausschließlich über die Responses API bereit
https://direct.evolink.ai und bietet bessere Unterstützung für Textmodelle sowie persistente Verbindungen. https://api.evolink.ai ist der primäre Endpunkt für multimodale Dienste und dient bei Textmodellen als Ausweichadresse.function-Tool-Aufrufe.Autorisierungen
##Alle APIs erfordern Bearer-Token-Authentifizierung##
API-Schlüssel erhalten:
Besuchen Sie die API-Schlüsselverwaltungsseite, um Ihren API-Schlüssel zu erhalten
Zum Anfrage-Header hinzufügen:
Body
Aufzurufendes Modell:
grok-4.5 "grok-4.5"
Liste der Chat-Nachrichten. Unterstützt die Rollen system, user und assistant.
1Ob eine Streaming-Antwort zurückgegeben wird (SSE, chat.completion.chunk-Events). Standard false.
false
Maximale Anzahl der zu generierenden Token. Wird unverändert an das Modell weitergegeben.
1024
Sampling-Temperatur (0-2). Höhere Werte erzeugen zufälligere Ausgaben.
0.7
Nucleus-Sampling-Parameter (0-1).
0.95
Reguläre OpenAI-function-Tool-Definitionen (clientseitige Funktionsaufrufe, keine zusätzliche Gebühr pro Aufruf). Serverseitige xAI-Tools stehen ausschließlich über die Responses API bereit.
Steuert die Funktionsauswahl: "auto" / "none" / "required" oder ein Objekt, das eine bestimmte Funktion festlegt.
auto, none, required Antwort
Chat-Vervollständigung erfolgreich generiert (JSON-Objekt oder – bei stream=true – ein SSE-Stream von chat.completion.chunk-Events)
Eindeutiger Bezeichner für die Chat-Vervollständigung
"chatcmpl-20260812164515123456789AbCdEfGh"
Tatsächlich verwendeter Modellname
"grok-4.5"
Antworttyp
chat.completion "chat.completion"
Erstellungszeitstempel
1786538000
Liste der Chat-Vervollständigungsoptionen
Statistik zur Token-Nutzung. Ab 200K Token im Prompt werden alle Token-Typen (Eingabe, Cache-Eingabe, Ausgabe) zum doppelten Preis abgerechnet.