GPT Schnittstelle für alle Modelle - Chat Completions vollständige Parameter
- OpenAI-kompatible Chat Completions API für GPT-Textmodelle; das konkrete Modell wird über
modelgewählt (alle möglichen Werte siehe Vergleichstabelle beim Parametermodel) - Die gesamte Reihe besteht aus Reasoning-Modellen; die Reasoning-Tiefe wird über
reasoning_effortgesteuert, Reasoning-Token werden als Ausgabe-Token abgerechnet - Prompt-Caching greift automatisch: im Cache getroffene Eingabe-Token werden zum günstigeren Cache-Preis abgerechnet
- Unterstützt synchronen und Streaming-Modus (SSE)
- Unterstützt gemischte Text- und Bildeingaben sowie
function-Werkzeugaufrufe - Serverseitige Tools (Websuche, Codeausführung, Dokumentensuche, MCP) werden nur auf der Responses API bereitgestellt
- Hinweis Der Unterstützungsumfang der Sampling-Parameter (
temperature,top_p,logprobsusw.) unterscheidet sich je nach Modell; Einzelheiten siehe die Hinweise zu den jeweiligen Parametern unten
https://direct.evolink.ai und bietet bessere Unterstützung für Textmodelle sowie persistente Verbindungen. https://api.evolink.ai ist der primäre Endpunkt für multimodale Dienste und dient bei Textmodellen als Ausweichadresse.function-Werkzeugaufrufe.stop (Stoppsequenzen) und web_search_options werden von keinem Modell unterstützt und geben bei Übergabe 400 zurück; logit_bias ist für diese Modellreihe nicht anwendbar.Der Unterstützungsumfang von temperature, top_p, frequency_penalty, presence_penalty, logprobs und verbosity unterscheidet sich je nach Modell — maßgeblich sind die Hinweise zu den jeweiligen Parametern oben.Autorisierungen
##Alle APIs erfordern Bearer-Token-Authentifizierung##
API-Schlüssel erhalten:
Besuchen Sie die API-Schlüsselverwaltungsseite, um Ihren API-Schlüssel zu erhalten
Zum Anfrage-Header hinzufügen:
Body
Aufzurufendes Modell:
gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna, gpt-5.5, gpt-5.4, gpt-5.2, gpt-5.1 "gpt-5.6-sol"
Liste der Chat-Nachrichten, unterstützt mehrstufigen Kontext und multimodale Eingaben.
role kann system / developer / user / assistant / tool sein.
content kann eine Zeichenkette oder ein Array von Content-Blöcken sein. Unterstützt werden zwei Blocktypen: text (Text) und image_url (Bild):
Bild
- Übergeben Sie in
image_url.urldie öffentliche URL des Bildes image_urlkann auch direkt als Zeichenkette geschrieben werden, gleichbedeutend mit{ "url": "..." }detailsteuert die Genauigkeit der Bildanalyse:auto(Standard) /low/high/original- Das Bild muss herunterladbar sein, andernfalls wird
400zurückgegeben
Hinweis Die Blocktypen dieser API unterscheiden sich von denen der Responses API (dort input_text / input_image). Sie dürfen nicht vermischt werden; eine falsche Verwendung gibt 400 zurück.
Ob die Rückgabe als Stream erfolgt (SSE-Ereignisstrom, der mit data: [DONE] endet). Standard false.
false
Maximale Anzahl zu generierender Token (einschließlich Reasoning-Token).
Hinweis Diese Modellreihe verwendet max_completion_tokens. Aus Gründen der Abwärtskompatibilität wird ein allein übergebenes max_tokens automatisch als max_completion_tokens behandelt; übergeben Sie jedoch nicht beide Felder gleichzeitig — auf gpt-5.1 / gpt-5.2 / gpt-5.4 gibt die gleichzeitige Übergabe 400 zurück.
2048
Steuerung der Reasoning-Tiefe. Die möglichen Werte unterscheiden sich je nach Modell:
Reasoning-Token werden als Ausgabe-Token abgerechnet und in usage.completion_tokens_details.reasoning_tokens gezählt.
none, low, medium, high, xhigh "medium"
Ausführlichkeit der Antwort: low / medium / high.
Hinweis Nur von gpt-5.6-sol / gpt-5.6-terra / gpt-5.6-luna / gpt-5.5 unterstützt; andere Modelle unterstützen diesen Parameter nicht.
low, medium, high "low"
Sampling-Temperatur, Wertebereich 0 bis 2. Niedrigere Werte machen die Ausgabe deterministischer.
Hinweis Nur von gpt-5.5 / gpt-5.4 / gpt-5.2 / gpt-5.1 unterstützt. Die gpt-5.6-Familie akzeptiert nur den Standardwert 1; andere Werte geben 400 zurück.
0 <= x <= 20.7
Nucleus-Sampling-Parameter, Wertebereich 0 bis 1. Es wird empfohlen, ihn nicht zusammen mit temperature anzupassen.
Hinweis Nur von gpt-5.5 / gpt-5.4 / gpt-5.2 / gpt-5.1 unterstützt; die gpt-5.6-Familie unterstützt diesen Parameter nicht.
0 <= x <= 10.9
Frequency Penalty, Wertebereich -2 bis 2. Positive Werte bestrafen Token nach ihrer Auftretenshäufigkeit und verringern wiederholte Inhalte.
Hinweis Nur von gpt-5.4 / gpt-5.2 / gpt-5.1 unterstützt; die gpt-5.6-Familie und gpt-5.5 unterstützen diesen Parameter nicht.
-2 <= x <= 20.5
Presence Penalty, Wertebereich -2 bis 2. Positive Werte ermutigen das Modell, neue Themen anzusprechen.
Hinweis Nur von gpt-5.4 / gpt-5.2 / gpt-5.1 unterstützt; die gpt-5.6-Familie und gpt-5.5 unterstützen diesen Parameter nicht.
-2 <= x <= 20.5
Ob die Log-Wahrscheinlichkeiten jedes Ausgabe-Token zurückgegeben werden.
Hinweis Nur von gpt-5.4 / gpt-5.2 / gpt-5.1 unterstützt; die gpt-5.6-Familie und gpt-5.5 unterstützen diesen Parameter nicht.
true
Anzahl der pro Position zurückgegebenen Kandidaten-Token, Wertebereich 0 bis 5; muss zusammen mit logprobs: true verwendet werden.
Hinweis Gleicher Unterstützungsumfang wie logprobs.
0 <= x <= 52
Anzahl der zu generierenden Antwortkandidaten, zurückgegeben als mehrere Einträge im Array choices. Alle Token (einschließlich der Ausgabe jedes Kandidaten) werden abgerechnet.
1
Zufalls-Seed. Bei gleichem Seed und gleicher Parameterkombination versucht das Modell, konsistente Ergebnisse zu liefern (nach bestem Bemühen, vollständige Reproduzierbarkeit ist nicht garantiert).
42
Steuerung des Ausgabeformats:
{"type": "text"}: freier Text, der Standard{"type": "json_object"}: gibt gültiges JSON zurück und erfordert, dass das Wortjsoninmessagesvorkommt, andernfalls wird400zurückgegeben{"type": "json_schema", "json_schema": {...}}: gibt strukturierte Ergebnisse gemäß dem angegebenen JSON-Schema zurück; mit"strict": truewird die Einhaltung des Schemas erzwungen
Werkzeugliste für Function Calling (clientseitige Funktionsaufrufe, keine Gebühr pro Aufruf).
Serverseitige Tools (Websuche, Codeausführung usw.) werden auf dieser API nicht bereitgestellt; verwenden Sie stattdessen die Responses API.
Steuerung der Werkzeugauswahl: "auto" (Standard) / "none" / "required", oder ein Objekt, das eine bestimmte Funktion angibt, etwa {"type": "function", "function": {"name": "get_weather"}}.
none, auto, required Ob das Modell innerhalb einer Runde mehrere Werkzeuge parallel aufrufen darf. Standard true; mit false werden die Aufrufe nacheinander erzwungen.
true
Cache-Gruppierungsschlüssel. Wenn Sie für Anfragen mit demselben Präfix denselben Wert übergeben, steigt die Trefferquote des Prompt-Caches.
"app-chat-v1"
Kennung des Endnutzers, dient der Unterscheidung der Aufrufquelle.
"user-1024"
Antwort
Chat-Generierung erfolgreich (JSON-Objekt; bei stream=true ein SSE-Ereignisstrom, der mit data: [DONE] endet)
Eindeutige Kennung dieses Gesprächs
"chatcmpl-CvJ2p8mQxK7nR4wS"
Antworttyp
chat.completion "chat.completion"
Erstellungszeitstempel
1786705221
Tatsächlich verwendeter Modellname
"gpt-5.6-sol"
Liste der generierten Ergebnisse (Länge entspricht n in der Anfrage)
Statistik zum Token-Verbrauch. Prompt-Caching greift automatisch; im Cache getroffene Eingabe-Token werden zum günstigeren Cache-Preis abgerechnet.