Skip to main content
POST
GPT Responses (alle Modelle, vollständige Parameter)
BaseURL: Die Standard-BaseURL ist https://direct.evolink.ai und bietet bessere Unterstützung für Textmodelle sowie persistente Verbindungen. https://api.evolink.ai ist der primäre Endpunkt für multimodale Dienste und dient bei Textmodellen als Ausweichadresse.
Serverseitige Tools (web_search, code_interpreter, file_search, mcp) werden auf dem Server ausgeführt, Ergebnisse müssen nicht vom Client zurückgesendet werden, und sie werden nur auf dieser API bereitgestellt. Der Chat-Completions-Endpunkt unterstützt ausschließlich gewöhnliche function-Werkzeugaufrufe.
Hinweis Diese API unterstützt nur den synchronen und den Streaming-Modus: Der asynchrone Hintergrundmodus mit background: true wird nicht unterstützt, und es gibt keine Endpunkte zum Abfragen, Abbrechen oder Löschen einer Antwort anhand ihrer ID. Verwenden Sie bei langen Generierungen stream: true, um die Verbindung offen zu halten.Das Werkzeug image_generation ist auf dieser Modellreihe nicht verfügbar; verwenden Sie für die Bildgenerierung die APIs der Bildmodellreihe.
Mehrstufige Konversationen: Übergeben Sie die in der vorherigen Runde zurückgegebene id in der nächsten Runde als previous_response_id, um den Kontext fortzuführen. Antworten haben eine Aufbewahrungsfrist; nach deren Ablauf ist die ID ungültig und die Anfrage wird als neue Konversation behandelt. Für Szenarien mit hohen Anforderungen an die Kontextgenauigkeit wird empfohlen, den vollständigen input-Verlauf selbst zu pflegen.

Autorisierungen

Authorization
string
header
erforderlich

##Alle APIs erfordern Bearer-Token-Authentifizierung##

API-Schlüssel erhalten:

Besuchen Sie die API-Schlüsselverwaltungsseite, um Ihren API-Schlüssel zu erhalten

Zum Anfrage-Header hinzufügen:

Body

application/json
model
enum<string>
erforderlich

Aufzurufendes Modell:

Verfügbare Optionen:
gpt-5.6-sol,
gpt-5.6-terra,
gpt-5.6-luna,
gpt-5.5,
gpt-5.4,
gpt-5.2,
gpt-5.1
Beispiel:

"gpt-5.6-sol"

input
erforderlich

Modelleingabe: eine reine Zeichenkette oder ein Array von Eingabeelementen.

Das content eines Eingabeelements unterstützt zwei Blocktypen: input_text (Text) und input_image (Bild):

Bild

  • Übergeben Sie in image_url die öffentliche URL des Bildes
  • image_url muss eine Zeichenkette sein; die Schreibweise { "url": "..." } gibt 400 zurück
  • detail steht auf derselben Ebene wie image_url (nicht darin verschachtelt): auto (Standard) / low / high / original
  • Das Bild muss herunterladbar sein, andernfalls wird 400 zurückgegeben

Werkzeugergebnisse

  • Das Array kann auch Werkzeugergebnis-Elemente aus der vorherigen Runde zurückgeben, etwa function_call_output

Hinweis Die Blocktypen dieser API unterscheiden sich von denen der Chat Completions API (dort text / image_url). Sie dürfen nicht vermischt werden; eine falsche Verwendung gibt 400 zurück.

Beispiel:

"Search for AI news from the past week and summarize it in three sentences."

instructions
string

Anweisungen auf Systemebene, gleichbedeutend mit dem Einfügen einer Systemnachricht ganz am Anfang von input. Wird die Konversation mit previous_response_id fortgesetzt, wird dieser Parameter nicht aus der vorherigen Runde übernommen und muss in jeder Runde übergeben werden.

Beispiel:

"You are a concise assistant. Answer in no more than three sentences."

stream
boolean
Standard:false

Ob eine Streaming-Antwort zurückgegeben wird (SSE-Events, endend mit response.completed). Standard false.

Beispiel:

false

max_output_tokens
integer

Maximale Anzahl zu generierender Token (einschließlich Reasoning-Token). Wird die Obergrenze erreicht, lautet status incomplete.

Beispiel:

2048

reasoning
object

Reasoning-Steuerung.

Die möglichen Werte von effort (Reasoning-Tiefe) unterscheiden sich je nach Modell:

summary (Reasoning-Zusammenfassung): auto / concise / detailed, in der gesamten Reihe verfügbar. Nach der Aktivierung erscheint in output ein reasoning-Element.

mode (Reasoning-Modus): standard / pro, nur von der gpt-5.6-Familie unterstützt.

context (Reasoning-Kontextbereich): auto / current_turn / all_turns, nur von der gpt-5.6-Familie unterstützt.

Reasoning-Token werden als Ausgabe-Token abgerechnet und in usage.output_tokens_details.reasoning_tokens gezählt.

text
object

Steuerung des Ausgabetexts:

  • format: {"type": "text"} (Standard), {"type": "json_object"} oder {"type": "json_schema", "name": "...", "schema": {...}, "strict": true} für strukturierte Ergebnisse
  • verbosity: low / medium / high, steuert die Ausführlichkeit der Antwort
tools
object[]

Werkzeugdeklarationen. Serverseitige Tools werden auf dem Server ausgeführt; Ergebnisse müssen nicht vom Client zurückgesendet werden:

Gewöhnliche function-Werkzeuge (clientseitige Funktionsaufrufe) werden ebenfalls unterstützt.

Hinweis image_generation ist auf dieser Modellreihe nicht verfügbar; verwenden Sie stattdessen die APIs der Bildmodellreihe.

Beispiel:
tool_choice

Steuert die Tool-Auswahl: "auto" (Standard) / "none" / "required" oder ein Objekt, das ein bestimmtes Tool festlegt, z. B. {"type": "web_search"}.

Verfügbare Optionen:
none,
auto,
required
max_tool_calls
integer

Obergrenze für die Gesamtzahl der in dieser Antwort zulässigen Werkzeugaufrufe.

Beispiel:

5

parallel_tool_calls
boolean
Standard:true

Ob das Modell innerhalb einer Runde mehrere Werkzeuge parallel aufrufen darf. Standard true.

Hinweis Nur die gpt-5.6-Familie und gpt-5.5 unterstützen die Einstellung false; auf gpt-5.4 / gpt-5.2 / gpt-5.1 hat dieser Parameter keine Wirkung und verhält sich stets wie true.

Beispiel:

true

previous_response_id
string

Die id der vorherigen Antwort, dient dazu, mehrere Gesprächsrunden zu verketten, ohne den Verlauf erneut zu übertragen.

Hinweis Muss zusammen mit store: true (Standardwert) verwendet werden. Antworten haben eine Aufbewahrungsfrist; nach deren Ablauf ist die ID ungültig, und die Anfrage wird als neue Konversation ohne Kontextübernahme behandelt. Für Szenarien mit hohen Anforderungen an die Kontextgenauigkeit wird empfohlen, den vollständigen input-Verlauf selbst zu pflegen.

Beispiel:

"resp_0f5c2b2c20c39e8a006a7ef545443081979e478b10927984b5"

store
boolean
Standard:true

Ob diese Antwort serverseitig gespeichert wird; nur gespeicherte Antworten können über previous_response_id referenziert werden. Standard true.

Hinweis Nur die gpt-5.6-Familie und gpt-5.5 unterstützen die Einstellung false; auf gpt-5.4 / gpt-5.2 / gpt-5.1 hat dieser Parameter keine Wirkung und verhält sich stets wie true. Wenn keine Speicherung gewünscht ist, wählen Sie ein Modell, das das Abschalten unterstützt.

Beispiel:

true

include
string[]

Zusätzliche Inhalte, die in der Antwort zurückgegeben werden sollen. Mögliche Werte:

  • reasoning.encrypted_content
  • message.output_text.logprobs
  • web_search_call.results
  • web_search_call.action.sources
  • file_search_call.results
  • code_interpreter_call.outputs
  • message.input_image.image_url
  • computer_call_output.output.image_url
Beispiel:
temperature
number

Sampling-Temperatur, Wertebereich 0 bis 2. Niedrigere Werte machen die Ausgabe deterministischer.

Hinweis Auf gpt-5.4 / gpt-5.2 / gpt-5.1 hat der Wert 0 keine Wirkung (er wird wie nicht gesetzt behandelt und auf den Standardwert 1 zurückgesetzt); für deterministischere Ausgaben verwenden Sie einen Wert größer als 0, etwa 0.01.

Erforderlicher Bereich: 0 <= x <= 2
Beispiel:

0.7

top_p
number

Nucleus-Sampling-Parameter, Wertebereich 0 bis 1. Es wird empfohlen, ihn nicht zusammen mit temperature anzupassen.

Erforderlicher Bereich: 0 <= x <= 1
Beispiel:

0.9

top_logprobs
integer

Anzahl der pro Position zurückgegebenen Kandidaten-Token, Wertebereich 0 bis 20; muss zusammen mit include: ["message.output_text.logprobs"] verwendet werden.

Hinweis Nur von der gpt-5.6-Familie und gpt-5.5 unterstützt; andere Modelle unterstützen diesen Parameter nicht.

Erforderlicher Bereich: 0 <= x <= 20
Beispiel:

2

frequency_penalty
number

Frequency Penalty, Wertebereich -2 bis 2, verringert die Wahrscheinlichkeit wiederholter Inhalte.

Hinweis Nur von der gpt-5.6-Familie unterstützt; andere Modelle unterstützen diesen Parameter nicht.

Erforderlicher Bereich: -2 <= x <= 2
Beispiel:

0.5

presence_penalty
number

Presence Penalty, Wertebereich -2 bis 2, ermutigt das Modell, neue Themen anzusprechen.

Hinweis Nur von der gpt-5.6-Familie unterstützt; andere Modelle unterstützen diesen Parameter nicht.

Erforderlicher Bereich: -2 <= x <= 2
Beispiel:

0.5

truncation
enum<string>
Standard:disabled

Verhalten, wenn der Kontext das Fenster überschreitet: disabled (Standard, gibt direkt einen Fehler zurück) oder auto (kürzt den mittleren Teil automatisch).

Verfügbare Optionen:
auto,
disabled
Beispiel:

"auto"

context_management
object[]

Konfiguration der automatischen Verdichtung langer Konversationen, zum Beispiel [{"type": "compaction", "compact_threshold": 100000}]: Überschreitet der Kontext den Schwellenwert, wird der Verlauf automatisch verdichtet.

Hinweis Nur von der gpt-5.6-Familie unterstützt; andere Modelle unterstützen diesen Parameter nicht.

prompt_cache_key
string

Cache-Gruppierungsschlüssel. Wenn Sie für Anfragen mit demselben Präfix denselben Wert übergeben, steigt die Trefferquote des Prompt-Caches.

Beispiel:

"app-agent-v1"

prompt_cache_retention
enum<string>

Aufbewahrungsstrategie für den Prompt-Cache: in_memory (Standard) oder 24h (verlängert die Aufbewahrungsdauer des Caches).

Verfügbare Optionen:
in_memory,
24h
Beispiel:

"in_memory"

prompt
object

Verweist auf eine bereits erstellte Prompt-Vorlage, in der Form {"id": "pmpt_xxx", "version": "1", "variables": {...}}.

metadata
object

Benutzerdefinierte Schlüssel-Wert-Paare, die unverändert mit der Antwort zurückgegeben werden und die Kennzeichnung auf Anwendungsseite erleichtern. Schlüssel und Werte sind jeweils Zeichenketten.

Beispiel:
safety_identifier
string

Stabile Kennung des Endnutzers, dient der Nachverfolgung von Missbrauch.

Hinweis Nur von der gpt-5.6-Familie unterstützt; andere Modelle unterstützen diesen Parameter nicht.

Beispiel:

"user-1024"

user
string

Kennung des Endnutzers, dient der Unterscheidung der Aufrufquelle.

Beispiel:

"user-1024"

Antwort

Antwortgenerierung erfolgreich (JSON-Objekt oder – bei stream=true – ein SSE-Event-Stream, der mit response.completed endet)

id
string

Eindeutige ID dieser Antwort, kann als previous_response_id für die nächste Runde dienen

Beispiel:

"resp_0f5c2b2c20c39e8a006a7ef545443081979e478b10927984b5"

object
enum<string>

Antworttyp

Verfügbare Optionen:
response
Beispiel:

"response"

status
enum<string>

Antwortstatus: completed für ein normales Ende, incomplete, wenn die Generierung etwa wegen Erreichen von max_output_tokens nicht abgeschlossen wurde, failed bei fehlgeschlagener Generierung

Verfügbare Optionen:
completed,
incomplete,
failed
Beispiel:

"completed"

model
string

Tatsächlich verwendeter Modellname

Beispiel:

"gpt-5.6-sol"

created_at
integer

Erstellungszeitstempel

Beispiel:

1786705221

output
object[]

Ausgabeelemente in Generierungsreihenfolge: das reasoning-Element (Reasoning-Zusammenfassung / verschlüsselter Reasoning-Inhalt), Werkzeugaufruf-Elemente (etwa web_search_call, code_interpreter_call) und zuletzt das message-Element mit dem output_text-Inhalt.

incomplete_details
object

Erläutert den Grund, wenn status gleich incomplete ist

usage
object

Statistik zum Token-Verbrauch. Prompt-Caching greift automatisch; im Cache getroffene Eingabe-Token werden zum günstigeren Cache-Preis abgerechnet.

metadata
object

Benutzerdefinierte Schlüssel-Wert-Paare aus der Anfrage, unverändert zurückgegeben