Zum Hauptinhalt springen
POST
BaseURL: Die Standard-BaseURL ist https://direct.evolink.ai, die Textmodelle und langlebige Verbindungen besser unterstützt. https://api.evolink.ai ist der primäre Endpunkt für multimodale Dienste; verwenden Sie diese Adresse bei Eingaben mit Bild / Audio / Video.

Autorisierungen

Authorization
string
header
erforderlich

##Alle APIs erfordern eine Bearer-Token-Authentifizierung##

API-Schlüssel abrufen:

Besuchen Sie die API-Schlüsselverwaltung, um Ihren API-Schlüssel abzurufen

Zum Anfrage-Header hinzufügen:

Body

application/json
model
enum<string>
erforderlich

Name des Chat-Modells

Verfügbare Optionen:
qwen3.8-max-preview
Beispiel:

"qwen3.8-max-preview"

messages
(System Message · object | User Message · object | Assistant Message · object | Tool Message · object)[]
erforderlich

Liste der Gesprächsnachrichten, unterstützt mehrstufige Gespräche. Die Nachrichtenfeldstruktur unterscheidet sich je nach Rolle (system / user / assistant / tool); bitte wählen Sie die entsprechende Rolle aus.

enable_thinking
boolean
Standard:false

Ob der Tiefdenkmodus aktiviert wird

  • true: Das Modell gibt den Denkprozess aus, zurückgegeben über reasoning_content
  • false (Standard): Der Denkprozess wird nicht ausgegeben

Hinweis: Einige Modelle geben bei nicht gestreamten Aufrufen Denkinhalte nur zurück, wenn dies explizit auf true gesetzt ist.

temperature
number

Sampling-Temperatur, steuert die Zufälligkeit der Ausgabe. Niedrigere Werte sind bestimmter, höhere Werte vielfältiger. Wertebereich [0, 2]. Es wird empfohlen, temperature und top_p nicht gleichzeitig anzupassen.

Erforderlicher Bereich: 0 <= x <= 2
top_p
number

Nucleus-Sampling-Parameter (Nucleus Sampling), das aus den Token mit der höchsten kumulativen Wahrscheinlichkeit sampelt. Wertebereich (0, 1]. Es wird empfohlen, temperature und top_p nicht gleichzeitig anzupassen.

Erforderlicher Bereich: 0 <= x <= 1
max_completion_tokens
integer

Obergrenze für die Länge des generierten Inhalts (Anzahl Token), einschließlich Gedankenkette und Antwort. Für Denkmodelle wird dieser Parameter empfohlen. Standard- und Maximalwert entsprechen der maximalen Ausgabelänge des Modells; bei Überschreitung wird mit finish_reason=length vorzeitig gestoppt.

max_tokens
integer

Veralteter Parameter zur Begrenzung der Generierungslänge.

Veraltet: Für neue Integrationen bitte max_completion_tokens verwenden. Dieser Parameter begrenzt nur den Antwortteil (ohne Gedankenkette).

stream
boolean
Standard:false

Ob die Antwort als Stream zurückgegeben wird.

  • true: blockweise über SSE (Server-Sent Events) zurückgegeben
  • false (Standard): die vollständige Antwort wird auf einmal zurückgegeben
stream_options
object

Optionen für die Streaming-Antwort, nur bei stream=true wirksam.

tools
object[]

Liste der Werkzeugdefinitionen für Function Calling. Jedes Werkzeug muss Name, Beschreibung und Parameter-Schema definieren.

Antwort

Chat erfolgreich generiert

id
string

Eindeutige Kennung dieses Gesprächs

Beispiel:

"chatcmpl-xxxxxxxx"

object
string
Beispiel:

"chat.completion"

created
integer

Erstellungszeit (Unix-Sekunden)

Beispiel:

1735120033

model
string
Beispiel:

"qwen3.8-max-preview"

choices
object[]
usage
object

Statistik zur Token-Nutzung.