Zum Hauptinhalt springen
POST
BaseURL: Die Standard-BaseURL ist https://direct.evolink.ai, die Textmodelle und langlebige Verbindungen besser unterstützt. https://api.evolink.ai ist der primäre Endpunkt für multimodale Dienste; verwenden Sie diese Adresse bei Eingaben mit Bild.Sitzungs-Caching: Die Responses-Schnittstelle aktiviert serverseitiges Sitzungs-Caching über den Header x-dashscope-session-cache: enable, um Latenz und Kosten bei mehreren Runden zu senken.

Autorisierungen

Authorization
string
header
erforderlich

##Alle APIs erfordern eine Bearer-Token-Authentifizierung##

API-Schlüssel abrufen:

Besuchen Sie die API-Schlüsselverwaltung, um Ihren API-Schlüssel abzurufen

Zum Anfrage-Header hinzufügen:

Header

x-dashscope-session-cache
enum<string>
Standard:disable

Schalter für Sitzungs-Caching. Bei enable cacht der Server den Gesprächskontext automatisch, um Latenz und Kosten bei mehrstufiger Inferenz zu senken.

Verfügbare Optionen:
enable,
disable

Body

application/json
model
enum<string>
erforderlich

Name des Chat-Modells

Verfügbare Optionen:
qwen3.8-max-preview
Beispiel:

"qwen3.8-max-preview"

input
erforderlich

Modelleingabe. Kann ein String (Klartext) oder ein Nachrichten-Array im Chat-Format sein (unterstützt Multimodalität input_text / input_image).

instructions
string

Wird als Systemanweisung an den Anfang des Kontexts eingefügt. Bei Verwendung von previous_response_id werden die instructions der vorherigen Runde nicht in diese Runde übernommen.

previous_response_id
string

Eindeutige ID der vorherigen Antwort (die Antwort-id, 7 Tage gültig). Dient zum Verknüpfen mehrstufiger Gespräche; der Server ruft Eingabe und Ausgabe dieser Runde automatisch ab und kombiniert sie als Kontext.

max_output_tokens
integer

Maximale Anzahl der Token für den in diesem Aufruf generierten Ausgabeinhalt (einschließlich Denken).

reasoning
object

Denksteuerung.

store
boolean
Standard:true

Ob diese Antwort gespeichert wird.

  • true (Standard): kann über previous_response_id referenziert werden
  • false: wird nicht gespeichert und kann später nicht referenziert werden
stream
boolean
Standard:false

Ob als Responses-Ereignisse gestreamt zurückgegeben wird.

temperature
number

Sampling-Temperatur, Wertebereich [0, 2].

Erforderlicher Bereich: 0 <= x <= 2
top_p
number

Nucleus-Sampling-Parameter, Wertebereich (0, 1].

Erforderlicher Bereich: 0 <= x <= 1
tools
object[]

Werkzeugliste. Unterstützt integrierte Werkzeuge (web_search Websuche, web_extractor Webseiten-Extraktion, code_interpreter Code-Interpreter) und benutzerdefinierte function.

Antwort

Erfolgreich generiert

id
string

Eindeutige ID dieser Antwort (7 Tage gültig, kann als previous_response_id dienen)

Beispiel:

"resp_xxxxxxxx"

object
string
Beispiel:

"response"

status
string

Antwortstatus

Beispiel:

"completed"

model
string
Beispiel:

"qwen3.8-max-preview"

output
object[]

Array von Ausgabe-Elementen (enthält message / reasoning / integrierte Werkzeugaufrufe usw.)

usage
object

Statistik zur Token-Nutzung.