Qwen3.8-Max-Preview - Responses-Schnittstelle
🚧 Dieses Modell ist noch nicht verfügbar, bleiben Sie gespannt
- Qwen3.8-Max-Preview über das OpenAI-Responses-Protokoll aufrufen
- Flexible Eingabe:
inputkann ein String oder ein Nachrichten-Array im Chat-Format sein (unterstützt Multimodalitätinput_text/input_image) - Mehrstufige Gespräche:
previous_response_idübergeben, um die vorherige Antwort zu verknüpfen; der Server kombiniert den Kontext automatisch (die Antwort-idist 7 Tage gültig) - Sitzungs-Caching: mit dem Header
x-dashscope-session-cache: enable(Standard disable) aktivieren, Treffer sieheusage.input_tokens_details.cached_tokens - Denkintensität: über
reasoning.effortgesteuert - Streaming-Ausgabe: bei
stream=trueals Responses-Ereignisse (response.output_text.delta/response.completedusw.) zurückgegeben
https://direct.evolink.ai, die Textmodelle und langlebige Verbindungen besser unterstützt. https://api.evolink.ai ist der primäre Endpunkt für multimodale Dienste; verwenden Sie diese Adresse bei Eingaben mit Bild.Sitzungs-Caching: Die Responses-Schnittstelle aktiviert serverseitiges Sitzungs-Caching über den Header x-dashscope-session-cache: enable, um Latenz und Kosten bei mehreren Runden zu senken.Autorisierungen
##Alle APIs erfordern eine Bearer-Token-Authentifizierung##
API-Schlüssel abrufen:
Besuchen Sie die API-Schlüsselverwaltung, um Ihren API-Schlüssel abzurufen
Zum Anfrage-Header hinzufügen:
Header
Schalter für Sitzungs-Caching. Bei enable cacht der Server den Gesprächskontext automatisch, um Latenz und Kosten bei mehrstufiger Inferenz zu senken.
enable, disable Body
Name des Chat-Modells
qwen3.8-max-preview "qwen3.8-max-preview"
Modelleingabe. Kann ein String (Klartext) oder ein Nachrichten-Array im Chat-Format sein (unterstützt Multimodalität input_text / input_image).
Wird als Systemanweisung an den Anfang des Kontexts eingefügt. Bei Verwendung von previous_response_id werden die instructions der vorherigen Runde nicht in diese Runde übernommen.
Eindeutige ID der vorherigen Antwort (die Antwort-id, 7 Tage gültig). Dient zum Verknüpfen mehrstufiger Gespräche; der Server ruft Eingabe und Ausgabe dieser Runde automatisch ab und kombiniert sie als Kontext.
Maximale Anzahl der Token für den in diesem Aufruf generierten Ausgabeinhalt (einschließlich Denken).
Denksteuerung.
Ob diese Antwort gespeichert wird.
true(Standard): kann überprevious_response_idreferenziert werdenfalse: wird nicht gespeichert und kann später nicht referenziert werden
Ob als Responses-Ereignisse gestreamt zurückgegeben wird.
Sampling-Temperatur, Wertebereich [0, 2].
0 <= x <= 2Nucleus-Sampling-Parameter, Wertebereich (0, 1].
0 <= x <= 1Werkzeugliste. Unterstützt integrierte Werkzeuge (web_search Websuche, web_extractor Webseiten-Extraktion, code_interpreter Code-Interpreter) und benutzerdefinierte function.
Antwort
Erfolgreich generiert
Eindeutige ID dieser Antwort (7 Tage gültig, kann als previous_response_id dienen)
"resp_xxxxxxxx"
"response"
Antwortstatus
"completed"
"qwen3.8-max-preview"
Array von Ausgabe-Elementen (enthält message / reasoning / integrierte Werkzeugaufrufe usw.)
Statistik zur Token-Nutzung.