Qwen3.8-Max-Preview - Anthropic-kompatible Schnittstelle
🚧 Dieses Modell ist noch nicht verfügbar, bleiben Sie gespannt
- Qwen3.8-Max-Preview über das Anthropic-Messages-Protokoll aufrufen
- System-Prompt: über das
system-Feld auf oberster Ebene festgelegt (nicht innerhalb von messages) - Multimodale Eingabe:
contentübergibt ein Array von Inhaltsblöcken, unterstützttext/image - Kontext-Caching: an einem Inhaltsblock
cache_controlhinzufügen, um explizites Caching zu deklarieren; Treffer / Erstellung siehe Antwortusage.cache_read_input_tokens/usage.cache_creation_input_tokens - Denkmodus: über
thinkingaktiviert, Denken wird alsthinking-Inhaltsblock gestreamt zurückgegeben - Streaming-Ausgabe: bei
stream=trueals Anthropic-SSE-Ereignisse (message_start/content_block_delta/message_deltausw.) zurückgegeben
https://direct.evolink.ai, die Textmodelle und langlebige Verbindungen besser unterstützt. https://api.evolink.ai ist der primäre Endpunkt für multimodale Dienste; verwenden Sie diese Adresse bei Eingaben mit Bild.Autorisierungen
##Alle APIs erfordern eine Bearer-Token-Authentifizierung##
API-Schlüssel abrufen:
Besuchen Sie die API-Schlüsselverwaltung, um Ihren API-Schlüssel abzurufen
Zum Anfrage-Header hinzufügen:
Body
Name des Chat-Modells
qwen3.8-max-preview "qwen3.8-max-preview"
Maximale Anzahl der Token für den generierten Inhalt.
Erforderlich (vom Anthropic-Protokoll vorgeschrieben). Wenn das Modell mehr als diesen Wert generiert, wird abgeschnitten.
1024
Liste der Gesprächsnachrichten (ohne system). Jede Nachricht enthält role (user / assistant) und content (String oder Array von Inhaltsblöcken).
System-Prompt. Als Klartext einen String übergeben; zum Deklarieren von explizitem Caching ein Array von Inhaltsblöcken übergeben (mit cache_control am Block).
Sampling-Temperatur, Wertebereich [0, 2].
0 <= x <= 2Nucleus-Sampling-Parameter, Wertebereich (0, 1].
0 <= x <= 1Sampelt aus den K Token mit der höchsten Wahrscheinlichkeit.
Benutzerdefinierte Stoppsequenzen; bei Treffer wird die Generierung gestoppt.
Ob als Anthropic-SSE-Ereignisse gestreamt zurückgegeben wird.
Konfiguration für den Tiefdenkmodus. Nach Aktivierung gibt das Modell den Denkprozess als thinking-Inhaltsblock zurück.
Liste der Werkzeugdefinitionen (Anthropic-tools-Format) für Function Calling.
Antwort
Erfolgreich generiert
"msg_xxxxxxxx"
"message"
"assistant"
"qwen3.8-max-preview"
Array von Antwort-Inhaltsblöcken
Grund für den Stopp: end_turn (normales Ende), max_tokens (Obergrenze erreicht), stop_sequence (Stoppsequenz getroffen), tool_use (Werkzeugaufruf erforderlich)
"end_turn"
Statistik zur Token-Nutzung (Anthropic-Semantik: input_tokens enthält keinen Cache und wird disjunkt zu den Cache-Feldern addiert).