{
"id": "msg_xxxxxxxx",
"type": "message",
"role": "assistant",
"model": "qwen3.8-max",
"content": [
{
"type": "text",
"text": "Hallo! Ich bin Tongyi Qianwen Qwen3.8-Max."
}
],
"stop_reason": "end_turn",
"usage": {
"input_tokens": 12,
"output_tokens": 104,
"cache_creation_input_tokens": 0,
"cache_read_input_tokens": 0
}
}{
"type": "error",
"error": {
"type": "invalid_request_error",
"message": "max_tokens is required"
}
}{
"type": "error",
"error": {
"type": "authentication_error",
"message": "Invalid or expired token"
}
}{
"type": "error",
"error": {
"type": "insufficient_quota",
"message": "Insufficient credits"
}
}{
"type": "error",
"error": {
"type": "<string>",
"message": "<string>"
}
}{
"type": "error",
"error": {
"type": "<string>",
"message": "<string>"
}
}Qwen3.8-Max - Anthropic-kompatible Schnittstelle
- Qwen3.8-Max über das Anthropic-Messages-Protokoll aufrufen
- System-Prompt: über das
system-Feld auf oberster Ebene festgelegt (nicht innerhalb von messages) - Multimodale Eingabe:
contentübergibt ein Array von Inhaltsblöcken, unterstützttext/image - Kontext-Caching: an einem Inhaltsblock
cache_controlhinzufügen, um explizites Caching zu deklarieren; Treffer / Erstellung siehe Antwortusage.cache_read_input_tokens/usage.cache_creation_input_tokens - Denkmodus: über
thinkingaktiviert, Denken wird alsthinking-Inhaltsblock gestreamt zurückgegeben - Streaming-Ausgabe: bei
stream=trueals Anthropic-SSE-Ereignisse (message_start/content_block_delta/message_deltausw.) zurückgegeben
{
"id": "msg_xxxxxxxx",
"type": "message",
"role": "assistant",
"model": "qwen3.8-max",
"content": [
{
"type": "text",
"text": "Hallo! Ich bin Tongyi Qianwen Qwen3.8-Max."
}
],
"stop_reason": "end_turn",
"usage": {
"input_tokens": 12,
"output_tokens": 104,
"cache_creation_input_tokens": 0,
"cache_read_input_tokens": 0
}
}{
"type": "error",
"error": {
"type": "invalid_request_error",
"message": "max_tokens is required"
}
}{
"type": "error",
"error": {
"type": "authentication_error",
"message": "Invalid or expired token"
}
}{
"type": "error",
"error": {
"type": "insufficient_quota",
"message": "Insufficient credits"
}
}{
"type": "error",
"error": {
"type": "<string>",
"message": "<string>"
}
}{
"type": "error",
"error": {
"type": "<string>",
"message": "<string>"
}
}https://direct.evolink.ai, die Textmodelle und langlebige Verbindungen besser unterstützt. https://api.evolink.ai ist der primäre Endpunkt für multimodale Dienste; verwenden Sie diese Adresse bei Eingaben mit Bild.Autorisierungen
##Alle APIs erfordern eine Bearer-Token-Authentifizierung##
API-Schlüssel abrufen:
Besuchen Sie die API-Schlüsselverwaltung, um Ihren API-Schlüssel abzurufen
Zum Anfrage-Header hinzufügen:
Authorization: Bearer YOUR_API_KEY
Body
Name des Chat-Modells
qwen3.8-max "qwen3.8-max"
Maximale Anzahl der Token für den generierten Inhalt.
Erforderlich (vom Anthropic-Protokoll vorgeschrieben). Wenn das Modell mehr als diesen Wert generiert, wird abgeschnitten.
1024
Liste der Gesprächsnachrichten (ohne system). Jede Nachricht enthält role (user / assistant) und content (String oder Array von Inhaltsblöcken).
Show child attributes
Show child attributes
System-Prompt. Als Klartext einen String übergeben; zum Deklarieren von explizitem Caching ein Array von Inhaltsblöcken übergeben (mit cache_control am Block).
Sampling-Temperatur, Wertebereich [0, 2].
0 <= x <= 2Nucleus-Sampling-Parameter, Wertebereich (0, 1].
0 <= x <= 1Sampelt aus den K Token mit der höchsten Wahrscheinlichkeit.
Benutzerdefinierte Stoppsequenzen; bei Treffer wird die Generierung gestoppt.
Ob als Anthropic-SSE-Ereignisse gestreamt zurückgegeben wird.
Konfiguration für den Tiefdenkmodus. Nach Aktivierung gibt das Modell den Denkprozess als thinking-Inhaltsblock zurück.
Show child attributes
Show child attributes
Liste der Werkzeugdefinitionen (Anthropic-tools-Format) für Function Calling.
Show child attributes
Show child attributes
Antwort
Erfolgreich generiert
"msg_xxxxxxxx"
"message"
"assistant"
"qwen3.8-max"
Array von Antwort-Inhaltsblöcken
Show child attributes
Show child attributes
Grund für den Stopp: end_turn (normales Ende), max_tokens (Obergrenze erreicht), stop_sequence (Stoppsequenz getroffen), tool_use (Werkzeugaufruf erforderlich)
"end_turn"
Statistik zur Token-Nutzung (Anthropic-Semantik: input_tokens enthält keinen Cache und wird disjunkt zu den Cache-Feldern addiert).
Show child attributes
Show child attributes