{
"id": "msg_xxxxxxxx",
"type": "message",
"role": "assistant",
"model": "qwen3.8-max",
"content": [
{
"type": "text",
"text": "Bonjour ! Je suis Qwen3.8-Max."
}
],
"stop_reason": "end_turn",
"usage": {
"input_tokens": 12,
"output_tokens": 104,
"cache_creation_input_tokens": 0,
"cache_read_input_tokens": 0
}
}{
"type": "error",
"error": {
"type": "invalid_request_error",
"message": "max_tokens is required"
}
}{
"type": "error",
"error": {
"type": "authentication_error",
"message": "Invalid or expired token"
}
}{
"type": "error",
"error": {
"type": "insufficient_quota",
"message": "Insufficient credits"
}
}{
"type": "error",
"error": {
"type": "<string>",
"message": "<string>"
}
}{
"type": "error",
"error": {
"type": "<string>",
"message": "<string>"
}
}Qwen3.8-Max - Interface compatible Anthropic
- Appelez Qwen3.8-Max avec le protocole Anthropic Messages
- Prompt système : défini via le champ
systemde premier niveau (pas dans messages) - Entrée multimodale :
contentreçoit un tableau de blocs de contenu, prenant en chargetext/image - Mise en cache du contexte : ajoutez
cache_controlsur un bloc de contenu pour déclarer un cache explicite ; voir les correspondances / créations dans la réponseusage.cache_read_input_tokens/usage.cache_creation_input_tokens - Mode réflexion : activé via
thinking, la réflexion est renvoyée en streaming sous forme de blocs de contenuthinking - Sortie en streaming : lorsque
stream=true, le retour suit les événements Anthropic SSE (message_start/content_block_delta/message_delta, etc.)
{
"id": "msg_xxxxxxxx",
"type": "message",
"role": "assistant",
"model": "qwen3.8-max",
"content": [
{
"type": "text",
"text": "Bonjour ! Je suis Qwen3.8-Max."
}
],
"stop_reason": "end_turn",
"usage": {
"input_tokens": 12,
"output_tokens": 104,
"cache_creation_input_tokens": 0,
"cache_read_input_tokens": 0
}
}{
"type": "error",
"error": {
"type": "invalid_request_error",
"message": "max_tokens is required"
}
}{
"type": "error",
"error": {
"type": "authentication_error",
"message": "Invalid or expired token"
}
}{
"type": "error",
"error": {
"type": "insufficient_quota",
"message": "Insufficient credits"
}
}{
"type": "error",
"error": {
"type": "<string>",
"message": "<string>"
}
}{
"type": "error",
"error": {
"type": "<string>",
"message": "<string>"
}
}https://direct.evolink.ai, qui offre une meilleure prise en charge des modèles de texte et des connexions longues ; https://api.evolink.ai est l’adresse principale multimodale, à utiliser en cas d’entrée image.Autorisations
##Toutes les API nécessitent une authentification Bearer Token##
Obtenir une clé API :
Visitez la Page de gestion des clés API pour obtenir votre clé API
Ajouter à l'en-tête de requête :
Authorization: Bearer YOUR_API_KEY
Corps
Nom du modèle de conversation
qwen3.8-max "qwen3.8-max"
Nombre maximal de tokens du contenu généré.
Obligatoire (exigé par le protocole Anthropic). Si le modèle génère au-delà de cette valeur, la sortie sera tronquée.
1024
Liste des messages de conversation (hors system). Chaque message contient role (user / assistant) et content (chaîne ou tableau de blocs de contenu).
Show child attributes
Show child attributes
Prompt système. Passez une chaîne pour du texte brut ; passez un tableau de blocs de contenu pour déclarer un cache explicite (en ajoutant cache_control sur un bloc).
Température d'échantillonnage, plage [0, 2].
0 <= x <= 2Paramètre d'échantillonnage nucleus, plage (0, 1].
0 <= x <= 1Échantillonne parmi les K tokens les plus probables.
Séquences d'arrêt personnalisées, la génération s'arrête lorsqu'elles sont rencontrées.
Renvoyer ou non un flux d'événements Anthropic SSE.
Configuration de la réflexion approfondie. Une fois activée, le modèle renvoie son processus de réflexion sous forme de blocs de contenu thinking.
Show child attributes
Show child attributes
Liste de définitions d'outils (format Anthropic tools), utilisée pour Function Calling.
Show child attributes
Show child attributes
Réponse
Génération réussie
"msg_xxxxxxxx"
"message"
"assistant"
"qwen3.8-max"
Tableau de blocs de contenu de la réponse
Show child attributes
Show child attributes
Raison de l'arrêt : end_turn (fin normale), max_tokens (limite atteinte), stop_sequence (séquence d'arrêt rencontrée), tool_use (appel d'outil nécessaire)
"end_turn"
Statistiques d'utilisation des tokens (sémantique Anthropic : input_tokens n'inclut pas le cache et s'additionne de manière exclusive avec les champs cache).
Show child attributes
Show child attributes