Qwen3.8-Max-Preview - Interface compatible Anthropic
🚧 Ce modele n’est pas encore disponible, restez a l’ecoute
- Appelez Qwen3.8-Max-Preview avec le protocole Anthropic Messages
- Prompt système : défini via le champ
systemde premier niveau (pas dans messages) - Entrée multimodale :
contentreçoit un tableau de blocs de contenu, prenant en chargetext/image - Mise en cache du contexte : ajoutez
cache_controlsur un bloc de contenu pour déclarer un cache explicite ; voir les correspondances / créations dans la réponseusage.cache_read_input_tokens/usage.cache_creation_input_tokens - Mode réflexion : activé via
thinking, la réflexion est renvoyée en streaming sous forme de blocs de contenuthinking - Sortie en streaming : lorsque
stream=true, le retour suit les événements Anthropic SSE (message_start/content_block_delta/message_delta, etc.)
https://direct.evolink.ai, qui offre une meilleure prise en charge des modèles de texte et des connexions longues ; https://api.evolink.ai est l’adresse principale multimodale, à utiliser en cas d’entrée image.Autorisations
##Toutes les API nécessitent une authentification Bearer Token##
Obtenir une clé API :
Visitez la Page de gestion des clés API pour obtenir votre clé API
Ajouter à l'en-tête de requête :
Corps
Nom du modèle de conversation
qwen3.8-max-preview "qwen3.8-max-preview"
Nombre maximal de tokens du contenu généré.
Obligatoire (exigé par le protocole Anthropic). Si le modèle génère au-delà de cette valeur, la sortie sera tronquée.
1024
Liste des messages de conversation (hors system). Chaque message contient role (user / assistant) et content (chaîne ou tableau de blocs de contenu).
Prompt système. Passez une chaîne pour du texte brut ; passez un tableau de blocs de contenu pour déclarer un cache explicite (en ajoutant cache_control sur un bloc).
Température d'échantillonnage, plage [0, 2].
0 <= x <= 2Paramètre d'échantillonnage nucleus, plage (0, 1].
0 <= x <= 1Échantillonne parmi les K tokens les plus probables.
Séquences d'arrêt personnalisées, la génération s'arrête lorsqu'elles sont rencontrées.
Renvoyer ou non un flux d'événements Anthropic SSE.
Configuration de la réflexion approfondie. Une fois activée, le modèle renvoie son processus de réflexion sous forme de blocs de contenu thinking.
Liste de définitions d'outils (format Anthropic tools), utilisée pour Function Calling.
Réponse
Génération réussie
"msg_xxxxxxxx"
"message"
"assistant"
"qwen3.8-max-preview"
Tableau de blocs de contenu de la réponse
Raison de l'arrêt : end_turn (fin normale), max_tokens (limite atteinte), stop_sequence (séquence d'arrêt rencontrée), tool_use (appel d'outil nécessaire)
"end_turn"
Statistiques d'utilisation des tokens (sémantique Anthropic : input_tokens n'inclut pas le cache et s'additionne de manière exclusive avec les champs cache).