
Qwen3.8 Max est sorti : fonctions, contexte 1M et statut API
qwen3.8-max comme flagship officiel le 3 août 2026. Sont confirmés : contexte 1M, Thinking, Function Calling, outils intégrés et Structured Output. EvoLink propose la route de production qwen3.8-max ; l’URL de documentation conserve le slug Preview historique.Statut au 3 août 2026
| Couche | Statut | Conséquence |
|---|---|---|
| QwenCloud | qwen3.8-max officiel | Les faits upstream sont confirmés |
| Preview | qwen3.8-max-preview devient le canal historique | Ne pas l'utiliser comme ID EvoLink final |
| Open Weights/licence | annoncés, artefacts non vérifiés | Ne pas promettre l'auto-hébergement |
| EvoLink | route de production qwen3.8-max disponible | Vérifier page produit, prix live et smoke test du compte avant production |
Les sections Preview suivantes restent utiles comme historique ; ce statut prévaut.
Token Plan n’est pas l’API Qwen standard
Fonctionnalités confirmées de Qwen3.8 Max Preview
Raisonnement avec niveau explicite
low, medium et xhigh, avec xhigh comme valeur par défaut documentée, ainsi qu'un traitement particulier de l'historique de raisonnement en conversation multitour.Une réponse unique convaincante ne prouve donc pas qu'un agent conservera correctement décisions, résultats d'outils et contraintes pendant une longue session.
Génération de texte pour travaux complexes
Qwen met en avant raisonnement difficile, code, analyse de données et productivité. Ce sont des catégories de test, pas des résultats de production. Séparez : exactitude, respect du format, exécution sans boucle et coût du résultat accepté après nouvelles tentatives et revue.
Compréhension visuelle
La liste Token Plan indique la compréhension visuelle. Captures, documents, graphiques et entrées texte-image sont donc pertinents, sans garantir chaque format, taille de fichier, durée de média ou capacité d'une future route EvoLink.
Outils intégrés au Token Plan
Qwen documente recherche web, interpréteur de code, extraction web, recherche inversée d'images et recherche d'images à partir de texte. Un bon résultat peut venir du modèle, du retrieval, de l'interpréteur ou du harnais complet. Évaluez le raisonnement seul et le workflow assisté séparément.

Annoncé, mais pas entièrement documenté
Qwen présente Qwen3.8 comme un modèle de 2,4 billions de paramètres, prévoit des Open Weights et le positionne près de la frontière. Ces signaux ne constituent pas une fiche technique complète.
| Élément annoncé | Ce qu'il indique | Ce qui manque |
|---|---|---|
| 2,4 billions de paramètres | Hausse majeure d'échelle | Paramètres actifs, experts, entraînement, efficacité d'inférence |
| Projet Open Weights | Une voie auto-hébergée pourrait arriver | Dépôt, fichiers, licence, date, matériel, variantes |
| Positionnement frontier | Qwen attend un gain de capacité | Tableaux complets, méthode, réplication, latence et coût |
Le nombre total de paramètres ne détermine ni la qualité acceptée, ni le coût de service, ni la longueur de sortie, ni la reprise des outils.
Limites de la Preview importantes en production
L'identifiant peut changer
qwen3.8-max-preview était l’ID Token Plan ; l’ID upstream de production est qwen3.8-max. Gardez configurable l’ID final d’EvoLink.Les Credits ne sont pas des prix par token
Ils mesurent la consommation d'un abonnement et peuvent inclure des multiplicateurs temporaires. Attendez les tarifs de la route et mesurez le coût par tâche acceptée.
Le contexte est propre au canal
qwen3.8-max. Cela ne prouve pas un retrieval fiable à toute position et ne garantit pas les mêmes limites sur la future route EvoLink.Le Token Plan personnel n'est pas une route backend
Le comportement doit être vérifié route par route
Limites de débit, régions, sortie structurée, streaming, cache, batch, outils et facturation des échecs peuvent varier selon le canal. Ne recopiez pas les paramètres de Qwen3.7.
Qwen3.8 propose trois modes de cache
| Cache | Création | Hit | Minimum | Utilisation |
|---|---|---|---|---|
| Explicite | 125 % | 10 % | 1 024 tokens | cache_control manuel |
| Implicite | 100 % | 20 % | 256 tokens | Préfixe détecté automatiquement |
| Session | 125 % | 10 % | 1 024 tokens | Conversation Responses API |
Ce sont les règles du canal Qwen, pas celles du contrat commercial ou du cache de la route EvoLink.
Qui devrait préparer Qwen3.8 maintenant ?
Commencez si votre équipe exécute du code à l'échelle d'un dépôt ou des agents longs, possède une base stable, des tests automatisés ou une grille humaine claire, et peut tolérer les changements avec un fallback.
Attendez avant la production si vous avez besoin d'un ID versionné stable, d'un budget prévisible, de garanties régionales ou de débit, ou si vous ne pouvez pas détecter les échecs silencieux et revenir à une autre route.
Préparation avant une API de production
Figez les prompts, critères d’acceptation et baselines. Ne lancez pas une grande évaluation payante avant l’arrivée d’une route de production avec prix et droits d’usage clairs.
| Charge | Exemple | À mesurer |
|---|---|---|
| Code de dépôt | Correctif multifichier avec tests | Acceptation, changements inutiles, retries, temps de revue |
| Agent | Tâche outil avec erreur injectée | Exactitude, reprise, boucles, interventions |
| Vision | Capture UI ou document | Grounding, détails manqués, extraction structurée |
| Contexte long | Grand dépôt ou corpus | Rappel, consignes, contradictions |
| Analyse | Tableau vers rapport | Exactitude numérique, preuve, qualité de l'artefact |
| Routine | Petite modification | Valeur face à une route moins chère |
accepted_task_cost = model_usage + retries + fallback_usage + reviewer_time + defect_repairPréparation pour les utilisateurs EvoLink
- Vérifier la route, l’ID
qwen3.8-maxet le prix en direct sur la page produit Qwen3.8 Max. - Décider si le long contexte, les grands dépôts ou les agents à outils justifient une route frontier.
- Construire un jeu fixe avec une route existante comme Kimi K3 et conserver les critères d’acceptation.
- Exécuter un smoke test minimal avec le guide API, puis rejouer les mêmes tâches.
- Comparer acceptation, latence, retries, correction humaine et coût par tâche acceptée tout en gardant un fallback.
Les termes Preview et les questions techniques restent utiles
La sortie production n'efface pas les anciennes configurations, évaluations et recherches.
Distinguer production, Preview et anciens checkpoints
| Terme | Signification actuelle | Conclusion interdite |
|---|---|---|
qwen3.8-max | ID de production QwenCloud | EvoLink doit utiliser le même ID |
qwen3.8-max-preview | Ancien ID Token Plan et identifiant draft EvoLink | L'upstream resterait seulement Preview |
| Qwen3.8 Token Plan | Abonnement pour outils interactifs compatibles | Clé backend générale ou contrat tarifaire EvoLink |
| Qwen3-8B | Ancien checkpoint 8B | Autre orthographe de Qwen3.8 |
| Open Weights | Artefact futur annoncé | Licence, checkpoint ou matériel déjà vérifiés |
Le cache influence toujours le coût. Vérifiez stabilité du préfixe, durée, coût de création contre hits et input ajouté par l'historique Thinking. Testez 32K, 128K, 256K et la vraie limite ; 1M ne garantit ni retrieval ni économie.
| Test | Preuve requise |
|---|---|
| Cache implicite/explicite | Usage et facture sur répétitions contrôlées |
| Session | État, outils et latence multitour |
| Structured Output | Schema strict, erreurs et réparations |
| Vision | Formats, grounding et détails inventés |
| Route EvoLink | Vérifier endpoint, champs, limites, erreurs et prix live dans le compte cible |
La préparation production appartient à la route. Les fonctions upstream ne remplacent pas formats média, Rate Limits, régions, facturation, erreurs, latence et lifecycle vérifiés.
De l’annonce à un test API justifié
Ne vous inscrivez pas sur la seule foi d’une annonce. Validez d’abord ces points, puis créez une clé API si la route correspond à votre charge.
- 01
Publié ?
Oui. Qwen3.8 Max est le modèle de production ; Preview reste un contexte de canal historique.
- 02
Disponible ?
Oui sur EvoLink. Vérifiez la route active et l’ID du modèle sur la page produit.
- 03
Adapté à mon cas ?
Pour le raisonnement long contexte, les grands dépôts et les agents à outils ; gardez les tâches simples sur une route plus légère.
- 04
Quel prix ?
Consultez le module de prix en direct de la page produit, sans reprendre un prix upstream ou Preview.
- 05
Comment l’appeler ?
Choisissez Chat Completions, Responses ou Messages, puis suivez le guide et la référence des paramètres.
Les cinq points sont validés ? Créer une clé API.
FAQ
Qwen3.8 est-il officiellement sorti ?
qwen3.8-max au journal et au catalogue de production le 3 août 2026. EvoLink gère la route de production séparément de l’ancienne documentation Preview.Quel est l'ID de la Preview ?
qwen3.8-max pour la route de production ; qwen3.8-max-preview est l’ancien ID Token Plan et documentation.Qwen3.8 est-il identique à Qwen3-8B ?
Non. Qwen3.8 est la version 2026 de la famille ; Qwen3-8B est un ancien modèle de huit milliards de paramètres.
Quelle différence entre Token Plan et l’accès API ?
Token Plan est un abonnement à Credits pour outils interactifs. Une API standard vise les applications automatisées et facture les tokens.
Qwen3.8 est-il disponible sur EvoLink ?
qwen3.8-max. Vérifiez la page produit et le prix en direct, puis exécutez un smoke test dans votre compte avant le trafic de production.Qwen3.8 prend-il les images en charge ?
Qwen décrit la production comme un modèle vision-language natif. Formats, tailles, limites média et comportement EvoLink doivent être vérifiés par route.
Qwen3.8 est-il Open Source ou Open Weight ?
Qwen a annoncé des Open Weights, mais dépôt, checkpoints, licence et guide de déploiement n’étaient pas vérifiés le 3 août.
Combien coûte Qwen3.8 ?
Séparez prix upstream QwenCloud et prix de route EvoLink. Budgétez avec le prix live du canal utilisé et le coût par tâche acceptée, pas avec les Credits Token Plan.
Qwen3.8 est-il meilleur que Qwen3.7 Max ?
Qwen le positionne comme un progrès ; les équipes doivent attendre des preuves complètes et tester leurs charges. Qwen3.7 reste la base de production mieux documentée.
Faut-il attendre Qwen3.8 avant de livrer ?
Non. Construisez sur un modèle pris en charge, conservez un fallback et préparez des tests reproductibles. Migrez seulement après validation de la route, du prix, des limites et des résultats.
Sources
- Journal des modèles QwenCloud
- Sortie technique et benchmarks Qwen3.8 Max
- Présentation de Qwen Token Plan
- Modèles Qwen de génération de texte
- Guide Qwen Context Cache
- Qwen Token Plan personnel
- Outils intégrés Qwen
- Qwen OpenAI Chat API
- Configuration Qwen Kilo CLI
- Page Qwen Token Plan
- Annonce Qwen3.8


