
Qwen3.8 Max Preview : fonctionnalités, Token Plan et sortie
qwen3.8-max-preview, 1M tokens de contexte, le raisonnement, la vision, Function Calling, des outils intégrés et trois caches. Une API backend GA avec tarif standard et une route EvoLink manquent encore.Attention au nom : Qwen3.8 n’est pas Qwen3-8B. Les prix, téléchargements et guides locaux de l’ancien modèle à huit milliards de paramètres ne s’appliquent pas àqwen3.8-max-preview.
Statut de Qwen3.8 au 21 juillet 2026
| Question | Réponse actuelle | Interprétation prudente |
|---|---|---|
| Existe-t-il une Preview officielle ? | Oui | Qwen liste qwen3.8-max-preview dans Token Plan. |
| Est-ce un modèle GA ? | Non | La Preview peut évoluer, être retirée ou remplacée. |
| L'ID Preview est-il public ? | Oui | Il vaut pour le canal documenté, pas forcément pour EvoLink. |
| Une clé Token Plan personnelle peut-elle alimenter un backend ? | Non | Scripts automatisés, backends personnalisés et batch non interactif sont interdits. |
| Le prix standard par token est-il publié ? | Non | Les Credits sont des unités d'abonnement, pas un tarif API général. |
| Les Open Weights sont-ils disponibles ? | Pas encore | Dépôt, licence, architecture et date restent en attente. |
| Qwen3.8 est-il disponible sur EvoLink ? | Pas encore | EvoLink vérifie les faits requis pour une route prise en charge. |
Une disponibilité dans un client Preview n'équivaut pas à une API prête pour un backend de production. L'ID stable, la facturation, les régions, les limites et le cycle de vie peuvent rester inconnus.
Token Plan n’est pas l’API Qwen standard
Fonctionnalités confirmées de Qwen3.8 Max Preview
Raisonnement avec niveau explicite
low, medium et xhigh, avec xhigh comme valeur par défaut documentée, ainsi qu'un traitement particulier de l'historique de raisonnement en conversation multitour.Une réponse unique convaincante ne prouve donc pas qu'un agent conservera correctement décisions, résultats d'outils et contraintes pendant une longue session.
Génération de texte pour travaux complexes
Qwen met en avant raisonnement difficile, code, analyse de données et productivité. Ce sont des catégories de test, pas des résultats de production. Séparez : exactitude, respect du format, exécution sans boucle et coût du résultat accepté après nouvelles tentatives et revue.
Compréhension visuelle
La liste Token Plan indique la compréhension visuelle. Captures, documents, graphiques et entrées texte-image sont donc pertinents, sans garantir chaque format, taille de fichier, durée de média ou capacité d'une future route EvoLink.
Outils intégrés au Token Plan
Qwen documente recherche web, interpréteur de code, extraction web, recherche inversée d'images et recherche d'images à partir de texte. Un bon résultat peut venir du modèle, du retrieval, de l'interpréteur ou du harnais complet. Évaluez le raisonnement seul et le workflow assisté séparément.

Annoncé, mais pas entièrement documenté
Qwen présente Qwen3.8 comme un modèle de 2,4 billions de paramètres, prévoit des Open Weights et le positionne près de la frontière. Ces signaux ne constituent pas une fiche technique complète.
| Élément annoncé | Ce qu'il indique | Ce qui manque |
|---|---|---|
| 2,4 billions de paramètres | Hausse majeure d'échelle | Paramètres actifs, experts, entraînement, efficacité d'inférence |
| Projet Open Weights | Une voie auto-hébergée pourrait arriver | Dépôt, fichiers, licence, date, matériel, variantes |
| Positionnement frontier | Qwen attend un gain de capacité | Tableaux complets, méthode, réplication, latence et coût |
Le nombre total de paramètres ne détermine ni la qualité acceptée, ni le coût de service, ni la longueur de sortie, ni la reprise des outils.
Limites de la Preview importantes en production
L'identifiant peut changer
qwen3.8-max-preview est un ID officiel du Token Plan. Une version finale peut adopter un alias ou snapshot différent. Gardez le choix du modèle dans la configuration.Les Credits ne sont pas des prix par token
Ils mesurent la consommation d'un abonnement et peuvent inclure des multiplicateurs temporaires. Attendez les tarifs de la route et mesurez le coût par tâche acceptée.
Le contexte est propre au canal
La liste actuelle de Qwen documente 1M tokens pour la Preview Token Plan. C’est une limite de canal confirmée, pas une preuve de retrieval fiable à toute position ni une garantie pour une future route EvoLink.
Le Token Plan personnel n'est pas une route backend
Le comportement doit être vérifié route par route
Limites de débit, régions, sortie structurée, streaming, cache, batch, outils et facturation des échecs peuvent varier selon le canal. Ne recopiez pas les paramètres de Qwen3.7.
Qwen3.8 propose trois modes de cache
| Cache | Création | Hit | Minimum | Utilisation |
|---|---|---|---|---|
| Explicite | 125 % | 10 % | 1 024 tokens | cache_control manuel |
| Implicite | 100 % | 20 % | 256 tokens | Préfixe détecté automatiquement |
| Session | 125 % | 10 % | 1 024 tokens | Conversation Responses API |
Ce sont les règles du canal Qwen, pas encore celles de la route EvoLink.
Qui devrait préparer Qwen3.8 maintenant ?
Commencez si votre équipe exécute du code à l'échelle d'un dépôt ou des agents longs, possède une base stable, des tests automatisés ou une grille humaine claire, et peut tolérer les changements avec un fallback.
Attendez avant la production si vous avez besoin d'un ID versionné stable, d'un budget prévisible, de garanties régionales ou de débit, ou si vous ne pouvez pas détecter les échecs silencieux et revenir à une autre route.
Préparation avant une API de production
Figez les prompts, critères d’acceptation et baselines. Ne lancez pas une grande évaluation payante avant l’arrivée d’une route de production avec prix et droits d’usage clairs.
| Charge | Exemple | À mesurer |
|---|---|---|
| Code de dépôt | Correctif multifichier avec tests | Acceptation, changements inutiles, retries, temps de revue |
| Agent | Tâche outil avec erreur injectée | Exactitude, reprise, boucles, interventions |
| Vision | Capture UI ou document | Grounding, détails manqués, extraction structurée |
| Contexte long | Grand dépôt ou corpus | Rappel, consignes, contradictions |
| Analyse | Tableau vers rapport | Exactitude numérique, preuve, qualité de l'artefact |
| Routine | Petite modification | Valeur face à une route moins chère |
accepted_task_cost = model_usage + retries + fallback_usage + reviewer_time + defect_repairPréparation pour les utilisateurs EvoLink
- Rejoindre la page d'accès anticipé Qwen3.8.
- Construire un jeu fixe avec une route disponible comme Kimi K3.
- Stocker prompts, schémas d'outils, critères et artefacts indépendamment du fournisseur.
- Garder la sélection du modèle configurable aux frontières de tâche.
- Rejouer les mêmes tâches après activation et comparer acceptation, latence, fiabilité et coût.
FAQ
Qwen3.8 est-il officiellement sorti ?
Qwen3.8 Max Preview est officiellement listé depuis le 21 juillet 2026, mais reste une Preview évolutive et non un modèle GA final.
Quel est l'ID de la Preview ?
qwen3.8-max-preview. Il est propre au canal et ne garantit pas l'ID final ou EvoLink.Qwen3.8 est-il identique à Qwen3-8B ?
Non. Qwen3.8 est la version 2026 de la famille ; Qwen3-8B est un ancien modèle de huit milliards de paramètres.
Quelle différence entre Token Plan et l’accès API ?
Token Plan est un abonnement à Credits pour outils interactifs. Une API standard vise les applications automatisées et facture les tokens.
Quel cache Qwen3.8 choisir ?
Le cache implicite est le plus simple, l’explicite convient aux préfixes maîtrisés et le cache de session aux conversations Responses API. Vérifiez la route réelle.
Qwen3.8 est-il disponible sur EvoLink ?
Pas encore. EvoLink n'a publié ni route, ni prix, ni ID de requête pris en charge.
Qwen3.8 prend-il les images en charge ?
La liste Token Plan indique la compréhension visuelle. Formats, tailles et comportement doivent être confirmés par endpoint.
Qwen3.8 est-il Open Source ou Open Weight ?
Qwen prévoit des Open Weights ; dépôt, fichiers, licence, architecture et calendrier n'étaient pas confirmés au 21 juillet 2026.
Combien coûte Qwen3.8 ?
L'abonnement et les Credits sont publics, mais pas le tarif standard par token ni celui d'EvoLink. Ne transformez pas les Credits en prix API supposé.
Qwen3.8 est-il meilleur que Qwen3.7 Max ?
Qwen le positionne comme un progrès ; les équipes doivent attendre des preuves complètes et tester leurs charges. Qwen3.7 reste la base de production mieux documentée.
Faut-il attendre Qwen3.8 avant de livrer ?
Non. Construisez sur un modèle pris en charge, conservez un fallback et préparez des tests reproductibles. Migrez seulement après validation de la route, du prix, des limites et des résultats.


