Seedance 2.5 est disponible sur EvoLinkEssayer Seedance 2.5
Environnement abstrait d'évaluation de la version officielle de Qwen3.8 Max pour le code, la vision et les agents
model-release

Qwen3.8 Max est sorti : fonctions, contexte 1M et statut API

Jacey
Jacey
Founder
21 juillet 2026
Mis à jour le 3 août 2026
10 min de lecture
Réponse rapide : QwenCloud a lancé qwen3.8-max comme flagship officiel le 3 août 2026. Sont confirmés : contexte 1M, Thinking, Function Calling, outils intégrés et Structured Output. EvoLink propose la route de production qwen3.8-max ; l’URL de documentation conserve le slug Preview historique.

Statut au 3 août 2026

CoucheStatutConséquence
QwenCloudqwen3.8-max officielLes faits upstream sont confirmés
Previewqwen3.8-max-preview devient le canal historiqueNe pas l'utiliser comme ID EvoLink final
Open Weights/licenceannoncés, artefacts non vérifiésNe pas promettre l'auto-hébergement
EvoLinkroute de production qwen3.8-max disponibleVérifier page produit, prix live et smoke test du compte avant production

Les sections Preview suivantes restent utiles comme historique ; ce statut prévaut.

Token Plan n’est pas l’API Qwen standard

Token Plan est un abonnement avec clé, Credits et quotas dédiés aux outils interactifs de code et d’agents. La page officielle affiche actuellement des promotions à 6, 18 et 68 dollars par mois. Ce ne sont pas des prix par token et la clé ne doit pas alimenter un backend automatisé.

Fonctionnalités confirmées de Qwen3.8 Max Preview

Raisonnement avec niveau explicite

Qwen classe la Preview comme modèle de raisonnement. La référence Chat API documente low, medium et xhigh, avec xhigh comme valeur par défaut documentée, ainsi qu'un traitement particulier de l'historique de raisonnement en conversation multitour.

Une réponse unique convaincante ne prouve donc pas qu'un agent conservera correctement décisions, résultats d'outils et contraintes pendant une longue session.

Génération de texte pour travaux complexes

Qwen met en avant raisonnement difficile, code, analyse de données et productivité. Ce sont des catégories de test, pas des résultats de production. Séparez : exactitude, respect du format, exécution sans boucle et coût du résultat accepté après nouvelles tentatives et revue.

Compréhension visuelle

La liste Token Plan indique la compréhension visuelle. Captures, documents, graphiques et entrées texte-image sont donc pertinents, sans garantir chaque format, taille de fichier, durée de média ou capacité d'une future route EvoLink.

Outils intégrés au Token Plan

Qwen documente recherche web, interpréteur de code, extraction web, recherche inversée d'images et recherche d'images à partir de texte. Un bon résultat peut venir du modèle, du retrieval, de l'interpréteur ou du harnais complet. Évaluez le raisonnement seul et le workflow assisté séparément.

Workflow d'évaluation de Qwen3.8 Max séparant raisonnement, outils, comportement de route et acceptation production
Workflow d'évaluation de Qwen3.8 Max séparant raisonnement, outils, comportement de route et acceptation production

Annoncé, mais pas entièrement documenté

Qwen présente Qwen3.8 comme un modèle de 2,4 billions de paramètres, prévoit des Open Weights et le positionne près de la frontière. Ces signaux ne constituent pas une fiche technique complète.

Élément annoncéCe qu'il indiqueCe qui manque
2,4 billions de paramètresHausse majeure d'échelleParamètres actifs, experts, entraînement, efficacité d'inférence
Projet Open WeightsUne voie auto-hébergée pourrait arriverDépôt, fichiers, licence, date, matériel, variantes
Positionnement frontierQwen attend un gain de capacitéTableaux complets, méthode, réplication, latence et coût

Le nombre total de paramètres ne détermine ni la qualité acceptée, ni le coût de service, ni la longueur de sortie, ni la reprise des outils.

Limites de la Preview importantes en production

L'identifiant peut changer

qwen3.8-max-preview était l’ID Token Plan ; l’ID upstream de production est qwen3.8-max. Gardez configurable l’ID final d’EvoLink.

Les Credits ne sont pas des prix par token

Ils mesurent la consommation d'un abonnement et peuvent inclure des multiplicateurs temporaires. Attendez les tarifs de la route et mesurez le coût par tâche acceptée.

Le contexte est propre au canal

Le catalogue de production Qwen documente 1M tokens pour qwen3.8-max. Cela ne prouve pas un retrieval fiable à toute position et ne garantit pas les mêmes limites sur la future route EvoLink.

Le Token Plan personnel n'est pas une route backend

Le forfait personnel est limité aux outils interactifs de code et d'agents. Séparez donc accès d'évaluation et route API de production approuvée.

Le comportement doit être vérifié route par route

Limites de débit, régions, sortie structurée, streaming, cache, batch, outils et facturation des échecs peuvent varier selon le canal. Ne recopiez pas les paramètres de Qwen3.7.

Qwen3.8 propose trois modes de cache

CacheCréationHitMinimumUtilisation
Explicite125 %10 %1 024 tokenscache_control manuel
Implicite100 %20 %256 tokensPréfixe détecté automatiquement
Session125 %10 %1 024 tokensConversation Responses API

Ce sont les règles du canal Qwen, pas celles du contrat commercial ou du cache de la route EvoLink.

Qui devrait préparer Qwen3.8 maintenant ?

Commencez si votre équipe exécute du code à l'échelle d'un dépôt ou des agents longs, possède une base stable, des tests automatisés ou une grille humaine claire, et peut tolérer les changements avec un fallback.

Attendez avant la production si vous avez besoin d'un ID versionné stable, d'un budget prévisible, de garanties régionales ou de débit, ou si vous ne pouvez pas détecter les échecs silencieux et revenir à une autre route.

Préparation avant une API de production

Figez les prompts, critères d’acceptation et baselines. Ne lancez pas une grande évaluation payante avant l’arrivée d’une route de production avec prix et droits d’usage clairs.

ChargeExempleÀ mesurer
Code de dépôtCorrectif multifichier avec testsAcceptation, changements inutiles, retries, temps de revue
AgentTâche outil avec erreur injectéeExactitude, reprise, boucles, interventions
VisionCapture UI ou documentGrounding, détails manqués, extraction structurée
Contexte longGrand dépôt ou corpusRappel, consignes, contradictions
AnalyseTableau vers rapportExactitude numérique, preuve, qualité de l'artefact
RoutinePetite modificationValeur face à une route moins chère
accepted_task_cost = model_usage + retries + fallback_usage + reviewer_time + defect_repair
  1. Vérifier la route, l’ID qwen3.8-max et le prix en direct sur la page produit Qwen3.8 Max.
  2. Décider si le long contexte, les grands dépôts ou les agents à outils justifient une route frontier.
  3. Construire un jeu fixe avec une route existante comme Kimi K3 et conserver les critères d’acceptation.
  4. Exécuter un smoke test minimal avec le guide API, puis rejouer les mêmes tâches.
  5. Comparer acceptation, latence, retries, correction humaine et coût par tâche acceptée tout en gardant un fallback.

Les termes Preview et les questions techniques restent utiles

La sortie production n'efface pas les anciennes configurations, évaluations et recherches.

Distinguer production, Preview et anciens checkpoints

TermeSignification actuelleConclusion interdite
qwen3.8-maxID de production QwenCloudEvoLink doit utiliser le même ID
qwen3.8-max-previewAncien ID Token Plan et identifiant draft EvoLinkL'upstream resterait seulement Preview
Qwen3.8 Token PlanAbonnement pour outils interactifs compatiblesClé backend générale ou contrat tarifaire EvoLink
Qwen3-8BAncien checkpoint 8BAutre orthographe de Qwen3.8
Open WeightsArtefact futur annoncéLicence, checkpoint ou matériel déjà vérifiés

Le cache influence toujours le coût. Vérifiez stabilité du préfixe, durée, coût de création contre hits et input ajouté par l'historique Thinking. Testez 32K, 128K, 256K et la vraie limite ; 1M ne garantit ni retrieval ni économie.

TestPreuve requise
Cache implicite/expliciteUsage et facture sur répétitions contrôlées
SessionÉtat, outils et latence multitour
Structured OutputSchema strict, erreurs et réparations
VisionFormats, grounding et détails inventés
Route EvoLinkVérifier endpoint, champs, limites, erreurs et prix live dans le compte cible

La préparation production appartient à la route. Les fonctions upstream ne remplacent pas formats média, Rate Limits, régions, facturation, erreurs, latence et lifecycle vérifiés.

Votre prochaine décision

De l’annonce à un test API justifié

Ne vous inscrivez pas sur la seule foi d’une annonce. Validez d’abord ces points, puis créez une clé API si la route correspond à votre charge.

  1. 01

    Publié ?

    Oui. Qwen3.8 Max est le modèle de production ; Preview reste un contexte de canal historique.

  2. 02

    Disponible ?

    Oui sur EvoLink. Vérifiez la route active et l’ID du modèle sur la page produit.

  3. 03

    Adapté à mon cas ?

    Pour le raisonnement long contexte, les grands dépôts et les agents à outils ; gardez les tâches simples sur une route plus légère.

  4. 04

    Quel prix ?

    Consultez le module de prix en direct de la page produit, sans reprendre un prix upstream ou Preview.

  5. 05

    Comment l’appeler ?

    Choisissez Chat Completions, Responses ou Messages, puis suivez le guide et la référence des paramètres.

Les cinq points sont validés ? Créer une clé API.

FAQ

Qwen3.8 est-il officiellement sorti ?

Oui. QwenCloud a ajouté qwen3.8-max au journal et au catalogue de production le 3 août 2026. EvoLink gère la route de production séparément de l’ancienne documentation Preview.

Quel est l'ID de la Preview ?

QwenCloud et EvoLink utilisent qwen3.8-max pour la route de production ; qwen3.8-max-preview est l’ancien ID Token Plan et documentation.

Qwen3.8 est-il identique à Qwen3-8B ?

Non. Qwen3.8 est la version 2026 de la famille ; Qwen3-8B est un ancien modèle de huit milliards de paramètres.

Quelle différence entre Token Plan et l’accès API ?

Token Plan est un abonnement à Credits pour outils interactifs. Une API standard vise les applications automatisées et facture les tokens.

Oui. La route de production EvoLink utilise qwen3.8-max. Vérifiez la page produit et le prix en direct, puis exécutez un smoke test dans votre compte avant le trafic de production.

Qwen3.8 prend-il les images en charge ?

Qwen décrit la production comme un modèle vision-language natif. Formats, tailles, limites média et comportement EvoLink doivent être vérifiés par route.

Qwen3.8 est-il Open Source ou Open Weight ?

Qwen a annoncé des Open Weights, mais dépôt, checkpoints, licence et guide de déploiement n’étaient pas vérifiés le 3 août.

Combien coûte Qwen3.8 ?

Séparez prix upstream QwenCloud et prix de route EvoLink. Budgétez avec le prix live du canal utilisé et le coût par tâche acceptée, pas avec les Credits Token Plan.

Qwen3.8 est-il meilleur que Qwen3.7 Max ?

Qwen le positionne comme un progrès ; les équipes doivent attendre des preuves complètes et tester leurs charges. Qwen3.7 reste la base de production mieux documentée.

Faut-il attendre Qwen3.8 avant de livrer ?

Non. Construisez sur un modèle pris en charge, conservez un fallback et préparez des tests reproductibles. Migrez seulement après validation de la route, du prix, des limites et des résultats.

Sources

Étape suivante : implémenter la route

Transformez le plan fonctionnel en requêtes exécutables avec le guide d'intégration Qwen3.8 Max pour Chat, Responses et Messages.

Prêt à réduire vos coûts IA de 89 % ?

Commencez avec EvoLink dès aujourd'hui et découvrez la puissance du routage intelligent des API.