GPT Image 2.5 Flare & Sunburst sont disponibles sur EvoLinkEssayer GPT Image 2.5
Suivi de la sortie de GLM-5.3 séparant les canaux livrés de l'API et des poids ouverts encore en attente
model-release

Sortie de GLM-5.3 : ce qui est livré et ce qui change pour les développeurs

Jessie
Jessie
COO
3 août 2026
Mis à jour le 27 août 2026
16 min de lecture
GLM-5.3 est officiellement sorti. Z.ai l'a annoncé le 14 août 2026 dans le billet « GLM-5.3: Frontier Coding with Emergent Cyber Capabilities ». Pour être précis sur les noms : cette sortie est GLM-5.3. Les étiquettes « GLM 5.5 » et « GLM-6 » qui ont circulé pendant la période de rumeurs désignent d'éventuels modèles ultérieurs — GLM 5.5 reste non annoncé et fait l'objet d'un suivi séparé.
Mise à jour du 26 août : la sortie a dépassé son état de lancement réservé aux abonnements. La page tarifaire officielle de Z.ai liste désormais GLM-5.3 à 1,40 $ en entrée, 0,26 $ en entrée mise en cache et 4,40 $ en sortie par million de tokens. La route EvoLink utilise l'identifiant de modèle glm-5.3 derrière la même clé d'API unifiée et expose à la fois les endpoints Chat Completions et Anthropic Messages. L'état échelonné décrit plus bas reste utile comme historique de la sortie ; ce n'est plus la réponse actuelle côté API. Pour les tarifs de route et le code à jour, voir la page API GLM-5.3.
Mise à jour famille du 27 août : GLM-5.3 Flash est lui aussi actif, sous glm-5.3-flash, avec entrée image, vidéo et fichier, à un tarif de route nettement inférieur. Le comparatif GLM-5.3 Flash vs GLM-5.3 aide à décider si une charge de travail doit démarrer sur le palier volume ou aller directement au modèle phare texte seul.
Au jour J, la situation était différente, et cette étape reste instructive comme historique : GLM-5.3 n'était actif que dans l'abonnement GLM Coding Plan et l'agent de codage ZCode de Z.ai, le prix par token n'était pas publié, la page tarifaire de Z.ai s'arrêtait à GLM-5.2, et la page API de BigModel (Chine) indiquait que l'API GLM-5.3 « arrive bientôt ». Les poids ouverts restent promis environ deux semaines après le lancement, une fois l'évaluation de sécurité de Z.ai terminée. C'est pourquoi cette page suit chaque canal d'accès séparément — avec, désormais, l'état actuel en tête.

Ce que Z.ai a réellement annoncé

GLM-5.3 utilise la même base que GLM-5.2 — Z.ai l'écrit noir sur blanc : « chaque gain vient du post-entraînement ». Cela en fait une sortie inhabituelle : pas de nouveau pré-entraînement, pas de nombre de paramètres révélé, et des sauts de benchmark très importants attribués entièrement à la montée en échelle du post-entraînement.
ÉlémentValeur confirmée (14 août 2026)
Nom officiel / ID de modèle APIGLM-5.3 / glm-5.3 (d'après l'exemple d'API de Z.ai lui-même)
Modèle de baseIdentique à GLM-5.2 ; tous les gains issus du post-entraînement
Fenêtre de contexte / sortie max1M tokens / 128K tokens
ModalitésTexte en entrée, texte en sortie — pas de vision ; cette demande communautaire d'avant-sortie, largement relayée par TechTimes et explainx, n'a pas été livrée
ThinkingToujours actif : thinking.type: "disabled" n'est plus pris en charge
Contrôle du raisonnementNouveau paramètre reasoning_effort : low / high / max (max recommandé pour le code)
OutillageFunction calling, MCP, streaming, cache de contexte, sorties structurées (selon la doc officielle)
Nombre de paramètresNon publié (déduire de la base commune ≠ un chiffre officiel)
Positionnement« Built to Code. Ready for Cyber Defense. »

Comment l'accès a évolué depuis le jour de la sortie

GLM-5.3 est un exemple instructif de lancement où l'annonce, le produit par abonnement, l'API et les poids ne sont pas arrivés le même jour. Le tableau ci-dessous conserve l'état canal par canal du jour J à titre d'historique — l'état actuel est différent :
CanalStatut au 14 août 2026Preuve
GLM Coding Plan (abonnement)✅ Actif pour tous les paliers ; les requêtes GLM-5.2/5.1 sont désormais auto-routées vers GLM-5.3Doc devpack Z.ai
ZCode (agent de codage de Z.ai)✅ Actif, avec une promotion de quota ×1,5 jusqu'au 31 aoûtAnnonce Z.ai
API internationale Z.ai⚠️ Ambigu — le billet montre un exemple de requête "model": "glm-5.3", mais la page tarifaire officielle n'a aucune entrée GLM-5.3 et l'URL de la doc modèle renvoie 404Vérifié le 14 août 2026
API BigModel (Chine)❌ « GLM-5.3 模型 API 即将上线 » — arrive bientôt, selon les propres mots de Z.aiDoc BigModel
Poids ouverts (Hugging Face)❌ Promis ~deux semaines après le lancement, après évaluation et durcissement de sécurité ; licence non préciséeAnnonce Z.ai
Agrégateurs d'API❌ Zéro plateforme majeure sur neuf ne pouvait servir GLM-5.3 le jour de la sortie ; Together AI n'affiche qu'un espace réservé « coming soon »API des plateformes, vérifiées le 14 août 2026
Étapes de vérification de la sortie de GLM-5.3, de l'annonce à une route testée en production
Étapes de vérification de la sortie de GLM-5.3, de l'annonce à une route testée en production
La conséquence pratique est aujourd'hui l'inverse de l'avertissement du jour J : le prix est désormais une donnée confirmée de la décision d'adoption. Les tarifs officiels sont identiques à ceux de GLM-5.2 (1,40 $ en entrée / 0,26 $ en cache / 4,40 $ en sortie par million de tokens) — mais des tarifs par token identiques ne garantissent pas un coût par tâche identique, car GLM-5.3 raisonne toujours et facture ce raisonnement dans les tokens de sortie.

Les benchmarks annoncés — et leurs réserves

Tous les chiffres ci-dessous sont les résultats rapportés par Z.ai lui-même (selon Z.ai, non vérifiés par des tiers). Aucune réplication indépendante n'existait le jour de la sortie.
BenchmarkGLM-5.3GLM-5.2Note
Terminal Bench 3.028,34,6Revendiqué n°1 des modèles ouverts ; Claude Fable 5 = 33,7
DeepSWE v1.166,946,2
FrontierSWE78,167,5
SWE-Marathon v1.142,519,4
CyberGym84,577,2La doc chinoise de Z.ai indique 83,5 % dans le corps du texte — deux chiffres officiels circulent
ExploitBench54,424,4Z.ai reconnaît lui-même que les modèles fermés restent devant (Mythos 5 = 78)
Agents' Last Exam (CLI)28,523,8Revendiqué n°1 des modèles ouverts

Z.ai annonce aussi une « amélioration de 50 % par rapport à GLM-5.2 » sur son Code Bench interne — un benchmark privé — et reconnaît ouvertement que GLM-5.3 « reste derrière Claude Fable 5 » à effort maximal. La réaction de la communauté le premier jour, sur Hacker News, a capté les deux pôles : « seulement d'un cheveu » derrière les modèles fermés de pointe, et « la magie du post-entraînement n'est-elle pas juste du surapprentissage des benchmarks ? ». Deux citations à garder en tête tant que des évaluations tierces n'ont pas atterri.

Les résultats en cybersécurité s'accompagnent d'un artefact inhabituel : Z.ai a lancé simultanément un registre public de divulgation de sécurité (Security Disclosure Ledger) pour les vulnérabilités que le modèle découvre — l'une des raisons pour lesquelles l'API et les poids sont cette fois retenus derrière une revue de sécurité, une vraie rupture avec l'open-sourcing du jour J de GLM-5.2.

GLM-5.3, GLM 5.5, GLM-6 : de quoi s'agit-il ?

Pendant deux mois, trois noms ont circulé autour de la feuille de route de Z.ai. Où en est chacun après la sortie d'aujourd'hui :

  • GLM-5.3 — l'étiquette utilisée dans les discussions de développeurs depuis juillet. C'est ce qui est sorti aujourd'hui.
  • GLM 5.5 — une étiquette distincte d'analystes et de médias (prévision JPMorgan via Reuters), souvent associée à un modèle phare supposé de plus de 1 000 milliards de paramètres. Toujours non annoncé — s'il arrive, ce serait une sortie ultérieure, possiblement celle qui suivra GLM-5.3. Notre veille de sortie GLM 5.5 continue de le suivre comme une entité à part entière.
  • GLM-6 — une piste de spéculation sans aucun statut officiel.

Un détail de rumeur à solder : l'URL GitHub d'une « branche glm-5.3 » largement partagée n'a jamais constitué une preuve de sortie (la page n'affichait aucun historique de commits lors de la vérification, et le dépôt a ensuite disparu de l'accès public). La sortie a tout de même eu lieu — via une annonce officielle, exactement l'artefact que ce suivi recommandait d'attendre.

Ce qui change pour les développeurs : le contrat d'API

Deux changements au niveau de l'API sont confirmés dans l'annonce et comptent avant toute migration :

  1. Le thinking ne peut plus être désactivé. GLM-5.2 acceptait thinking.type: "disabled" ; GLM-5.3 non. Les pipelines qui s'appuyaient sur des appels sans raisonnement pour maîtriser la latence ou le coût ont un changement cassant à gérer.
  2. reasoning_effort est la nouvelle surface de contrôlelow / high / max, avec max recommandé pour les tâches de code.

L'exemple de requête officiel de Z.ai :

{
  "model": "glm-5.3",
  "thinking": { "type": "enabled" },
  "reasoning_effort": "max"
}
Au sein du Coding Plan, la migration a déjà eu lieu de fait, sans action de l'utilisateur : les requêtes GLM-5.2 et GLM-5.1 sont auto-routées vers GLM-5.3. Pour une décision de bascule complète — ce qui s'est amélioré, ce qu'implique l'auto-routage et quand rester sur GLM-5.2 est le bon choix — voir le comparatif dédié : GLM-5.3 vs GLM-5.2 : ce qui a vraiment changé et faut-il migrer ?

Utiliser GLM-5.3 dès aujourd'hui

Il existe désormais deux voies d'achat distinctes : un abonnement de codage à points et une API facturée au token. Ne comparez pas leurs unités affichées directement.

Votre situationOption réaliste aujourd'huiÀ surveiller
Vous utilisez Claude Code / OpenCode / un agent de codageAbonnement GLM Coding Plan (à partir de 18 $/mois, quota à points ; GLM-5.3 est facturé aux multiplicateurs de points les plus élevés de la famille)Les heures creuses sont facturées à 50 % des points
Vous facturez au token via l'APIAppelez glm-5.3 via la page modèle EvoLink ; démarrez avec reasoning_effort: "low" pour le travail de routineLe coût par tâche acceptée, les hits de cache, la croissance des tokens de sortie
Vous auto-hébergezAttendre les poids (~28 août) et les conditions de licenceL'organisation zai-org sur Hugging Face ; la licence n'est pas garantie identique à celle de GLM-5.2
Vous avez besoin de visionGLM-5.3 ne l'a pas ; utilisez une route multimodaleUne éventuelle convergence de la ligne GLM-V avec la ligne GLM principale

EvoLink expose désormais GLM-5.3 derrière une seule passerelle, aux côtés des autres modèles utilisables en production. Gardez l'identifiant de modèle en configuration, validez le comportement du streaming et des outils sur vos propres payloads, et conservez un repli testé : la disponibilité d'une route ne remplace pas les tests de recette sur votre charge de travail.

Ce que l'on ne sait toujours pas

Même si le prix est désormais public, plusieurs faits pertinents pour la production restent ouverts et doivent être vérifiés sur votre propre charge de travail :

  • Limites de débit et concurrence. Aucun chiffre RPM/TPM publié.
  • Licence des poids ouverts. GLM-5.2 était de type MIT ; Kimi et Qwen sont récemment passés à des licences restreintes, et la communauté regarde si Z.ai suit. Deux semaines de revue de sécurité signifient aussi que les conditions pourraient différer.
  • Nombre de paramètres. « Même base que GLM-5.2 » invite à une déduction ; Z.ai n'a publié aucun chiffre.
  • Benchmarks indépendants. Tous les chiffres du jour de la sortie sont rapportés par le fournisseur.

Les signaux qui déclencheront la prochaine mise à jour

  1. L'apparition des poids GLM-5.3 sous huggingface.co/zai-org, avec des conditions de licence explicites.
  2. La publication de limites de débit ou de concurrence permettant de dimensionner la production.
  3. Des évaluations indépendantes à harnais comparable, qui reproduisent ou contredisent le tableau de benchmarks du fournisseur.
  4. Un changement significatif de prix ou de contrat d'API chez Z.ai ou EvoLink.

FAQ

GLM-5.3 est-il sorti ?

Oui. Z.ai a officiellement annoncé GLM-5.3 le 14 août 2026. L'accès du jour J passait d'abord par les abonnements ; le prix de l'API par token est désormais publié.

Comment utiliser réellement GLM-5.3 aujourd'hui ?

Avec l'identifiant de modèle glm-5.3 via la route API EvoLink, ou via les produits par abonnement de Z.ai (GLM Coding Plan et ZCode). Le premier facture au token, les seconds suivent l'économie du forfait.

Combien coûte l'API GLM-5.3 ?

Les tarifs officiels de Z.ai sont de 1,40 $ en entrée, 0,26 $ en entrée mise en cache et 4,40 $ en sortie par million de tokens. Le tarif de route EvoLink en vigueur et son calculateur se trouvent sur la page API GLM-5.3.

Quel est l'identifiant de modèle de GLM-5.3 ?

L'exemple d'API de Z.ai utilise glm-5.3. Vérifiez-le dans la documentation API officielle avant de le placer en configuration de production.

Que signifie « même base, tous les gains issus du post-entraînement » ?

Z.ai n'a pas pré-entraîné de nouveau modèle. GLM-5.3 est le réseau de base de GLM-5.2 avec un post-entraînement massivement étendu (fine-tuning, RL et étapes associées). C'est pourquoi il n'y a pas de nouveau nombre de paramètres — et pourquoi certains développeurs se demandent si les gains de benchmark généraliseront.

GLM-5.3 a-t-il la même taille que GLM-5.2 ?

Vraisemblablement, puisque la base est la même — mais Z.ai n'a publié aucun nombre de paramètres pour GLM-5.3, donc aucun chiffre ne doit être traité comme officiel.

GLM-5.3 prend-il en charge la vision ?

Non. Il est texte uniquement. La vision était avant le lancement une demande largement relayée (TechTimes et explainx ont tous deux couvert le fil du sondage développeurs), et elle n'a pas été livrée ; les travaux multimodaux de Z.ai restent dans la ligne distincte GLM-V.

Quand les poids ouverts sortiront-ils, et sous quelle licence ?

Z.ai promet les poids environ deux semaines après le lancement (autour du 28 août 2026), après évaluation et durcissement de sécurité. La licence n'a pas été précisée — ne supposez pas que les conditions de GLM-5.2 se transmettent.

Est-ce la même chose que GLM 5.5 ?

Non — ce sont deux entités distinctes. GLM 5.5 reste non annoncé : pendant la période de rumeurs, les analystes utilisaient cette étiquette pour un éventuel modèle phare plus grand, qui peut encore arriver comme une sortie ultérieure. La sortie d'aujourd'hui est GLM-5.3, et la veille GLM 5.5, distincte, continue.

Peut-on se fier aux chiffres de benchmark ?

Ce sont les résultats rapportés par Z.ai lui-même, y compris des comparaisons où GLM-5.3 reste derrière des modèles fermés — un point de franchise en sa faveur. Mais aucune réplication indépendante n'existe encore, et un chiffre (CyberGym) apparaît à la fois comme 84,5 et 83,5 dans deux documents officiels différents. Traitez-les comme des affirmations du fournisseur en attente de tests tiers.

Qu'est-ce qui casse si je migre une intégration GLM-5.2 vers GLM-5.3 ?

Le changement cassant confirmé : le thinking ne peut plus être désactivé. Les chemins d'appel sans raisonnement, sensibles à la latence ou au coût, doivent être repensés, et reasoning_effort devient votre bouton de contrôle. Liste de vérification complète dans le guide GLM-5.3 vs GLM-5.2.

Dois-je quitter GLM-5.2 maintenant ?

Si vous êtes sur le Coding Plan, c'est déjà fait — les requêtes sont auto-routées vers GLM-5.3. Pour le trafic facturé au token : ouvrez une voie challenger contrôlée sur glm-5.3, retirez thinking.type: "disabled", comparez le coût par tâche acceptée et gardez GLM-5.2 comme route de repli jusqu'à ce que vos critères soient tenus.

Sources et journal des mises à jour

26 août 2026 — révision d'activation de l'API. La page tarifaire de Z.ai liste désormais GLM-5.3 à 1,40 $ / 0,26 $ en cache / 4,40 $ par million de tokens. La route produit d'EvoLink utilise glm-5.3 et expose les tarifs en vigueur, les deux protocoles d'API pris en charge, les vérifications de migration et des exemples de code. Toutes les formulations au présent affirmant que l'API n'est pas disponible ont été retirées ; l'état du jour J ne subsiste qu'à titre d'historique daté.
14 août 2026 — révision du jour de la sortie. GLM-5.3 a été officiellement annoncé ce jour-là ; cette page est passée du suivi de rumeur au suivi de sortie. Confirmés : le nom, l'ID de modèle glm-5.3 (selon l'exemple officiel), les limites 1M/128K, la modalité texte uniquement, le thinking toujours actif avec reasoning_effort, le tableau de benchmarks du fournisseur, la disponibilité dans le Coding Plan avec auto-routage depuis GLM-5.2/5.1, et le calendrier de ~2 semaines pour les poids ouverts. Encore ouverts à cette date : le prix par token, les dates d'ouverture de l'API, les limites de débit, la licence, le nombre de paramètres, les évaluations indépendantes.
3 août 2026 — première publication. Documenté les preuves de la période de rumeurs : l'URL GitHub de commits qui n'affichait aucun historique (capture archivée ; le dépôt a ensuite disparu de l'accès public — correctement traité comme un signal, pas comme une preuve de sortie), le conflit de noms GLM-5.3 / GLM 5.5 / GLM-6 alors non résolu, et la recommandation de livrer sur une route GLM-5.2 vérifiée en traitant le successeur comme un candidat d'évaluation. Cette recommandation a tenu le jour de la sortie : à ce moment-là, l'API par token était la partie qui n'avait pas encore été livrée.
Preuves revues pour la dernière fois le 26 août 2026. Cette page est mise à jour quand le prix, le comportement de l'API, les poids, la licence ou les évaluations indépendantes changent.

Prêt à réduire vos coûts IA de 89 % ?

Commencez avec EvoLink dès aujourd'hui et découvrez la puissance du routage intelligent des API.