
Sortie de GLM-5.3 : ce qui est livré et ce qui change pour les développeurs
glm-5.3 derrière la même clé d'API unifiée et expose à la fois les endpoints Chat Completions et Anthropic Messages. L'état échelonné décrit plus bas reste utile comme historique de la sortie ; ce n'est plus la réponse actuelle côté API. Pour les tarifs de route et le code à jour, voir la page API GLM-5.3.glm-5.3-flash, avec entrée image, vidéo et fichier, à un tarif de route nettement inférieur. Le comparatif GLM-5.3 Flash vs GLM-5.3 aide à décider si une charge de travail doit démarrer sur le palier volume ou aller directement au modèle phare texte seul.Ce que Z.ai a réellement annoncé
| Élément | Valeur confirmée (14 août 2026) |
|---|---|
| Nom officiel / ID de modèle API | GLM-5.3 / glm-5.3 (d'après l'exemple d'API de Z.ai lui-même) |
| Modèle de base | Identique à GLM-5.2 ; tous les gains issus du post-entraînement |
| Fenêtre de contexte / sortie max | 1M tokens / 128K tokens |
| Modalités | Texte en entrée, texte en sortie — pas de vision ; cette demande communautaire d'avant-sortie, largement relayée par TechTimes et explainx, n'a pas été livrée |
| Thinking | Toujours actif : thinking.type: "disabled" n'est plus pris en charge |
| Contrôle du raisonnement | Nouveau paramètre reasoning_effort : low / high / max (max recommandé pour le code) |
| Outillage | Function calling, MCP, streaming, cache de contexte, sorties structurées (selon la doc officielle) |
| Nombre de paramètres | Non publié (déduire de la base commune ≠ un chiffre officiel) |
| Positionnement | « Built to Code. Ready for Cyber Defense. » |
Comment l'accès a évolué depuis le jour de la sortie
| Canal | Statut au 14 août 2026 | Preuve |
|---|---|---|
| GLM Coding Plan (abonnement) | ✅ Actif pour tous les paliers ; les requêtes GLM-5.2/5.1 sont désormais auto-routées vers GLM-5.3 | Doc devpack Z.ai |
| ZCode (agent de codage de Z.ai) | ✅ Actif, avec une promotion de quota ×1,5 jusqu'au 31 août | Annonce Z.ai |
| API internationale Z.ai | ⚠️ Ambigu — le billet montre un exemple de requête "model": "glm-5.3", mais la page tarifaire officielle n'a aucune entrée GLM-5.3 et l'URL de la doc modèle renvoie 404 | Vérifié le 14 août 2026 |
| API BigModel (Chine) | ❌ « GLM-5.3 模型 API 即将上线 » — arrive bientôt, selon les propres mots de Z.ai | Doc BigModel |
| Poids ouverts (Hugging Face) | ❌ Promis ~deux semaines après le lancement, après évaluation et durcissement de sécurité ; licence non précisée | Annonce Z.ai |
| Agrégateurs d'API | ❌ Zéro plateforme majeure sur neuf ne pouvait servir GLM-5.3 le jour de la sortie ; Together AI n'affiche qu'un espace réservé « coming soon » | API des plateformes, vérifiées le 14 août 2026 |

Les benchmarks annoncés — et leurs réserves
| Benchmark | GLM-5.3 | GLM-5.2 | Note |
|---|---|---|---|
| Terminal Bench 3.0 | 28,3 | 4,6 | Revendiqué n°1 des modèles ouverts ; Claude Fable 5 = 33,7 |
| DeepSWE v1.1 | 66,9 | 46,2 | |
| FrontierSWE | 78,1 | 67,5 | |
| SWE-Marathon v1.1 | 42,5 | 19,4 | |
| CyberGym | 84,5 | 77,2 | La doc chinoise de Z.ai indique 83,5 % dans le corps du texte — deux chiffres officiels circulent |
| ExploitBench | 54,4 | 24,4 | Z.ai reconnaît lui-même que les modèles fermés restent devant (Mythos 5 = 78) |
| Agents' Last Exam (CLI) | 28,5 | 23,8 | Revendiqué n°1 des modèles ouverts |
Z.ai annonce aussi une « amélioration de 50 % par rapport à GLM-5.2 » sur son Code Bench interne — un benchmark privé — et reconnaît ouvertement que GLM-5.3 « reste derrière Claude Fable 5 » à effort maximal. La réaction de la communauté le premier jour, sur Hacker News, a capté les deux pôles : « seulement d'un cheveu » derrière les modèles fermés de pointe, et « la magie du post-entraînement n'est-elle pas juste du surapprentissage des benchmarks ? ». Deux citations à garder en tête tant que des évaluations tierces n'ont pas atterri.
GLM-5.3, GLM 5.5, GLM-6 : de quoi s'agit-il ?
Pendant deux mois, trois noms ont circulé autour de la feuille de route de Z.ai. Où en est chacun après la sortie d'aujourd'hui :
- GLM-5.3 — l'étiquette utilisée dans les discussions de développeurs depuis juillet. C'est ce qui est sorti aujourd'hui.
- GLM 5.5 — une étiquette distincte d'analystes et de médias (prévision JPMorgan via Reuters), souvent associée à un modèle phare supposé de plus de 1 000 milliards de paramètres. Toujours non annoncé — s'il arrive, ce serait une sortie ultérieure, possiblement celle qui suivra GLM-5.3. Notre veille de sortie GLM 5.5 continue de le suivre comme une entité à part entière.
- GLM-6 — une piste de spéculation sans aucun statut officiel.
Un détail de rumeur à solder : l'URL GitHub d'une « branche glm-5.3 » largement partagée n'a jamais constitué une preuve de sortie (la page n'affichait aucun historique de commits lors de la vérification, et le dépôt a ensuite disparu de l'accès public). La sortie a tout de même eu lieu — via une annonce officielle, exactement l'artefact que ce suivi recommandait d'attendre.
Ce qui change pour les développeurs : le contrat d'API
Deux changements au niveau de l'API sont confirmés dans l'annonce et comptent avant toute migration :
- Le thinking ne peut plus être désactivé. GLM-5.2 acceptait
thinking.type: "disabled"; GLM-5.3 non. Les pipelines qui s'appuyaient sur des appels sans raisonnement pour maîtriser la latence ou le coût ont un changement cassant à gérer. reasoning_effortest la nouvelle surface de contrôle —low/high/max, avecmaxrecommandé pour les tâches de code.
L'exemple de requête officiel de Z.ai :
{
"model": "glm-5.3",
"thinking": { "type": "enabled" },
"reasoning_effort": "max"
}Utiliser GLM-5.3 dès aujourd'hui
Il existe désormais deux voies d'achat distinctes : un abonnement de codage à points et une API facturée au token. Ne comparez pas leurs unités affichées directement.
| Votre situation | Option réaliste aujourd'hui | À surveiller |
|---|---|---|
| Vous utilisez Claude Code / OpenCode / un agent de codage | Abonnement GLM Coding Plan (à partir de 18 $/mois, quota à points ; GLM-5.3 est facturé aux multiplicateurs de points les plus élevés de la famille) | Les heures creuses sont facturées à 50 % des points |
| Vous facturez au token via l'API | Appelez glm-5.3 via la page modèle EvoLink ; démarrez avec reasoning_effort: "low" pour le travail de routine | Le coût par tâche acceptée, les hits de cache, la croissance des tokens de sortie |
| Vous auto-hébergez | Attendre les poids (~28 août) et les conditions de licence | L'organisation zai-org sur Hugging Face ; la licence n'est pas garantie identique à celle de GLM-5.2 |
| Vous avez besoin de vision | GLM-5.3 ne l'a pas ; utilisez une route multimodale | Une éventuelle convergence de la ligne GLM-V avec la ligne GLM principale |
EvoLink expose désormais GLM-5.3 derrière une seule passerelle, aux côtés des autres modèles utilisables en production. Gardez l'identifiant de modèle en configuration, validez le comportement du streaming et des outils sur vos propres payloads, et conservez un repli testé : la disponibilité d'une route ne remplace pas les tests de recette sur votre charge de travail.
Ce que l'on ne sait toujours pas
Même si le prix est désormais public, plusieurs faits pertinents pour la production restent ouverts et doivent être vérifiés sur votre propre charge de travail :
- Limites de débit et concurrence. Aucun chiffre RPM/TPM publié.
- Licence des poids ouverts. GLM-5.2 était de type MIT ; Kimi et Qwen sont récemment passés à des licences restreintes, et la communauté regarde si Z.ai suit. Deux semaines de revue de sécurité signifient aussi que les conditions pourraient différer.
- Nombre de paramètres. « Même base que GLM-5.2 » invite à une déduction ; Z.ai n'a publié aucun chiffre.
- Benchmarks indépendants. Tous les chiffres du jour de la sortie sont rapportés par le fournisseur.
Les signaux qui déclencheront la prochaine mise à jour
- L'apparition des poids GLM-5.3 sous huggingface.co/zai-org, avec des conditions de licence explicites.
- La publication de limites de débit ou de concurrence permettant de dimensionner la production.
- Des évaluations indépendantes à harnais comparable, qui reproduisent ou contredisent le tableau de benchmarks du fournisseur.
- Un changement significatif de prix ou de contrat d'API chez Z.ai ou EvoLink.
FAQ
GLM-5.3 est-il sorti ?
Oui. Z.ai a officiellement annoncé GLM-5.3 le 14 août 2026. L'accès du jour J passait d'abord par les abonnements ; le prix de l'API par token est désormais publié.
Comment utiliser réellement GLM-5.3 aujourd'hui ?
glm-5.3 via la route API EvoLink, ou via les produits par abonnement de Z.ai (GLM Coding Plan et ZCode). Le premier facture au token, les seconds suivent l'économie du forfait.Combien coûte l'API GLM-5.3 ?
Quel est l'identifiant de modèle de GLM-5.3 ?
glm-5.3. Vérifiez-le dans la documentation API officielle avant de le placer en configuration de production.Que signifie « même base, tous les gains issus du post-entraînement » ?
Z.ai n'a pas pré-entraîné de nouveau modèle. GLM-5.3 est le réseau de base de GLM-5.2 avec un post-entraînement massivement étendu (fine-tuning, RL et étapes associées). C'est pourquoi il n'y a pas de nouveau nombre de paramètres — et pourquoi certains développeurs se demandent si les gains de benchmark généraliseront.
GLM-5.3 a-t-il la même taille que GLM-5.2 ?
Vraisemblablement, puisque la base est la même — mais Z.ai n'a publié aucun nombre de paramètres pour GLM-5.3, donc aucun chiffre ne doit être traité comme officiel.
GLM-5.3 prend-il en charge la vision ?
Quand les poids ouverts sortiront-ils, et sous quelle licence ?
Z.ai promet les poids environ deux semaines après le lancement (autour du 28 août 2026), après évaluation et durcissement de sécurité. La licence n'a pas été précisée — ne supposez pas que les conditions de GLM-5.2 se transmettent.
Est-ce la même chose que GLM 5.5 ?
Peut-on se fier aux chiffres de benchmark ?
Ce sont les résultats rapportés par Z.ai lui-même, y compris des comparaisons où GLM-5.3 reste derrière des modèles fermés — un point de franchise en sa faveur. Mais aucune réplication indépendante n'existe encore, et un chiffre (CyberGym) apparaît à la fois comme 84,5 et 83,5 dans deux documents officiels différents. Traitez-les comme des affirmations du fournisseur en attente de tests tiers.
Qu'est-ce qui casse si je migre une intégration GLM-5.2 vers GLM-5.3 ?
reasoning_effort devient votre bouton de contrôle. Liste de vérification complète dans le guide GLM-5.3 vs GLM-5.2.Dois-je quitter GLM-5.2 maintenant ?
glm-5.3, retirez thinking.type: "disabled", comparez le coût par tâche acceptée et gardez GLM-5.2 comme route de repli jusqu'à ce que vos critères soient tenus.Sources et journal des mises à jour
- Z.ai — annonce de GLM-5.3
- BigModel — documentation du modèle GLM-5.3
- Z.ai — tarifs officiels de GLM-5.3
- Z.ai — documentation GLM Coding Plan / devpack
- Hacker News — discussion du jour de la sortie
- Unite.AI — couverture de la sortie
- Hugging Face — zai-org (pas encore de poids GLM-5.3)
glm-5.3 et expose les tarifs en vigueur, les deux protocoles d'API pris en charge, les vérifications de migration et des exemples de code. Toutes les formulations au présent affirmant que l'API n'est pas disponible ont été retirées ; l'état du jour J ne subsiste qu'à titre d'historique daté.glm-5.3 (selon l'exemple officiel), les limites 1M/128K, la modalité texte uniquement, le thinking toujours actif avec reasoning_effort, le tableau de benchmarks du fournisseur, la disponibilité dans le Coding Plan avec auto-routage depuis GLM-5.2/5.1, et le calendrier de ~2 semaines pour les poids ouverts. Encore ouverts à cette date : le prix par token, les dates d'ouverture de l'API, les limites de débit, la licence, le nombre de paramètres, les évaluations indépendantes.

