Identifiant de modèle et format d'API
L'annonce officielle de Z.ai utilise l'identifiant de requête glm-5.3, avec un thinking toujours actif et un nouveau paramètre reasoning_effort (low/high/max).
GLM-5.3 est sorti le 14 août 2026 — mais son API au token est déployée par étapes, sans tarif publié. La vraie question est donc : quand pourrez-vous réellement l'appeler ? Inscrivez-vous à l'alerte pour être prévenu dès qu'EvoLink vérifie une route opérationnelle.
Nous vous écrirons quand EvoLink aura vérifié une route GLM-5.3 appelable, l'identifiant de modèle des requêtes, les prix en direct et le comportement API pris en charge.
Nous ne vous écrirons qu'au sujet de la disponibilité de GLM-5.3. Pas de spam.
Envie de mises à jour plus rapides ? Rejoindre le Discord EvoLink
Dès l'ouverture de l'accès, nous vous enverrons une alerte de lancement, et cette page sera mise à jour avec l'identifiant de modèle vérifié, les prix en direct, la compatibilité API, les régions et limites — ainsi que le chemin d'intégration via l'API unifiée d'EvoLink tout en conservant un modèle de repli.
La sortie du 14 août a fixé certains champs d'intégration et en a laissé d'autres ouverts. EvoLink ne met chacun à jour qu'après publication officielle et vérification au niveau de la route.
L'annonce officielle de Z.ai utilise l'identifiant de requête glm-5.3, avec un thinking toujours actif et un nouveau paramètre reasoning_effort (low/high/max).
Le prix par token n'est pas publié — la page tarifaire de Z.ai s'arrête toujours à GLM-5.2. Le module de prix EvoLink en direct fera référence après le lancement.
La documentation officielle indique pour GLM-5.3 une fenêtre de contexte de 1M tokens et jusqu'à 128K tokens en sortie.
Régions, concurrence, quotas, limites de débit et comportement 429 exigent une route de production appelable ; rien n'est encore publié.
Le jour de la sortie, aucun agrégateur ne pouvait servir GLM-5.3, et la page API BigModel indique « coming soon ». Les poids ouverts sont promis environ deux semaines après le lancement.
Seules de vraies charges de travail sur une vraie route API peuvent répondre à la question de la production. Voici les six métriques attendues par les utilisateurs qu'EvoLink vérifiera après l'ouverture de l'accès ; les benchmarks du fournisseur n'en tiennent pas lieu.
Mesurer si les corrections de bugs, refactorisations multi-fichiers et tâches de test passent réellement, au lieu de juger une seule réponse.
Suivre les erreurs d'arguments, les appels répétés, les boucles improductives et la fréquence des reprises humaines.
Tester si le modèle conserve les contraintes, trouve les preuves et termine le travail en profondeur dans les grands dépôts et documents.
GLM-5.3 supprime la possibilité de désactiver le thinking. Mesurez la latence et le surcoût en tokens de sortie à chaque niveau de reasoning_effort, face à vos anciens chemins sans raisonnement.
Évaluer le temps jusqu'au premier token, la vitesse de bout en bout, la capacité, le taux d'erreurs et les réponses 429 en heures de pointe.
Inclure l'usage de tokens, les reprises, les exécutions échouées et la correction humaine au lieu de comparer les seuls prix affichés.
GLM-5.3 n'est pas encore appelable au token, et son prix n'est pas publié — les équipes ne devraient donc pas retarder un projet qui peut être livré aujourd'hui avec GLM-5.2.
Si la livraison compte maintenant, établissez une vraie référence sur la route GLM-5.2, documentée et appelable.
Ne basculez que lorsque vos charges de travail montrent une amélioration vérifiée sur une vraie route — et notez le changement cassant : le thinking ne peut plus être désactivé.
Gardez le modèle actuel derrière l'API unifiée d'EvoLink, puis ajoutez GLM-5.3 après validation, sans reconstruire une intégration fournisseur.
La sortie est échelonnée : ce qui est livré, ce qui est en attente et faut-il basculer.
Ce qui est sorti le 14 août, ce qui reste en attente et le calendrier des poids ouverts — mis à jour à chaque changement de statut.
Ce qui a vraiment changé, le changement cassant du thinking toujours actif et quand rester sur GLM-5.2.
Un modèle distinct, toujours non annoncé — possiblement la sortie qui suivra GLM-5.3 — suivi sur sa propre page.
Pas au token. Le jour de la sortie, GLM-5.3 n'était disponible que via l'abonnement GLM Coding Plan et ZCode ; la page tarifaire de Z.ai n'a aucune entrée glm-5.3 et la page API BigModel indique « coming soon ».
L'annonce officielle de Z.ai utilise glm-5.3 dans son exemple d'API. Vérifiez-le dans la documentation API officielle avant tout usage en production.
Non publié. La page tarifaire de Z.ai ne liste toujours que GLM-5.2 (1,40 $/0,26 $/4,40 $ par million de tokens — les tarifs propres à GLM-5.2). Cette page n'utilisera le module de prix EvoLink en direct qu'après approbation de la route et des SKU.
Pas encore vérifié. EvoLink ne publie une route appelable, un identifiant de modèle et un prix qu'après des vérifications réelles de requêtes, de facturation et de comportement. Rejoignez l'alerte pour être averti.
Même modèle de base — tous les gains viennent du post-entraînement. Le changement cassant confirmé : le thinking ne peut plus être désactivé, et reasoning_effort (low/high/max) devient la surface de contrôle.
Non. GLM-5.3 est texte uniquement ; les travaux multimodaux de Z.ai restent dans la ligne distincte GLM-V.
Z.ai promet les poids environ deux semaines après le lancement (autour du 28 août 2026), après une évaluation de sécurité. La licence n'a pas été précisée.
Non — ce sont deux modèles distincts. GLM 5.5 reste non annoncé ; s'il sort, il est attendu comme une version ultérieure, et il est suivi sur sa propre page de disponibilité.
GLM-5.2 — en ligne, tarifé, contexte 1M, appelable via EvoLink dès aujourd'hui. Gardez l'identifiant de modèle configurable pour que le passage à une route GLM-5.3 vérifiée ne soit qu'un changement de configuration.
Une notification après vérification de la route GLM-5.3 par EvoLink : statut de sortie officiel, identifiant de modèle, prix, comportement de la route et état d'accès.