ID de modelo y formato de API
El anuncio oficial de Z.ai usa el ID de modelo glm-5.3 en las peticiones, con thinking siempre activo y un nuevo parámetro reasoning_effort (low/high/max).
GLM-5.3 se lanzó el 14 de agosto de 2026, pero su API por token llega por fases y sin precio publicado: la verdadera pregunta es cuándo podrás llamarla de verdad. Únete a la alerta para recibir aviso cuando EvoLink verifique una ruta operativa.
Te enviaremos un correo cuando EvoLink verifique una ruta invocable de GLM-5.3, el ID de modelo de las peticiones, los precios en vivo y el comportamiento de API soportado.
Solo te escribiremos sobre la disponibilidad de GLM-5.3. Sin spam.
¿Quieres avisos más rápidos? Únete al Discord de EvoLink
Cuando se abra el acceso te enviaremos un aviso de lanzamiento, y esta página se actualizará con el ID de modelo verificado, los precios en vivo, la compatibilidad de la API, las regiones y los límites, además del camino para integrar a través de la API unificada de EvoLink manteniendo un modelo de fallback.
El lanzamiento del 14 de agosto zanjó algunos campos de integración y dejó otros abiertos. EvoLink actualiza cada uno solo tras la publicación oficial y la verificación a nivel de ruta.
El anuncio oficial de Z.ai usa el ID de modelo glm-5.3 en las peticiones, con thinking siempre activo y un nuevo parámetro reasoning_effort (low/high/max).
El precio por token no está publicado: la propia página de precios de Z.ai sigue terminando en GLM-5.2. El módulo de precios en vivo de EvoLink será la fuente de verdad tras el lanzamiento.
La documentación oficial indica una ventana de contexto de 1M de tokens y hasta 128K tokens de salida para GLM-5.3.
Las regiones, la concurrencia, las cuotas, los límites de tasa y el comportamiento de los 429 requieren una ruta de producción invocable; nada de ello está publicado todavía.
El día del lanzamiento ningún agregador podía servir GLM-5.3, y la página de la API de BigModel dice «próximamente». Los pesos abiertos se prometen unas dos semanas después del lanzamiento.
Solo cargas de trabajo reales sobre una ruta de API real pueden responder a la pregunta de producción. Estas seis métricas que demandan los usuarios son las que EvoLink verificará cuando se abra el acceso; los benchmarks del proveedor no son un sustituto.
Mide si las correcciones de bugs, las refactorizaciones multiarchivo y las tareas de test realmente pasan, en lugar de juzgar una sola respuesta.
Registra errores de argumentos, llamadas repetidas, bucles improductivos y la frecuencia con la que una persona debe intervenir.
Comprueba si el modelo mantiene las restricciones, encuentra evidencias y completa el trabajo en lo profundo de repositorios y documentos grandes.
GLM-5.3 elimina la opción de desactivar el thinking. Mide la latencia y el sobrecoste de tokens de salida en cada nivel de reasoning_effort frente a tus antiguas rutas sin razonamiento.
Evalúa el tiempo hasta el primer token, la velocidad de extremo a extremo, la capacidad, la tasa de errores y las respuestas 429 en horas punta.
Incluye el uso de tokens, los reintentos, las ejecuciones fallidas y la corrección humana en lugar de comparar solo los precios de lista.
GLM-5.3 todavía no es invocable por token y su precio no está publicado, así que los equipos no deberían retrasar un proyecto que hoy puede salir con GLM-5.2.
Si la entrega importa ahora, establece una línea base real sobre la ruta de GLM-5.2, documentada e invocable.
Cambia solo cuando tus cargas de trabajo muestren una mejora verificada sobre una ruta real — y ten presente el breaking change: el thinking ya no se puede desactivar.
Mantén el modelo actual tras la API unificada de EvoLink y añade GLM-5.3 tras la validación sin reconstruir otra integración de proveedor.
El lanzamiento llega por fases: qué ha salido, qué está pendiente y si conviene cambiar.
Qué salió el 14 de agosto, qué llega por fases y el calendario de pesos abiertos — actualizado cuando cambia el estado.
Qué cambió de verdad, el breaking change del thinking siempre activo y cuándo quedarse en GLM-5.2.
Un modelo aparte, aún sin anunciar — posiblemente el lanzamiento posterior a GLM-5.3 — seguido en su propia página.
Por token, no. El día del lanzamiento, GLM-5.3 solo estaba disponible mediante la suscripción GLM Coding Plan y ZCode; la página de precios de Z.ai no tiene entrada de glm-5.3 y la página de la API de BigModel dice «próximamente».
El anuncio oficial de Z.ai usa glm-5.3 en su ejemplo de API. Verifícalo contra la documentación oficial de la API antes de usarlo en producción.
Sin publicar. La página de precios de Z.ai sigue mostrando solo GLM-5.2 (1,40 $/0,26 $/4,40 $ por millón de tokens — las tarifas propias de GLM-5.2). Esta página usará el módulo de precios en vivo de EvoLink solo cuando la ruta y los SKUs estén aprobados.
Aún sin verificar. EvoLink publica una ruta invocable, un ID de modelo y precios solo después de que pasen las comprobaciones reales de peticiones, facturación y comportamiento. Únete a la alerta para recibir el aviso.
El mismo modelo base — todas las mejoras vienen del post-entrenamiento. El breaking change confirmado: el thinking ya no se puede desactivar, y reasoning_effort (low/high/max) pasa a ser la superficie de control.
No. GLM-5.3 es de solo texto; el trabajo multimodal de Z.ai sigue en la línea aparte GLM-V.
Z.ai promete los pesos unas dos semanas después del lanzamiento (en torno al 28 de agosto de 2026), tras una evaluación de seguridad. La licencia no se ha indicado.
No — son modelos separados. GLM 5.5 sigue sin anunciarse; si llega, se espera como un lanzamiento posterior, y se sigue en su propia página de disponibilidad.
GLM-5.2 — en vivo, con precio, contexto de 1M e invocable hoy a través de EvoLink. Mantén el ID de modelo configurable para que cambiar a una ruta verificada de GLM-5.3 sea solo un cambio de configuración.
Un aviso cuando EvoLink verifique la ruta de GLM-5.3: estado oficial del lanzamiento, ID del modelo, precios, comportamiento de la ruta y estado de acceso.