GPT Image 2.5 Flare & Sunburst ya están disponibles en EvoLinkProbar GPT Image 2.5
Seguimiento del lanzamiento de GLM-5.3 que separa los canales ya disponibles de la API y los pesos abiertos aún por fases
model-release

Lanzamiento de GLM-5.3: qué ha salido y qué cambia para los desarrolladores

Jessie
Jessie
COO
3 de agosto de 2026
Actualizado el 27 de agosto de 2026
16 min de lectura
GLM-5.3 está oficialmente lanzado. Z.ai lo anunció el 14 de agosto de 2026 en la entrada de blog "GLM-5.3: Frontier Coding with Emergent Cyber Capabilities". Para ser precisos con los nombres: este lanzamiento es GLM-5.3. Las etiquetas «GLM 5.5» y «GLM-6» que circularon durante el periodo de rumores se refieren a posibles modelos posteriores — GLM 5.5 sigue sin anunciarse y se le hace seguimiento por separado.
Actualización del 26 de agosto: el lanzamiento ha dejado atrás su estado inicial de solo suscripción. La página oficial de precios de Z.ai ya lista GLM-5.3 a 1,40 $ de entrada, 0,26 $ de entrada en caché y 4,40 $ de salida por millón de tokens. La ruta de EvoLink usa el ID de modelo glm-5.3 detrás de la misma clave de API unificada y expone tanto el endpoint de Chat Completions como el de Anthropic Messages. El estado por fases que se describe más abajo sigue siendo útil como historial del lanzamiento; ya no es la respuesta actual sobre la API. Para precios de ruta y código al día, consulta la página de la API de GLM-5.3.
Actualización de familia del 27 de agosto: GLM-5.3 Flash también está activo, como glm-5.3-flash, añade entrada de imagen, vídeo y archivo, y su precio de ruta es mucho más bajo. La comparativa GLM-5.3 Flash vs GLM-5.3 ayuda a decidir si una carga de trabajo debe arrancar en el nivel de volumen o ir directa al buque insignia de solo texto.
El día del lanzamiento la situación era otra, y esa etapa sigue siendo útil como historial: GLM-5.3 solo estaba activo dentro de la suscripción GLM Coding Plan y del agente ZCode de Z.ai, el precio por token de la API no estaba publicado, la propia página de precios de Z.ai terminaba en GLM-5.2 y la página de la API de BigModel (China) decía que la API de GLM-5.3 llegaría «próximamente». Los pesos abiertos siguen prometidos unas dos semanas después del lanzamiento, cuando Z.ai complete una evaluación de seguridad. Por eso esta página sigue cada canal de acceso por separado; solo que ahora el estado actual va primero.

Qué ha anunciado Z.ai realmente

GLM-5.3 usa la misma base que GLM-5.2: Z.ai afirma sin rodeos que «cada mejora procede del post-entrenamiento». Eso lo convierte en un lanzamiento inusual: sin nueva ejecución de preentrenamiento, sin cifra de parámetros y con saltos de benchmark muy grandes atribuidos íntegramente a la escala del post-entrenamiento.
ElementoValor confirmado (14 de agosto de 2026)
Nombre oficial / ID de modelo en la APIGLM-5.3 / glm-5.3 (del ejemplo de API de la propia Z.ai)
Modelo baseEl mismo que GLM-5.2; todas las mejoras proceden del post-entrenamiento
Ventana de contexto / salida máxima1M tokens / 128K tokens
ModalidadesEntrada y salida de texto — sin visión, una petición de la comunidad muy difundida antes del lanzamiento (según TechTimes y explainx) que no llegó
ThinkingSiempre activo: thinking.type: "disabled" ya no está soportado
Control de razonamientoNuevo parámetro reasoning_effort: low / high / max (max recomendado para código)
HerramientasFunction calling, MCP, streaming, caché de contexto, salidas estructuradas (según la documentación oficial)
Número de parámetrosNo publicado (inferirlo de la misma base ≠ una cifra oficial)
Posicionamiento"Built to Code. Ready for Cyber Defense."

Cómo ha cambiado el acceso desde el día del lanzamiento

GLM-5.3 es un ejemplo instructivo de lanzamiento en el que el anuncio, el producto por suscripción, la API y los pesos no salieron el mismo día. La tabla siguiente conserva el estado canal por canal del día del lanzamiento como historial; el estado actual es distinto:
CanalEstado el 14 de agosto de 2026Evidencia
GLM Coding Plan (suscripción)✅ Activo en todos los niveles del plan; las peticiones a GLM-5.2/5.1 ahora se redirigen automáticamente a GLM-5.3Documentación devpack de Z.ai
ZCode (el agente de código de Z.ai)✅ Activo, con una promoción de cuota de 1,5× hasta el 31 de agostoAnuncio de Z.ai
API internacional de Z.ai⚠️ Ambiguo: el blog muestra un ejemplo de petición con "model": "glm-5.3", pero la página oficial de precios no incluye ninguna entrada de GLM-5.3 y la URL de la documentación del modelo devuelve 404Comprobado el 14 de agosto de 2026
API de BigModel (China)❌ "GLM-5.3 模型 API 即将上线": próximamente, en palabras de la propia Z.aiDocumentación de BigModel
Pesos abiertos (Hugging Face)❌ Prometidos ~dos semanas tras el lanzamiento, después de una evaluación de seguridad y endurecimiento; la licencia aún no se ha indicadoAnuncio de Z.ai
Agregadores de API❌ Cero de nueve plataformas principales podían servir GLM-5.3 el día del lanzamiento; Together AI solo muestra un marcador de "próximamente"APIs de modelos de las plataformas, comprobadas el 14 de agosto de 2026
Fases de verificación del lanzamiento de GLM-5.3, del anuncio a una ruta probada en producción
Fases de verificación del lanzamiento de GLM-5.3, del anuncio a una ruta probada en producción
La consecuencia práctica hoy es la contraria a la advertencia del día del lanzamiento: el precio ya es un dato confirmado en la decisión de adopción. Las tarifas oficiales coinciden con las de GLM-5.2 (1,40 $ de entrada / 0,26 $ en caché / 4,40 $ de salida por millón de tokens), pero unas tarifas por token iguales no garantizan un coste por tarea igual, porque GLM-5.3 siempre razona y factura ese razonamiento dentro de los tokens de salida.

Los benchmarks reclamados — y sus matices

Todos los números siguientes son resultados reportados por la propia Z.ai (declarados por el proveedor). El día del lanzamiento no existía ninguna réplica independiente.
BenchmarkGLM-5.3GLM-5.2Nota
Terminal Bench 3.028,34,6Reclama el nº 1 entre modelos abiertos; Claude Fable 5 = 33,7
DeepSWE v1.166,946,2
FrontierSWE78,167,5
SWE-Marathon v1.142,519,4
CyberGym84,577,2La documentación china de Z.ai dice 83,5 % en el cuerpo del texto: circulan dos cifras oficiales
ExploitBench54,424,4La propia Z.ai señala que los modelos cerrados siguen por delante (Mythos 5 = 78)
Agents' Last Exam (CLI)28,523,8Reclama el nº 1 entre modelos abiertos

Z.ai también reporta una «mejora del 50 % sobre GLM-5.2» en su Code Bench interno —un benchmark privado— y reconoce abiertamente que GLM-5.3 «sigue por detrás de Claude Fable 5» a esfuerzo máximo. La reacción de la comunidad en Hacker News el primer día capturó los dos polos: «solo por un pelo» por detrás de los modelos cerrados frontier, y «¿es la magia del post-entrenamiento solo sobreajuste a los benchmarks?». Ambas citas merecen tenerse presentes hasta que lleguen evaluaciones de terceros.

Los resultados de ciberseguridad vienen con un artefacto inusual: Z.ai lanzó a la vez un registro público de divulgación de seguridad (Security Disclosure Ledger) para las vulnerabilidades que encuentre el modelo; en parte por eso la API y los pesos quedan esta vez detrás de una revisión de seguridad, una ruptura real con GLM-5.2, que abrió su código el mismo día del lanzamiento.

GLM-5.3, GLM 5.5, GLM-6: ¿qué es cada uno?

Durante dos meses circularon tres nombres en torno a la hoja de ruta de Z.ai. Así queda cada uno tras el lanzamiento de hoy:

  • GLM-5.3 — la etiqueta usada en las discusiones de desarrolladores desde julio. Esto es lo que se lanzó hoy.
  • GLM 5.5 — una etiqueta independiente de analistas y medios (previsión de JPMorgan vía Reuters), a menudo asociada a un rumoreado buque insignia de más de 1T de parámetros. Sigue sin anunciarse — si llega, sería un lanzamiento posterior, posiblemente el siguiente a GLM-5.3. Nuestro seguimiento del lanzamiento de GLM 5.5 lo sigue rastreando como entidad propia.
  • GLM-6 — una vía de especulación sin respaldo oficial.

Un detalle del rumor que conviene cerrar: la URL de la "rama glm-5.3" de GitHub, tan compartida, nunca fue prueba de lanzamiento (la página no mostraba historial de commits al comprobarla, y el repositorio más tarde desapareció del acceso público). El lanzamiento ocurrió de todos modos, mediante un anuncio oficial: exactamente el artefacto que este seguimiento pedía esperar.

Qué cambia para los desarrolladores: el contrato de la API

Dos cambios a nivel de API están confirmados en el anuncio e importan antes de cualquier migración:

  1. El thinking ya no puede desactivarse. GLM-5.2 aceptaba thinking.type: "disabled"; GLM-5.3 no. Las pipelines que dependían de llamadas sin razonamiento por latencia o coste tienen un breaking change que gestionar.
  2. reasoning_effort es la nueva superficie de controllow / high / max, con max recomendado para tareas de código.

Ejemplo oficial de petición de Z.ai:

{
  "model": "glm-5.3",
  "thinking": { "type": "enabled" },
  "reasoning_effort": "max"
}
Dentro del Coding Plan, la migración ya ha ocurrido de hecho sin acción del usuario: las peticiones a GLM-5.2 y GLM-5.1 se redirigen automáticamente a GLM-5.3. Para la decisión de cambio completa — qué mejoró, qué implica la redirección automática y cuándo lo correcto es quedarse en GLM-5.2 — consulta la comparativa dedicada: GLM-5.3 vs GLM-5.2: qué cambia de verdad y si merece la pena migrar

Cómo usar GLM-5.3 hoy

Ahora hay dos vías de compra distintas: una suscripción de código por puntos y una API por token. No compares sus unidades de cabecera directamente.

Tu situaciónOpción realista hoyQué vigilar
Usas Claude Code / OpenCode / un agente de códigoSuscripción GLM Coding Plan (desde 18 $/mes, cuota por puntos; GLM-5.3 factura con los multiplicadores de puntos más altos de la familia)Las horas valle facturan al 50 % de los puntos
Facturas por token vía APILlama a glm-5.3 desde la página de modelo de EvoLink; empieza con reasoning_effort: "low" para el trabajo rutinarioEl coste por tarea aceptada, los aciertos de caché y el crecimiento de los tokens de salida
Te autoalojasEspera a los pesos (~28 de agosto) y a los términos de la licenciaLa organización zai-org en Hugging Face; no está garantizado que la licencia coincida con la de GLM-5.2
Necesitas visiónGLM-5.3 no la tiene; usa una ruta multimodalSi la línea GLM-V converge con la línea principal GLM

EvoLink expone ahora GLM-5.3 tras una única pasarela, junto al resto de opciones de modelo listas para producción. Mantén el ID del modelo en configuración, valida el comportamiento de streaming y de herramientas con tus propios payloads y conserva un fallback probado: que exista una ruta no sustituye a las pruebas de aceptación sobre tu carga de trabajo.

Qué no sabemos todavía

Aunque el precio ya es público, siguen abiertos varios hechos relevantes para producción que hay que verificar sobre tu propia carga de trabajo:

  • Límites de tasa y concurrencia. Sin cifras de RPM/TPM publicadas.
  • Licencia de los pesos abiertos. GLM-5.2 era estilo MIT; Kimi y Qwen han pasado recientemente a licencias restringidas y la comunidad observa si Z.ai les sigue. Dos semanas de revisión de seguridad también implican que los términos podrían diferir.
  • Número de parámetros. "Misma base que GLM-5.2" invita a una inferencia; Z.ai no ha publicado ninguna cifra.
  • Benchmarks independientes. Todos los números del día del lanzamiento son declarados por el proveedor.

Las señales que activarán la próxima actualización

  1. Que los pesos de GLM-5.3 aparezcan bajo huggingface.co/zai-org, con términos de licencia explícitos.
  2. Que se publiquen límites de tasa o de concurrencia para dimensionar producción.
  3. Evaluaciones independientes con un arnés equivalente que reproduzcan o refuten la tabla de benchmarks del proveedor.
  4. Cambios relevantes de precio o de contrato de API en Z.ai o en EvoLink.

Preguntas frecuentes

¿Se ha lanzado GLM-5.3?

Sí. Z.ai anunció oficialmente GLM-5.3 el 14 de agosto de 2026. El acceso del día de lanzamiento fue primero por suscripción; el precio por token de la API ya está publicado.

¿Cómo puedo usar GLM-5.3 hoy realmente?

Con el ID de modelo glm-5.3 a través de la ruta de API de EvoLink, o con los productos de suscripción de Z.ai (GLM Coding Plan y ZCode). El primero factura por token; los segundos siguen la economía del plan.

¿Cuánto cuesta la API de GLM-5.3?

Las tarifas oficiales de Z.ai son 1,40 $ de entrada, 0,26 $ de entrada en caché y 4,40 $ de salida por millón de tokens. El precio de ruta vigente en EvoLink y su calculadora están en la página de la API de GLM-5.3.

¿Cuál es el ID de modelo de GLM-5.3?

El propio ejemplo de API de Z.ai usa glm-5.3. Verifícalo contra la documentación oficial de la API antes de ponerlo en la configuración de producción.

¿Qué significa "misma base, todas las mejoras del post-entrenamiento"?

Z.ai no preentrenó un modelo nuevo. GLM-5.3 es la red base de GLM-5.2 con un post-entrenamiento escalado de forma sustancial (fine-tuning, RL y fases relacionadas). Por eso no hay una nueva cifra de parámetros, y por eso algunos desarrolladores dudan de que las mejoras de benchmark generalicen.

¿Tiene GLM-5.3 el mismo tamaño que GLM-5.2?

Presumiblemente, dado que la base es la misma, pero Z.ai no ha publicado el número de parámetros de GLM-5.3, así que ninguna cifra debe tratarse como oficial.

¿Tiene visión GLM-5.3?

No. Es solo texto. La visión fue una petición de la comunidad muy difundida antes del lanzamiento (TechTimes y explainx cubrieron el hilo de la encuesta a desarrolladores) y no llegó; el trabajo multimodal de Z.ai sigue en la línea aparte GLM-V.

¿Cuándo se publicarán los pesos abiertos y bajo qué licencia?

Z.ai promete los pesos unas dos semanas después del lanzamiento (en torno al 28 de agosto de 2026), tras una evaluación de seguridad y endurecimiento. La licencia no se ha indicado: no asumas que los términos de GLM-5.2 se trasladan.

¿Es esto lo mismo que GLM 5.5?

No — son entidades separadas. GLM 5.5 sigue sin anunciarse: durante el periodo de rumores, los analistas usaron esa etiqueta para un posible buque insignia de mayor tamaño, que todavía puede llegar como un lanzamiento posterior. Lo lanzado hoy es GLM-5.3, y el seguimiento de GLM 5.5, independiente, continúa.

¿Son fiables los números de benchmark?

Son resultados reportados por la propia Z.ai, incluidas comparaciones en las que GLM-5.3 queda por detrás de modelos cerrados, un punto a favor de su franqueza. Pero aún no existe réplica independiente, y una cifra (CyberGym) aparece como 84,5 y como 83,5 en distintos documentos oficiales. Trátalos como afirmaciones del proveedor pendientes de pruebas de terceros.

¿Qué se rompe si muevo una integración de GLM-5.2 a GLM-5.3?

El breaking change confirmado: el thinking ya no puede desactivarse. Las rutas de llamadas sin razonamiento sensibles a latencia o coste necesitan rediseño, y reasoning_effort pasa a ser tu mando de control. Lista de migración completa en la guía GLM-5.3 vs GLM-5.2.

¿Debería cambiar desde GLM-5.2 ya?

Si estás en el Coding Plan, ya has cambiado: las peticiones se redirigen automáticamente a GLM-5.3. Para el tráfico por token, abre un carril retador controlado sobre glm-5.3, elimina thinking.type: "disabled", compara el coste por tarea aceptada y mantén GLM-5.2 como ruta de reversión hasta que se cumplan tus criterios.

Fuentes y registro de cambios

26 de agosto de 2026 — revisión por activación de la API. La página de precios de Z.ai ya lista GLM-5.3 a 1,40 $ / 0,26 $ en caché / 4,40 $ por millón de tokens. La ruta de producto de EvoLink usa glm-5.3 y muestra precios vigentes, los dos protocolos de API soportados, comprobaciones de migración y ejemplos de código. Se retiró toda la redacción en presente sobre una API no disponible; el estado del día del lanzamiento permanece solo como historial fechado.
14 de agosto de 2026 — revisión del día del lanzamiento. GLM-5.3 fue anunciado oficialmente ese día; esta página pasó de seguir un rumor a seguir un lanzamiento. Confirmado: nombre, ID de modelo glm-5.3 (según el ejemplo oficial), límites de 1M/128K, modalidad de solo texto, thinking siempre activo con reasoning_effort, tabla de benchmarks del proveedor, disponibilidad en el Coding Plan con redirección automática desde GLM-5.2/5.1, calendario de pesos abiertos de ~2 semanas. En ese momento seguía abierto: precio por token, fechas de apertura de la API, límites de tasa, licencia, número de parámetros, evaluaciones independientes.
3 de agosto de 2026 — primera publicación. Documentó las evidencias del periodo de rumores: la URL de commits de GitHub que no mostraba historial de commits (captura archivada; el repositorio desapareció después, tratado correctamente como una señal y no como prueba de lanzamiento), la división de nombres GLM-5.3 / GLM 5.5 / GLM-6 sin resolver, y la recomendación de entregar con una ruta verificada de GLM-5.2 tratando al sucesor como candidato de evaluación. Esa recomendación aguantó el día del lanzamiento: en aquel momento, la API por token era la parte que aún no había salido.
Evidencias revisadas por última vez el 26 de agosto de 2026. Esta página se actualiza cuando cambian el precio, el comportamiento de la API, los pesos, la licencia o las evaluaciones independientes.

¿Listo para reducir tus costos de IA en un 89%?

Comienza a usar EvoLink hoy y experimenta el poder del enrutamiento inteligente de API.