
Lanzamiento de GLM-5.3: qué ha salido y qué cambia para los desarrolladores
glm-5.3 detrás de la misma clave de API unificada y expone tanto el endpoint de Chat Completions como el de Anthropic Messages. El estado por fases que se describe más abajo sigue siendo útil como historial del lanzamiento; ya no es la respuesta actual sobre la API. Para precios de ruta y código al día, consulta la página de la API de GLM-5.3.glm-5.3-flash, añade entrada de imagen, vídeo y archivo, y su precio de ruta es mucho más bajo. La comparativa GLM-5.3 Flash vs GLM-5.3 ayuda a decidir si una carga de trabajo debe arrancar en el nivel de volumen o ir directa al buque insignia de solo texto.Qué ha anunciado Z.ai realmente
| Elemento | Valor confirmado (14 de agosto de 2026) |
|---|---|
| Nombre oficial / ID de modelo en la API | GLM-5.3 / glm-5.3 (del ejemplo de API de la propia Z.ai) |
| Modelo base | El mismo que GLM-5.2; todas las mejoras proceden del post-entrenamiento |
| Ventana de contexto / salida máxima | 1M tokens / 128K tokens |
| Modalidades | Entrada y salida de texto — sin visión, una petición de la comunidad muy difundida antes del lanzamiento (según TechTimes y explainx) que no llegó |
| Thinking | Siempre activo: thinking.type: "disabled" ya no está soportado |
| Control de razonamiento | Nuevo parámetro reasoning_effort: low / high / max (max recomendado para código) |
| Herramientas | Function calling, MCP, streaming, caché de contexto, salidas estructuradas (según la documentación oficial) |
| Número de parámetros | No publicado (inferirlo de la misma base ≠ una cifra oficial) |
| Posicionamiento | "Built to Code. Ready for Cyber Defense." |
Cómo ha cambiado el acceso desde el día del lanzamiento
| Canal | Estado el 14 de agosto de 2026 | Evidencia |
|---|---|---|
| GLM Coding Plan (suscripción) | ✅ Activo en todos los niveles del plan; las peticiones a GLM-5.2/5.1 ahora se redirigen automáticamente a GLM-5.3 | Documentación devpack de Z.ai |
| ZCode (el agente de código de Z.ai) | ✅ Activo, con una promoción de cuota de 1,5× hasta el 31 de agosto | Anuncio de Z.ai |
| API internacional de Z.ai | ⚠️ Ambiguo: el blog muestra un ejemplo de petición con "model": "glm-5.3", pero la página oficial de precios no incluye ninguna entrada de GLM-5.3 y la URL de la documentación del modelo devuelve 404 | Comprobado el 14 de agosto de 2026 |
| API de BigModel (China) | ❌ "GLM-5.3 模型 API 即将上线": próximamente, en palabras de la propia Z.ai | Documentación de BigModel |
| Pesos abiertos (Hugging Face) | ❌ Prometidos ~dos semanas tras el lanzamiento, después de una evaluación de seguridad y endurecimiento; la licencia aún no se ha indicado | Anuncio de Z.ai |
| Agregadores de API | ❌ Cero de nueve plataformas principales podían servir GLM-5.3 el día del lanzamiento; Together AI solo muestra un marcador de "próximamente" | APIs de modelos de las plataformas, comprobadas el 14 de agosto de 2026 |

Los benchmarks reclamados — y sus matices
| Benchmark | GLM-5.3 | GLM-5.2 | Nota |
|---|---|---|---|
| Terminal Bench 3.0 | 28,3 | 4,6 | Reclama el nº 1 entre modelos abiertos; Claude Fable 5 = 33,7 |
| DeepSWE v1.1 | 66,9 | 46,2 | |
| FrontierSWE | 78,1 | 67,5 | |
| SWE-Marathon v1.1 | 42,5 | 19,4 | |
| CyberGym | 84,5 | 77,2 | La documentación china de Z.ai dice 83,5 % en el cuerpo del texto: circulan dos cifras oficiales |
| ExploitBench | 54,4 | 24,4 | La propia Z.ai señala que los modelos cerrados siguen por delante (Mythos 5 = 78) |
| Agents' Last Exam (CLI) | 28,5 | 23,8 | Reclama el nº 1 entre modelos abiertos |
Z.ai también reporta una «mejora del 50 % sobre GLM-5.2» en su Code Bench interno —un benchmark privado— y reconoce abiertamente que GLM-5.3 «sigue por detrás de Claude Fable 5» a esfuerzo máximo. La reacción de la comunidad en Hacker News el primer día capturó los dos polos: «solo por un pelo» por detrás de los modelos cerrados frontier, y «¿es la magia del post-entrenamiento solo sobreajuste a los benchmarks?». Ambas citas merecen tenerse presentes hasta que lleguen evaluaciones de terceros.
GLM-5.3, GLM 5.5, GLM-6: ¿qué es cada uno?
Durante dos meses circularon tres nombres en torno a la hoja de ruta de Z.ai. Así queda cada uno tras el lanzamiento de hoy:
- GLM-5.3 — la etiqueta usada en las discusiones de desarrolladores desde julio. Esto es lo que se lanzó hoy.
- GLM 5.5 — una etiqueta independiente de analistas y medios (previsión de JPMorgan vía Reuters), a menudo asociada a un rumoreado buque insignia de más de 1T de parámetros. Sigue sin anunciarse — si llega, sería un lanzamiento posterior, posiblemente el siguiente a GLM-5.3. Nuestro seguimiento del lanzamiento de GLM 5.5 lo sigue rastreando como entidad propia.
- GLM-6 — una vía de especulación sin respaldo oficial.
Un detalle del rumor que conviene cerrar: la URL de la "rama glm-5.3" de GitHub, tan compartida, nunca fue prueba de lanzamiento (la página no mostraba historial de commits al comprobarla, y el repositorio más tarde desapareció del acceso público). El lanzamiento ocurrió de todos modos, mediante un anuncio oficial: exactamente el artefacto que este seguimiento pedía esperar.
Qué cambia para los desarrolladores: el contrato de la API
Dos cambios a nivel de API están confirmados en el anuncio e importan antes de cualquier migración:
- El thinking ya no puede desactivarse. GLM-5.2 aceptaba
thinking.type: "disabled"; GLM-5.3 no. Las pipelines que dependían de llamadas sin razonamiento por latencia o coste tienen un breaking change que gestionar. reasoning_effortes la nueva superficie de control —low/high/max, conmaxrecomendado para tareas de código.
Ejemplo oficial de petición de Z.ai:
{
"model": "glm-5.3",
"thinking": { "type": "enabled" },
"reasoning_effort": "max"
}Cómo usar GLM-5.3 hoy
Ahora hay dos vías de compra distintas: una suscripción de código por puntos y una API por token. No compares sus unidades de cabecera directamente.
| Tu situación | Opción realista hoy | Qué vigilar |
|---|---|---|
| Usas Claude Code / OpenCode / un agente de código | Suscripción GLM Coding Plan (desde 18 $/mes, cuota por puntos; GLM-5.3 factura con los multiplicadores de puntos más altos de la familia) | Las horas valle facturan al 50 % de los puntos |
| Facturas por token vía API | Llama a glm-5.3 desde la página de modelo de EvoLink; empieza con reasoning_effort: "low" para el trabajo rutinario | El coste por tarea aceptada, los aciertos de caché y el crecimiento de los tokens de salida |
| Te autoalojas | Espera a los pesos (~28 de agosto) y a los términos de la licencia | La organización zai-org en Hugging Face; no está garantizado que la licencia coincida con la de GLM-5.2 |
| Necesitas visión | GLM-5.3 no la tiene; usa una ruta multimodal | Si la línea GLM-V converge con la línea principal GLM |
EvoLink expone ahora GLM-5.3 tras una única pasarela, junto al resto de opciones de modelo listas para producción. Mantén el ID del modelo en configuración, valida el comportamiento de streaming y de herramientas con tus propios payloads y conserva un fallback probado: que exista una ruta no sustituye a las pruebas de aceptación sobre tu carga de trabajo.
Qué no sabemos todavía
Aunque el precio ya es público, siguen abiertos varios hechos relevantes para producción que hay que verificar sobre tu propia carga de trabajo:
- Límites de tasa y concurrencia. Sin cifras de RPM/TPM publicadas.
- Licencia de los pesos abiertos. GLM-5.2 era estilo MIT; Kimi y Qwen han pasado recientemente a licencias restringidas y la comunidad observa si Z.ai les sigue. Dos semanas de revisión de seguridad también implican que los términos podrían diferir.
- Número de parámetros. "Misma base que GLM-5.2" invita a una inferencia; Z.ai no ha publicado ninguna cifra.
- Benchmarks independientes. Todos los números del día del lanzamiento son declarados por el proveedor.
Las señales que activarán la próxima actualización
- Que los pesos de GLM-5.3 aparezcan bajo huggingface.co/zai-org, con términos de licencia explícitos.
- Que se publiquen límites de tasa o de concurrencia para dimensionar producción.
- Evaluaciones independientes con un arnés equivalente que reproduzcan o refuten la tabla de benchmarks del proveedor.
- Cambios relevantes de precio o de contrato de API en Z.ai o en EvoLink.
Preguntas frecuentes
¿Se ha lanzado GLM-5.3?
Sí. Z.ai anunció oficialmente GLM-5.3 el 14 de agosto de 2026. El acceso del día de lanzamiento fue primero por suscripción; el precio por token de la API ya está publicado.
¿Cómo puedo usar GLM-5.3 hoy realmente?
glm-5.3 a través de la ruta de API de EvoLink, o con los productos de suscripción de Z.ai (GLM Coding Plan y ZCode). El primero factura por token; los segundos siguen la economía del plan.¿Cuánto cuesta la API de GLM-5.3?
¿Cuál es el ID de modelo de GLM-5.3?
glm-5.3. Verifícalo contra la documentación oficial de la API antes de ponerlo en la configuración de producción.¿Qué significa "misma base, todas las mejoras del post-entrenamiento"?
Z.ai no preentrenó un modelo nuevo. GLM-5.3 es la red base de GLM-5.2 con un post-entrenamiento escalado de forma sustancial (fine-tuning, RL y fases relacionadas). Por eso no hay una nueva cifra de parámetros, y por eso algunos desarrolladores dudan de que las mejoras de benchmark generalicen.
¿Tiene GLM-5.3 el mismo tamaño que GLM-5.2?
Presumiblemente, dado que la base es la misma, pero Z.ai no ha publicado el número de parámetros de GLM-5.3, así que ninguna cifra debe tratarse como oficial.
¿Tiene visión GLM-5.3?
¿Cuándo se publicarán los pesos abiertos y bajo qué licencia?
Z.ai promete los pesos unas dos semanas después del lanzamiento (en torno al 28 de agosto de 2026), tras una evaluación de seguridad y endurecimiento. La licencia no se ha indicado: no asumas que los términos de GLM-5.2 se trasladan.
¿Es esto lo mismo que GLM 5.5?
¿Son fiables los números de benchmark?
Son resultados reportados por la propia Z.ai, incluidas comparaciones en las que GLM-5.3 queda por detrás de modelos cerrados, un punto a favor de su franqueza. Pero aún no existe réplica independiente, y una cifra (CyberGym) aparece como 84,5 y como 83,5 en distintos documentos oficiales. Trátalos como afirmaciones del proveedor pendientes de pruebas de terceros.
¿Qué se rompe si muevo una integración de GLM-5.2 a GLM-5.3?
reasoning_effort pasa a ser tu mando de control. Lista de migración completa en la guía GLM-5.3 vs GLM-5.2.¿Debería cambiar desde GLM-5.2 ya?
glm-5.3, elimina thinking.type: "disabled", compara el coste por tarea aceptada y mantén GLM-5.2 como ruta de reversión hasta que se cumplan tus criterios.Fuentes y registro de cambios
- Z.ai — anuncio de GLM-5.3
- BigModel — documentación del modelo GLM-5.3
- Z.ai — precios oficiales de GLM-5.3
- Z.ai — documentación del GLM Coding Plan / devpack
- Hacker News — discusión del día del lanzamiento
- Unite.AI — cobertura del lanzamiento
- Hugging Face — zai-org (aún sin pesos de GLM-5.3)
glm-5.3 y muestra precios vigentes, los dos protocolos de API soportados, comprobaciones de migración y ejemplos de código. Se retiró toda la redacción en presente sobre una API no disponible; el estado del día del lanzamiento permanece solo como historial fechado.glm-5.3 (según el ejemplo oficial), límites de 1M/128K, modalidad de solo texto, thinking siempre activo con reasoning_effort, tabla de benchmarks del proveedor, disponibilidad en el Coding Plan con redirección automática desde GLM-5.2/5.1, calendario de pesos abiertos de ~2 semanas. En ese momento seguía abierto: precio por token, fechas de apertura de la API, límites de tasa, licencia, número de parámetros, evaluaciones independientes.

