Kimi K3 ya está disponibleDescubrir Kimi K3
Seguimiento del lanzamiento de GLM 5.5 con una ventana prevista en agosto y detalles de API sin confirmar
model-release

GLM 5.5: fecha de lanzamiento, rumores y disponibilidad de la API

Jacey
Jacey
Founder
21 de julio de 2026
Actualizado el 27 de julio de 2026
13 min de lectura
GLM 5.5 apunta, según informes, a agosto de 2026, pero Z.ai no ha anunciado el modelo ni una fecha exacta de lanzamiento. La ventana de agosto procede de una cobertura de CGTN que cita a Reuters y una previsión de analistas de JPMorgan. Es una señal creíble que conviene vigilar, no una fecha que los desarrolladores deban tratar como comprometida.
Tampoco existe un nombre oficial, ni model card, ni ID de API, ni precio, ni límite de contexto, ni licencia, ni benchmark verificado. La decisión práctica, por tanto, no es "creer o descartar el rumor". Es saber qué evidencias harían usable el modelo y prepararse sin bloquear el trabajo que hoy puede salir a producción con GLM-5.2. EvoLink sigue esos hitos en la página de disponibilidad de GLM 5.5.

La respuesta directa: ¿qué está confirmado hoy?

PreguntaRespuesta a 21 de julio de 2026Nivel de evidencia
¿Es oficial GLM 5.5?No hay anuncio oficial ni model card públicaAusencia confirmada en las fuentes oficiales actuales
¿Cuándo podría lanzarse?Agosto de 2026 es la previsión de analistas recogida por la prensaCobertura creíble, no un compromiso del proveedor
¿Cómo se llamará?GLM-5.3, GLM 5.5 y GLM-6 aparecen en informes o discusionesSin resolver
¿Supera el billón (10^12) de parámetros?Esa cifra aparece en previsiones de analistas y mediosSin confirmar
¿Tendrá pesos abiertos, contexto de 1M o visión?Z.ai no ha publicado esos detallesDesconocido
¿Pueden llamarlo los desarrolladores?No existe ninguna ruta oficial ni de terceros verificadaNo disponible
Esta distinción es la primera razón por la que esta página resulta útil. Muchas páginas tempranas combinan hechos de GLM-5.2 con expectativas de GLM 5.5 en una única tabla de especificaciones. Eso hace que una característica heredada parezca un hecho del nuevo modelo. Aquí mantenemos separada la información reportada, la esperada y la verificada.
Cronología del lanzamiento de GLM 5.5 que separa las fechas reportadas de los detalles de producto confirmados
Cronología del lanzamiento de GLM 5.5 que separa las fechas reportadas de los detalles de producto confirmados

De dónde sale la afirmación de agosto de 2026

La cadena pública más sólida es esta:

  1. Analistas de JPMorgan habrían previsto otro modelo de Z.ai para agosto de 2026.
  2. Reuters recogió esa previsión en su cobertura del mercado chino de IA.
  3. CGTN republicó la información de Reuters al hablar de GLM-5.2.

Esa cadena es más fuerte que una publicación anónima en redes sociales, pero sigue terminando en una previsión de analistas, no en una nota de lanzamiento de Z.ai. La misma cobertura se ha repetido con la afirmación de "más de un billón de parámetros". Esa cifra tiene el mismo estatus y no puede usarse para planificar hardware, estimar precios ni afirmar capacidades.

El fundador de Z.ai, Jie Tang, también ha descrito una mejora en preparación como un "plus épico" en una respuesta pública recogida por medios chinos. Esto sugiere que se está preparando una actualización relevante. No identifica el producto como GLM 5.5 ni confirma su fecha, arquitectura, modalidades o licencia.

Las evidencias solo cambiarían de forma sustancial cuando Z.ai publique un lanzamiento con nombre, una model card, un repositorio, documentación de API o una entrada de precios. Hasta entonces, agosto es una ventana de observación.

¿GLM-5.3, GLM 5.5 o GLM-6?

El conflicto de nombres importa porque puede romper integraciones y fragmentar los resultados de búsqueda. Las discusiones de desarrolladores han usado GLM-5.3 para una posible versión menor; la cobertura de analistas usa GLM 5.5 para el buque insignia esperado; y parte de la prensa china especula con que Z.ai podría saltar directamente a GLM-6.
Ninguno está confirmado. No pongas un identificador supuesto como glm-5.5 en la configuración de producción ni copies código de una página que lo haga. Un slug de URL puede seguir la expresión que la gente busca, pero una petición de API debe usar el ID exacto publicado por el proveedor de la ruta.

Cuando aparezca el nombre oficial, verifica cuatro identidades por separado:

IdentidadPor qué puede diferir
Nombre de marketingEl nombre usado en el anuncio de Z.ai
Nombre de los pesos o del repositorioEl nombre del artefacto en GitHub o Hugging Face
ID oficial del modelo en la APIEl identificador aceptado por Z.ai o BigModel
ID de la ruta alojadaEl identificador expuesto por EvoLink u otro proveedor

Esto evita un fallo habitual del día cero: asumir que el titular del modelo, el repositorio y la API usan la misma cadena de texto.

Lanzamiento no significa API disponible

Un modelo se vuelve usable por fases. Quien busca suele ver "lanzado" y asume que puede contratar un endpoint estable de inmediato, pero esos eventos pueden separarse horas o semanas.

Fase de disponibilidadQué la demuestraQué puede hacer el desarrollador con seguridad
1. Anuncio oficialNota de lanzamiento de Z.ai o model card con nombreLeer capacidades confirmadas y licencia
2. Artefactos oficialesID de API documentado, pesos o repositorioIniciar experimentos de integración o despliegue
3. Alojamiento de tercerosPágina del modelo exacto más una petición exitosaComparar reglas del proveedor y comportamiento de la ruta
4. Verificación del agregadorPeticiones, facturación, errores, límites y fallback probadosEjecutar tráfico de producción controlado
5. Confianza de producciónCalidad, latencia, errores y coste estables en el tiempoAmpliar el despliegue con rollback disponible

EvoLink cambiará la página de GLM 5.5 de vigilancia de disponibilidad a ruta activa solo cuando la identidad upstream, el comportamiento de las peticiones, la facturación y el manejo de errores estén verificados. Un logotipo de proveedor o una etiqueta de "próximamente" no son suficientes.

Qué nos enseñan los canales actuales de GLM-5.2

GLM-5.2 es la mejor referencia disponible para los campos que los desarrolladores necesitarán en el lanzamiento. Sus valores no predicen los de GLM 5.5.
Canal actual de GLM-5.2Qué puede verificar el usuario hoyPor qué el mismo campo debe revalidarse para GLM 5.5
Z.ai / artefactos oficialesPosicionamiento del lanzamiento, pesos, licencia, comportamiento del modeloUn sucesor puede cambiar licencia, modalidades y vías de acceso
OpenRouterSelección de proveedor, precio efectivo, contexto, TTFT, throughput, uptimePrecio y capacidades pueden variar por host y comportamiento de caché
Alibaba Model StudioIDs y precios por región; varios protocolos compatibles y controles de razonamientoRegión, protocolo y sintaxis de parámetros pueden diferir
NVIDIA NIMEndpoint de prueba, model card, soporte de herramientas y condiciones de servicioLas condiciones del endpoint alojado son independientes de la licencia del modelo
FeatherlessOpciones serverless y dedicadas con distinto contexto y reglas comercialesUn mismo modelo puede tener límites distintos según el tipo de despliegue
EvoLinkAcceso unificado a la ruta GLM actual y un camino de migración configurableUna ruta nueva debe pasar igualmente controles de disponibilidad independientes

El precio mostrado en cualquier página de proveedor de GLM-5.2 es dinámico y específico de cada canal. No debe copiarse en una estimación de GLM 5.5. El día del lanzamiento, la respuesta útil debe nombrar el proveedor, la región, el protocolo, los límites de contexto y salida, las reglas de caché, los límites de tasa, el comportamiento ante errores y la fecha en que se verificó la información.

Qué quieren realmente los desarrolladores del próximo GLM

Las preguntas de mayor valor en foros y plataformas de modelos no tratan sobre el número de parámetros. Tratan sobre los problemas que bloquean la adopción:

  • Visión nativa: ¿puede el modelo examinar capturas de pantalla, PDFs, diagramas y estados de interfaz sin una ruta de visión aparte?
  • Contexto largo efectivo: ¿conserva las restricciones y recupera hechos en lo profundo de un repositorio extenso, en lugar de limitarse a aceptar un prompt grande?
  • Finalización de tareas de agente: ¿termina el trabajo dirigido por herramientas con menos bucles, llamadas inválidas, reintentos y tareas abandonadas?
  • Compatibilidad de harness: ¿se comporta la misma ruta correctamente en clientes compatibles con OpenAI, herramientas tipo Claude Code, Cline y OpenCode?
  • Capacidad: ¿qué pasa con el tiempo hasta el primer token, el throughput, las cuotas y los errores HTTP 429 en horas punta?
  • Economía: ¿resulta más barato por tarea aceptada tras contar tokens de razonamiento, reintentos, herramientas y revisión, y no solo más barato por token?
  • Control del despliegue: ¿habrá pesos disponibles, bajo qué licencia, y qué hardware exige de forma realista?

Son preguntas de evaluación, no predicciones. Cuando exista una ruta invocable, conviértelas en pruebas reproducibles con tareas fijas, reglas de aceptación y metadatos de la ruta.

¿Deberías esperar? Decide según el riesgo de entrega

Tu situaciónMejor acción ahoraQué cambiaría la decisión
Lanzas en los próximos 30–60 díasIntegra GLM-5.2 y mantén el modelo configurableUna ruta de GLM 5.5 verificada supera tus pruebas de aceptación antes del lanzamiento
Investigas un futuro modelo por defectoGuarda tareas representativas y suscríbete a las alertas de disponibilidadAPI oficial más resultados comparados reproducibles
Construyes una plataforma multimodeloDefine ya un contrato de peticiones neutral al proveedor y un fallbackMetadatos de ruta, límites y semántica de errores estables
Planificas un despliegue privadoEspera a los pesos oficiales, la licencia, los formatos y las guías de hardwareArtefactos descargables e informes de inferencia reproducibles
Gestionas compras corporativasNo presupuestes a partir de precios o parámetros rumoreadosRegión, condiciones, tratamiento de datos, cuotas y facturación documentados
Para la mayoría de los equipos de producto, "usar ahora y probar después" implica menos riesgo que esperar. Pon el ID del modelo en configuración, conserva un fallback y mantén las pruebas de aceptación independientes de un único proveedor. La guía de decisión GLM 5.5 vs GLM-5.2 incluye una política de migración por etapas.

Las siete señales que merece la pena vigilar

En lugar de refrescar páginas de rumores, vigila los eventos que desbloquean una decisión real:

  1. Una nota de lanzamiento de Z.ai nombra el modelo.
  2. Una model card oficial publica arquitectura, modalidades, contexto, licencia y limitaciones.
  3. BigModel o Z.ai documentan un ID de API exacto y los parámetros de las peticiones.
  4. Precios, límites de tasa, regiones, comportamiento de caché y condiciones de uso se hacen públicos.
  5. GitHub o Hugging Face publican los pesos y los artefactos de despliegue.
  6. Evaluadores independientes revelan ID del modelo, harness, ajustes, ejecuciones, fallos y trazas.
  7. Una ruta de producción demuestra peticiones exitosas, facturación correcta, errores conocidos y capacidad estable.

La primera señal responde a "¿es real?". La última responde a "¿puedo confiar en él?". Ambas importan.

Una plataforma de agregación de IA solo aporta valor si elimina la incertidumbre entre el anuncio de un modelo y una petición de producción. El papel de EvoLink es, por tanto, mantener visibles cuatro cosas: los hechos del modelo, los límites específicos de cada host, el comportamiento de la ruta y el fallback del usuario.

Puedes usar GLM-5.2 a través de la API unificada ahora mismo. Cuando se verifique una ruta de GLM 5.5, la misma integración podrá evaluarla por configuración, comparar la fiabilidad a nivel de ruta y el coste por tarea aceptada, y conservar GLM-5.2 u otro modelo como fallback. Únete a la lista de avisos en la página de GLM 5.5 si te resulta más práctico que vigilar los anuncios manualmente.

Preguntas frecuentes

¿Cuándo sale GLM 5.5?

Agosto de 2026 es la previsión de analistas recogida por la prensa. Z.ai no ha anunciado una fecha exacta.

¿Ha anunciado Z.ai oficialmente GLM 5.5?

No. A 21 de julio de 2026, no existe ninguna nota de lanzamiento ni model card oficial de GLM 5.5.

¿Podría el próximo modelo llamarse GLM-5.3 o GLM-6?

Sí. GLM-5.3, GLM 5.5 y GLM-6 aparecen en la cobertura y las discusiones actuales, pero ninguno está confirmado como nombre definitivo.

¿Es GLM 5.5 un modelo de más de un billón (10^12) de parámetros?

Esa escala aparece en previsiones de analistas y medios. No es una especificación oficial y no debe usarse para planificar despliegues.

¿Mantendrá GLM 5.5 pesos abiertos o una licencia MIT?

Se desconoce. El modelo de publicación de GLM-5.2 no garantiza la licencia ni la disponibilidad de pesos de su sucesor.

¿Soportará GLM 5.5 visión y PDFs?

Z.ai no ha confirmado visión nativa. La comprensión de capturas, PDFs e interfaces es una de las peticiones más frecuentes de los usuarios y debería probarse si se anuncia el soporte.

¿Existe una API o un ID de modelo de GLM 5.5?

No hay documentación de API ni ID de modelo verificados públicos. No uses IDs supuestos procedentes de ejemplos de código no oficiales.

¿Qué proveedores ofrecen GLM 5.5?

Ninguno tiene una ruta verificada del modelo exacto en el momento de esta revisión. Cada proveedor debe comprobarse de forma independiente tras el lanzamiento oficial.

¿Uso GLM-5.2 ahora o espero?

Usa GLM-5.2 si tienes una fecha de entrega. Mantén el modelo configurable y prueba GLM 5.5 solo cuando existan una ruta real y evidencias reproducibles.

¿Cuándo está lista para producción una ruta de GLM 5.5?

Cuando la identidad exacta del modelo, las peticiones, la facturación, los límites, los errores, la capacidad y el comportamiento del fallback se hayan probado, no simplemente tras un anuncio de lanzamiento.

Fuentes

Evidencias revisadas por última vez el 21 de julio de 2026. La ventana de agosto y la afirmación sobre la escala de parámetros son previsiones, no hechos oficiales de producto de Z.ai.

¿Listo para reducir tus costos de IA en un 89%?

Comienza a usar EvoLink hoy y experimenta el poder del enrutamiento inteligente de API.