Crypto news

14.08.2026
07:47

Z.ai ha presentado GLM-5.3: un avance en programación y ciberseguridad

La startup china Z.ai ha lanzado el modelo de lenguaje actualizado GLM-5.3, que marca un avance significativo en programación, escenarios de agentes y búsqueda de vulnerabilidades. A diferencia de iteraciones anteriores, la mejora de rendimiento aquí se logró exclusivamente mediante post-entrenamiento, sin cambiar la arquitectura base. Es un enfoque intrigante que demuestra que el potencial de los modelos existentes está lejos de agotarse.

En el benchmark interno Code Bench, diseñado para evaluar habilidades de codificación, GLM-5.3 mostró una mejora del 50% en comparación con su predecesora. Sin embargo, los resultados más impresionantes se ven en pruebas especializadas. Por ejemplo, en Terminal Bench 3.0, el nuevo modelo obtuvo 28,3 puntos frente a los escasos 4,6 de GLM-5.2. En DeepSWE v1.1, el progreso fue de 66,9 frente a 46,2, y en Agents' Last Exam, de 28,5 frente a 23,8.

Los resultados en el ámbito de la seguridad merecen especial atención. En la prueba CyberGym, el modelo alcanzó un 84,5% de éxito, y en ExploitBench, un 54,4%, más del doble que el resultado de la versión anterior (24,4%). Con un presupuesto de dos horas, GLM-5.3 resolvió 105 tareas, mientras que GLM-5.2 solo gestionaba 29. Al aumentar el presupuesto a seis horas, la brecha se mantiene: 130 frente a 39 tareas, respectivamente.

Pruebas reales y registro público

Z.ai también realizó pruebas en bases de código reales junto con varios equipos de seguridad chinos. Tras la verificación y deduplicación, el sistema identificó 2436 vulnerabilidades en 269 proyectos, incluyendo 1097 problemas de criticidad media y alta. Solo se revelaron públicamente 53 hallazgos; los otros 2383 permanecen bajo embargo. Es notable que la "vida útil" promedio de dichas vulnerabilidades se estima en 26,6 años, y la más antigua descubierta data de 1981.

Para mayor transparencia, la empresa lanzó Z.ai Security Disclosure Ledger, un registro público donde se documentan el estado, los proyectos afectados y el nivel de criticidad. Paralelamente, GLM-5.3 ya está desplegada para los suscriptores de GLM Coding Plan, convirtiéndose en el motor principal para la programación de agentes y tareas de larga duración. Las solicitudes a modelos antiguos se enrutan automáticamente a la nueva versión.

Los pesos abiertos del modelo estarán disponibles dos semanas después de la evaluación de seguridad y un endurecimiento adicional. Es un enfoque razonable, dada la sensibilidad de la herramienta.

Mi opinión: GLM-5.3 no es solo una actualización evolutiva, sino una seria declaración de intenciones para liderar en el ámbito de los agentes de IA para ciberseguridad. Sin embargo, recuerdo que en julio Anthropic acusó a Z.ai de destilación no autorizada de GLM-5.2 utilizando respuestas de Claude y GPT. Dado un salto tan pronunciado en ExploitBench, vale la pena seguir de cerca las investigaciones posteriores, aunque por ahora no hay pruebas de infracciones.