El laboratorio chino Zhipu (Z.ai) anunció GLM-5.3 el 14 de agosto, describiéndolo como el modelo de código abierto más potente para programación y afirmando una mejora del 50% frente a GLM-5.2 en su evaluación interna de programación práctica.

La cifra que destaca

Terminal Bench 3.0 pasa de 4,6 a 28,3: un salto de seis veces en el benchmark que mide si un modelo puede realmente manejar una shell durante una tarea larga. El trabajo agentivo en terminal ha sido la mayor brecha entre los modelos chinos de pesos abiertos y los sistemas fronteriza occidentales, y Zhipu sostiene que ha cerrado la mayor parte de esa distancia en un solo lanzamiento.

El resto de la tarjeta

DeepSWE v1.1 sube a 66,9 desde 46,2; Agents' Last Exam, a 28,5 desde 23,8; y AutomationBench, a 48,2 desde 26,2. En Z.ai Code Bench, en el nivel High, el modelo informa de una exactitud del 31,4% mientras gasta aproximadamente 50.000 tokens por tarea, una cifra de coste que la mayoría de los proveedores omite y que conviene leer junto a la exactitud.

Vuelva a leer el mismo gráfico

La propia comparación de Zhipu sitúa a GLM-5.3 por detrás de GPT-5.6 Sol y Fable 5 en los seis benchmarks que publicó —Terminal Bench, 28,3 frente a 34,6 y 33,7. En DeepSWE también queda justo por debajo de Kimi K3, con 67,5. La afirmación es "el modelo de código abierto más potente" y, en uno de sus propios seis benchmarks, incluso eso queda en entredicho.

Sin nueva ronda de preentrenamiento

Zhipu afirma que GLM-5.3 usa el mismo modelo base que GLM-5.2 y que las mejoras proceden íntegramente de ampliar el post-entrenamiento. Es la misma afirmación que hizo xAI para Grok 4.6 dos días antes, y apunta a la misma conclusión: la parte cara de la vida de un modelo es cada vez más lo que ocurre después de que termina el preentrenamiento.

Lo que aún no puede verificarse

Todas las cifras aquí son autodeclaradas, y los pesos no se han publicado. Zhipu dice que llegarán dentro de aproximadamente dos semanas, tras la evaluación de seguridad y el endurecimiento, con acceso a la API poco después; la organización de la compañía en Hugging Face sigue mostrando GLM-5.2 como su última versión. Hasta que lleguen los pesos, "el modelo de código abierto para programación más potente" es una afirmación sobre un modelo que nadie fuera de Zhipu puede ejecutar.