Китайская лаборатория Zhipu (Z.ai) объявила о GLM-5.3 14 августа, назвав его самой сильной open-source моделью для программирования и заявив о 50% улучшении по сравнению с GLM-5.2 на своём внутреннем практическом тесте по кодингу.

Цифра, которая бросается в глаза

Terminal Bench 3.0 растёт с 4.6 до 28.3 — шестикратный скачок по бенчмарку, который проверяет, может ли модель действительно работать в shell на протяжении длительной задачи. Агентная работа в терминале была самым большим разрывом между китайскими open-weight моделями и западными frontier-системами, и Zhipu утверждает, что за один релиз закрыла большую часть этого разрыва.

Остальные показатели

DeepSWE v1.1 растёт до 66.9 с 46.2; Agents' Last Exam — до 28.5 с 23.8; AutomationBench — до 48.2 с 26.2. На Z.ai Code Bench в режиме High модель показывает точность 31.4%, расходуя примерно 50,000 токенов на задачу — показатель затрат, который большинство поставщиков опускают, и его стоит читать вместе с точностью.

Посмотрите на ту же таблицу ещё раз

Собственное сравнение Zhipu показывает, что GLM-5.3 уступает GPT-5.6 Sol и Fable 5 по всем шести опубликованным бенчмаркам — Terminal Bench 28.3 против 34.6 и 33.7. На DeepSWE он также немного отстаёт от Kimi K3 с 67.5. Заявление звучит как «самая сильная open-source», но как минимум по одному из шести собственных бенчмарков это утверждение оспаривается.

Нового прогона pretraining не было

Zhipu говорит, что GLM-5.3 использует ту же базовую модель, что и GLM-5.2, а прирост достигнут исключительно за счёт масштабирования постобучения. Это то же утверждение, которое xAI сделалo для Grok 4.6 двумя днями ранее, и оно указывает на тот же вывод: дорогостоящая часть жизни модели всё чаще происходит уже после завершения pretraining.

Что пока нельзя проверить

Все приведённые цифры — это собственные данные компании, а веса не опубликованы. Zhipu говорит, что они появятся примерно через две недели, после оценки безопасности и hardening, а доступ к API последует вскоре после этого; в организации компании на Hugging Face по-прежнему указан GLM-5.2 как последний релиз. Пока веса не опубликованы, заявление о «самой сильной open-source модели для кодинга» — это утверждение о модели, которую никто вне Zhipu не может запустить.