Z.ai выпустила GLM-5.3 — модель на той же базовой архитектуре, что и GLM-5.2. Все улучшения получены за счет дополнительного обучения: компания увеличила число тренировочных сред, разнообразие задач и объем вычислений.
По данным Z.ai, результат GLM-5.3 в собственном тесте Z.ai Code Bench вырос на 50%. В Terminal Bench 3.0 показатель увеличился с 4,6 до 28,3, а в DeepSWE v1.1 — с 46,2 до 66,9.
В задачах кибербезопасности GLM-5.3 набрала 84,5% в CyberGym и 54,4% в ExploitBench против 24,4% у GLM-5.2. В ExploitGym модель выполнила 105 задач за 2 часа и 130 за 6 часов.
Z.ai также сообщила о 2 436 найденных уязвимостях в 269 проектах с открытым исходным кодом. Из них 1 097 имеют критическую или высокую степень опасности. Открытые веса модели планируют опубликовать через две недели после проверки безопасности.