Новости криптомира

14.08.2026
07:47

Z.ai представила GLM-5.3: прорыв в программировании и кибербезопасности

Китайский стартап Z.ai выпустил обновленную языковую модель GLM-5.3, которая знаменует собой значительный шаг вперед в области программирования, агентных сценариев и поиска уязвимостей. В отличие от предыдущих итераций, прирост производительности здесь достигнут исключительно за счет посттренировки, без изменения базовой архитектуры. Это интригующий подход, который демонстрирует, что потенциал существующих моделей еще далеко не исчерпан.

На внутреннем бенчмарке Code Bench, предназначенном для оценки навыков кодинга, GLM-5.3 показала улучшение на 50% по сравнению с предшественницей. Однако наиболее впечатляющие результаты видны в специализированных тестах. Например, в Terminal Bench 3.0 новая модель набрала 28,3 балла против жалких 4,6 у GLM-5.2. В DeepSWE v1.1 прогресс составил 66,9 против 46,2, а в Agents' Last Exam — 28,5 против 23,8.

Особого внимания заслуживают показатели в области безопасности. В тесте CyberGym модель достигла 84,5% успеха, а в ExploitBench — 54,4%, что более чем вдвое превышает результат предыдущей версии (24,4%). В рамках двухчасового бюджета GLM-5.3 закрыла 105 задач, тогда как GLM-5.2 справлялась лишь с 29. При увеличении бюджета до шести часов разрыв сохраняется: 130 против 39 задач соответственно.

Реальные испытания и публичный реестр

Z.ai также провела тестирование на реальных кодовых базах совместно с несколькими китайскими командами по безопасности. После проверки и дедупликации система выявила 2436 уязвимостей в 269 проектах, включая 1097 проблем средней и высокой критичности. Публично раскрыты лишь 53 находки, остальные 2383 остаются под эмбарго. Примечательно, что средний «срок жизни» таких уязвимостей оценен в 26,6 года, а самая старая из обнаруженных датируется 1981 годом.

Для прозрачности компания запустила Z.ai Security Disclosure Ledger — публичный реестр, где фиксируются статус, затронутые проекты и уровень критичности. Параллельно GLM-5.3 уже развернута для подписчиков GLM Coding Plan, став основным движком для агентного программирования и длительных задач. Запросы к старым моделям автоматически маршрутизируются на новую версию.

Открытые веса модели станут доступны через две недели после оценки безопасности и дополнительного харденинга. Это разумный подход, учитывая чувствительность инструмента.

Мой взгляд: GLM-5.3 — это не просто эволюционное обновление, а серьезная заявка на лидерство в области ИИ-агентов для кибербезопасности. Однако напомню, что в июле Anthropic обвиняла Z.ai в несанкционированной дистилляции GLM-5.2 на ответах Claude и GPT. Учитывая столь резкий скачок в ExploitBench, стоит внимательно следить за дальнейшими разбирательствами, хотя доказательств нарушений пока нет.