К содержанию
Выпуск №71 · 18 августа 2026 / Новости

GLM-5.3 опередила Mythos 5 и GPT-5.6 Sol на CyberGym, но уступила им на ExploitBench

Как сообщает InfoWorld, китайский разработчик Zhipu выпустил модель GLM-5.3, ориентированную на программирование.

Редакция 17 августа 2026 г., 00:06 MSK

В Telegram

Как сообщает InfoWorld, китайский разработчик Zhipu выпустил модель GLM-5.3, ориентированную на программирование. Компания утверждает, что во время дополнительного обучения ее возможности в области кибербезопасности росли быстрее, чем ожидалось.

Во внутренних тестах Zhipu модель показала результат 84,5% на CyberGym, который предназначен для выявления и проверки уязвимостей. Mythos 5 от Anthropic набрала 83,8%, а GPT-5.6 Sol от OpenAI получила 83,6%. На ExploitBench картина оказалась другой: результат GLM-5.3 составил 54,4%, Mythos 5 получила 78%, GPT-5.6 Sol набрала 76,5%.

Zhipu также назвала GLM-5.3 своей самой производительной моделью с открытыми весами для программирования. Во внутреннем тесте Z.ai Code Bench она на 50% превзошла GLM-5.2. По словам компании, теперь модель не ограничивается поиском отдельных уязвимостей и способна составлять последовательные планы полных цепочек эксплуатации.

Ключевые факты

  • На CyberGym модель GLM-5.3 набрала 84,5%, Mythos 5, 83,8%, а GPT-5.6 Sol, 83,6%.

  • На ExploitBench результат GLM-5.3 составил 54,4% против 78% у Mythos 5 и 76,5% у GPT-5.6 Sol.

  • По данным Zhipu, GLM-5.3 превзошла GLM-5.2 на 50% во внутреннем тесте Z.ai Code Bench.

Вопросы и ответы

Что изменилось по сравнению с GLM-5.2?

GLM-5.3 превзошла предыдущую версию на 50% во внутреннем тесте Z.ai Code Bench и стала самой производительной моделью Zhipu с открытыми весами для программирования.

Для каких задач кибербезопасности модель выглядит сильнее, а для каких слабее?

GLM-5.3 лидирует в выявлении и проверке уязвимостей на CyberGym с 84,5%, но заметно уступает в эксплуатации на ExploitBench: 54,4% против 78% у Mythos 5 и 76,5% у GPT-5.6 Sol.

Что модель теперь умеет делать на практике помимо поиска отдельных уязвимостей?

Zhipu заявляет, что GLM-5.3 способна формировать последовательные планы полных цепочек эксплуатации, а не только обнаруживать отдельные уязвимости.

Контекст по теме

Как процитировать

«GLM-5.3 опередила Mythos 5 и GPT-5.6 Sol на CyberGym, но уступила им на ExploitBench». hegai.media, 17 августа 2026 г.. https://hegai.media/novosti/glm-5-3-operedila-mythos-5-i-gpt-5-6-sol-na-cybergym-no-ustupila-im-na--e17ade4b-7ad0-4941-b4ac-5273c90d912a

так материал выглядит в мессенджере