НовостиАкцииZ.ai выпустила GLM-5.3, назвав её ведущей открытой моделью для программирования

Z.ai выпустила GLM-5.3, назвав её ведущей открытой моделью для программирования

Автор: Decrypt·

Ключевые выводы

  • GLM-5.3 — модель с 743 млрд параметров от пекинской компании Z.ai, созданная путём масштабирования пост-тренинга на базе GLM-5.2, а не путём построения новой архитектуры.
  • Модель набрала 34,5% на внутреннем бенчмарке программирования Z.ai, используя около 75 000 выходных токенов на задачу, тогда как GLM-5.2 показала 23,4% при 96 000 токенов.
  • GLM-5.3 возглавила бенчмарк эксплуатации CyberGym с результатом 84,5% и, по данным Z.ai, выявила 2 436 уязвимостей в 269 проектах с открытым кодом, включая 1 097 проблем средней и высокой степени серьёзности.
  • Веса модели и доступ к API ожидаются примерно через две недели после запуска по итогам проверок безопасности, поэтому статус открытой модели относится к будущему релизу, а не к тому, что доступно для скачивания сегодня.
  • Все сравнения по бенчмаркам взяты из собственной публикации Z.ai о запуске, а закрытые американские модели, такие как Claude Fable 5 и GPT-5.6 Sol, по-прежнему опережают GLM-5.3 на Terminal Bench 3.0 и DeepSWE v1.1.
Z.ai выпустила GLM-5.3, назвав её ведущей открытой моделью для программирования

Китайская лаборатория искусственного интеллекта Z.ai в четверг выпустила GLM-5.3 через сервис GLM Coding Plan и платформу ZCode.

Компания описывает модель как «самую способную открытую модель для программирования». GLM-5.3 — это модель с 743 млрд параметров, созданная путём масштабирования пост-тренинга на базе GLM-5.2. «Открытые веса» означают, что лаборатория публикует файлы обученной модели, поэтому разработчики могут скачать их и запускать на собственном оборудовании, в отличие от закрытых моделей, таких как Claude от Anthropic или серия GPT от OpenAI, доступных только через API вендора.

Z.ai сообщила, что модель уже доступна по подписке GLM Coding Plan и в ZCode, а доступ к API и загружаемые веса появятся после проверки безопасности.

«Для GLM-5.3 мы сделали только одно — масштабировали пост-тренинг», — написала компания в публикации, посвящённой запуску. «С GLM-5.2 мы построили стек... За последний месяц мы продолжали масштабировать его: больше окружений, более разнообразные задачи и больше вычислений, потраченных на их обучение».

Команда заявила, что приоритетом была эффективность по токенам, а не абсолютное превосходство в «сырых» показателях. GLM-5.3 насчитывает 743 млрд параметров и использует заметно меньше токенов на задачу, чем предшественница. Параметры — это количество переменных, которыми оперирует модель при обработке информации, а токены — базовые единицы информации, которые модель может потреблять и генерировать. Токен-экономика имеет и прямое коммерческое значение: поскольку оплата API начисляется за токены, чем меньше выходных токенов тратится на задачу, тем ниже стоимость использования модели.

По словам Z.ai, GLM-5.3 набирает 34,5% на внутреннем бенчмарке Z.ai Code Bench в режиме Max effort, используя около 75 000 выходных токенов на задачу, тогда как GLM-5.2 показала 23,4% при 96 000 токенов. На фоне закрытых моделей в блоге отмечается, что новинка превосходит Claude Opus 4.8 по токен-экономике, но «остаётся позади Claude Fable 5, которая достигает 39,5% в режиме Max effort». Эти сравнения взяты из собственной публикации Z.ai о запуске, поэтому это данные производителя, а не результаты независимой оценки.

На бенчмарках программирования GLM-5.3 выступает очень хорошо и превосходит также китайскую модель Kimi K3 на наиболее релевантных тестах.

На Terminal Bench 3.0, тесте автономной работы с шеллом и инструментами в реальных окружениях Linux, GLM-5.3 набрала 28,3 балла, немного уступив закрытым моделям Fable 5 (33,7) и GPT-5.6 Sol (34,6). На DeepSWE v1.1, бенчмарке, предполагающем сквозное исправление реальных проблем из GitHub, открытый конкурент Kimi K3 набрал 67,5 балла, Fable 5 — 69,7; обе модели опередили GLM-5.3 с её результатом 66,9.

В совокупности эти результаты показывают, что GLM-5.3 опережает предшественницу и ряд открытых конкурентов, однако закрытые американские модели по-прежнему лидируют на основных бенчмарках программирования.

Результаты в области кибербезопасности продемонстрировали ещё один заметный шаг вперёд. GLM-5.3 возглавила CyberGym, бенчмарк, оценивающий модели на реальных задачах по эксплуатации уязвимостей ПО, с результатом 84,5% и более чем вдвое превысила показатели GLM-5.2 на бенчмарках эксплуатации. По данным Z.ai, модель выявила 2 436 уязвимостей в 269 проектах с открытым кодом, включая 1 097 проблем средней и высокой степени серьёзности.

«GLM-5.3 выводит агентное программирование на новый уровень, обеспечивая резкий прогресс по сравнению с GLM-5.2 и достигая лучших результатов при меньшем числе выходных токенов», — написала Z.ai в X. «GLM-5.3 уже доступна через GLM Coding Plan и ZCode. Доступ к API и открытым весам будет открываться поэтапно после строгих проверок безопасности».

"GLM-5.3 takes agentic coding to the next level, delivering a dramatic improvement over GLM-5.2 while achieving better results with fewer output tokens. pic.twitter.com/KGc6ZR7GHv — Z.ai (@Zai_org) August 14, 2026"

В плане цен Z.ai позиционирует модель как более дешёвую альтернативу американским фронтальным системам. В GLM Coding Plan действует квота баллов (в непиковые часы вызовы стоят вдвое дешевле), а API Zhipu стоит примерно десятую часть американских фронтальных тарифов за токены. Официальные тарифы GLM-5.2 составляли $1.40 за входные и $4.40 за выходные токены на миллион. Для сравнения: GPT-5.3-Codex — $1.75 и $14 соответственно, а Claude Opus 4.8 находится у верхней границы ценовых уровней Anthropic.

Z.ai — пекинская лаборатория, внесённая в американский Entity List, что означает запрет для американских компаний на экспорт контролируемых технологий в её адрес. Z.ai — бренд компании Zhipu AI, основанной в 2019 году как ответвление исследований Университета Цинхуа и включённой Министерством торговли США в Entity List в январе 2025 года. Тем не менее GLM остаётся широко используемой моделью, а китайские открытые модели уже опережают американские по объёму использования токенов на OpenRouter; OpenRouter — агрегатор API, который маршрутизирует запросы между множеством моделей и публикует доли использования по моделям.

Согласно публикации о запуске, веса GLM-5.3 должны быть открыто опубликованы примерно через две недели. Таким образом, статус открытой модели относится к будущему релизу, а не к тому, что доступно для скачивания сегодня. Когда веса и доступ к API появятся, сторонние разработчики смогут запускать модель на собственной инфраструктуре и напрямую проверять заявленные компанией результаты бенчмарков.