TL;DR — кратко
- GLM 5.3 вышла 14 августа 2026 года — Zhipu называет её самой сильной открытой моделью для кода
- 753 млрд параметров, окно на 1 млн токенов, ответ до 128 тысяч токенов
- GLM 5.3 Flash и FlashX — первые мультимодальные модели серии: видят картинки и видео
- FlashX — ускоренный Flash, до 200 токенов в секунду, в API с 18 сентября
GLM — семейство нейросетей китайской компании Zhipu AI, которая за рубежом работает под брендом Z.ai. В 2026 году GLM стала одной из самых популярных открытых моделей для программирования: «glm 5.3» ищут почти 14 тысяч раз в месяц. Разбираемся, чем отличаются три версии.
Не путайте с газонокосилками Huter GLM — в поиске их много, но к нейросетям они отношения не имеют.
GLM 5.3 — флагман для кода
- Дата выхода: 14 августа 2026 года, сначала в GLM Coding Plan.
- Размер: 753 млрд параметров.
- Окно контекста: 1 млн токенов, ответ — до 128 тысяч.
- Модальность: только текст.
- Рассуждение: всегда включено; глубина — low, high или max (по умолчанию max).
Интересная деталь: база у GLM 5.3 та же, что у GLM 5.2, — весь прирост получен дообучением. И прирост большой: в тесте DeepSWE v1.1 результат вырос с 46,2 до 66,9. Среди других результатов по данным Z.ai — Terminal Bench 2.1: 88,2, HLE с инструментами: 62,5.
Модель работает с популярными инструментами для программистов: ZCode, Claude Code, OpenCode.
Веса открыты на Hugging Face под собственной лицензией glm-5.3. Это не полностью свободная лицензия: компаниям с выручкой от продажи доступа к моделям больше $10 млрд в год нужна проверка безопасности от Z.ai. Для всех остальных ограничений практически нет.
GLM 5.3 Flash — видит картинки и видео
Первая нативно мультимодальная модель серии GLM-5: принимает текст, изображения, видео и файлы, отвечает текстом.
- 320 млрд параметров, из них при ответе работают 18 млрд — поэтому модель быстрая;
- окно на 1 млн токенов, ответ до 128 тысяч;
- рассуждение всегда включено;
- DeepSWE v1.1 — 63,4, индекс Artificial Analysis — 57;
- веса открыты под лицензией MIT — полностью свободной.
GLM 5.3 FlashX — самый быстрый GLM
FlashX — это не отдельная модель, а ускоренный режим обслуживания GLM 5.3 Flash: те же веса, но меньше задержка и скорость до 200 токенов в секунду. В API Z.ai FlashX появился 18 сентября 2026 года.
Когда брать: чат-боты и сервисы, где важен мгновенный ответ, — поддержка клиентов, подсказки в интерфейсе, потоковая обработка.
Сравнение GLM 5.3, Flash и FlashX
| GLM 5.3 | GLM 5.3 Flash | GLM 5.3 FlashX | |
|---|---|---|---|
| Для чего | код, сложные рассуждения | быстрые задачи с картинками | мгновенные ответы |
| Картинки и видео | нет | да | да |
| Окно | 1 млн токенов | 1 млн токенов | 1 млн токенов |
| Цена API Z.ai (вход / выход за 1 млн) | $1,40 / $4,40 | $0,15 / $0,50 | $0,37 / $1,25 |
| Веса | открыты, лицензия glm-5.3 | открыты, MIT | — (режим Flash) |
Как пользоваться GLM 5.3 бесплатно и на русском
GLM нормально понимает русский язык. Официальный сервис Z.ai рассчитан на зарубежных пользователей; сведений о работе из России в официальных источниках нет, а API оплачивается зарубежной картой.
В LeanTech модели GLM 5.3 уже подключены:
- Зарегистрируйтесь в LeanTech — без VPN.
- GLM 5.3 и GLM 5.3 Flash доступны бесплатно.
- GLM 5.3 FlashX открывается на тарифе Light.
