Z.AI (Zhipu) · 2026-06-16
от тарифа «Плюс»
GLM-5.2
Флагман GLM: MoE ~744B / 40B активных, устойчивый 1M контекст — длинный код на Плюс
GLM-5.2 — флагман Z.AI (Zhipu) для длинных многошаговых задач: смесь экспертов (~744B, около 40B активных), устойчивый контекст 1M, ответ до 128K. Заточена под код и работу «от ТЗ до реализации» — глубже и стабильнее Flash. В GPThub — только текст, с тарифа Плюс.
В GPThub — с тарифа «Плюс» и выше.
Картинки
Нет
Только текст
Тариф
Плюс+
С тарифа «Плюс» и выше
Контекст
1M
текст → текст
GLM-5.2
Флагман GLM: MoE ~744B / 40B активных, устойчивый 1M контекст — длинный код на Плюс
Когда выбирать
- Крупный код и рефакторинг — Многофайловый контекст, миграции, архитектурный разбор, длинные агентные планы.
- От ТЗ до каркаса продукта — Собрать структуру сервиса, API, критерии приёмки и пошаговый план внедрения.
- Аналитика и регламенты — Длинные инструкции, сравнение вариантов, регламент, исследовательские выжимки.
- Когда Flash уже мало — Сложный рассуждения, связный длинный ответ, «дотащить» задачу от начала до конца на Плюс.
Честно о границах
- Нет поддержки картинок — только текст
- На Про Claude / Grok 4.5 / Terra могут быть сильнее или удобнее под задачу (и с картинками)
- 1M контекст + длинный вывод быстро тратят пакет токенов Плюс — держите объём задачи
- Как у любой LLM: проверяйте код, зависимости и «галочку done» сами
Характеристики
- Серия
- GLM-5.2 (флагман)
- Параметры
- ~744B всего · ~40B активных (MoE 744B-A40B)
- Контекст
- 1M токенов (устойчивый 1M, документация Z.AI)
- Макс. ответ
- до 128K токенов
- Модальности
- текст → текст
- Релиз
- 16 июня 2026
- В GPThub
- тариф «Плюс» и выше
Как это выглядит в чате
Примеры диалогов — иллюстрация сценариев, не запись реальных сессий. Формулировки упрощают задачу; в чате можно уточнять и прикладывать файлы.
GLM 5.2
GLM 5.2
Что это за модель
16 июня 2026 Z.AI представила GLM-5.2 как latest флагман после GLM-5 / 5.1: упор на «реально рабочий» 1M контекст и длинный код, а не просто увеличение окна. В docs — text→text, 1M контекст, макс. ответ 128K; позиционирование — full development сценарий от требований до готовые к выкладке артефактов.
Архитектура 744B-A40B (в карточках HF/GitHub — 744B всего / 40B активных MoE): ёмкость огромной модели при активных-вычисления ближе к 40B-классу. Для GPThub это «тяжёлый» GLM на Плюс рядом с быстрым Flash 4.7 — когда нужны длинный репозиторий-контекст, многошаговые refactor и агентный стиль планы.
1M контекст и код agent
По сравнению с ~200K у GLM-5.1 / Flash-ветки серии 4.7, 1M у 5.2 рассчитан на масштаб проекта: большие кодовые базы, длинные логи, многофайловые патчи, сессии «задача → исследование → правка → проверка». Z.AI отдельно подчёркивает стабильность на сверхдлинный контекст (не только «принять токены»).
На публичных код-сигналах (Terminal-Bench 2.1 ~81.0, SWE-bench Pro ~62.1, длинные многошаговые наборы вроде FrontierSWE / SWE-Marathon) модель держится среди топ открытых моделей и близко к закрытым лидерам. В чате GPThub это значит: длинные ТЗ, архитектурные разборы, пошаговые планы-агенты — зона 5.2; быстрые мелкие фиксы можно оставить Flash.
Когда брать 5.2, а когда другую
5.2 — если Flash «не дотягивает»: сложный код, длинный контекст, многошаговые рассуждения, связная аналитика на русском. Luna / Grok 4.3 — если нужны картинки или другой стиль на том же Плюс. Claude Sonnet 5, Grok 4.5, Terra — на Про, когда нужен другой топовый-профиль или картинки + топ-модель.
Только текст: скриншоты UI, фото, PDF-как-картинка — не зона GLM-5.2. Для изображений переключитесь на модель тарифа.
Сильные стороны
- Устойчивый 1M контекст — масштаб проекта код, длинные ТЗ и многофайловый сессии
- MoE ~40B активных: ёмкость «744B-класса» при умеренном активных-вычисления
- Длинные многошаговые код / agent: от требований до связанной реализации
- Сильнее GLM-4.7-Flash на сложных и длинных задачах
- Публичные код-бенчмарки — топ открытых моделей, близко к закрытым лидерам (Z.AI)
Ограничения
Честно о границах — чтобы выбрать модель под задачу
- Нет поддержки картинок — только текст
- На Про Claude / Grok 4.5 / Terra могут быть сильнее или удобнее под задачу (и с картинками)
- 1M контекст + длинный вывод быстро тратят пакет токенов Плюс — держите объём задачи
- Как у любой LLM: проверяйте код, зависимости и «галочку done» сами
Для каких задач
Крупный код и рефакторинг
Многофайловый контекст, миграции, архитектурный разбор, длинные агентные планы.
От ТЗ до каркаса продукта
Собрать структуру сервиса, API, критерии приёмки и пошаговый план внедрения.
Аналитика и регламенты
Длинные инструкции, сравнение вариантов, регламент, исследовательские выжимки.
Когда Flash уже мало
Сложный рассуждения, связный длинный ответ, «дотащить» задачу от начала до конца на Плюс.
Как пользоваться в GPThub
- 01В чате GPThub выберите GLM 5.2 (тариф «Плюс» и выше).
- 02Для кода: цель + ограничения + ключевые файлы; просите план → diff → тесты, а не «просто почини».
- 03Для 1M-контекста: сначала оглавление/цель, потом тело — модель лучше держит задачу.
- 04Мелкие быстрые правки — GLM-4.7-Flash. Картинки — Luna/Grok. Топовый на Про — Claude / Grok 4.5 / Terra.
Источники
Материалы о возможностях модели (релизы, обзоры, бенчмарки). Тарифы и доступ — только в GPThub.
Частые вопросы
Чем 5.2 отличается от GLM-4.7-Flash?
Flash — лёгкий MoE ~30B/3B активных, 200K, ежедневный код. 5.2 — флагман ~744B/40B активных, устойчивый 1M, длинные и сложные задачи. Обе только текст на Плюс.
Правда ли контекст 1M?
Да, Z.AI заявляет устойчивый контекст 1M и макс. ответ до 128K. Пакет токенов тарифа GPThub по-прежнему ограничивает суммарный расход.
С какого тарифа?
С Плюс. На госте и бесплатный GLM нет — там DeepSeek V4 Flash и GPT-5 Nano.
Есть ли картинки?
Нет. Для скринов и фото выберите модель на вашем тарифе (например Luna или Grok 4.3 на Плюс).
Похожие модели
Запустить GLM 5.2 в чате
Доступ из России без VPN. Нужен тариф «Плюс» или выше.