Z.AI (Zhipu) logo

Z.AI (Zhipu) · 2026-06-16

от тарифа «Плюс»

GLM-5.2

Флагман GLM: MoE ~744B / 40B активных, устойчивый 1M контекст — длинный код на «Плюс»

ПлюсMoE1M контекстКодТекст

GLM-5.2 — флагман Z.AI (Zhipu) для длинных многошаговых задач: смесь экспертов (~744B, около 40B активных), устойчивый контекст 1M, ответ до 128K. Заточена под код «от ТЗ до реализации» — глубже и стабильнее Flash. В GPThub — только текст, с тарифа «Плюс».

В GPThub — с тарифа «Плюс» и выше.

Картинки

Нет

Только текст

Тариф

Плюс+

С тарифа «Плюс» и выше

Контекст

1M

текст → текст

Когда выбирать

  • Крупный код и рефакторингМногофайловый контекст, миграции, архитектурный разбор, длинные планы.
  • От ТЗ до каркаса продуктаСтруктура сервиса, API, критерии приёмки, пошаговый план внедрения.
  • Аналитика и регламентыДлинные инструкции, сравнение вариантов, runbook, исследовательские выжимки.
  • Когда Flash уже малоСложные рассуждения, связный длинный ответ, «дотащить» задачу до конца на «Плюс».

Честно о границах

  • Нет картинок — только текст
  • На «Про» Claude / Grok 4.5 / Terra могут быть сильнее или удобнее (и с картинками)
  • 1M контекст + длинный вывод быстро тратят пакет токенов «Плюс»
  • Как у любой нейросети: проверяйте код, зависимости и «галочку готово» сами

Характеристики

Серия
GLM-5.2 (флагман)
Параметры
~744B всего · ~40B активных (MoE 744B-A40B)
Контекст
1M токенов (документация Z.AI)
Макс. ответ
до 128K токенов
Модальности
текст → текст
Релиз
16 июня 2026
В GPThub
тариф «Плюс» и выше

Как это выглядит в чате

Примеры диалогов — иллюстрация сценариев, не запись реальных сессий. Формулировки упрощают задачу; в чате можно уточнять и прикладывать файлы.

Z.AI (Zhipu) logoПример · GLM 5.2
Архитектура сервиса
Нужен backend для биллинга подписок: сущности, API, идемпотентность вебхуков, риски. Дай ADR + скелет.

GLM 5.2

Контекст: … Сущности: Subscription, Invoice… API: … Вебхуки: at-least-once + ключ идемпотентности… Риски: … ADR: решение / альтернативы / последствия…
Z.AI (Zhipu) logoПример · GLM 5.2
Длинный рефакторинг
Ниже 8 файлов legacy-модуля. Разбей на 3 PR: безопасный порядок, риски, что не трогать.

GLM 5.2

PR1 (безопасно): … PR2: … PR3: … Не трогать: … Риски регрессии: … Чек-лист после merge: …

Что это за модель

16 июня 2026 Z.AI представила GLM-5.2 как актуальный флагман после GLM-5 / 5.1: упор на реально рабочий контекст 1M и длинный код, а не просто «большое окно». В документации — текст→текст, 1M контекст, макс. ответ 128K.

Архитектура 744B-A40B: ёмкость огромной модели при активных вычислениях ближе к 40B-классу. В GPThub это «тяжёлый» GLM на «Плюс» рядом с быстрым Flash 4.7.

Контекст 1M и код

По сравнению с ~200K у Flash-ветки, 1M у 5.2 рассчитан на крупные репозитории, длинные логи, многофайловые патчи и сессии «задача → исследование → правка → проверка».

На публичных coding-бенчмарках модель держится среди топа открытых моделей и близко к закрытым лидерам. В чате GPThub: длинные ТЗ, архитектурные разборы, пошаговые планы — зона 5.2; быстрые мелкие фиксы можно оставить Flash.

Когда брать 5.2, а когда другую

5.2 — если Flash «не дотягивает»: сложный код, длинный контекст, многошаговые рассуждения, связная аналитика на русском. Luna / Grok 4.3 — если нужны картинки. Claude, Grok 4.5, Terra — на «Про», когда нужен другой топовый профиль.

Только текст. Для скринов и фото переключитесь на модель с картинками.

Сильные стороны

  • Устойчивый 1M контекст — код масштаба проекта, длинные ТЗ, многофайловые сессии
  • MoE ~40B активных: ёмкость «744B-класса» при умеренных активных вычислениях
  • Длинный код и агентные планы: от требований до связанной реализации
  • Сильнее GLM-4.7-Flash на сложных и длинных задачах
  • Сильные публичные сигналы по коду среди открытых моделей (Z.AI)

Ограничения

Честно о границах — чтобы выбрать модель под задачу

  • Нет картинок — только текст
  • На «Про» Claude / Grok 4.5 / Terra могут быть сильнее или удобнее (и с картинками)
  • 1M контекст + длинный вывод быстро тратят пакет токенов «Плюс»
  • Как у любой нейросети: проверяйте код, зависимости и «галочку готово» сами

Для каких задач

Крупный код и рефакторинг

Многофайловый контекст, миграции, архитектурный разбор, длинные планы.

От ТЗ до каркаса продукта

Структура сервиса, API, критерии приёмки, пошаговый план внедрения.

Аналитика и регламенты

Длинные инструкции, сравнение вариантов, runbook, исследовательские выжимки.

Когда Flash уже мало

Сложные рассуждения, связный длинный ответ, «дотащить» задачу до конца на «Плюс».

Как пользоваться в GPThub

  1. 01В чате GPThub выберите GLM 5.2 (тариф «Плюс»+).
  2. 02Для кода: цель + ограничения + ключевые файлы; просите план → патч → тесты.
  3. 03Для 1M-контекста: сначала оглавление/цель, потом тело.
  4. 04Мелкие быстрые правки — GLM-4.7-Flash. Картинки — Luna/Grok. Топ на «Про» — Claude / Grok 4.5 / Terra.

Источники

Материалы о возможностях модели (релизы, обзоры, бенчмарки). Тарифы и доступ — только в GPThub.

Частые вопросы

Чем 5.2 отличается от GLM-4.7-Flash?

Flash — лёгкий MoE ~30B/3B активных, 200K, ежедневный код. 5.2 — флагман ~744B/40B активных, устойчивый 1M, длинные и сложные задачи. Обе только текст на «Плюс».

Правда ли контекст 1M?

Да, Z.AI заявляет устойчивый контекст 1M и макс. ответ до 128K. Пакет токенов тарифа GPThub ограничивает суммарный расход.

С какого тарифа?

С «Плюс». На госте и бесплатном GLM нет.

Есть ли картинки?

Нет. Для скринов и фото выберите модель с картинками (например Luna или Grok 4.3 на «Плюс»).

Похожие модели

Запустить GLM 5.2 в чате

Доступ из России без VPN. Нужен тариф «Плюс» или выше.