Z.AI (Zhipu) · 2026-01-20
от тарифа «Плюс»
GLM-4.7-Flash
Лёгкий MoE GLM: ~30B / 3B активных, контекст 200K — код и тексты на Плюс
GLM-4.7-Flash — лёгкая модель серии GLM-4.7 от Z.AI (Zhipu): смесь экспертов (~30B, около 3B активных), контекст 200K, ответ до 128K. Только текст. В GPThub — с тарифа Плюс: быстрый код, инструкции и тексты на русском и английском.
В GPThub — с тарифа «Плюс» и выше.
Картинки
Нет
Только текст
Тариф
Плюс+
С тарифа «Плюс» и выше
Контекст
200K
текст → текст
GLM-4.7-Flash
Лёгкий MoE GLM: ~30B / 3B активных, контекст 200K — код и тексты на Плюс
Когда выбирать
- Код «на каждый день» — Фиксы, небольшие фичи, объяснение чужого кода, чек-листы перед релизом — быстрый цикл без Про.
- Фронтенд / бэкенд каркасы — Структура компонента, API-хендлер, схема миграции: «собери каркас + зависимости».
- RU-тексты и перевод — Инструкции, FAQ, деловые письма, EN↔RU — GLM хорошо держит естественный тон.
- Длинные текстовые вводные — ТЗ, переписки, логи: 200K контекст позволяет держать больше материала в одном запросе.
Честно о границах
- Нет поддержки картинок: скрины UI, фото, PDF-как-картинка — не её зона
- GLM 5.2, Luna, Grok 4.3/4.5, Claude, Terra в GPThub часто сильнее на топовых задачах
- Как у любой LLM: проверяйте код и факты; Flash не заменяет ревью уровня senior
- Длинный контекст + большой вывод быстро тратят пакет токенов Плюс
Характеристики
- Серия
- GLM-4.7 (Flash)
- Параметры
- ~30–31B всего · ~3B активных (MoE 30B-A3B)
- Контекст
- 200K токенов (документация Z.AI)
- Макс. ответ
- до 128K токенов
- Модальности
- текст → текст
- Релиз Flash
- ≈ 20 января 2026
- В GPThub
- тариф «Плюс» и выше
Как это выглядит в чате
Примеры диалогов — иллюстрация сценариев, не запись реальных сессий. Формулировки упрощают задачу; в чате можно уточнять и прикладывать файлы.
GLM 4.7 Flash
GLM 4.7 Flash
Место в семье GLM-4.7
Серия GLM-4.7 усиливает программирование и стабильные многошаговые рассуждения и выполнение: от разбора задачи до связного кода и циклов «как у инструментов». Полный GLM-4.7 — «тяжёлая» ветка; Flash — лёгкий вариант для высокой скорости при сильных результатах в своём размере.
По материалам Z.AI, Flash на публичных наборах вроде SWE-bench Verified и τ²-Bench показывает лучшие результаты среди открытых моделей сопоставимого масштаба и уверенно ведёт себя на фронтенд/бэкенд-задачах. Помимо кода разработчик рекомендует китайские/общие тексты, перевод, длинные тексты и ролевые диалоги — для RU-аудитории GPThub это плюс к «альтернативному голосу» рядом с GPT и Grok.
Архитектура 30B-A3B
Flash — MoE (часто пишут 30B-A3B): разреженная активация держит задержку и вычисления ниже плотной модели того же «номинала», сохраняя ёмкость экспертов. В карточках с открытыми весами встречается тег glm4_moe_lite / Multi-Latent Attention — детали стека вывода, а не кнопка в чате GPThub.
Контекст 200K по документации Z.AI удобен для многофайловых фрагментов, длинных ТЗ и переписок. Пакет токенов тарифа Плюс в GPThub по-прежнему ограничивает суммарный расход — длинное окно ≠ «залейте всё без учёта лимита».
Когда брать Flash, а когда другую модель
Flash — ежедневный код, чек-листы, инструкции, RU/EN черновики, когда нужен быстрый цикл «вопрос → патч/план». GLM 5.2 в том же каталоге — более «тяжёлый» GLM на Плюс для связной аналитики. Grok 4.3 / Luna — если нужны картинки или другой стиль. Claude, Grok 4.5, Terra на Про — топовые модели, когда Flash «упёрся».
Это только текст: скриншоты и фото в GPThub — на Nano, Luna, Grok, Claude и других моделях с картинками вашего тарифа.
Сильные стороны
- MoE ~3B активных — быстрые ответы при ёмкости «30B-класса»
- Упор на код: фронтенд/бэкенд, структурированный код, агентный многошаговый стиль
- Контекст 200K — длинные ТЗ, логи, многофайловые вставки
- Сильные тексты RU/ZH/EN, перевод, инструкции рядом с GPT/Grok
- На SWE-bench / tool-bench в классе размера — сильные публичные сигналы (Z.AI)
Ограничения
Честно о границах — чтобы выбрать модель под задачу
- Нет поддержки картинок: скрины UI, фото, PDF-как-картинка — не её зона
- GLM 5.2, Luna, Grok 4.3/4.5, Claude, Terra в GPThub часто сильнее на топовых задачах
- Как у любой LLM: проверяйте код и факты; Flash не заменяет ревью уровня senior
- Длинный контекст + большой вывод быстро тратят пакет токенов Плюс
Для каких задач
Код «на каждый день»
Фиксы, небольшие фичи, объяснение чужого кода, чек-листы перед релизом — быстрый цикл без Про.
Фронтенд / бэкенд каркасы
Структура компонента, API-хендлер, схема миграции: «собери каркас + зависимости».
RU-тексты и перевод
Инструкции, FAQ, деловые письма, EN↔RU — GLM хорошо держит естественный тон.
Длинные текстовые вводные
ТЗ, переписки, логи: 200K контекст позволяет держать больше материала в одном запросе.
Как пользоваться в GPThub
- 01Откройте чат GPThub → модель GLM 4.7 Flash (нужен тариф Плюс или выше).
- 02Для кода: фрагмент + ожидаемое поведение + стек/версии; просите diff или пошаговый план.
- 03Для длинного контекста: сначала цель и ограничения, потом тело документа.
- 04Нужны картинки — переключитесь на модель тарифа (Luna, Grok 4.3…). Сложнее рассуждения — GLM 5.2, Grok 4.5, Claude, Terra.
Источники
Материалы о возможностях модели (релизы, обзоры, бенчмарки). Тарифы и доступ — только в GPThub.
Частые вопросы
Чем Flash отличается от GLM 5.2 в GPThub?
Flash — лёгкий MoE 4.7 (~3B активных): скорость и код/тексты «на каждый день». GLM 5.2 — более сильная ветка GLM на том же Плюс для сложных связных задач. Обе только текст.
Какой контекст?
В документации Z.AI для GLM-4.7-Flash — 200K токенов, макс. ответ до 128K. Пакет токенов тарифа GPThub ограничивает суммарный расход.
С какого тарифа?
С Плюс. На госте и бесплатный GLM Flash нет — там DeepSeek V4 Flash и GPT-5 Nano.
Есть ли картинки?
Нет. Только текст. Для изображений выберите модель с картинками на вашем тарифе.
Похожие модели
Запустить GLM 4.7 Flash в чате
Доступ из России без VPN. Нужен тариф «Плюс» или выше.