Z.AI (Zhipu) · 2026-01-20
от тарифа «Плюс»
GLM-4.7-Flash
Лёгкий GLM MoE: ~30B / 3B активных, контекст 200K — код и тексты на «Плюс»
GLM-4.7-Flash — лёгкая модель серии GLM-4.7 от Z.AI (Zhipu): смесь экспертов (~30–31 млрд параметров, около 3 млрд активных), контекст 200K, ответ до 128K. Только текст. В GPThub — с тарифа «Плюс»: быстрый код, инструкции и тексты на русском и английском.
В GPThub — с тарифа «Плюс» и выше.
Картинки
Нет
Только текст
Тариф
Плюс+
С тарифа «Плюс» и выше
Контекст
200K
текст → текст
GLM-4.7-Flash
Лёгкий GLM MoE: ~30B / 3B активных, контекст 200K — код и тексты на «Плюс»
Когда выбирать
- Код «на каждый день» — Фиксы, небольшие фичи, объяснение чужого кода, чек-листы перед релизом.
- Фронтенд / бэкенд каркасы — Структура компонента, API-обработчик, схема миграции.
- Русские тексты и перевод — Инструкции, FAQ, деловые письма, EN↔RU.
- Длинные текстовые вводные — ТЗ, переписки, логи в одном запросе (200K).
Честно о границах
- Нет картинок: скрины, фото, PDF-как-изображение — не её зона
- GLM 5.2, Luna, Grok, Claude, Terra в GPThub часто сильнее на топовых задачах
- Как у любой нейросети: проверяйте код и факты; Flash не заменяет ревью senior
- Длинный контекст + большой вывод быстро тратят пакет токенов «Плюс»
Характеристики
- Серия
- GLM-4.7 (Flash)
- Параметры
- ~30–31B всего · ~3B активных (MoE 30B-A3B)
- Контекст
- 200K токенов (документация Z.AI)
- Макс. ответ
- до 128K токенов
- Модальности
- текст → текст
- Релиз Flash
- ≈ 20 января 2026
- В GPThub
- тариф «Плюс» и выше
Как это выглядит в чате
Примеры диалогов — иллюстрация сценариев, не запись реальных сессий. Формулировки упрощают задачу; в чате можно уточнять и прикладывать файлы.
GLM 4.7 Flash
GLM 4.7 Flash
Место в семье GLM-4.7
Серия GLM-4.7 усиливает программирование и стабильные многошаговые рассуждения: от разбора задачи до связного кода. Полный GLM-4.7 — «тяжёлая» ветка; Flash — лёгкий вариант для высокой скорости при сильных результатах в своём размере.
По материалам Z.AI, Flash на публичных наборах (SWE-bench Verified, τ²-Bench) показывает сильные результаты среди моделей сопоставимого масштаба и уверенно ведёт себя на фронтенде и бэкенде. Помимо кода разработчик рекомендует тексты, перевод и длинные материалы — удобно как «другой голос» рядом с GPT и Grok.
Архитектура 30B-A3B
Flash — MoE (часто пишут 30B-A3B): разреженная активация держит задержку и вычисления ниже, чем у плотной модели того же номинала.
Контекст 200K по документации Z.AI удобен для многофайловых фрагментов, длинных ТЗ и переписок. Пакет токенов тарифа «Плюс» по-прежнему ограничивает суммарный расход.
Когда брать Flash, а когда другую модель
Flash — ежедневный код, чек-листы, инструкции, черновики RU/EN, когда нужен быстрый цикл «вопрос → патч/план». GLM 5.2 — более сильный GLM на том же «Плюс». Grok 4.3 / Luna — если нужны картинки. Claude, Grok 4.5, Terra на «Про» — когда Flash «упёрся».
Только текст: скриншоты и фото — на Nano, Luna, Grok, Claude и других моделях с картинками вашего тарифа.
Сильные стороны
- MoE ~3B активных — быстрые ответы при ёмкости «30B-класса»
- Упор на код: фронтенд/бэкенд, структурированный код, многошаговые планы
- Контекст 200K — длинные ТЗ, логи, многофайловые вставки
- Сильные тексты RU/ZH/EN, перевод, инструкции рядом с GPT/Grok
- Сильные публичные сигналы на бенчмарках по коду в своём размере (Z.AI)
Ограничения
Честно о границах — чтобы выбрать модель под задачу
- Нет картинок: скрины, фото, PDF-как-изображение — не её зона
- GLM 5.2, Luna, Grok, Claude, Terra в GPThub часто сильнее на топовых задачах
- Как у любой нейросети: проверяйте код и факты; Flash не заменяет ревью senior
- Длинный контекст + большой вывод быстро тратят пакет токенов «Плюс»
Для каких задач
Код «на каждый день»
Фиксы, небольшие фичи, объяснение чужого кода, чек-листы перед релизом.
Фронтенд / бэкенд каркасы
Структура компонента, API-обработчик, схема миграции.
Русские тексты и перевод
Инструкции, FAQ, деловые письма, EN↔RU.
Длинные текстовые вводные
ТЗ, переписки, логи в одном запросе (200K).
Как пользоваться в GPThub
- 01Откройте чат GPThub → модель GLM 4.7 Flash (нужен «Плюс»+).
- 02Для кода: фрагмент + ожидаемое поведение + стек; просите патч или пошаговый план.
- 03Для длинного контекста: сначала цель и ограничения, потом тело документа.
- 04Нужны картинки — Luna/Grok 4.3. Сложнее рассуждения — GLM 5.2, Grok 4.5, Claude, Terra.
Источники
Материалы о возможностях модели (релизы, обзоры, бенчмарки). Тарифы и доступ — только в GPThub.
Частые вопросы
Чем Flash отличается от GLM 5.2?
Flash — лёгкий MoE 4.7 (~3B активных): скорость и код/тексты «на каждый день». GLM 5.2 — более сильная ветка на том же «Плюс». Обе только текст.
Какой контекст?
В документации Z.AI — 200K токенов, макс. ответ до 128K. Пакет токенов тарифа GPThub ограничивает суммарный расход.
С какого тарифа?
С «Плюс». На госте и бесплатном GLM Flash нет — там DeepSeek V4 Flash и GPT-5 Nano.
Есть ли картинки?
Нет. Только текст. Для изображений выберите модель с картинками на вашем тарифе.
Похожие модели
Запустить GLM 4.7 Flash в чате
Доступ из России без VPN. Нужен тариф «Плюс» или выше.