Z.AI (Zhipu) logo

Z.AI (Zhipu) · 2026-01-20

от тарифа «Плюс»

GLM-4.7-Flash

Лёгкий MoE GLM: ~30B / 3B активных, контекст 200K — код и тексты на Плюс

ПлюсMoE200KКодТекст

GLM-4.7-Flash — лёгкая модель серии GLM-4.7 от Z.AI (Zhipu): смесь экспертов (~30B, около 3B активных), контекст 200K, ответ до 128K. Только текст. В GPThub — с тарифа Плюс: быстрый код, инструкции и тексты на русском и английском.

В GPThub — с тарифа «Плюс» и выше.

Картинки

Нет

Только текст

Тариф

Плюс+

С тарифа «Плюс» и выше

Контекст

200K

текст → текст

Когда выбирать

  • Код «на каждый день»Фиксы, небольшие фичи, объяснение чужого кода, чек-листы перед релизом — быстрый цикл без Про.
  • Фронтенд / бэкенд каркасыСтруктура компонента, API-хендлер, схема миграции: «собери каркас + зависимости».
  • RU-тексты и переводИнструкции, FAQ, деловые письма, EN↔RU — GLM хорошо держит естественный тон.
  • Длинные текстовые вводныеТЗ, переписки, логи: 200K контекст позволяет держать больше материала в одном запросе.

Честно о границах

  • Нет поддержки картинок: скрины UI, фото, PDF-как-картинка — не её зона
  • GLM 5.2, Luna, Grok 4.3/4.5, Claude, Terra в GPThub часто сильнее на топовых задачах
  • Как у любой LLM: проверяйте код и факты; Flash не заменяет ревью уровня senior
  • Длинный контекст + большой вывод быстро тратят пакет токенов Плюс

Характеристики

Серия
GLM-4.7 (Flash)
Параметры
~30–31B всего · ~3B активных (MoE 30B-A3B)
Контекст
200K токенов (документация Z.AI)
Макс. ответ
до 128K токенов
Модальности
текст → текст
Релиз Flash
≈ 20 января 2026
В GPThub
тариф «Плюс» и выше

Как это выглядит в чате

Примеры диалогов — иллюстрация сценариев, не запись реальных сессий. Формулировки упрощают задачу; в чате можно уточнять и прикладывать файлы.

Z.AI (Zhipu) logoПример · GLM 4.7 Flash
Патч по багу
Вот стек ошибки и кусок обработчика. Найди причину и дай минимальный патч + тест.

GLM 4.7 Flash

Падает в X: … Причина — … Патч: ```diff - … + … ``` Тест: … Риски: …
Z.AI (Zhipu) logoПример · GLM 4.7 Flash
Чек-лист релиза
Чек-лист перед выкладкой веб-сервиса, 12 пунктов: мигра, данные, откат.

GLM 4.7 Flash

1) Миграции + пробный прогон 2) переменные окружения/секреты 3) проверки здоровья 4) Rollback plan … 12) После выкладки дымовой

Место в семье GLM-4.7

Серия GLM-4.7 усиливает программирование и стабильные многошаговые рассуждения и выполнение: от разбора задачи до связного кода и циклов «как у инструментов». Полный GLM-4.7 — «тяжёлая» ветка; Flash — лёгкий вариант для высокой скорости при сильных результатах в своём размере.

По материалам Z.AI, Flash на публичных наборах вроде SWE-bench Verified и τ²-Bench показывает лучшие результаты среди открытых моделей сопоставимого масштаба и уверенно ведёт себя на фронтенд/бэкенд-задачах. Помимо кода разработчик рекомендует китайские/общие тексты, перевод, длинные тексты и ролевые диалоги — для RU-аудитории GPThub это плюс к «альтернативному голосу» рядом с GPT и Grok.

Архитектура 30B-A3B

Flash — MoE (часто пишут 30B-A3B): разреженная активация держит задержку и вычисления ниже плотной модели того же «номинала», сохраняя ёмкость экспертов. В карточках с открытыми весами встречается тег glm4_moe_lite / Multi-Latent Attention — детали стека вывода, а не кнопка в чате GPThub.

Контекст 200K по документации Z.AI удобен для многофайловых фрагментов, длинных ТЗ и переписок. Пакет токенов тарифа Плюс в GPThub по-прежнему ограничивает суммарный расход — длинное окно ≠ «залейте всё без учёта лимита».

Когда брать Flash, а когда другую модель

Flash — ежедневный код, чек-листы, инструкции, RU/EN черновики, когда нужен быстрый цикл «вопрос → патч/план». GLM 5.2 в том же каталоге — более «тяжёлый» GLM на Плюс для связной аналитики. Grok 4.3 / Luna — если нужны картинки или другой стиль. Claude, Grok 4.5, Terra на Про — топовые модели, когда Flash «упёрся».

Это только текст: скриншоты и фото в GPThub — на Nano, Luna, Grok, Claude и других моделях с картинками вашего тарифа.

Сильные стороны

  • MoE ~3B активных — быстрые ответы при ёмкости «30B-класса»
  • Упор на код: фронтенд/бэкенд, структурированный код, агентный многошаговый стиль
  • Контекст 200K — длинные ТЗ, логи, многофайловые вставки
  • Сильные тексты RU/ZH/EN, перевод, инструкции рядом с GPT/Grok
  • На SWE-bench / tool-bench в классе размера — сильные публичные сигналы (Z.AI)

Ограничения

Честно о границах — чтобы выбрать модель под задачу

  • Нет поддержки картинок: скрины UI, фото, PDF-как-картинка — не её зона
  • GLM 5.2, Luna, Grok 4.3/4.5, Claude, Terra в GPThub часто сильнее на топовых задачах
  • Как у любой LLM: проверяйте код и факты; Flash не заменяет ревью уровня senior
  • Длинный контекст + большой вывод быстро тратят пакет токенов Плюс

Для каких задач

Код «на каждый день»

Фиксы, небольшие фичи, объяснение чужого кода, чек-листы перед релизом — быстрый цикл без Про.

Фронтенд / бэкенд каркасы

Структура компонента, API-хендлер, схема миграции: «собери каркас + зависимости».

RU-тексты и перевод

Инструкции, FAQ, деловые письма, EN↔RU — GLM хорошо держит естественный тон.

Длинные текстовые вводные

ТЗ, переписки, логи: 200K контекст позволяет держать больше материала в одном запросе.

Как пользоваться в GPThub

  1. 01Откройте чат GPThub → модель GLM 4.7 Flash (нужен тариф Плюс или выше).
  2. 02Для кода: фрагмент + ожидаемое поведение + стек/версии; просите diff или пошаговый план.
  3. 03Для длинного контекста: сначала цель и ограничения, потом тело документа.
  4. 04Нужны картинки — переключитесь на модель тарифа (Luna, Grok 4.3…). Сложнее рассуждения — GLM 5.2, Grok 4.5, Claude, Terra.

Источники

Материалы о возможностях модели (релизы, обзоры, бенчмарки). Тарифы и доступ — только в GPThub.

Частые вопросы

Чем Flash отличается от GLM 5.2 в GPThub?

Flash — лёгкий MoE 4.7 (~3B активных): скорость и код/тексты «на каждый день». GLM 5.2 — более сильная ветка GLM на том же Плюс для сложных связных задач. Обе только текст.

Какой контекст?

В документации Z.AI для GLM-4.7-Flash — 200K токенов, макс. ответ до 128K. Пакет токенов тарифа GPThub ограничивает суммарный расход.

С какого тарифа?

С Плюс. На госте и бесплатный GLM Flash нет — там DeepSeek V4 Flash и GPT-5 Nano.

Есть ли картинки?

Нет. Только текст. Для изображений выберите модель с картинками на вашем тарифе.

Похожие модели

Запустить GLM 4.7 Flash в чате

Доступ из России без VPN. Нужен тариф «Плюс» или выше.