Z.AI (Zhipu) logo

Z.AI (Zhipu) · 2026-01-20

от тарифа «Плюс»

GLM-4.7-Flash

Лёгкий GLM MoE: ~30B / 3B активных, контекст 200K — код и тексты на «Плюс»

ПлюсMoE200KКодТекст

GLM-4.7-Flash — лёгкая модель серии GLM-4.7 от Z.AI (Zhipu): смесь экспертов (~30–31 млрд параметров, около 3 млрд активных), контекст 200K, ответ до 128K. Только текст. В GPThub — с тарифа «Плюс»: быстрый код, инструкции и тексты на русском и английском.

В GPThub — с тарифа «Плюс» и выше.

Картинки

Нет

Только текст

Тариф

Плюс+

С тарифа «Плюс» и выше

Контекст

200K

текст → текст

Когда выбирать

  • Код «на каждый день»Фиксы, небольшие фичи, объяснение чужого кода, чек-листы перед релизом.
  • Фронтенд / бэкенд каркасыСтруктура компонента, API-обработчик, схема миграции.
  • Русские тексты и переводИнструкции, FAQ, деловые письма, EN↔RU.
  • Длинные текстовые вводныеТЗ, переписки, логи в одном запросе (200K).

Честно о границах

  • Нет картинок: скрины, фото, PDF-как-изображение — не её зона
  • GLM 5.2, Luna, Grok, Claude, Terra в GPThub часто сильнее на топовых задачах
  • Как у любой нейросети: проверяйте код и факты; Flash не заменяет ревью senior
  • Длинный контекст + большой вывод быстро тратят пакет токенов «Плюс»

Характеристики

Серия
GLM-4.7 (Flash)
Параметры
~30–31B всего · ~3B активных (MoE 30B-A3B)
Контекст
200K токенов (документация Z.AI)
Макс. ответ
до 128K токенов
Модальности
текст → текст
Релиз Flash
≈ 20 января 2026
В GPThub
тариф «Плюс» и выше

Как это выглядит в чате

Примеры диалогов — иллюстрация сценариев, не запись реальных сессий. Формулировки упрощают задачу; в чате можно уточнять и прикладывать файлы.

Z.AI (Zhipu) logoПример · GLM 4.7 Flash
Патч по багу
Вот стек ошибки и кусок обработчика. Найди причину и дай минимальный патч + тест.

GLM 4.7 Flash

Падает в X: … Причина — … Патч: ```diff - … + … ``` Тест: … Риски: …
Z.AI (Zhipu) logoПример · GLM 4.7 Flash
Чек-лист релиза
Чек-лист перед выкладкой веб-сервиса, 12 пунктов: безопасность, данные, откат.

GLM 4.7 Flash

1) Миграции + dry-run 2) Секреты/ENV 3) Healthchecks 4) План отката … 12) Smoke после выкладки

Место в семье GLM-4.7

Серия GLM-4.7 усиливает программирование и стабильные многошаговые рассуждения: от разбора задачи до связного кода. Полный GLM-4.7 — «тяжёлая» ветка; Flash — лёгкий вариант для высокой скорости при сильных результатах в своём размере.

По материалам Z.AI, Flash на публичных наборах (SWE-bench Verified, τ²-Bench) показывает сильные результаты среди моделей сопоставимого масштаба и уверенно ведёт себя на фронтенде и бэкенде. Помимо кода разработчик рекомендует тексты, перевод и длинные материалы — удобно как «другой голос» рядом с GPT и Grok.

Архитектура 30B-A3B

Flash — MoE (часто пишут 30B-A3B): разреженная активация держит задержку и вычисления ниже, чем у плотной модели того же номинала.

Контекст 200K по документации Z.AI удобен для многофайловых фрагментов, длинных ТЗ и переписок. Пакет токенов тарифа «Плюс» по-прежнему ограничивает суммарный расход.

Когда брать Flash, а когда другую модель

Flash — ежедневный код, чек-листы, инструкции, черновики RU/EN, когда нужен быстрый цикл «вопрос → патч/план». GLM 5.2 — более сильный GLM на том же «Плюс». Grok 4.3 / Luna — если нужны картинки. Claude, Grok 4.5, Terra на «Про» — когда Flash «упёрся».

Только текст: скриншоты и фото — на Nano, Luna, Grok, Claude и других моделях с картинками вашего тарифа.

Сильные стороны

  • MoE ~3B активных — быстрые ответы при ёмкости «30B-класса»
  • Упор на код: фронтенд/бэкенд, структурированный код, многошаговые планы
  • Контекст 200K — длинные ТЗ, логи, многофайловые вставки
  • Сильные тексты RU/ZH/EN, перевод, инструкции рядом с GPT/Grok
  • Сильные публичные сигналы на бенчмарках по коду в своём размере (Z.AI)

Ограничения

Честно о границах — чтобы выбрать модель под задачу

  • Нет картинок: скрины, фото, PDF-как-изображение — не её зона
  • GLM 5.2, Luna, Grok, Claude, Terra в GPThub часто сильнее на топовых задачах
  • Как у любой нейросети: проверяйте код и факты; Flash не заменяет ревью senior
  • Длинный контекст + большой вывод быстро тратят пакет токенов «Плюс»

Для каких задач

Код «на каждый день»

Фиксы, небольшие фичи, объяснение чужого кода, чек-листы перед релизом.

Фронтенд / бэкенд каркасы

Структура компонента, API-обработчик, схема миграции.

Русские тексты и перевод

Инструкции, FAQ, деловые письма, EN↔RU.

Длинные текстовые вводные

ТЗ, переписки, логи в одном запросе (200K).

Как пользоваться в GPThub

  1. 01Откройте чат GPThub → модель GLM 4.7 Flash (нужен «Плюс»+).
  2. 02Для кода: фрагмент + ожидаемое поведение + стек; просите патч или пошаговый план.
  3. 03Для длинного контекста: сначала цель и ограничения, потом тело документа.
  4. 04Нужны картинки — Luna/Grok 4.3. Сложнее рассуждения — GLM 5.2, Grok 4.5, Claude, Terra.

Источники

Материалы о возможностях модели (релизы, обзоры, бенчмарки). Тарифы и доступ — только в GPThub.

Частые вопросы

Чем Flash отличается от GLM 5.2?

Flash — лёгкий MoE 4.7 (~3B активных): скорость и код/тексты «на каждый день». GLM 5.2 — более сильная ветка на том же «Плюс». Обе только текст.

Какой контекст?

В документации Z.AI — 200K токенов, макс. ответ до 128K. Пакет токенов тарифа GPThub ограничивает суммарный расход.

С какого тарифа?

С «Плюс». На госте и бесплатном GLM Flash нет — там DeepSeek V4 Flash и GPT-5 Nano.

Есть ли картинки?

Нет. Только текст. Для изображений выберите модель с картинками на вашем тарифе.

Похожие модели

Запустить GLM 4.7 Flash в чате

Доступ из России без VPN. Нужен тариф «Плюс» или выше.