Работа с картинками в GPThub: скрины, UI и фото документов
Не каждая модель в GPThub «видит» изображения: текстовые (DeepSeek V4 Flash, GLM) картинку не прочитают. На бесплатном тарифе для скринов берите GPT-5 Nano; на «Плюс» и «Про» — Luna, Grok, Kimi, Claude, Terra. Ниже — как прикрепить файл, что написать в запросе и готовые шаблоны под UI, ошибки и фото документов.
Опубликовано 6 августа 2026 г.
Понадобится
- ·Скрин или фото (лучше крупно, читаемый текст на экране)
- ·Модель с поддержкой изображений в списке чата
Шаги
01Выберите модель с картинками
В карточке модели и в каталоге «Модели» смотрите, есть ли работа с изображениями. Бесплатно: GPT-5 Nano. «Плюс»: Luna, Grok 4.3, Kimi K2.6. «Про»: Terra, Grok 4.5, Claude Sonnet 5, Kimi K3. Flash и GLM — только текст: вложите скрин — модель его не увидит.
Совет: Если в списке нет нужной модели, проверьте тариф или откройте «Цены».
02Прикрепите изображение и опишите задачу
Загрузите файл в чат (как принимает интерфейс GPThub), затем текстом: что это за экран, что нужно сделать, в каком формате ответить. «Посмотри картинку» без цели даёт общий пересказ. Лучше: «это форма оплаты, найди 3 UX-проблемы» или «прочитай ошибку и предложи 3 шага».
03Сделайте картинку читаемой
Крупный фрагмент с текстом работает лучше, чем весь рабочий стол мелким шрифтом. Обрежьте лишнее, увеличьте область с ошибкой. На фото документа — ровный свет, без бликов; одна страница за раз, если страниц много.
04Просите структуру ответа
Как и в текстовых промптах: список, таблица, «сначала что видишь, потом выводы». Для UI: проблема → где на скрине → правка. Для бага: текст ошибки → вероятная причина → что проверить. Так проще сверить ответ с картинкой.
05Добавьте контекст, которого нет на скрине
Модель не знает, что вы нажали до ошибки, какой стенд (тест/прод) и какой браузер. Допишите 2–3 строки: «Chrome, после клика „Оплатить“, ожидал успех». Для макета — цель экрана и аудитория.
06Проверьте и уточните
Модели иногда «дочитывают» нечёткий текст. Если цитата с экрана важна — попросите: «процитируй надпись дословно, не перефразируй». Уточняйте: «увеличь внимание на красный баннер справа». Неверный OCR — пришлите более чёткий кроп.
Готовые запросы
Нажмите «Скопировать» и вставьте в чат. Текст в квадратных скобках замените на свой.
Разбор UI / макета
GPT-5 NanoНа скрине — [экран: форма / лендинг / кабинет]. Аудитория: [кто пользуется]. Задача: найди 5 конкретных проблем (ясность, иерархия, ошибки, доступность на глаз). Для каждой: что видишь → почему мешает → как исправить в 1 предложении. Не хвали «в целом нормально». Если данных мало — список вопросов.
Ошибка на экране
GPT-5.6 LunaНа скрине ошибка или стек. 1) Процитируй текст ошибки дословно. 2) Объясни простыми словами. 3) Дай 3 шага диагностики по убыванию вероятности. 4) Если хватает контекста — один вероятный фикс (без выдуманных файлов). Контекст: [что делал пользователь, браузер/ОС, стенд].
Фото документа / таблицы
Claude Sonnet 5На фото — [чек / таблица / бланк / слайд]. Извлеки данные списком: поля и значения. Если строка нечитаема — пометь «неуверен» и не угадывай. Затем: краткое резюме в 3 пунктах для [кому: бухгалтер / менеджер]. Не добавляй поля, которых нет на изображении.
Сравнение двух скринов
Grok 4.5Два скрина: A (до) и B (после) / вариант 1 и 2. Сравни: что изменилось, что стало лучше/хуже для пользователя, 3 риска. Формат: таблица «критерий | A | B | вывод». Контекст задачи: […].
Готово, если…
- Выбрана модель с поддержкой изображений
- Картинка прикреплена, текст на ней читается
- В запросе есть цель и формат ответа
- Добавлен контекст «что делали до скрина»
- Важные надписи при необходимости запрошены дословно
- Ответ сверен глазами со скрином (цифры, имена, ошибки)
Частые ошибки
- Кидать скрин в Flash или GLM — они работают только с текстом
- Весь рабочий стол 4K мелким шрифтом без кропа
- «Что на картинке?» без задачи — получаете пересказ вместо пользы
- Доверять распознаванию сумм и реквизитов без проверки
- Пачка из 10 скринов в одном сообщении без нумерации и цели
Частые вопросы
Какая модель для скринов на бесплатном тарифе?
GPT-5 Nano. DeepSeek V4 Flash изображения не обрабатывает.
Почему модель «не видит» вложение?
Чаще всего выбрана текстовая модель, файл не прикрепился или формат не поддержан. Смените модель на Nano/Luna/Claude и прикрепите файл заново.
Можно ли прислать фото паспорта или карты?
Не стоит. Не загружайте в чат чувствительные персональные и платёжные данные. Замажьте лишнее или опишите задачу без скана.
PDF или только картинки?
Ориентируйтесь на то, что принимает интерфейс чата. Многостраничный документ часто удобнее как отдельные скрины страниц с подписью «стр. 2 из 5».
Текст на скрине на английском — писать промпт по-русски?
Да. Можно: «отвечай по-русски, термины с экрана оставляй как есть».
Связанные модели
GPT-5 Nano
GPT-5 Nano · картинки · ~400K контекст · бесплатно
Luna
GPT-5.6 Luna · картинки · ежедневные задачи · Плюс
Terra
GPT-5.6 Terra · картинки · ~1M контекст · Про
Grok 4.5
Grok 4.5 · картинки · 500K · код и агенты · Про
Claude Sonnet 5
Sonnet 5 · картинки · 1M · агентный код · Про
Kimi K2.6
Kimi K2.6 · MoE 1T·32B · 256K · картинки · Плюс
Источники
Попробовать в чате
Доступ из России без VPN. Начните с бесплатных моделей или выберите тариф.