Знакомая ситуация: нашли референс — кадр, иллюстрацию, стиль обложки — и хотите такое же, но своё. Пишете нейросети «сделай в этом стиле», прикладываете картинку, а на выходе получается что-то отдалённо похожее.

Проблема в том, что модель видит картинку иначе, чем вы. Чтобы повторить результат, нужно перевести изображение в слова — в промпт, где названы субъект, композиция, свет, цвет и стиль. Это и есть обратный приём: не от текста к картинке, а от картинки к тексту.

Разберём два способа сделать это: быстрый — попросить саму нейросеть описать изображение, и ручной — собрать промпт по понятной схеме. И покажем, как их сочетать.

Из чего состоит промпт по картинке

1. Что на картинке

Начните с главного: кто или что в кадре и что происходит. Один человек, группа, предмет, пейзаж. Что делает субъект, в какой позе, с каким выражением. Это ядро промпта. «Женщина средних лет улыбается, держит чашку кофе» — уже конкретнее, чем «человек с кофе». Чем точнее субъект, тем ближе результат.

2. Где и как снято

Опишите окружение и то, как построен кадр. Что на фоне, где происходит сцена. Затем ракурс и композиция: крупный план или общий, вид спереди или сбоку, снято сверху или на уровне глаз, где расположен субъект в кадре. Ракурс часто важнее, чем кажется. «Портрет крупным планом» и «человек в полный рост на общем плане» дают совершенно разные картинки при одном и том же субъекте.

3. Свет и цвет

Свет задаёт настроение сильнее всего. Определите его характер: мягкий рассеянный, жёсткий контрастный, тёплый закатный, холодный студийный, откуда падает. Затем палитра: общая гамма, доминирующие цвета, насыщенные они или приглушённые. «Тёплые бежевые и коричневые тона, мягкий свет из окна» — это половина узнаваемости кадра.

4. Стиль и настроение

Назовите технику: фотография, 3D-рендер, акварель, векторная иллюстрация, масляная живопись. Добавьте детали, если они видны: плёночное зерно, глянцевые поверхности, плоский дизайн. И общее настроение: спокойное, энергичное, минималистичное, драматичное. Эти слова помогают модели собрать разрозненные детали в цельную картину.

Разбор изображения на элементы промпта: субъект, кадр, свет, стиль
Любую картинку можно разложить на четыре части — и собрать из них точный запрос.

Нейросеть не видит вашу картинку у вас в голове. Опишите её по частям — и модель соберёт похожий результат.

Редакция SpeShu.AI

Проверьте промт по картинке

  • Назовите главный субъект и что он делает
  • Опишите фон и окружение
  • Укажите ракурс и композицию кадра
  • Задайте характер света и его направление
  • Обозначьте основную цветовую гамму
  • Определите технику: фото, 3D, иллюстрация
  • Добавьте общее настроение сцены
  • Уберите детали, которые повторять не нужно

Способ 1. Быстрый: пусть нейросеть опишет сама

Современные мультимодальные модели умеют смотреть на изображение и описывать его словами. Достаточно загрузить картинку и попросить составить промпт. За минуту вы получите готовую заготовку, которую останется поправить.

Это лучший старт, если не знаете, с чего начать: модель сама заметит детали, которые вы могли упустить.

Способ 2. Ручной: соберите промпт по схеме

Когда нужен полный контроль, описывайте картинку сами по четырём блокам из статьи: субъект → кадр → свет и цвет → стиль. Так вы точно назовёте то, что важно именно вам, и уберёте лишнее.

Идеальный вариант — совместить: получить черновик от нейросети, а потом пройтись по схеме и уточнить каждый блок.

Промпты, чтобы превратить картинку в запрос

Загрузите изображение и используйте нужный шаблон.

1. Базовое описание в промпт
Обычная программа выполняет заранее прописанные правила — если А, то Б. ИИ вместо этого обучается на примерах и сам находит закономерности, по которым потом действует, включая ситуации, которые заранее никто не описывал.

2. Промпт по схеме

Нет, у современных систем ИИ нет сознания, эмоций или понимания в человеческом смысле — это программы, предсказывающие наиболее вероятный результат на основе данных, даже если ответ звучит очень по-человечески.

3. Повторить стиль, но с другим объектом
Опиши стиль этого изображения: технику, свет, цвет, композицию и настроение — но без самого субъекта. Составь промпт, в который я смогу подставить свой объект: [опиши, что хочешь вместо оригинала].

4. Промпт для редактирования, а не генерации
Опиши это изображение и составь промпт для его редактирования: я хочу изменить [что менять], сохранив [что оставить]. Сформулируй чёткий запрос с указанием, что трогать нельзя.

5. Короткий и длинный варианты

Составь два промпта по этому изображению: короткий на 1–2 предложения для быстрой генерации и подробный развёрнутый — для точного повтора. Оба готовы к копированию.

6. Разбор для обучения

Объясни, какие приёмы делают это изображение выразительным: свет, композиция, цвет, ракурс. Затем на их основе составь промпт, который поможет получить похожий по качеству результат.

Мини пример

Было: «Сделай как на фото».

Стало: «Портрет женщины крупным планом, вид немного сбоку. Она улыбается, держит чашку кофе. Фон — размытая комната у окна. Мягкий тёплый свет из окна слева, тёплая бежево-коричневая гамма. Фотореализм, спокойное уютное настроение».

Второй вариант повторяем, первый — нет.

Частые вопросы

Какая нейросеть умеет описывать картинки?
Это делают мультимодальные модели — те, что принимают изображение на вход. Многие современные чат-модели умеют посмотреть на картинку и составить по ней текстовый промпт.

Промпт от нейросети всегда точный?

Нет. Модель может упустить деталь или добавить лишнее. Считайте её описание черновиком: прочитайте и поправьте под то, что вам действительно нужно.

Можно ли так повторить любую картинку один в один?

Точной копии обычно не выходит: генерация каждый раз новая. Приём помогает получить похожий результат по стилю и содержанию, а не идентичный дубль.

Что делать, если результат не совпадает?

Уточняйте промпт по блокам: добавьте недостающие детали света, ракурса или цвета, уберите лишнее. Обычно достаточно двух-трёх правок.

Можно ли брать чужие изображения как референс?

Как источник стиля и приёмов — да. Но копировать защищённую работу или узнаваемого человека один в один рискованно с точки зрения авторских прав. Ориентируйтесь на подход, а не на точное клонирование.

Нужно ли описывать всё до мелочей?

Нет. Называйте то, что важно для результата, и убирайте случайные детали. Слишком длинный промпт с лишним может увести генерацию в сторону.

Поработайте над одной из своих картинок уже сейчас

Возьмите любое изображение, которое хотели бы повторить, загрузите в нейросеть и попросите составить по нему промпт. Затем пройдитесь по схеме — субъект, кадр, свет, стиль — и уточните детали под себя. Сделать это удобно там, где под рукой сразу несколько ИND-моделей: в SpeShu.AI можно загрузить картинку, получить промпт и тут же проверить его на генерации, выбрав подходящую модель.

Попробовать в чате