Как составлять промпты к нейросетям для создания картинок

Если вы уже пользовались нейросетями, то знаете, как трудно получить не просто красивую, а именно нужную вам картинку.
Вы придумали идею, вводите запрос, нажимаете кнопку и видите результат. Но получается совсем не то, что вы себе представляли. Нейросеть сама додумала детали и композицию — и картинка стала рассказывать совсем другую историю.
Базовые принципы хорошего запроса похожи в Nano Banana, Midjourney, ChatGPT и других сервисах, хотя работа с референсами и настройками может различаться. Расскажу, как не тратить часы на неудачные эксперименты.
Определяем главное
Сначала стоит определить, без чего изображение точно не годится: что за ситуация или формат, какой центральный объект, что происходит. Пробуйте описывать так, как вы рассказывали бы про будущую картинку своему приятелю.
🎯 Объект. Основа практически любого запроса — именно он будет в центре всего рисунка. Например, кот, волшебник, священник, ангел, император, некромант, рок-звезда, город, королева, дом, храм, ферма, машина, пейзаж, гора, река.
Некоторые нейросети отказываются генерировать известных героев, защищенных авторским правом. В таком случае попробуйте описать персонажа словами, не называя его по имени: не Гарри Поттер, а мальчик-волшебник с темными волосами, в очках и со шрамом-молнией.
Например, для обложки статьи о переезде определяем три обязательных условия: пустая светлая комната, один красный диван справа и свободное место слева для заголовка. Цвет пола, вид из окна и материал обивки пока оставляем на усмотрение нейросети.

Если хотите, чтобы на изображении было несколько объектов, указывайте их количество. Но, когда объектов много, нейросети не всегда справляются: появляются повторы, ломается геометрия, вылезают ошибки. А еще так сложнее добиться точного воспроизводимого результата.
В этом случае помогает перегенерировать картинку или сначала сделать простую сцену, а потом добавлять в нее новые предметы или персонажей.


🌅 Абстракции. Помимо реальных объектов нейросети могут генерировать абстрактные понятия вроде времени, судьбы, счастья или смысла жизни. Делают они это так, как такие концепты обычно изображают в поп-культуре или искусстве.
Абстрактный запрос удобно использовать для поиска идеи. Сгенерируйте несколько вариантов, посмотрите, через какие образы нейросеть передает понятие, и выберите подходящую метафору. Затем доработайте понравившийся вариант.


Описываем сцену и добавляем детали
Уделите время конкретике: придумайте, как расположены объекты на картинке, какие у них отличительные черты. Напишите не просто «волшебник», а «грустный волшебник в колпаке работает за компьютером в офисе поздно вечером».
Вот какие базовые детали можно добавить к запросу.
🛋 Характеристики объекта. Уточните его форму, материал, цвет и состояние. Например, вместо просто красного дивана можно попросить советскую модель из 1970-х с деревянными подлокотниками и слегка потертой обивкой. Конкретные признаки работают лучше, чем расплывчатые слова вроде «старый» или «красивый».
🏃♀️ Действие. Если в сцене что-то происходит, опишите это явно, глаголом. «Человек переезжает» не дает конкретной картинки, а «мужчина снимает с дивана упаковочную пленку» задает понятное действие.


🏠 Окружение. Добавьте несколько деталей, которые объясняют место и ситуацию: коробки, свернутый ковер, голые стены. Если предметов несколько, полезно указать их количество и расположение, чтобы нейросеть не расставила их случайным образом.
🎨 Цвета. Уточните общую цветовую палитру или цвет конкретных деталей. Например, что ваза на столе должна быть синей, а платье на девушке — красным.
Можно использовать базовые цвета — красный, синий, желтый и все остальные. А можно уточнить тон: приглушенные, пастельные, минималистичное двухтонное изображение, неон, сепия или даже точный цвет с HEX-кодом или Pantone. Правда, точные коды многие нейросети воспринимают скорее как ориентир.
📷 Настройки кадра. Каждый запрос можно уточнять дополнительными параметрами. Например, указать крупность плана, ракурс, объектив и эффект съемки. Технические параметры нейросеть воспринимает приблизительно, поэтому достаточно выбрать те, что заметно влияют на вид кадра.



Несколько примеров:
- Крупность плана: сверхкрупный, крупный, средний, общий или дальний.
- Ракурс: из-за плеча, сверху, снизу или с наклоненным горизонтом.
- Эффекты камеры: боке, размытие движения, короткая или длинная выдержка.
- Объектив: телеобъектив, макрообъектив или широкоугольный.
- Формат съемки: селфи на GoPro, полароидный снимок, пленочная мыльница или запись с камеры наблюдения.
- Отсылки к платформам: упоминание Pinterest, соцсетей или других площадок может подсказать нейросети нужную визуальную эстетику.
Характеристики, действие и окружение можно уточнить одновременно. Тогда вместо общей темы нейросеть получит конкретную ситуацию. Например, вот что получилось для обложки статьи о переезде.

Задаем стилистику
Одна и та же сцена может выглядеть как фотография, карандашный рисунок, кадр из фильма или трехмерный рендер. Это стоит указать в промпте.
Вот несколько рекомендаций.
🖼 Укажите формат. Напишите, что именно хотите получить: реалистичную фотографию, акварельную иллюстрацию, коллаж из цветной бумаги, пиксель-арт, рекламный постер или 3D-рендер. Это задаст нейросети основное направление.
🔍 Опишите видимые признаки. Названия вроде «ретро» или «минимализм» модели отлично понимают, но конкретная трактовка может отличаться от вашей. Полезнее уточнить, как стиль должен проявляться: приглушенные цвета, пленочное зерно, низкий контраст, грубые мазки, простые геометрические формы или четкие темные контуры.



🧩 Сочетайте характеристики осмысленно. Обычно достаточно соединить формат и одно направление: акварельная иллюстрация в стиле минимализма, пленочная фотография с эстетикой нуара, трехмерный рендер в виде бумажной аппликации. Если перечислить много несвязанных стилей, результат станет менее предсказуемым.
✍️ Осторожнее с именами авторов. Нейросети понимают указания вроде «в стиле Ван Гога» или «в эстетике фильмов Уэса Андерсона», но некоторые сервисы ограничивают запросы с именами современных авторов. Надежнее описать нужные приемы своими словами, например «симметричная композиция, пастельные цвета, мягкий свет и немного театральные декорации».
Для обложки о переезде я хотела получить современную редакционную фотографию с легкой ностальгией — не глянцевый интерьерный снимок, а живую сцену, будто случайно снятую на пленку. Поэтому добавила к запросу мягкое пленочное зерно, слегка выцветшие тона, естественные фактуры и невысокий контраст.

Используем картинки как референсы
Иногда нужный результат проще показать, чем описать словами. К запросу можно приложить фотографию, рисунок, скриншот или предыдущую генерацию. Но важно объяснить, что именно нейросеть должна взять из изображения.
📐 Композиция. Референс может подсказать расположение предметов, ракурс или позу человека. Например: «Сохрани расположение дивана и свободное место слева, но измени интерьер комнаты на современную детскую в зеленых тонах».
🎨 Стиль. Из картинки можно взять палитру, освещение, фактуру и общую атмосферу. Можно так и сказать: «Используй стиль второй картинки». А можно перечислить нужные признаки: «Используй яркие цвета, крупные мазки и характерные штрихи, как на втором рисунке».
Если прикладываете несколько референсов, обозначьте роль каждого: «Первая картинка — пример стиля, вторая — пример композиции».



🧍 Объект или персонаж. Если важно сохранить конкретный диван, одежду или внешность героя, укажите это отдельно. Правда, точного переноса удается добиться не всегда, и многое тут зависит от выбранного сервиса. В ChatGPT или Gemini можно указать прямо в запросе, что откуда взять. А, например, в Midjourney для разных задач предусмотрены Image Prompt и Style Reference.
🔧 Все, кроме одной детали. Еще один сценарий — точечно доработать готовое изображение, будь то реальное фото или ранее сгенерированная картинка. Например: «Замени современную батарею на чугунную. Сохрани как есть диван, человека, композицию и освещение». Чем точнее указано, что изменить и что сохранить, тем меньше картинка будет отличаться от исходной.
Референсы можно искать в галереях самих нейросетей, на сайтах с фотографиями, в кино и социальных сетях.
Я взяла в качестве референса предыдущую картинку с мужчиной и диваном. Попросила нейросеть сохранить персонажа, красный диван, коробки и свернутый ковер, но перенести всю сцену в просторный хайтек-интерьер. Так можно проверить, насколько хорошо нейросеть удерживает объекты и композицию при замене окружения.

Настраиваем формат и качество
Кроме самого запроса во многих сервисах можно выбрать соотношение сторон, качество изображения, а также насколько сильно будут отличаться друг от друга разные варианты генераций.
📐 Соотношение сторон. Определяет форму кадра, но не его разрешение. Квадрат 1:1 подойдет для поста, вертикальный формат 9:16 — для историй и коротких видео, горизонтальный 16:9 — для обложки статьи или презентации. Если нужное соотношение можно выбрать в интерфейсе, надежнее использовать настройку, а не писать «широкий кадр» в запросе.


✨ Размер и качество. Чем выше разрешение и качество, тем дольше может идти генерация и тем дороже она может стоить. Сначала удобно делать быстрые черновики, а максимальное качество выбирать уже для удачного варианта. В разных сервисах это может быть реализовано как отдельный режим Draft, выбор 1K, 2K или 4K или размер картинки в пикселях.
🎲 Вариативность. Некоторые генераторы позволяют регулировать, насколько сильно результаты одного запроса будут отличаться друг от друга. Например, в Midjourney параметр Chaos управляет разбросом вариантов, Stylize — силой собственной эстетики сервиса, а режим Raw уменьшает автоматическую стилизацию и дает больше контроля над результатом. В других сервисах похожие возможности могут находиться на панели настроек.

Собираем все в один запрос
Универсальной формулы идеального промпта нет. Но нейросети проще понять запрос, если он построен последовательно: сначала задача и сцена, затем главный объект, действие, композиция, стиль и ограничения.
Удобно придерживаться такого порядка:
- Задача и формат — для чего нужна картинка, фотография это или иллюстрация.
- Сцена — где все происходит и что находится в кадре.
- Главный объект и действие — как он выглядит и что происходит.
- Композиция — где расположены предметы, какой нужен ракурс и где оставить свободное место.
- Стиль — палитра, свет, материалы и фактура.
- Ограничения и настройки — что важно сохранить, чего не должно быть, какое нужно соотношение сторон.
Если результат не подошел, не переписывайте запрос целиком. Сначала измените одно условие: освещение, положение предмета или стиль. Так будет проще понять, какая формулировка повлияла на картинку. Для этого в чате можно дать короткую команду: «Сохрани всю композицию, но сделай свет теплее». В отдельном генераторе — изменить соответствующую часть исходного промпта или воспользоваться редактором изображения.

Мы постим кружочки, красивые карточки и новости о технологиях и поп-культуре в нашем телеграм-канале. Подписывайтесь, там классно: @t_technocult




















