Как составлять пром­пты к нейросетям для создания картинок

Изучите наши советы, чтобы не потратить десятки попыток на создание одного изображения
23
Как составлять пром­пты к нейросетям для создания картинок
Аватар автора

Даша Лейзаренко

стала промпт-инженеркой

Страница автора
Аватар автора

Катя Лебедева

носила диван

Страница автора

Если вы уже пользовались нейросетями, то знаете, как трудно получить не просто красивую, а именно нужную вам картинку.

Вы придумали идею, вводите запрос, нажимаете кнопку и видите результат. Но получается совсем не то, что вы себе представляли. Нейросеть сама додумала детали и композицию — и картинка стала рассказывать совсем другую историю.

Базовые принципы хорошего запроса похожи в Nano Banana, Midjourney, ChatGPT и других сервисах, хотя работа с референсами и настройками может различаться. Расскажу, как не тратить часы на неудачные эксперименты.

Что вы узнаете
ШАГ ПЕРВЫЙ

Определяем главное

Сначала стоит определить, без чего изображение точно не годится: что за ситуация или формат, какой центральный объект, что происходит. Пробуйте описывать так, как вы рассказывали бы про будущую картинку своему приятелю.

🎯 Объект. Основа практически любого запроса — именно он будет в центре всего рисунка. Например, кот, волшебник, священник, ангел, император, некромант, рок-звезда, город, королева, дом, храм, ферма, машина, пейзаж, гора, река.

Некоторые нейросети отказываются генерировать известных героев, защищенных авторским правом. В таком случае попробуйте описать персонажа словами, не называя его по имени: не Гарри Поттер, а мальчик-волшебник с темными волосами, в очках и со шрамом-молнией.

Например, для обложки статьи о переезде определяем три обязательных условия: пустая светлая комната, один красный диван справа и свободное место слева для заголовка. Цвет пола, вид из окна и материал обивки пока оставляем на усмотрение нейросети.

Пустая светлая комната, справа стоит один красный диван
Пустая светлая комната, справа стоит один красный диван

Если хотите, чтобы на изображении было несколько объектов, указывайте их количество. Но, когда объектов много, нейросети не всегда справляются: появляются повторы, ломается геометрия, вылезают ошибки. А еще так сложнее добиться точного воспроизводимого результата.

В этом случае помогает перегенерировать картинку или сначала сделать простую сцену, а потом добавлять в нее новые предметы или персонажей.

В запросе — домашний рабочий стол, открытый ноутбук, белая чашка и черная настольная лампа. Нейросеть справилась
В запросе — домашний рабочий стол, открытый ноутбук, белая чашка и черная настольная лампа. Нейросеть справилась
Перегруженный запрос — появились проблемы со стеблями цветов, количеством карандашей и другими деталями
Перегруженный запрос — появились проблемы со стеблями цветов, количеством карандашей и другими деталями

🌅 Абстракции. Помимо реальных объектов нейросети могут генерировать абстрактные понятия вроде времени, судьбы, счастья или смысла жизни. Делают они это так, как такие концепты обычно изображают в поп-культуре или искусстве.

Абстрактный запрос удобно использовать для поиска идеи. Сгенерируйте несколько вариантов, посмотрите, через какие образы нейросеть передает понятие, и выберите подходящую метафору. Затем доработайте понравившийся вариант.

Жизненный путь. По замыслу нейросети, человек идет через четыре времени года
Жизненный путь. По замыслу нейросети, человек идет через четыре времени года
Когнитивный диссонанс в узнаваемой ИИ-стилистике
Когнитивный диссонанс в узнаваемой ИИ-стилистике
ШАГ ВТОРОЙ

Описываем сцену и добавляем детали

Уделите время конкретике: придумайте, как расположены объекты на картинке, какие у них отличительные черты. Напишите не просто «волшебник», а «грустный волшебник в колпаке работает за компьютером в офисе поздно вечером».

Вот какие базовые детали можно добавить к запросу.

🛋 Характеристики объекта. Уточните его форму, материал, цвет и состояние. Например, вместо просто красного дивана можно попросить советскую модель из 1970-х с деревянными подлокотниками и слегка потертой обивкой. Конкретные признаки работают лучше, чем расплывчатые слова вроде «старый» или «красивый».

🏃‍♀️ Действие. Если в сцене что-то происходит, опишите это явно, глаголом. «Человек переезжает» не дает конкретной картинки, а «мужчина снимает с дивана упаковочную пленку» задает понятное действие.

Женщина готовит ужин — больше в запросе не было никаких деталей
Женщина готовит ужин — больше в запросе не было никаких деталей
Конкретное действие, предметы и их расположение описывают ситуацию точнее
Конкретное действие, предметы и их расположение описывают ситуацию точнее

🏠 Окружение. Добавьте несколько деталей, которые объясняют место и ситуацию: коробки, свернутый ковер, голые стены. Если предметов несколько, полезно указать их количество и расположение, чтобы нейросеть не расставила их случайным образом.

🎨 Цвета. Уточните общую цветовую палитру или цвет конкретных деталей. Например, что ваза на столе должна быть синей, а платье на девушке — красным.

Можно использовать базовые цвета — красный, синий, желтый и все остальные. А можно уточнить тон: приглушенные, пастельные, минималистичное двухтонное изображение, неон, сепия или даже точный цвет с HEX-кодом или Pantone. Правда, точные коды многие нейросети воспринимают скорее как ориентир.

📷 Настройки кадра. Каждый запрос можно уточнять дополнительными параметрами. Например, указать крупность плана, ракурс, объектив и эффект съемки. Технические параметры нейросеть воспринимает приблизительно, поэтому достаточно выбрать те, что заметно влияют на вид кадра.

Сначала нейросеть сама выбрала цвета
Конкретная палитра распределила цветовые акценты
Нижний ракурс и широкоугольный объектив сделали ту же сцену динамичнее

Несколько примеров:

  1. Крупность плана: сверхкрупный, крупный, средний, общий или дальний.
  2. Ракурс: из-за плеча, сверху, снизу или с наклоненным горизонтом.
  3. Эффекты камеры: боке, размытие движения, короткая или длинная выдержка.
  4. Объектив: телеобъектив, макрообъектив или широкоугольный.
  5. Формат съемки: селфи на GoPro, полароидный снимок, пленочная мыльница или запись с камеры наблюдения.
  6. Отсылки к платформам: упоминание Pinterest, соцсетей или других площадок может подсказать нейросети нужную визуальную эстетику.

Характеристики, действие и окружение можно уточнить одновременно. Тогда вместо общей темы нейросеть получит конкретную ситуацию. Например, вот что получилось для обложки статьи о переезде.

Теперь на картинке видно действие и окружение: мужчина снимает пленку, рядом — коробки
Теперь на картинке видно действие и окружение: мужчина снимает пленку, рядом — коробки
ШАГ ТРЕТИЙ

Задаем стилистику

Одна и та же сцена может выглядеть как фотография, карандашный рисунок, кадр из фильма или трехмерный рендер. Это стоит указать в промпте.

Вот несколько рекомендаций.

🖼 Укажите формат. Напишите, что именно хотите получить: реалистичную фотографию, акварельную иллюстрацию, коллаж из цветной бумаги, пиксель-арт, рекламный постер или 3D-рендер. Это задаст нейросети основное направление.

🔍 Опишите видимые признаки. Названия вроде «ретро» или «минимализм» модели отлично понимают, но конкретная трактовка может отличаться от вашей. Полезнее уточнить, как стиль должен проявляться: приглушенные цвета, пленочное зерно, низкий контраст, грубые мазки, простые геометрические формы или четкие темные контуры.

Слово «ретро» оставляет модели свободу трактовки
Формат и видимые признаки — материалы, палитра, свет и фактура — задают более конкретную стилистику
Изменила технику — акварель вместо фото

🧩 Сочетайте характеристики осмысленно. Обычно достаточно соединить формат и одно направление: акварельная иллюстрация в стиле минимализма, пленочная фотография с эстетикой нуара, трехмерный рендер в виде бумажной аппликации. Если перечислить много несвязанных стилей, результат станет менее предсказуемым.

✍️ Осторожнее с именами авторов. Нейросети понимают указания вроде «в стиле Ван Гога» или «в эстетике фильмов Уэса Андерсона», но некоторые сервисы ограничивают запросы с именами современных авторов. Надежнее описать нужные приемы своими словами, например «симметричная композиция, пастельные цвета, мягкий свет и немного театральные декорации».

Для обложки о переезде я хотела получить современную редакционную фотографию с легкой ностальгией — не глянцевый интерьерный снимок, а живую сцену, будто случайно снятую на пленку. Поэтому добавила к запросу мягкое пленочное зерно, слегка выцветшие тона, естественные фактуры и невысокий контраст.

Вместе со стилем нейросеть изменила и некоторые детали интерьера — например, добавила узорчатый ковер и чугунную батарею
Вместе со стилем нейросеть изменила и некоторые детали интерьера — например, добавила узорчатый ковер и чугунную батарею
ШАГ ЧЕТВЕРТЫЙ

Используем картинки как референсы

Иногда нужный результат проще показать, чем описать словами. К запросу можно приложить фотографию, рисунок, скриншот или предыдущую генерацию. Но важно объяснить, что именно нейросеть должна взять из изображения.

📐 Композиция. Референс может подсказать расположение предметов, ракурс или позу человека. Например: «Сохрани расположение дивана и свободное место слева, но измени интерьер комнаты на современную детскую в зеленых тонах».

🎨 Стиль. Из картинки можно взять палитру, освещение, фактуру и общую атмосферу. Можно так и сказать: «Используй стиль второй картинки». А можно перечислить нужные признаки: «Используй яркие цвета, крупные мазки и характерные штрихи, как на втором рисунке».

Если прикладываете несколько референсов, обозначьте роль каждого: «Первая картинка — пример стиля, вторая — пример композиции».

Женщина в кафе — обычное нейтральное изображение
Абстрактная картина гуашью
Первая картинка задала расположение объектов, вторая — палитру и фактуру

🧍 Объект или персонаж. Если важно сохранить конкретный диван, одежду или внешность героя, укажите это отдельно. Правда, точного переноса удается добиться не всегда, и многое тут зависит от выбранного сервиса. В ChatGPT или Gemini можно указать прямо в запросе, что откуда взять. А, например, в Midjourney для разных задач предусмотрены Image Prompt и Style Reference.

🔧 Все, кроме одной детали. Еще один сценарий — точечно доработать готовое изображение, будь то реальное фото или ранее сгенерированная картинка. Например: «Замени современную батарею на чугунную. Сохрани как есть диван, человека, композицию и освещение». Чем точнее указано, что изменить и что сохранить, тем меньше картинка будет отличаться от исходной.

Референсы можно искать в галереях самих нейросетей, на сайтах с фотографиями, в кино и социальных сетях.

Я взяла в качестве референса предыдущую картинку с мужчиной и диваном. Попросила нейросеть сохранить персонажа, красный диван, коробки и свернутый ковер, но перенести всю сцену в просторный хайтек-интерьер. Так можно проверить, насколько хорошо нейросеть удерживает объекты и композицию при замене окружения.

Мужчина с ковром и диваном переехал в хайтек-интерьер
Мужчина с ковром и диваном переехал в хайтек-интерьер
ШАГ ПЯТЫЙ

Настраиваем формат и качество

Кроме самого запроса во многих сервисах можно выбрать соотношение сторон, качество изображения, а также насколько сильно будут отличаться друг от друга разные варианты генераций.

📐 Соотношение сторон. Определяет форму кадра, но не его разрешение. Квадрат 1:1 подойдет для поста, вертикальный формат 9:16 — для историй и коротких видео, горизонтальный 16:9 — для обложки статьи или презентации. Если нужное соотношение можно выбрать в интерфейсе, надежнее использовать настройку, а не писать «широкий кадр» в запросе.

Картинка стала квадратной, но композиция сохранена
Картинка стала квадратной, но композиция сохранена
Вертикальный формат для сторис
Вертикальный формат для сторис

Размер и качество. Чем выше разрешение и качество, тем дольше может идти генерация и тем дороже она может стоить. Сначала удобно делать быстрые черновики, а максимальное качество выбирать уже для удачного варианта. В разных сервисах это может быть реализовано как отдельный режим Draft, выбор 1K, 2K или 4K или размер картинки в пикселях.

🎲 Вариативность. Некоторые генераторы позволяют регулировать, насколько сильно результаты одного запроса будут отличаться друг от друга. Например, в Midjourney параметр Chaos управляет разбросом вариантов, Stylize — силой собственной эстетики сервиса, а режим Raw уменьшает автоматическую стилизацию и дает больше контроля над результатом. В других сервисах похожие возможности могут находиться на панели настроек.

Все изображения сгенерированы по одному и тому же запросу, но с указанием сделать варианты очень разными
Все изображения сгенерированы по одному и тому же запросу, но с указанием сделать варианты очень разными
ШАГ ШЕСТОЙ

Собираем все в один запрос

Универсальной формулы идеального промпта нет. Но нейросети проще понять запрос, если он построен последовательно: сначала задача и сцена, затем главный объект, действие, композиция, стиль и ограничения.

Удобно придерживаться такого порядка:

  1. Задача и формат — для чего нужна картинка, фотография это или иллюстрация.
  2. Сцена — где все происходит и что находится в кадре.
  3. Главный объект и действие — как он выглядит и что происходит.
  4. Композиция — где расположены предметы, какой нужен ракурс и где оставить свободное место.
  5. Стиль — палитра, свет, материалы и фактура.
  6. Ограничения и настройки — что важно сохранить, чего не должно быть, какое нужно соотношение сторон.

Если результат не подошел, не переписывайте запрос целиком. Сначала измените одно условие: освещение, положение предмета или стиль. Так будет проще понять, какая формулировка повлияла на картинку. Для этого в чате можно дать короткую команду: «Сохрани всю композицию, но сделай свет теплее». В отдельном генераторе — изменить соответствующую часть исходного промпта или воспользоваться редактором изображения.

Финальный вариант обложки: проще интерьер, энергичнее движение, по-прежнему есть место для заголовка
Финальный вариант обложки: проще интерьер, энергичнее движение, по-прежнему есть место для заголовка

Мы постим кружочки, красивые карточки и новости о технологиях и поп-культуре в нашем телеграм-канале. Подписывайтесь, там классно: @t_technocult

интернетнейросети
Даша ЛейзаренкоПридумывали запросы сами? Поделитесь опытом:
  • Hey_sister, go_sisterДаша, спасибо за статью, увлекательнейшая вещь! Скажите, а как использовать референс или смешивать 2 картинки для получения новой? Я наделала несколько картинок, близких к целевой, но не могу понять, как совместить их в одну. На первой нравится стилистика, на второй - композиция.1
  • Hey_sister, go_sisterДаша, а если к двум картинкам еще и целевой запрос добавить, будет вообще ух!0
  • Михаил СмотринКапец, всё перемешали. Где про СД, где про МЖ - не понять.2
  • Alexred alfa romeo brera miami retrowave with driver in pink 80's costume near neon club водителя не нарисовал, но тачка отлично получилась:4
  • MAD RABBIT🥰0
  • Владислав ИжевскийЕще несколько советов, которые собирал по отдельным веткам Дискорда (касаются, соответственно, Midjourney): 1) Поскольку Midjourney можно "скормить" картинку, то можно референсом ставить УЖЕ СГЕНЕРИРОВАННУЮ картинку. Например, сгенерировали аватарку, но нейросеть подрисовала усы или очки - указав в качестве источника полученную картинку с запросом --no moustache или -- no glasses можно добиться желаемого эффекта. Аналогично, если картинка в целом нравится, но нужно поправить детали или перевести в другой стиль и т.д. 2) Продолжение предыдущего пункта: сиды. Если сгенерированная картинка близка к тому, что вы хотели, но нужно чуть поменять запрос, то можно добавить команду --seed номер_сида, чтобы свести к минимуму влияние случайностей при генерации. Получить номер сида можно, отправив сгенерированную картинку себе в личные сообщения, указав в качестве эмодзи-реакции конверт (envelope) 3) Считается, что аниме/манга лучше рисуется с настройкой --NiJi 4) Есть мнение, что если не получается добиться нужного объекта, позы, сцены и т.д., то лучше всего пользоваться так называемыми архетипами. Это значит, что вместо описания многочисленных деталей, лучше одним емким словом-архетипом описать нужный функционал. Например, вместо "с луком и стрелами за спиной" лучше писать "лучник", вместо "в строгом бизнес костюме с галстуком и рубашкой" лучше писать "бизнесмен"... Если никак не получается нужная композиция/стиль/структура, нужно поискать на том же Pinterest, Artstation, какими словами описывают авторы свои изображения, ведь на этих заготовках нейросеть и обучалась 5) Есть еще множество продвинутых функций, с которыми пока не разобрался, но читал про них: remix, custom, blend и другие. Про них можно почитать в ветке prompt-faqs в дискорде Midjourney21
  • Вера ГоловановаПодскажите, пожалуйста, первая картинка с Дуэйн Скалой в каком стиле задана? Очень нравится такой стиль) Спасибо!0
  • Виктор БорисенковПоправлю. Sd абсолютно бесплатен и всё модели и скрипты к нему так же. Лучшая сборка от automatic 11112
  • Klim Sergeev«По умолчанию вес любого слова из запроса равен 0,25» — откуда это? Вес фрагментов (не слов) в запросах (если верить описанию из их гайдов в дискорде) работает как вес в арифметическом средневзвешенном, ему не нужно значение по умолчанию. Можно поставить вес = 500 для единственного фрагмента и он будет слабо отличаться от такого же запроса, где вес этого фрагмента равен одному или 0.0001, лишь бы положительный. Если поставить по 500 на каждый из двух фрагментов, они оба будут пересчитаны как 0.5 и будут иметь равную силу. (A * 500 + B * 500 ) / (500 + 500) = 0.5 * (A + B)0
  • Klim SergeevО, я разбирался) https://vc.ru/s/midjourneygame4
  • Klim SergeevЛучше воспринимать вес, который ставите после двоеточия как долю от суммы всех весов запроса. И если фрагмент один, то его вес = 100% (кроме веса картинок)0
  • Alexey SviridovПрошу прощения за занудство, но Ван Гог — НЕ АРТИСТ, а ХУДОЖНИК! И выбирать надо не артиста, а ХУДОЖНИКА. Слово артист в русском языке имеет совершенно другое значение, пожалуйста, не нужно язык коверкать.4
  • Иван ВелланскийAlexey, так это писала "инженерка")2
  • Olga Abramova"Используйте уже сгенерированные изображения в качестве референса" — а как? Поделитесь кто-нибудь подробностями, пожалуйста.0
  • Ксения ВолковаНикак не получается сгенерировать лого бренда, кто знает, как правильно составлять промты на буквы и цифры ?3
  • Павел ШестаковСделать счастливым человека при помощи песни0
  • Полина Ананьеваcat <lora:Dark_Aura_XL_-_Filled_with_miasma:1> dark aura, dynamic angle, 8K, HD1
  • SushiЛол. Я обычно в качестве промтов использую теги с rule34 убрав из них обычно запрещеные для нейронок слова.0
  • Андрей СорокинКсения, добрый день. Вы разобрались с вашим запросом? У меня аналогичный вопрос.0
  • ОльгаМне на днях ИИ просто взорвал мозг, потому что ни одна из трех сетей почему-то не смогла сгенерировать "гладко выбритого мужчину")))) я сгенерировала полсотни запросов с самыми разными формулировками, но все мужики были с щетиной)))1
  • arina.rubtsowaНа генерациях в посте очень много галлюцинаций, например, плохо прорисованных лиц, косых глаз, неправильных пропорций. Эти картинки брак. Хорошие советы, базовые, в то же время не сказано, как избежать этих галлюцинаций. А именно такие ошибки выдают работу некачественную нейросети.1
  • Константин БелашКсения, смотря где вы генерите. Например stablediffusion модель не умеет работать с текстом, нужны дополнительные инструменты. Но умеет Flux. Зайдите на civitai и попробуйте сгенерить с использованием ,flux модели.0
  • ValeryПромпт для того, чтобы поучить иностранные слова. Например на смартфоне. С микрофоном или без. Для уровня ученика школы. Тестировалось на бесплатных perplexity.ai и web.deepseek.com Т.е. ИИ системы уже о методике знают. Промпт "Давайте поучим английские слова с логическим упражнением по методике Oflameron CZ Block2. В логической задаче Вы показываете мне русский перевод каких-то двух слов из английского языка (например СТЕНА и ВОДА) и на следующем шаге представляете на экране буквы из английских версий слов одним общим списком. Буквы в списке переставлены случайным образом. Например, для слов WALL (стена) и WATER (вода), так: l t e a w l a r w Я должен из этих букв составить два английских слова, перевод которых я получил от ИИ. Я напишу ответ или говорю в микрофон, а вы дадите оценку" Можно заказать любой язык и указать тематику для слов. Если ИИ предлагает слишком простые варианты, закажите из трёх слов или более длинные слова.0
Сообщество
марина колганова (корсунцева)
марина колганова (корсунцева)
Фото питомца: кошка Даша на балконе
марина колганова (корсунцева)
марина колганова (корсунцева)
Фото питомца: кошка Даша отдыхает
София Литвинова
София Литвинова
Майкломания лечится?