Промт «красивая девушка на фоне города» почти гарантированно даёт шаблонную картинку с пластиковой кожей и пересвеченным небом — а замена всего трёх слов в запросе меняет результат кардинально. Разница между посредственной генерацией и изображением, которое не отличить от профессиональной фотографии, почти всегда кроется не в нейросети, а в структуре самого промта: указании типа съёмки, оптики, освещения и атмосферы кадра.
В этой статье собраны интересные промты для нейросетей, генерирующих фото: Midjourney, Stable Diffusion, DALL-E, Flux и других моделей. Вы найдёте готовые формулировки для портретов, пейзажей, предметной съёмки и креативных экспериментов, а также разбор того, из каких блоков строится сильный запрос и почему одни слова работают, а другие модель игнорирует.
Из чего состоит сильный промт для фотогенерации
Нейросети, обученные на фотографиях, реагируют на язык фотографов, а не на абстрактные пожелания. Слова «красиво» и «качественно» почти не влияют на результат, потому что модель не знает, что именно вы считаете красивым. Зато термины вроде портретной съёмки с малой глубиной резкости или контрового света на закате напрямую связаны с визуальными паттернами в обучающих данных.
Рабочая структура промта для фотореалистичного изображения обычно включает пять блоков:
- 📸 Субъект — кто или что в кадре, с конкретными деталями внешности, одежды, позы;
- 🎬 Действие и настроение — что происходит, эмоция, атмосфера сцены;
- 💡 Освещение — тип света: мягкий рассеянный, жёсткий полуденный, неоновый, свеча;
- 🔭 Камера и оптика — фокусное расстояние, диафрагма, ракурс, тип объектива;
- 🎨 Стиль и обработка — плёночный вид, цветокоррекция, референс эпохи или жанра.
Необязательно заполнять все пять блоков в каждом запросе — для простых задач хватает субъекта и света. Но когда результат «не цепляет», почти всегда не хватает именно блока камеры или освещения: без них модель выбирает усреднённый вариант, который и выглядит «нейросетевым».
Промты для портретной фотографии
Портрет — самый популярный жанр генерации и одновременно самый требовательный к деталям. Лицо человека мгновенно выдаёт артефакты: асимметрию глаз, неестественные зубы, странные руки. Чтобы минимизировать проблемы, описывайте портрет максимально конкретно и избегайте перегруженных фонов.
Вот несколько рабочих идей, которые можно адаптировать под себя:
- 🧑🎨 «Портрет пожилого моряка, глубокие морщины, седые щетина, взгляд в сторону, мягкий оконный свет, 85mm f/1.8, малая глубина резкости, тёплые тона» — классический характерный портрет;
- 🌃 «Молодая женщина под неоновыми вывесками ночного города, отражения на мокром асфальте, киберпанк-освещение, синие и розовые неоновые блики на лице, cinematic» — ночная городская съёмка;
- 📻 «Портрет в стиле 1970-х, девушка в вельветовой куртке, золотистый солнечный свет сквозь занавеску, плёночное зерно, выцветшие цвета, vintage photography» — ретро-эстетика;
- 🎭 «Чёрно-белый студийный портрет, жёсткий боковой свет, сильные тени, high contrast, драматичное освещение Рембрандта» — классика световых схем.
Обратите внимание: в каждом примере указан не только человек, но и свет, и оптика. Именно связка «свет + объектив» отвечает за фотографичность. Если убрать эти блоки, модель вернёт усреднённый цифровой рендер.
⚠️ Внимание. Запросы на генерацию изображений реальных людей — публичных персон, коллег, знакомых — могут нарушать правила сервиса и законодательство о личных данных и изображении гражданина. Используйте нейросети для вымышленных персонажей или собственных фотографий с согласия изображённых людей.
Пейзажи и атмосферные сцены
Пейзажные промты прощают больше ошибок, чем портретные, но здесь решающую роль играет атмосфера. Слово «горы» даст открытку из стока, а вот «горный хребет в утреннем тумане, лучи солнца пробиваются сквозь облака, объёмный свет» — уже кадр с глубиной и настроением.
Ключевые усилители пейзажных промтов — это погодные явления и время суток. Туман, дождь, метель, золотой час, синий час, грозовое небо — каждое из этих слов резко меняет картинку. Добавьте точку интереса на переднем плане — одинокое дерево, человека с зонтом, заброшенную лодку — и композиция перестанет быть плоской.
Несколько готовых идей:
«Осенний лес после дождя, лучи солнца сквозь туман между стволами, ковёр из красных листьев, объёмный свет, широкоугольный объектив, гиперреализм» — классический осенний кадр. Или более необычный вариант: «Пустыня ночью, Млечный Путь над дюнами, длинная выдержка, звёздное небо, силуэт верблюда на гребне бархана, astrophotography».
Предметная съёмка и фуд-фотография
Коммерческая предметная съёмка — жанр, где нейросети дают результаты, пригодные для реальных задач: карточек товаров, меню, соцсетей. Здесь промт строится вокруг поверхности, реквизита и световой схемы, а не вокруг самого объекта — чашка кофе есть у всех, а вот чашка на тёмном сланце с паром и каплями росы выглядит как работа фуд-фотографа.
Что добавлять в промты для предметки:
- ☕ Реквизит и фактуру — «на деревянном столе», «льняная салфетка», «капли воды на стекле»;
- 💡 Схему света — «мягкий свет из окна слева», «студийный софтбокс», «подсветка контура сзади»;
- 📐 Ракурс — «вид сверху (flat lay)», «макросъёмка», «съёмка на уровне глаз»;
- 🌫 Атмосферу — «пар над блюдом», «брызги в замороженном движении», «размытый фон кафе».
Пример для фуд-фотографии: «Круассан на мраморной доске, крошки, чашка эспрессо на фоне, утренний свет из окна, макросъёмка, малая глубина резкости, аппетитные тёплые тона, editorial food photography». Для косметики или техники замените реквизит: «Флакон духов на мокром камне, брызги воды в заморозке, драматичная подсветка, тёмный фон, luxury product photography».
☑️ Проверка промта перед генерацией
Креативные и необычные идеи
Когда базовые жанры освоены, самое интересное начинается на стыке стилей. Нейросети отлично справляются с противоречивыми сочетаниями, которые в реальной съёмке невозможны или стоят огромных денег. Самые вирусные генерации почти всегда построены на неожиданном контрасте: эпоха против эпохи, микро против макро, обыденность против фантастики.
Идеи для экспериментов:
- 🕰 Анахронизмы — «рыцарь в полном доспехе едет в метро, фотореализм, документальный стиль»;
- 🔬 Микромиры — «крошечный город внутри стеклянной лампочки, макросъёмка, tilt-shift эффект»;
- 🐾 Перевёрнутые роли — «кот-астронавт сажает флаг на Луне, съёмка National Geographic»;
- 🌊 Невозможная физика — «океанская волна, застывшая как стеклянная скульптура, закатный свет сквозь воду»;
- 🏚 Постапокалипсис и заброшки — «заросший мхом торговый центр, солнечные лучи сквозь обрушенную крышу, олень среди полок».
Как придумывать собственные необычные промты
Возьмите два слова из разных областей — например, «библиотека» и «подводный мир». Соедините их в одну сцену: «подводная библиотека, рыбы плавают между стеллажами, лучи света сквозь воду». Затем добавьте технические блоки: освещение, оптику, стиль. Чем абсурднее исходная пара, тем оригинальнее результат — модель не имеет «здравого смысла» и честно отрисует любую комбинацию.
Ещё одно продуктивное направление — имитация конкретных фотографических техник: двойная экспозиция, съёмка через призму, инфракрасная фотография, дагерротип, полароидный снимок. Эти термины хорошо представлены в обучающих данных и дают узнаваемый, стильный результат.
Технические параметры и типичные ошибки
Разные нейросети по-разному понимают промты. Midjourney лучше реагирует на короткие образные описания с параметрами в конце, Stable Diffusion — на плотные перечисления тегов с весами, а DALL-E и Flux хорошо понимают длинные естественные предложения. Один и тот же промт в разных моделях даст заметно разные результаты — это нормально, адаптируйте формулировки под конкретный инструмент.
Типичные ошибки, из-за которых генерации выглядят слабо:
| Ошибка | Почему это плохо | Как исправить |
|---|---|---|
| Только субъект без контекста | Модель выбирает усреднённый фон и свет | Добавить освещение и окружение |
| Слова «красивый, качественный» | Не привязаны к визуальным паттернам | Заменить на конкретные термины съёмки |
| Противоречия в промте | «Ночь» и «яркое солнце» конфликтуют | Проверить логику всех блоков |
| Слишком много деталей сразу | Модель теряет часть указаний | Оставить 5–7 ключевых элементов |
| Игнорирование негативного промта | Артефакты рук, лишние пальцы, искажения | В Stable Diffusion указать негативный промт |
⚠️ Внимание. В Stable Diffusion негативный промт — отдельное поле, куда выносят нежелательные элементы: деформированные руки, размытость, водяные знаки, лишние конечности. В Midjourney для этого служит параметр --no. Не путайте эти механизмы: слова «без дефектов» внутри основного промта могут, наоборот, усилить дефекты, потому что модель «видит» само слово.
Пример негативного промта для портретов в Stable Diffusion:
deformed hands, extra fingers, blurry, watermark, text, low quality, bad anatomy, mutated face
Как улучшать результаты итерациями
Редко какая генерация получается идеальной с первого раза. Рабочий процесс выглядит так: сначала грубый промт для проверки композиции, затем последовательное добавление деталей. Меняйте по одному элементу за итерацию — так вы поймёте, какое именно слово дало нужный эффект. Если изменить пять блоков сразу, причину улучшения отследить невозможно.
Вам также помогут вариации: в Midjourney это кнопки V1–V4 под результатом, в других сервисах — повторная генерация с тем же промтом, но другим зерном (seed). Если композиция нравится, но не нравится лицо — зафиксируйте seed и уточните только описание лица. Этот приём экономит десятки попыток.
Полезно вести собственную библиотеку промтов: сохраняйте удачные формулировки вместе с результатами. Через пару недель у вас соберётся персональный набор «рецептов» под ваши задачи — и это ценнее любой чужой подборки, потому что подборки устаревают вместе с обновлением моделей, а понимание структуры остаётся.
Часто задаваемые вопросы
На каком языке писать промты — русском или английском?
Большинство моделей обучены преимущественно на англоязычных описаниях, поэтому английский даёт более предсказуемый результат. DALL-E и некоторые другие сервисы понимают русский, но тонкие оттенки стиля надёжнее передавать на английском. Практичный вариант — продумать промт на русском, затем перевести.
Почему нейросеть рисует искажённые руки и лица?
Это известное ограничение генеративных моделей: мелкие сложные структуры вроде пальцев требуют высокой детализации. Помогают негативный промт, упрощение позы, крупный план лица вместо полного роста и выбор лучшего результата из нескольких генераций. Новые версии моделей справляются с руками заметно лучше старых.
Можно ли использовать сгенерированные фото в коммерческих целях?
Это зависит от условий конкретного сервиса и вашего тарифа — у разных платформ правила различаются. Перед коммерческим использованием проверьте лицензионное соглашение выбранной нейросети. Также учитывайте, что изображения реальных людей и защищённых брендов могут создавать юридические риски независимо от лицензии сервиса.
Как сделать, чтобы персонаж выглядел одинаково на разных генерациях?
Полного сходства добиться сложно, но есть приёмы: фиксация seed, максимально детальное и неизменное описание внешности, использование функций вроде Character Reference в Midjourney или обучение LoRA-модели на наборе изображений персонажа в Stable Diffusion. Доступность этих функций зависит от сервиса и версии модели.
Что делать, если модель игнорирует часть промта?
Сократите запрос до ключевых элементов — длинные промты «размывают» приоритеты. Вынесите самое важное в начало описания: многие модели сильнее реагируют на первые слова. В Stable Diffusion можно усилить элемент весами, например (красное платье:1.3). Если деталь критична, иногда проще сгенерировать сцену без неё и добавить её последующей генерацией или редактированием.