Когда нейросеть вместо «киберпанк-города в дождь» выдаёт размытое пятно с лишними антеннами, причина почти всегда в самом промте: модели не хватило конкретики о композиции, освещении и стиле. Проверить это просто — достаточно сравнить результат короткого запроса из трёх слов и структурированного описания в 30–50 слов: разница в детализации видна сразу.
В этом материале разберём, как устроен хороший промт, какие формулы работают в Midjourney, Stable Diffusion и DALL-E, и дадим готовые шаблоны, которые можно адаптировать под свои задачи — от портретов до концепт-арта.
Как нейросети понимают промт
Промт — это текстовое описание, по которому генеративная модель строит изображение. Модель не «понимает» смысл как человек: она сопоставляет слова с визуальными паттернами, на которых обучалась. Поэтому порядок и точность слов напрямую влияют на результат.
У большинства моделей слова в начале промта имеют больший вес, чем в конце. Если главный объект — «рыжая кошка на подоконнике», ставьте его первым, а детали фона и атмосферы — после. Это простое правило заметно снижает количество «случайных» результатов.
Ещё один нюанс: абстрактные слова вроде «красиво» или «качественно» почти бесполезны. Модели нужны конкретные визуальные якоря — материалы, источники света, ракурс камеры, художественный стиль.
Универсальная структура промта
Рабочая формула, которая подходит для большинства генераторов, выглядит так: объект + действие/поза + окружение + освещение + стиль + технические параметры. Необязательно заполнять все шесть блоков, но минимум три-четыре дают устойчивый результат.
- 🎯 Объект — кто или что в кадре: «пожилой рыбак», «футуристический мотоцикл».
- 🌆 Окружение — фон и контекст: «на пристани на рассвете», «в неоновом гараже».
- 💡 Освещение — «мягкий рассеянный свет», «контровой свет заката», «неоновая подсветка».
- 🎨 Стиль — «цифровая живопись», «акварель», «фотореализм», «в стиле Studio Ghibli».
- 📷 Камера — «крупный план», «вид с высоты птичьего полёта», «объектив 85mm, малая глубина резкости».
Пример собранного промта:
elderly fisherman mending nets on a wooden pier at dawn, soft golden backlight, photorealistic, 85mm lens, shallow depth of field
Обратите внимание: промт написан на английском. Большинство моделей обучались преимущественно на англоязычных подписях, поэтому запрос на английском обычно даёт более точный результат, даже если сервис принимает русский.
Готовые промты по жанрам
Ниже — проверенные шаблоны для популярных задач. Их можно копировать и менять ключевые слова под свою сцену.
| Жанр | Пример промта | Ключевые слова |
|---|---|---|
| Портрет | portrait of a young woman with freckles, natural window light, film photography, 50mm | window light, film grain |
| Пейзаж | misty mountain valley at sunrise, pine forest, volumetric fog, digital painting | volumetric fog, sunrise |
| Фуд-фото | rustic apple pie on wooden table, steam, warm side light, food photography, macro | steam, warm side light |
| Концепт-арт | abandoned space station interior, overgrown with plants, cinematic lighting, concept art | cinematic lighting |
| Аниме | girl with umbrella in rainy Tokyo street at night, neon reflections, anime style, Makoto Shinkai inspired | neon reflections |
Каждый шаблон стоит воспринимать как каркас: замените объект, время суток и стиль — и получите десятки вариаций без потери качества формулировки.
Промты для Midjourney: параметры и стиль
Midjourney отличается тем, что поддерживает специальные параметры после двойного дефиса. Они управляют соотношением сторон, степенью «стилизации» и вариативностью результата.
cozy cabin in snowy forest, warm light from windows, evening --ar 16:9 --style raw
Параметр --ar задаёт пропорции кадра (например, --ar 16:9 для обоев), а --style raw снижает фирменную «приукрашенность» модели — полезно, когда нужен более буквальный результат. Набор доступных параметров зависит от версии модели, поэтому актуальный список стоит сверять в официальной документации Midjourney.
⚠️ Внимание: не складывайте в один промт десятки стилей сразу («акварель, масло, аниме, фотореализм»). Конфликтующие указания дают усреднённый, невыразительный результат. Лучше один стиль и один-два модификатора.
Промты для Stable Diffusion и DALL-E
В Stable Diffusion (включая интерфейсы вроде AUTOMATIC1111 или ComfyUI) важную роль играет негативный промт — отдельное поле, где перечисляется то, чего на картинке быть не должно. Это один из самых эффективных инструментов чистки результата.
Негативный промт (базовый набор):
blurry, low quality, deformed hands, extra fingers, watermark, text, cropped
DALL-E, встроенный в ChatGPT, наоборот, лучше реагирует на развёрнутые естественные описания целыми предложениями, чем на набор ключевых слов через запятую. Ему можно писать так: «нарисуй уютную кофейню дождливым вечером, вид изнутри через запотевшее окно, тёплый жёлтый свет».
- 🧩 Для Stable Diffusion — короткие теги через запятую + негативный промт.
- 💬 Для DALL-E — связное описание сцен одним-двумя предложениями.
- ⚖️ Для Midjourney — описание + параметры через
--.
Почему руки и пальцы получаются деформированными
Генеративные модели не «знают» анатомию — они воспроизводят статистические паттерны. Кисти рук в обучающих данных часто маленькие, частично скрытые и размытые, поэтому модель ошибается. Помогают негативные промты (deformed hands, extra fingers), скрытие рук в композиции (в карманах, за спиной) и генерация в более высоком разрешении с последующей доработкой.
Типичные ошибки при составлении промтов
Первая и самая частая ошибка — перегрузка промта. Когда описание превращается в простыню из ста слов, модель начинает игнорировать часть указаний, и контроль над результатом теряется. Оптимально — 20–60 слов с чёткими приоритетами.
Вторая ошибка — использование отрицаний в основном промте. Фраза «без людей на улице» часто даёт обратный эффект: модель «видит» слово «люди» и добавляет их. Для исключений используйте негативный промт, если инструмент его поддерживает, или переформулируйте позитивно — «пустая улица».
⚠️ Внимание: названия живых художников и защищённых брендов в промтах могут нарушать правила сервиса. Ряд платформ блокирует такие запросы или фильтрует результаты — проверяйте условия использования конкретного генератора.
Третья ошибка — ожидание идеала с первой генерации. Профессиональный результат почти всегда получается итеративно: генерируете, анализируете, меняете 2–3 слова, генерируете снова.
☑️ Проверка промта перед генерацией
Как улучшать результаты итеративно
Рабочий цикл выглядит так: сначала генерируете 4–8 вариантов базового промта и выбираете лучший по композиции. Затем усиливаете то, что понравилось: добавляете детали освещения, уточняете ракурс, меняете один элемент за раз. Менять всё сразу — значит потерять понимание, какое слово сработало.
Полезный приём — фиксация сида (seed), если инструмент это позволяет. Один и тот же seed с изменённым промтом показывает, как именно ваши правки влияют на картинку, без случайного шума между генерациями.
Часто задаваемые вопросы
Можно ли писать промты на русском языке?
Технически — да, многие сервисы принимают русский и автоматически переводят запрос. Но модели обучались преимущественно на англоязычных данных, поэтому промты на английском обычно дают более точный и предсказуемый результат. Если английский сложен, используйте переводчик для проверки формулировок.
Сколько слов должно быть в промте?
Универсальной нормы нет, но практически удобный диапазон — 20–60 слов. Короткий промт даёт модели слишком много свободы, а чрезмерно длинный размывает приоритеты. Важнее не длина, а структура: объект, окружение, свет, стиль.
Что такое негативный промт и где он работает?
Это список того, чего на изображении быть не должно: размытие, лишние пальцы, водяные знаки. Поддерживается в Stable Diffusion и ряде других инструментов, но не во всех сервисах — в DALL-E, например, отдельного поля для негативного промта нет.
Почему один и тот же промт даёт разные результаты?
Генерация стартует со случайного шума, поэтому результаты различаются. Если инструмент позволяет зафиксировать параметр seed, одинаковые промт и seed дадут воспроизводимый результат.
Какие стили работают лучше всего?
Устойчиво хорошие результаты дают общеизвестные визуальные категории: фотореализм, цифровая живопись, акварель, пиксель-арт, кинематографический стиль. Конкретные имена художников усиливают стилизацию, но могут ограничиваться правилами сервиса.