Google Veo 3 генерирует видео со звуком и диалогами, но при размытом запросе вроде «человек идёт по улице» модель выдаёт случайный ракурс, плоское освещение и рассинхрон речи — и лимит генераций расходуется впустую. Проблема почти всегда не в нейросети, а в структуре промта: Veo 3 ожидает описание сцены, камеры, звука и действия в определённой логике.
В этом руководстве разберём, из каких блоков состоит эффективный промт для Google Veo 3, как описывать движение камеры и аудиодорожку, какие ошибки чаще всего портят результат и как адаптировать запросы под разные задачи — от кинематографичных роликов до рекламных видео.
Что такое Google Veo 3 и почему промт решает всё
Veo 3 — это модель генерации видео от Google, доступная через сервисы вроде Gemini и Flow. Её ключевая особенность — синхронная генерация звука: шагов, шума города, музыки и даже диалогов персонажей с lip-sync. Именно поэтому промт для Veo 3 отличается от промтов для Midjourney или Stable Diffusion: здесь нужно описывать не только картинку, но и звуковую сцену.
Модель чувствительна к деталям. Запрос «красивый закат» даст случайный результат, а «static wide shot, golden hour sunset over calm ocean, gentle waves, soft ambient sound of water» — предсказуемый и управляемый. Конкретика в промте напрямую определяет качество генерации.
⚠️ Внимание: интерфейс, лимиты и доступные функции Veo 3 зависят от вашего тарифа и региона. Перед массовой генерацией проверьте актуальные условия в официальной документации Google — они периодически меняются.
Структура идеального промта для Veo 3
Рабочая формула промта для Veo 3 состоит из шести блоков. Не обязательно использовать все, но чем больше релевантных деталей, тем стабильнее результат:
- 🎬 Субъект и действие — кто в кадре и что делает: «a barista pours latte art»
- 🎥 Камера — тип плана и движение: «close-up», «slow dolly in», «aerial drone shot»
- 🌍 Окружение — локация, время суток, погода: «rainy Tokyo street at night»
- 💡 Освещение и стиль — «cinematic lighting», «film grain», «35mm film look»
- 🔊 Звук — фон, эффекты, музыка: «ambient city noise, distant sirens»
- 🗣 Диалог — реплики в кавычках с указанием говорящего
Порядок блоков не критичен, но логично начинать с камеры или субъекта — так модель быстрее «фиксирует» главный объект сцены. Проверьте, что каждый блок добавляет новую информацию, а не дублирует уже сказанное.
Как описывать камеру и движение
Кинематографические термины — самый сильный инструмент управления Veo 3. Модель хорошо понимает профессиональную лексику операторов. Вместо «камера приближается» используйте slow dolly in, вместо «съёмка сверху» — aerial top-down shot.
| Термин в промте | Что делает камера | Когда использовать |
|---|---|---|
| close-up / extreme close-up | Крупный план лица или объекта | Эмоции, детали продукта |
| wide shot / establishing shot | Общий план локации | Начало сцены, пейзажи |
| dolly in / dolly out | Плавный наезд или отъезд | Нарастание драмы, акцент |
| tracking shot | Камера следует за объектом | Движение, экшен, бег |
| static shot | Неподвижная камера | Диалоги, минимализм |
Один промт — одно основное движение камеры. Если указать dolly in и pan left одновременно, модель может «смешать» их в дрожащий, нестабильный результат.
Работа со звуком и диалогами
Это то, что отличает Veo 3 от других видеогенераторов. Звук описывается прямо в промте отдельным предложением, обычно с маркерами вроде Audio: или SFX:. Для диалогов реплику помещают в кавычки и указывают, кто говорит.
Пример блока диалога:
A woman in a red coat says: "The train leaves in five minutes."
Audio: station announcements, footsteps on concrete.
- 🎙 Описывайте голос — «deep male voice», «soft whisper», иначе тембр будет случайным
- 🌆 Добавляйте фон — тишина в кадре выглядит неестественно, укажите ambient-звуки
- ⏱ Короткие реплики — длинные монологи модель может не уместить в хронометраж ролика
Готовые примеры промтов для Veo 3
Ниже — шаблоны, которые можно адаптировать под свои задачи. Обратите внимание: каждый пример содержит камеру, действие, свет и звук.
Кинематографичная сцена:
Cinematic tracking shot: a lone cyclist rides through foggy morning
forest, sun rays breaking through trees, shallow depth of field,
35mm film look. Audio: birds chirping, wheels on gravel, wind.
Рекламный ролик продукта:
Macro close-up: drops of water slide down a cold glass bottle of
sparkling water, studio lighting, dark background, slow motion.
Audio: crisp fizzing sound, subtle ambient music.
Сцена с диалогом:
Medium shot, two detectives in a dim interrogation room. The older
detective leans forward and says: "Where were you last night?"
Audio: ticking clock, hum of fluorescent lamp.
Почему промт на русском работает хуже
Основной массив обучающих данных видеомоделей — англоязычные описания. Русский промт Veo 3 сначала интерпретирует, и нюансы (оттенки освещения, типы планов, эмоции) часто теряются. Решение: пишите на английском или используйте перевод с последующей ручной правкой терминов.
Типичные ошибки при составлении промтов
Большинство неудачных генераций объясняется горсткой повторяющихся ошибок. Проверьте свой промт по этому списку перед запуском:
- 🚫 Слишком много действий — один ролик, одна сцена, одно ключевое действие
- 🚫 Абстрактные слова — «красиво», «эпично» модель трактует произвольно
- 🚫 Отсутствие камеры — без указания плана ракурс выбирается случайно
- 🚫 Игнорирование звука — аудиодорожка достраивается без вашего контроля
- 🚫 Противоречия — «night scene, bright sunlight» ломает генерацию
⚠️ Внимание: Veo 3 может отклонять промты с упоминанием реальных людей, брендов и некоторых категорий контента по правилам безопасности Google. Если генерация отклонена, переформулируйте запрос нейтрально, не пытаясь обойти фильтры.
Итеративный подход: как улучшать результат
Редко какой промт даёт идеальный результат с первой попытки. Рабочая стратегия — итерации: сгенерируйте черновой вариант, определите, что именно не устроило (ракурс, свет, темп, звук), и измените только один блок промта за раз. Так вы точно поймёте, какая формулировка повлияла на результат.
Ведите библиотеку удачных промтов. Сохраняйте формулировки, которые дали хороший результат по камере, свету или звуку, и собирайте из них новые запросы как конструктор. Со временем это экономит значительную часть лимитов генерации.
☑️ Проверка промта перед генерацией
Часто задаваемые вопросы
Нужно ли писать промт для Veo 3 на английском?
Модель понимает русский, но англоязычные промты дают заметно более точный и предсказуемый результат, особенно в части кинематографических терминов, освещения и эмоций. Рекомендуется писать на английском или тщательно проверять автоматический перевод.
Как заставить персонажа говорить конкретную фразу?
Опишите персонажа, укажите его действие и поместите реплику в кавычки: The man in a blue jacket says: "your phrase here". Дополнительно задайте тип голоса и фоновые звуки. Реплика должна быть короткой, чтобы уложиться в длительность ролика.
Почему Veo 3 игнорирует часть моего промта?
Чаще всего причина — перегруженный запрос: несколько действий, конфликтующие описания или слишком длинный текст. Сократите промт до одной сцены, уберите противоречия и оставьте только значимые детали. Также проверьте, не нарушает ли запрос правила контентной политики.
Можно ли использовать один промт для серии роликов?
Да, это удобно для единого стиля: зафиксируйте блоки камеры, света и стиля, меняя только субъект и действие. Однако полной идентичности персонажей между генерациями модель не гарантирует — описывайте внешность максимально детально в каждом промте.
Что делать, если генерация отклонена системой безопасности?
Переформулируйте промт нейтрально: уберите имена реальных людей, торговые марки и потенциально чувствительные сюжеты. Замените конкретику на обобщённые описания — например, вместо бренда используйте «a modern smartphone». Не пытайтесь обходить фильтры, это может привести к ограничению доступа.