tipsСтатьи и советы10 мин чтения

7 правок промпта, когда ИИ-видео вышло не таким

Диагностика ИИ-видео по симптомам: семь правок промпта против плывущих лиц, проигнорированного действия, ухода сцены, каши вместо текста, дрожания и рассинхрона речи.

Команда OmniArt
7 правок промпта, когда ИИ-видео вышло не таким

Большинство неудачных ИИ-клипов — не проблема модели. Это промпт с одним конкретным дефектом, и дефект оставляет отпечаток: плавящиеся руки, объект, который стоит на месте, камера, которая никуда не едет, куртка, меняющая цвет на середине клипа. Как только вы научитесь читать отпечаток, каждая из правок промпта ниже требует одного изменения.

Статья выстроена по симптомам, а не по принципам. Если нужна основа — объект, стиль, свет, композиция, — начните с материала как писать промпты лучше и возвращайтесь сюда, когда конкретная генерация начнёт капризничать. Всё ниже предполагает, что вы уже пишете разумные промпты и хотите знать, какое слово поменять, когда клип провалился.

В примерах используются модели, доступные в видеопространстве OmniArt: Seedance, Veo 3.1, Kling, Grok Imagine, PixVerse V6 и C1 — потому что часть отладки состоит в том, чтобы понять, когда симптом лучше лечится другой моделью, а не новым абзацем промпта.

Меняйте по одной переменной за раз

Прежде чем перейти к отдельным правкам, заведите привычку, которая ускоряет их все: одно изменение на генерацию. Переписывать промпт целиком после плохого дубля бессмысленно — вы не поймёте, какая именно правка помогла.

Длительность, разрешение, соотношение сторон и референсы влияют на результат не меньше формулировок, поэтому записывайте настройки вместе с текстом промпта. Два-три осознанных прогона обычно лучше десяти переписываний.

Совет

Сначала укоротите клип. Большая часть сбоев движения и анатомии исчезает, когда вы просите четыре секунды одного действия вместо восьми секунд трёх действий.

Правка 1: лица, руки и конечности плывут посреди клипа

Что вы видите: первый кадр чистый, а потом пальцы срастаются, лицо съезжает с черепа или во время поворота появляется лишняя рука.

Почему так происходит: модель проводит тело через положения, которых ваш промпт не описывал. Быстрое движение конечностей, крупная рамка на руках, перекрытия (рука проходит перед лицом) и большая длительность — всё это множит число кадров, которые модели приходится придумывать.

Как исправить: сократите то, что нужно придумывать. Отодвиньте рамку на один размер шире, явно назовите механику тела и держите руки либо неподвижно, либо на простой траектории. Старт с готового изображения вместо текста тоже закрепляет анатомию, потому что модель наследует правильное тело, а не угадывает его.

Было: «Крупный план рук повара, которые быстро нарезают овощи и забрасывают их в сковороду».

Стало: «Средний план повара за деревянным столом. Одно ровное режущее движение правой рукой, левая рука плоско лежит на доске. Руки не выходят за кадр, без склеек. 50 мм, мягкий свет из окна слева от камеры».

Для кадров с людьми Veo 3.1 и Kling обычно хорошо держат структуру тела на протяжении всего дубля, а генерация из изображения на любой модели выигрывает у генерации из текста, когда узкое место — анатомия. Если крупный план нужно сохранить, укоротите клип и согласитесь на одно движение вместо двух.

Правка 2: объект игнорирует действие, о котором вы просили

Что вы видите: рамка, свет и стиль совпадают с промптом, но объект просто стоит и дышит либо выполняет какое-то дежурное холостое движение вместо указанного вами действия.

Почему так происходит: действие похоронено. Если глагол стоит в конце длинного описательного предложения или конкурирует с тремя другими глаголами, модель считает его ещё одним свойством неподвижной сцены. У расплывчатых глаголов («взаимодействует», «наслаждается», «исследует») вообще нет визуальной формы, поэтому не происходит ничего.

Как исправить: поставьте объект и действие вперёд, используйте один конкретный физический глагол в настоящем времени и опишите, чем действие заканчивается. Всю стилистику — оптику, палитру, настроение — уводите после действия, чтобы она читалась как украшение, а не как главная часть.

Было: «Драматичный, мрачный, залитый дождём переулок ночью с неоновыми отражениями и паром, где курьер исследует местность и взаимодействует с окружением».

Стало: «Курьер приседает и поднимает упавший конверт, затем встаёт и смотрит налево. Залитый дождём переулок ночью, неоновые отражения на мокром асфальте, пар из решётки. Средний план с рук».

Seedance хорошо отзывается на такие формулировки в духе постановочного листа, а PixVerse C1 — разумный выбор, когда в брифе одно управляемое движение: поворот, протянутая рука, показ товара.

Правка 3: движение камеры не случилось или спорит с объектом

Что вы видите: вы просили наезд, а получили зафиксированный кадр. Или камера едет, но объект странно съезжает относительно фона, и кадр ощущается искажённой фотографией, а не движением через пространство.

Почему так происходит: причин две, и выглядят они похоже. Либо движение заявлено как эффект без мотивации («приблизить», «кинематографичное движение камеры»), либо вы сложили противоречивые указания: наезд при том, что объект идёт на камеру, или панорама плюс наклон плюс кран в одном четырёхсекундном клипе.

Как исправить: одно движение камеры на клип, названное киноязыком и привязанное к тому, что происходит в кадре. Затем проверьте на конфликт: если объект идёт к объективу, камера должна стоять или отступать, а не наезжать.

Было: «Эпичное кинематографичное движение камеры, приблизить и облететь героя, пока он бежит на камеру, динамичные ракурсы».

Стало: «Герой бежит на камеру по коридору. Камера ровным темпом отступает перед ним, держа его в среднем плане. Нижний ракурс, широкий объектив, никаких других движений камеры».

Kling и Seedance хорошо принимают явные указания по камере, а Grok Imagine стоит попробовать для более вольных, энергичных движений, где точность рамки важнее ощущения. Если движение всё равно отказывается регистрироваться, описывайте изменение того, что видит зритель, — «линия горизонта входит в кадр снизу», — а не называйте технику съёмки.

Правка 4: сцена уходит или внешность меняется посреди клипа

Что вы видите: объект начинает как один человек и заканчивает как его двоюродный брат. Красная куртка становится бордовой, витрина на фоне перестраивается, в комнате вырастает второе окно.

Почему так происходит: внешность ничем в генерации не закреплена. Текстовые промпты описывают категорию, а не конкретного человека, поэтому каждый кадр вправе трактовать «молодую женщину в красной куртке» немного иначе. Большая длительность и насыщенный фон ускоряют уход.

Как исправить: закрепите изображением, а потом описывайте только то, что меняется. Когда вы загружаете референс или начальный кадр, повторное описание внешности в промпте прямо вредит: текст конкурирует с изображением. Держите фон простым и разбивайте длинные идеи на несколько коротких кадров вместо одного длинного дубля.

Было: «Молодая женщина в красной куртке с каштановыми волосами идёт по оживлённому рынку, 10 секунд, много деталей, много людей и прилавков».

Стало: «Сохранить лицо, волосы и красную куртку объекта с референса без изменений. Она идёт вперёд мимо двух прилавков и останавливается, чтобы посмотреть направо. Малая глубина резкости, чтобы рынок за ней оставался мягким. 5 секунд, один непрерывный кадр».

Примечание

Работа с референсами устроена по-разному в разных моделях. PixVerse C1 поддерживает движение по референсу и переходы от начального кадра к конечному, когда важны обе композиции, а PixVerse V6 поддерживает многокадровые последовательности. Проверьте в конструкторе генерации, что открывает выбранная модель, прежде чем писать промпт, который на это опирается.

Правка 5: текст и логотипы выходят кашей

Что вы видите: вывеска, на которой написано «SHOPP», этикетка товара, растворяющаяся в псевдобуквах, логотип, мутирующий каждые несколько кадров.

Почему так происходит: видеомодели генерируют текст как текстуру, а не как глифы, и любое движение перерисовывает эту текстуру кадр за кадром. Мелкий кегль, текст на изогнутых или движущихся поверхностях и текст в перспективной плоскости — худшие случаи.

Как исправить: перестаньте просить видеомодель сочинять текст. Сгенерируйте кадр моделью изображений, где типографику можно дёшево прогонять итерациями, а потом оживите этот кадр. В видеопромпте приведите точную строку в кавычках, держите её короткой и оставьте поверхность с надписью максимально плоской и неподвижной.

Было: «Витрина кафе с большой детальной вывеской, меню-бордами и множеством указателей, пока камера пролетает мимо».

Стало: «Оживить предоставленный кадр. Вывеска с надписью 'DAYLIGHT' остаётся плоской к камере и неизменной. Медленный боковой снос вправо, вывеска всё время полностью в кадре, другого текста не видно».

В OmniArt первый шаг можно сделать моделью изображений вроде GPT Image 2 или Seedream 5.0 Pro, а затем отправить одобренный кадр в видеомодель в том же рабочем пространстве. Для всего, что идёт клиенту, считайте читаемый текст задачей, которая по умолчанию начинается с изображения.

Правка 6: движение слишком быстрое, дёрганое или рывками

Что вы видите: клип идёт как на скорости 1,5x, или объект слегка вибрирует, или движение продвигается заметными шагами, а не плавно.

Почему так происходит: прилагательные интенсивности читаются как скорость. «Динамичный», «взрывной», «энергичный», «полный экшена» толкают модель втиснуть больше изменений в то же число кадров. Вторая частая причина — слишком много событий за слишком малое время: три доли в четырёх секундах не оставляют кадров ни на одну из них.

Как исправить: удалите слова интенсивности и задайте темп. Одна доля на клип, укажите, что кадр непрерывный, и если действию действительно нужно больше времени, просите большую длительность, а не более быструю игру.

Было: «Взрывной динамичный экшен-кадр, скейтбордист делает трюки, быстрое энергичное движение, частые склейки».

Стало: «Скейтбордист выкатывается на рампу и наверху делает одно медленное олли. Ровный, равномерный темп, один непрерывный кадр, без склеек. Камера едет рядом с той же скоростью».

Если дрожание мелкое, а не структурное, попробуйте более высокий уровень той же семейной линейки моделей — стандартный вместо ускоренного или облегчённого, — поскольку младшие уровни обменивают временную устойчивость на скорость и цену.

Правка 7: звук и артикуляция не совпадают

Что вы видите: рот двигается раньше или позже слов, реплика продолжается при закрытых губах, а речь тонет в музыке, которую модель добавила сама.

Почему так происходит: синхронности речи нужен видимый рот и реплика, достаточно короткая, чтобы уместиться в клип. Длинный диалог в пятисекундном кадре заставляет модель либо гнать артикуляцию, либо потерять синхронность. Описания вроде «с эпичным саундтреком» приглашают музыкальную подложку, которая конкурирует с голосом.

Как исправить: один говорящий, одна короткая реплика в кавычках, рот в ясной рамке и без перекрытий, никаких конкурирующих указаний по звуку. Говорите, что должно молчать, так же явно, как то, что должно быть слышно.

Было: «Двое людей говорят о запуске продукта под эпичный саундтрек и городскую атмосферу, крупный план».

Стало: «Средний крупный план одной женщины лицом к камере, рот полностью виден. Она говорит: 'Отправляем в пятницу'. Затем делает паузу и улыбается. Только тихий шум помещения, без музыки».

Veo 3.1 генерирует собственный звук, включая речь, а PixVerse V6 поддерживает звук на бесплатном тарифе OmniArt. Когда у нужной модели своего звука нет, надёжный путь такой: сгенерировать клип без звука, отдельно получить голос речевой моделью вроде MiniMax Speech 2.8 или ElevenLabs, а потом сложить их вместе. Это заодно даёт возможность переписать начитку, не пересоздавая картинку.

Быстрая таблица: симптом и правка

Пользуйтесь ею как таблицей первичной сортировки, когда клип вернулся неправильным. Меняйте то, что стоит в первом столбце, прежде чем трогать что-либо ещё.

СимптомЧто менять первымЗамечание по модели
Плывут лица или рукиШире рамка, короче клип, начальный кадр изображениемVeo 3.1, Kling для движения человека
Действие проигнорированоВынести глагол вперёд, одно конкретное действиеSeedance, PixVerse C1
Движение камеры отсутствуетОдно названное, мотивированное движение; убрать конфликтыKling, Seedance, Grok Imagine
Уход сцены или внешностиРеференс, описывать только то, что меняетсяРеференс в PixVerse C1, многокадровость в V6
Каша вместо текстаСначала сгенерировать кадр моделью изображенийGPT Image 2, Seedream 5.0 Pro, затем любая видеомодель
Движение слишком быстрое или дёрганоеУбрать слова интенсивности, задать темп, увеличить длительностьПредпочитайте стандартные уровни ускоренным и облегчённым
Артикуляция не совпадаетОдна короткая реплика в кавычках, рот в кадре, без музыкиVeo 3.1, PixVerse V6 или добавить речь отдельно

Как начать в OmniArt

Возьмите свой последний неудачный клип и продиагностируйте его по семи симптомам выше. Примените ровно одну правку, сгенерируйте заново и сравните — двух прогонов обычно достаточно, чтобы понять, дело было в промпте или в выборе модели. Поскольку OmniArt держит модели изображений, видео и звука в одном рабочем пространстве, упрямый кадр может переходить между подходами без пересборки вашего окружения: закрепите его моделью изображений, попробуйте на второй видеомодели или добавьте голосовую дорожку отдельно.

Откройте рабочее пространство создания, вставьте исправленный промпт и оставляйте те дубли, которые держат удар.

Готовы создавать?

Начните генерировать впечатляющий контент с ИИ

Начать бесплатно