7 правок промпта, когда ИИ-видео вышло не таким
Диагностика ИИ-видео по симптомам: семь правок промпта против плывущих лиц, проигнорированного действия, ухода сцены, каши вместо текста, дрожания и рассинхрона речи.

Большинство неудачных ИИ-клипов — не проблема модели. Это промпт с одним конкретным дефектом, и дефект оставляет отпечаток: плавящиеся руки, объект, который стоит на месте, камера, которая никуда не едет, куртка, меняющая цвет на середине клипа. Как только вы научитесь читать отпечаток, каждая из правок промпта ниже требует одного изменения.
Статья выстроена по симптомам, а не по принципам. Если нужна основа — объект, стиль, свет, композиция, — начните с материала как писать промпты лучше и возвращайтесь сюда, когда конкретная генерация начнёт капризничать. Всё ниже предполагает, что вы уже пишете разумные промпты и хотите знать, какое слово поменять, когда клип провалился.
В примерах используются модели, доступные в видеопространстве OmniArt: Seedance, Veo 3.1, Kling, Grok Imagine, PixVerse V6 и C1 — потому что часть отладки состоит в том, чтобы понять, когда симптом лучше лечится другой моделью, а не новым абзацем промпта.
Меняйте по одной переменной за раз
Прежде чем перейти к отдельным правкам, заведите привычку, которая ускоряет их все: одно изменение на генерацию. Переписывать промпт целиком после плохого дубля бессмысленно — вы не поймёте, какая именно правка помогла.
Длительность, разрешение, соотношение сторон и референсы влияют на результат не меньше формулировок, поэтому записывайте настройки вместе с текстом промпта. Два-три осознанных прогона обычно лучше десяти переписываний.
Совет
Правка 1: лица, руки и конечности плывут посреди клипа
Что вы видите: первый кадр чистый, а потом пальцы срастаются, лицо съезжает с черепа или во время поворота появляется лишняя рука.
Почему так происходит: модель проводит тело через положения, которых ваш промпт не описывал. Быстрое движение конечностей, крупная рамка на руках, перекрытия (рука проходит перед лицом) и большая длительность — всё это множит число кадров, которые модели приходится придумывать.
Как исправить: сократите то, что нужно придумывать. Отодвиньте рамку на один размер шире, явно назовите механику тела и держите руки либо неподвижно, либо на простой траектории. Старт с готового изображения вместо текста тоже закрепляет анатомию, потому что модель наследует правильное тело, а не угадывает его.
Было: «Close-up of a chef's hands quickly chopping vegetables and tossing them into a pan.».
Стало: «Medium shot of a chef at a wooden counter. One steady chopping motion with the right hand, left hand resting flat on the board. Hands stay inside frame, no cuts. 50mm, soft window light from camera left.».
Для кадров с людьми Veo 3.1 и Kling обычно хорошо держат структуру тела на протяжении всего дубля, а генерация из изображения на любой модели выигрывает у генерации из текста, когда узкое место — анатомия. Если крупный план нужно сохранить, укоротите клип и согласитесь на одно движение вместо двух.
Правка 2: объект игнорирует действие, о котором вы просили
Что вы видите: рамка, свет и стиль совпадают с промптом, но объект просто стоит и дышит либо выполняет какое-то дежурное холостое движение вместо указанного вами действия.
Почему так происходит: действие похоронено. Если глагол стоит в конце длинного описательного предложения или конкурирует с тремя другими глаголами, модель считает его ещё одним свойством неподвижной сцены. У расплывчатых глаголов («взаимодействует», «наслаждается», «исследует») вообще нет визуальной формы, поэтому не происходит ничего.
Как исправить: поставьте объект и действие вперёд, используйте один конкретный физический глагол в настоящем времени и опишите, чем действие заканчивается. Всю стилистику — оптику, палитру, настроение — уводите после действия, чтобы она читалась как украшение, а не как главная часть.
Было: «A dramatic, moody, rain-soaked alley at night with neon reflections and steam, where a courier is exploring the area and interacting with her surroundings.».
Стало: «A courier crouches and picks up a dropped envelope, then stands and looks left. Rain-soaked alley at night, neon reflections on wet asphalt, steam from a vent. Handheld medium shot.».
Seedance хорошо отзывается на такие формулировки в духе постановочного листа, а PixVerse C1 — разумный выбор, когда в брифе одно управляемое движение: поворот, протянутая рука, показ товара.
Правка 3: движение камеры не случилось или спорит с объектом
Что вы видите: вы просили наезд, а получили зафиксированный кадр. Или камера едет, но объект странно съезжает относительно фона, и кадр ощущается искажённой фотографией, а не движением через пространство.
Почему так происходит: причин две, и выглядят они похоже. Либо движение заявлено как эффект без мотивации («приблизить», «кинематографичное движение камеры»), либо вы сложили противоречивые указания: наезд при том, что объект идёт на камеру, или панорама плюс наклон плюс кран в одном четырёхсекундном клипе.
Как исправить: одно движение камеры на клип, названное киноязыком и привязанное к тому, что происходит в кадре. Затем проверьте на конфликт: если объект идёт к объективу, камера должна стоять или отступать, а не наезжать.
Было: «Epic cinematic camera movement, zoom in and pan around the hero as he runs at the camera, dynamic angles.».
Стало: «The hero runs toward camera down a corridor. The camera retreats ahead of him at a steady pace, holding him at medium framing. Low angle, wide lens, no other camera movement.».
Kling и Seedance хорошо принимают явные указания по камере, а Grok Imagine стоит попробовать для более вольных, энергичных движений, где точность рамки важнее ощущения. Если движение всё равно отказывается регистрироваться, описывайте изменение того, что видит зритель, — «линия горизонта входит в кадр снизу», — а не называйте технику съёмки.
Правка 4: сцена уходит или внешность меняется посреди клипа
Что вы видите: объект начинает как один человек и заканчивает как его двоюродный брат. Красная куртка становится бордовой, витрина на фоне перестраивается, в комнате вырастает второе окно.
Почему так происходит: внешность ничем в генерации не закреплена. Текстовые промпты описывают категорию, а не конкретного человека, поэтому каждый кадр вправе трактовать «молодую женщину в красной куртке» немного иначе. Большая длительность и насыщенный фон ускоряют уход.
Как исправить: закрепите изображением, а потом описывайте только то, что меняется. Когда вы загружаете референс или начальный кадр, повторное описание внешности в промпте прямо вредит: текст конкурирует с изображением. Держите фон простым и разбивайте длинные идеи на несколько коротких кадров вместо одного длинного дубля.
Было: «A young woman in a red jacket with brown hair walks through a busy market, 10 seconds, lots of detail, many people and stalls.».
Стало: «Keep the referenced subject's face, hair, and red jacket unchanged. She walks forward past two stalls and stops to look right. Shallow depth of field so the market behind her stays soft. 5 seconds, single continuous shot.».
Примечание
Правка 5: текст и логотипы выходят кашей
Что вы видите: вывеска, на которой написано «SHOPP», этикетка товара, растворяющаяся в псевдобуквах, логотип, мутирующий каждые несколько кадров.
Почему так происходит: видеомодели генерируют текст как текстуру, а не как глифы, и любое движение перерисовывает эту текстуру кадр за кадром. Мелкий кегль, текст на изогнутых или движущихся поверхностях и текст в перспективной плоскости — худшие случаи.
Как исправить: перестаньте просить видеомодель сочинять текст. Сгенерируйте кадр моделью изображений, где типографику можно дёшево прогонять итерациями, а потом оживите этот кадр. В видеопромпте приведите точную строку в кавычках, держите её короткой и оставьте поверхность с надписью максимально плоской и неподвижной.
Было: «A cafe storefront with a big detailed sign, menu boards, and lots of signage as the camera swoops past.».
Стало: «Animate the provided frame. The sign reading 'DAYLIGHT' stays flat to camera and unchanged. Slow lateral drift to the right, sign fully in frame the whole time, no other text visible.».
В OmniArt первый шаг можно сделать моделью изображений вроде GPT Image 2 или Seedream 5.0 Pro, а затем отправить одобренный кадр в видеомодель в том же рабочем пространстве. Для всего, что идёт клиенту, считайте читаемый текст задачей, которая по умолчанию начинается с изображения.
Правка 6: движение слишком быстрое, дёрганое или рывками
Что вы видите: клип идёт как на скорости 1,5x, или объект слегка вибрирует, или движение продвигается заметными шагами, а не плавно.
Почему так происходит: прилагательные интенсивности читаются как скорость. «Динамичный», «взрывной», «энергичный», «полный экшена» толкают модель втиснуть больше изменений в то же число кадров. Вторая частая причина — слишком много событий за слишком малое время: три доли в четырёх секундах не оставляют кадров ни на одну из них.
Как исправить: удалите слова интенсивности и задайте темп. Одна доля на клип, укажите, что кадр непрерывный, и если действию действительно нужно больше времени, просите большую длительность, а не более быструю игру.
Было: «Explosive dynamic action shot, skateboarder doing tricks, fast energetic motion, rapid cuts.».
Стало: «A skateboarder rolls up a ramp and lifts into one slow ollie at the top. Steady, even pace, single continuous shot, no cuts. Camera tracks alongside at the same speed.».
Если дрожание мелкое, а не структурное, попробуйте более высокий уровень той же семейной линейки моделей — стандартный вместо ускоренного или облегчённого, — поскольку младшие уровни обменивают временную устойчивость на скорость и цену.
Правка 7: звук и артикуляция не совпадают
Что вы видите: рот двигается раньше или позже слов, реплика продолжается при закрытых губах, а речь тонет в музыке, которую модель добавила сама.
Почему так происходит: синхронности речи нужен видимый рот и реплика, достаточно короткая, чтобы уместиться в клип. Длинный диалог в пятисекундном кадре заставляет модель либо гнать артикуляцию, либо потерять синхронность. Описания вроде «с эпичным саундтреком» приглашают музыкальную подложку, которая конкурирует с голосом.
Как исправить: один говорящий, одна короткая реплика в кавычках, рот в ясной рамке и без перекрытий, никаких конкурирующих указаний по звуку. Говорите, что должно молчать, так же явно, как то, что должно быть слышно.
Было: «Two people talking about the product launch with an epic soundtrack and city ambience, close-up.».
Стало: «Medium close-up of one woman facing camera, mouth fully visible. She says: 'We ship on Friday.' Then she pauses and smiles. Quiet room tone only, no music.».
Veo 3.1 генерирует собственный звук, включая речь, а PixVerse V6 поддерживает звук на бесплатном тарифе OmniArt. Когда у нужной модели своего звука нет, надёжный путь такой: сгенерировать клип без звука, отдельно получить голос речевой моделью вроде MiniMax Speech 2.8 или ElevenLabs, а потом сложить их вместе. Это заодно даёт возможность переписать начитку, не пересоздавая картинку.
Быстрая таблица: симптом и правка
Пользуйтесь ею как таблицей первичной сортировки, когда клип вернулся неправильным. Меняйте то, что стоит в первом столбце, прежде чем трогать что-либо ещё.
| Симптом | Что менять первым | Замечание по модели |
|---|---|---|
| Плывут лица или руки | Шире рамка, короче клип, начальный кадр изображением | Veo 3.1, Kling для движения человека |
| Действие проигнорировано | Вынести глагол вперёд, одно конкретное действие | Seedance, PixVerse C1 |
| Движение камеры отсутствует | Одно названное, мотивированное движение; убрать конфликты | Kling, Seedance, Grok Imagine |
| Уход сцены или внешности | Референс, описывать только то, что меняется | Референс в PixVerse C1, multi-shot в V6 |
| Каша вместо текста | Сначала сгенерировать кадр моделью изображений | GPT Image 2, Seedream 5.0 Pro, затем любая видеомодель |
| Движение слишком быстрое или дёрганое | Убрать слова интенсивности, задать темп, увеличить длительность | Предпочитайте стандартные уровни ускоренным и облегчённым |
| Артикуляция не совпадает | Одна короткая реплика в кавычках, рот в кадре, без музыки | Veo 3.1, PixVerse V6 или добавить речь отдельно |
Как начать в OmniArt
Возьмите свой последний неудачный клип и продиагностируйте его по семи симптомам выше. Примените ровно одну правку, сгенерируйте заново и сравните — двух прогонов обычно достаточно, чтобы понять, дело было в промпте или в выборе модели. Поскольку OmniArt держит модели изображений, видео и звука в одном рабочем пространстве, упрямый кадр может переходить между подходами без пересборки вашего окружения: закрепите его моделью изображений, попробуйте на второй видеомодели или добавьте голосовую дорожку отдельно.
Откройте рабочее пространство создания, вставьте исправленный промпт и оставляйте те дубли, которые держат удар.
Готовы создавать?
Начните генерировать впечатляющий контент с ИИ