Як писати промпти для Gemini Omni Flash і 10-секундного відео
У Gemini Omni Flash незвична поверхня промпту: немає негативного параметра, лише два співвідношення сторін, тільки англійська й два різні режими написання. Ось як робити обидва добре.

Більшість посібників із промптів для ШІ-відео вчать писати одну річ: насичений детальний абзац, який ви одноразово віддаєте моделі. Gemini Omni Flash ламає це припущення. Її API для розробників (працює з 30 червня) побудований довкола двох різних дій із промптом — першої генерації, а потім безперервної розмови з правок, кожна з яких перекроює той самий кліп. Напишете під одну й проігноруєте другу — і більша частина моделі лишиться невикористаною.
Поверхня промпту в Omni Flash незвична ще й тим, чого в ній немає. Немає поля негативного промпту, немає регулятора температури, немає системної інструкції, а співвідношень сторін лише два. Це не прогалини, які треба наосліп обходити, — кожна з них змінює те, як слід формулювати промпт. Цей посібник охоплює обидва режими й обмеження, що їх формують.
Примітка
Відколи цей посібник опубліковано, Gemini Omni Flash з’явилася в просторі OmniArt для відео для стандартної генерації за текстом і зображенням. Розділи нижче й далі описують розмовний процес Google безпосередньо, бо OmniArt наразі не виносить назовні елементи керування Interactions API зі збереженням сесії.
Два режими промпту, а не один
Кожна сесія Omni Flash має два типи промпту, і вони винагороджують різне письмо.
Промпт першої генерації — це повний бриф на один десятисекундний акцент: суб’єкт, рух, камера, світло, звук, стиль. Він поводиться як будь-який сильний промпт «текст у відео» чи «зображення у відео»: виносьте деталі вперед, будьте конкретні, описуйте весь кадр одразу.
Інструкція розмовної правки — протилежність. Вона коротка, називає рівно одну зміну й припускає, що модель уже тримає попередній кліп у контексті. "Make the lighting golden hour." "Swap the sedan for a pickup." Модель застосовує зміну, зберігаючи все, чого ви не згадали, — через previous_interaction_id, який переносить стан сесії аж до трьох послідовних правок через Interactions API. Заженете три зміни в одну інструкцію — і втратите ту точність, заради якої цей режим і потрібен.
Ментальна модель така: компонуйте в першому промпті, режисуйте в наступних. Отримайте міцний базовий кліп, а тоді доопрацьовуйте його так, як інструктували б режисера просто на майданчику, — по одній ремарці за раз.
Обмеження API, які формують ваші формулювання
Список параметрів Omni Flash короткий за задумом. Кожна відсутність має наслідок для промпту:
| Обмеження | Що це означає для промпту |
|---|---|
| Немає поля негативного промпту | Формулюйте винятки всередині самого промпту — "an empty street, no pedestrians, no traffic" замість окремого негативного списку |
| Немає temperature / top_p / системної інструкції | Ви не можете покрутити варіативність чи задати сталу стильову норму — вписуйте тон і стиль у текст промпту щоразу |
| Співвідношення сторін лише 9:16 або 16:9 | Обирайте орієнтацію одразу; квадратного чи широкого кінематографічного варіанта немає, тож компонуйте під вертикаль або горизонталь із першого слова |
| Аудіо описується, а не вивантажується | Ви не можете дати їй доріжку для збігу — звук, який вам потрібен, ви описуєте словами (див. нижче) |
| Англійська підтримується повністю; інші мови не перевірено | Пишіть промпти англійською заради передбачуваного результату |
| Жорстка стеля у 10 секунд | Одна зрозуміла дія на генерацію — а не кадроплан |
Попередження
Omni Flash не приймає вивантаження аудіореференсу. Ви не можете дати їй музичну підкладку чи зразок голосу для синхронізації. Вона за замовчуванням генерує аудіодоріжку, і ваш єдиний важіль — слова в промпті, тож звуковий дизайн доводиться писати, а не докладати.
Шаблон для першої генерації
Оскільки 10 секунд вміщують один акцент, найсильніші перші промпти описують один безперервний момент із проговореним кожним шаром. Шість слотів покривають майже будь-який кадр:
- Суб’єкт — хто або що в кадрі, описано конкретно
- Рух — та єдина дія, що розгортається протягом кліпу
- Камера — один рух, а не послідовність ("slow push in", "locked-off wide")
- Світло — напрямок, якість, час доби
- Звуковий дизайн — аудіо, яке має бути згенеровано, словами
- Стиль — палітра, епоха, кінореференс, фактура
Розібраний приклад:
"A ceramic pour-over coffee dripper on a pale oak counter, steam rising as dark coffee streams into the glass carafe below. Slow push in on the drip. Soft morning light from a window camera-left, warm and diffused. Sound: gentle water trickle, distant kitchen ambience, no music. Muted editorial palette, shallow depth of field, shot on a fast prime lens."
Зверніть увагу: винятки живуть усередині речення ("no music"), камера має один рух, а звук проговорено. Оце й уся дисципліна.
Розмовне редагування: лексика, яка спрацьовує
Щойно у вас є базовий кліп, саме правки роблять Omni Flash сильнішою за процеси «згенерував і викинув». Тримайте кожну інструкцію в межах одного наміру й спирайтеся на сталу лексику дієслів, яку модель читає чисто:
- Перевисвітлити — "make it golden hour", "add a cool rim light from behind"
- Замінити — "swap the coffee dripper for a French press"
- Змінити стиль — "make it feel like 1970s film stock"
- Змінити колір — "change the mug to matte black"
- Змінити тайминґ — "slow the pour down", "let the steam linger longer"
Дві норми тримають нитку цілісною. Одна зміна на хід — модель зберігає те, чого ви не згадали, тож правка на одну ремарку і передбачуваніша, і легша для скасування повторним промптом. І спирайтеся на мову попереднього ходу — перевикористовуйте іменники, які ви вже закріпили ("the mug", "the pour"), щоб модель чіплялася за ті самі елементи, а не виводила сцену наново.
Порада
Ланцюжок із трьох правок — це бюджет, а не порада. Плануйте базовий промпт так, щоб йому потрібно було якомога менше уточнень: сильна перша генерація залишає ваші ходи правок для справжніх творчих змін, а не для латання того, що можна було вказати ще в першому промпті.
Як обійти нинішні обмеження
Кілька обмежень промптом не лікуються, і краще писати з ними в голові, ніж боротися з ними:
- Стеля у 10 секунд. В API немає продовження сцени, тож не пишіть промптів, які натякають на довшу арку. Проєктуйте один акцент, що стоїть сам по собі.
- Сталість персонажа при зміні сцени — визнано слабке місце. Якщо схожість важлива, тримайте правки в межах однієї сцени, а не просіть модель переселити персонажа в нове оточення.
- Відеореференси, довші за 3 секунди, обробляються не повністю. Тримайте будь-який референсний кліп коротким і по суті.
- Немає посилань на кілька відео й немає редагування голосу — обидва не підтримуються, тож плануйте ці кроки в окремому інструменті, а не в промпті.
Жодне з цих обмежень не дискваліфікує швидкий інструмент для короткої форми й ітерацій. Вони просто означають, що Omni Flash винагороджує промпти, зведені до того, що вона робить добре: один щільний акцент, доопрацьований у розмові.
Що працює в OmniArt сьогодні
Gemini Omni Flash уже доступна в OmniArt, і майже всі описані вище звички написання промптів застосовні напряму: один зрозумілий акцент, конкретика замість супу з ключових слів і звук, вписаний у промпт. Головний виняток — багатоходове редагування зі збереженням сесії, яке лишається процесом на боці API, а не елементом керування в інтерфейсі OmniArt.
- Генерація за референсами прямо лягає на Seedance 2.0, доступну в OmniArt: вона приймає до дев’яти зображень, трьох відео й трьох аудіофайлів, прив’язаних до ролей синтаксисом
@image1/@video1, — та сама ідея «зібрати з матеріалів», але з більшою кількістю входів, ніж пропонує Omni Flash. - Кінематографічна мова камери лягає на Veo 3.1, яка трактує дієслова руху на кшталт "drift", "glide" та "dolly in" зі стриманістю.
- Шаблон із шести слотів (суб’єкт, рух, камера, світло, звук, стиль) — той самий скелет, що дає чистий результат на кожній відеомоделі в просторі.
Відкрийте Gemini Omni Flash у просторі для відео і напишіть перший промпт як один цілісний акцент. Якщо вам потрібен багатоходовий цикл редагування від Google, продовжуйте цю частину в Interactions API; для стандартної генерації та роботи з референсними зображеннями сторінка моделі в OmniArt готова вже зараз.
Готові творити?
Почніть створювати вражаючий контент зі ШІ