IndustryМоделі та аналітика8 хв читання

Gemini Omni Flash: що вийшло і що Google притримав

Google запустив Gemini Omni Flash на I/O 2026 — ось що вміє перша модель Omni, що навмисно притримали й що з цього робити авторам в OmniArt.

Команда OmniArt
Gemini Omni Flash: що вийшло і що Google притримав

Google I/O 2026 відбулася 19 травня, і щойно скінчився кейноут, Gemini Omni Flash уже працювала. Не «незабаром», не «обмежений preview» — живою, того ж дня. Два тижні тому ми опублікували своє прочитання витоків перед I/O, відділивши підтверджені сигнали від здогадів. Тепер у нас є сама модель. Ось що вийшло, чого Google свідомо не випустив і що це означає для авторів, у яких робота горить уже цього тижня.

Omni Flash — перша публічна модель у новій «Omni»-рамці Google. Це не Veo 4 і не перейменована Veo 3.1 — це окрема продуктова лінія, і Google DeepMind уже підтвердив старшу Omni Pro як продовження. Дати для Omni Pro немає. Flash — це фаза перша.

Що підтвердилося, а що притримали

Матеріал про витік називав модель «нативним для Gemini відео з омнімодальними амбіціями». Це добре витримало перевірку. Ось повна картина тепер, коли пил після кейноуту осів.

МожливістьСтатусЩо це означає для авторів
Десятисекундні відеокліпи із синхронним звуком з одного промптуВийшлоКороткі формати для соцмереж, трейлери й заставки — природний вибір за такої тривалості
Вхід «будь-що в будь-що»: текст, зображення, аудіо та відео в одному промптіВийшлоМожна дати їй референсне зображення, голосове повідомлення й бриф — одна граматика промпту на всі три
Розмовне редагування в чаті («change the lighting», «swap the dog for a cat»)ВийшлоТа зміна процесу, яку матеріал про витік назвав головною новиною, — докладніше нижче
Водяний знак SynthID у кожному результатіВийшло — обов’язково, без перемикача в APIПлануйте роботу з водяним знаком за замовчуванням; перевіряйте умови використання перед комерційним розміщенням
Редагування мовлення чи звуку всередині згенерованого відеоПритримано з міркувань безпекиРизик, суміжний із дипфейками; Google підтвердив, що це навмисне рішення, а не брак можливості
Режим аватараПритриманоТа сама категорія занепокоєння, що й редагування звуку, — строків не названо
API для розробниківНа старті — «за кілька тижнів»; відкрито 30 червня 2026 рокуСтандартна генерація тепер доступна через API та в OmniArt

Попередження

Дві помітні можливості — редагування звуку всередині відео та режим аватара — на старті притримали свідомо, і не з технічних причин, а з міркувань безпеки. Google це підтвердив. Якщо ваш конвеєр залежить від будь-якої з них, обхідного шляху немає, як немає й дати релізу.

Google також публічно визнав три поточні обмеження: візуальна узгодженість під час правок, складні послідовності руху й читабельний текст усередині відео. Це ті самі слабкі місця, які має вся категорія ШІ-відео; Omni Flash їх не розв’язала.

Витік проти реальності

Перед I/O ми окреслили три сценарії того, чим може бути Omni: споживчий ребрендинг Veo, нативна для Gemini відеомодель або справжня омнімодальна єдина система. Найімовірнішим ми назвали «суміш сценаріїв 2 і 3».

Це виявилося точним. Omni Flash безсумнівно нативна для Gemini — вона працює всередині застосунку Gemini та Google Flow, а не як окрема поверхня Veo, — і вона справді приймає будь-що на вході. Рамка «омнімодальності», яку дав їй Google, не є маркетинговим перебільшенням: поєднання тексту, зображення, аудіо та відео в одному промпті — це реальна зміна порівняно з тим, що приймала на вхід Veo 3.1.

Чого не вгадали здогади: рамка «реміксу» з витоку недооцінила глибину розмовного редагування. Це не просто ремікс із нуля. Воно зберігає узгодженість між правками в кількох репліках, а це суттєво інша річ.

Головна новина — розмовне редагування

На рівні процесу всі великі ШІ-моделі для відео сьогодні працюють однаково: ви пишете промпт, чекаєте, завантажуєте кліп і пишете промпт заново, якщо вийшло не те. Omni Flash це ламає. Розмовне редагування дозволяє написати «change the lighting to golden hour» чи «swap the dog for a cat» і отримати перероблений кліп, який узгоджується з попередніми результатами, а не генерується з нуля.

Це важливо, бо ціною ітерації у відео завжди був цикл перегенерації — і в часі, і в кредитах. Багатокрокове редагування зі збереженням узгодженості стискає відстань між першою чернеткою й готовим кліпом. Воно також означає, що модель тримає стан вашого проєкту так, як не тримають процеси «згенерував і викинув».

Визнані сьогодні обмеження реальні: складні послідовності руху втрачають зв’язність між правками, а модель усе ще може пливти в дрібних візуальних деталях. Але принцип процесу здоровий, і саме ця функція найімовірніше добре старітиме, доки покращуватиметься модель під нею.

Де Omni Flash стоїть у лінійці

Сильні сторони Omni Flash — доступність для широкої аудиторії, розмовні ітерації та гнучкість мультимодального входу. Її обмеження — десятисекундні кліпи, відсутнє редагування мовлення, визнані прогалини в русі та відтворенні тексту — чітко окреслюють її смугу.

Що потрібно кадруЩо брати
Розмовні ітерації, доопрацювання в чатіOmni Flash (на поверхнях Google)
Нативний 4K, просторовий звук, ефірна якістьVeo 3.1
Довгі суцільні дубліSora 2
Неперервність розкадровки на кілька планівKling, V6 + BACH
Швидкі стилізовані енергійні кліпиМоделі PixVerse
Вигода в обсязіKling — економні готові секунди

Глибше порівняння Omni Flash і Veo 3.1 кадр за кадром — у матеріалі Gemini Omni Flash проти Veo 3.1: що обрати під ваш процес.

Де до неї реально дістатися

На момент запуску 19 травня Omni Flash працювала в YouTube Shorts, YouTube Create, застосунку Gemini та Google Flow, а API для розробників усе ще обіцяли «за кілька тижнів». Той API відкрили 30 червня 2026 року; стандартна генерація відео Gemini Omni тепер доступна й на сторінці моделі в OmniArt.

Про ширший контекст лінійки Veo — у матеріалі статус релізу Veo 4 і місце Veo в OmniArt: що Veo 3.1 уже вміє і як вона живе всередині багатомодельного простору.

Omni Pro підтверджено — але без дати

Google DeepMind підтвердив, що старша Omni Pro у планах, і описав її як «якісний стрибок над Flash». Дати релізу немає, списку можливостей немає, доступу до preview немає. Плануйте навколо того, що вийшло, а не того, що обіцяно.

Якщо у вашому конвеєрі є здача в третьому кварталі, будуйте її під підтверджені характеристики Omni Flash уже сьогодні. Коли Omni Pro вийде, ви додасте її як опцію в процес, що вже виробляє, — а не чекатимете на неї й не переїжджатимете заради неї на іншу платформу.

Примітка

Ось і практичний аргумент на користь багатомодельного простору: нові релізи стають доповненнями, а не зривами. Ви порівнюєте їх із тим, що вже випускаєте, а не з тим, на що чекали.

Що робити цього тижня

Заради повного циклу розмовного редагування зі збереженням сесії, який дає Google, користуйтеся застосунком Gemini, Google Flow або Interactions API. Для стандартної генерації з тексту й зображень Gemini Omni Flash тепер доступна в OmniArt поряд із рештою відеолінійки.

В OmniArt можна порівняти Gemini Omni Flash із Veo 3.1 та рештою лінійки — моделями PixVerse, Sora 2, Kling, Happy Horse, Seedance 2 й іншими — по зображеннях, відео, аудіо та музиці в одному просторі. Один баланс, одна граматика промпту, одне місце, щоб порівняти результати поруч.

Практичні кроки, як вичавити максимум із Veo 3.1, поки ви оцінюєте Omni Flash, є в посібнику з промптів і кінематографії для Veo 3.1: весь процес від брифу до готового кліпа.

Практичний хід: проженіть поточний бриф через моделі, які вже живі та стабільні, включно з Gemini Omni Flash, і додавайте Omni Pro лише тоді, коли вона вийде із завданням, якого ваш нинішній конвеєр іще не закриває.

Поширені запитання

Чи доступна Gemini Omni Flash просто зараз?

Так. Вона вийшла на Google I/O 2026 19 травня, відкрила API для розробників 30 червня й тепер доступна для стандартної генерації через сторінку моделі Gemini Omni в OmniArt. Розмовні елементи керування зі збереженням сесії лишаються специфічними для власних продуктів і API Google.

Чим Omni Flash відрізняється від Veo 3.1?

Omni Flash нативна для Gemini, приймає будь-що на вході (текст, зображення, аудіо, відео в одному промпті) й має розмовне редагування в кілька реплік. Veo 3.1 — спеціалізована відеомодель із підтвердженим нативним виводом у 4K і просторовим звуком. Стандартна генерація для обох тепер живе в OmniArt; повна поверхня розмовного керування від Google лишається окремою.

Які можливості Google притримав в Omni Flash?

Дві можливості притримали свідомо: редагування мовлення й звуку всередині відео та режим аватара. Google підтвердив, що це зроблено з міркувань безпеки, а не через технічні обмеження. Дати релізу немає для жодної з них.

Чи замінить Gemini Omni Pro модель Flash?

Google DeepMind підтвердив Omni Pro як майбутню старшу модель, описану як «якісний стрибок над Flash», але жодних можливостей, цін чи дати релізу не розкрито. Плануйте навколо підтверджених можливостей Flash; сприймайте Omni Pro як майбутнє доповнення.

Чи має Omni Flash водяний знак SynthID?

Так. Кожен результат Omni Flash містить водяний знак SynthID. Він обов’язковий і не має перемикача в API. Перевіряйте умови надання послуг платформи, перш ніж використовувати результати в комерційному контексті.

Готові творити?

Почніть створювати вражаючий контент зі ШІ

Почати безкоштовно