Утечка Gemini Omni: что может значить видеомодель Google
Перед Google I/O 2026 утечки указывают на видеомодель Gemini Omni. Что подтверждено, что остаётся слухом и что делать креаторам OmniArt на этой неделе.

Примечание
Обновление (13 июля 2026 г.): Gemini Omni Flash теперь доступен в OmniArt для стандартной генерации видео по тексту и референсному изображению. Диалоговые элементы управления Google с сохранением состояния пока не представлены в интерфейсе OmniArt; более ранние сведения о доступности ниже относятся к дате первоначальной публикации.
Google I/O 2026 проходит 19–20 мая, и весь уголок интернета, посвящённый ИИ-видео, уже заранее проживает эту презентацию. Причина — одна-единственная строка интерфейса, замеченная во вкладке видео в Gemini: «Start with an idea or try a template. Powered by Omni.» Из этой строки три волны утечек сложили рабочую картину необъявленной видеомодели Google — условно её называют Gemini Omni, — которая может заменить Veo 3.1, встать рядом с ней или тихо обновить весь генеративный стек Google.
Этот материал — разбор для креаторов OmniArt, которые пытаются решить, что со всем этим делать до вторника и надо ли что-то делать вообще. Мы отделяем подтверждённые сигналы от домыслов, проходим по трём правдоподобным версиям того, чем является Omni, и заканчиваем практическим ходом для тех, кому нужно отгрузить видео на этой неделе.
Что мы знаем на самом деле (и чего не знаем)
| Сигнал | Статус | Что это значит |
|---|---|---|
| Строка интерфейса «Powered by Omni» во вкладке видео в Gemini | Подтверждена скриншотами | Продукт под названием Omni подготовлен к релизу за флагом функции |
Идентификатор модели bard_eac_video_generation_omni | Найден при инспекции приложения | Внутренний идентификатор проведён через видеоконвейер Gemini |
| Ограничение клипа в 10 секунд | Сообщают ранние тестировщики | Похоже на раннюю стадию или ограничение потребительского уровня, а не API |
| «Remix your videos, edit directly in chat, try a template» | Сообщаемый текст описания функций | Сценарии правки и ремикса, а не только генерация |
| Сильная связность текста (например, формулы) | По материалам демонстраций | Заметный технический шаг для типографики внутри видео |
| Нативное аудио | Не подтверждено | У Veo 3.1 нативное аудио есть; по Omni ясности нет |
| Доступ по API | Не подтверждено | Разработчикам не стоит строить планы на неподтверждённой доступности |
| Заменяет, дополняет или переименовывает Veo 3.1 | Открытый вопрос | Самый важный вопрос для продакшен-команд |
Честное резюме: видеопродукт Google под названием Omni достаточно реален, чтобы дойти до текстов в интерфейсе, но любое утверждение о его архитектуре пока остаётся выводом из строк приложения и отчётов тестировщиков.
Три правдоподобные версии
Почти вся неопределённость сводится к трём сценариям того, чем Omni является на самом деле. У каждого свои последствия для линейки инструментов ИИ-видео, на которую опираются креаторы.
Сценарий 1 — потребительский ребрендинг Veo
Самое простое прочтение: Omni — это потребительская замена бренду «Veo» внутри Gemini, примерно так же, как Google свела генерацию изображений под имя «Nano Banana». Veo остаётся движком под капотом, Omni — поверхностью, которую видит большинство пользователей.
Если так, ждите: минимальных изменений возможностей относительно Veo 3.1, тех же ограничений в 8–10 с на потребительском уровне и продолжения Veo на корпоративном треке и в API.
Сценарий 2 — видеомодель, родная для Gemini
Второе прочтение: Omni — это версия архитектуры Gemini, дообученная специально под видео и работающая параллельно треку Veo. Veo остаётся выделенной видеомоделью для API и корпоративных задач, Omni — потребительской моделью, которая выигрывает от текстовых и рассуждающих способностей Gemini.
Если так, ждите: более точного следования промпту, лучшей типографики внутри видео (сообщения о формулах это подтверждают) и более тесной связки с правками через чат Gemini.
Сценарий 3 — по-настоящему омнимодальная модель
Самое амбициозное прочтение: Omni — это единая система, которая нативно генерирует текст, изображения, видео и звук из одной модели. Само имя («Omni») намекает, что именно к этому сценарию Google и позиционируется, даже если запуск окажется скромнее полного паритета.
Если так, ждите: заметного сдвига процессов в сторону правок диалогом, передачи задач между модальностями прямо в чате и долгосрочного вызова той схеме «одна модель на модальность», которой пользуется остальное поле.
Самый вероятный исход на I/O — смесь второго и третьего сценариев: родная для Gemini видеомодель с омнимодальными амбициями, но с потребительскими ограничениями на старте.
Почему сообщаемые функции важны
Три из сообщаемых функций заслуживают большего внимания, чем сам вопрос об идентичности модели, потому что они показывают, куда движется категория ИИ-видео, независимо от того, кто выпустит их первым.
Правки диалогом как поведение по умолчанию
«Remix your videos, edit directly in chat» — та часть утечки, которая меняет разговор о процессе. Большинство инструментов ИИ-видео сегодня всё ещё живут по схеме «сгенерируй и скачай»: вы пишете промпт, ждёте, сохраняете клип и пишете новый промпт ради правок. Правки через чат переопределяют модель как постоянного соавтора: «сделай второй кадр теплее», «замени фон», «продли на три секунды». Если Omni выпустит это в достойном виде, остальным моделям придётся подтягиваться.
Шаблоны как точка входа
Шаблоны снижают порог промпт-инжиниринга для новых пользователей — это реальная польза. Они же выравнивают разнообразие результатов, когда все стартуют с одного и того же общего промпта. Интересен не сам факт появления шаблонов, а то, обгоняют ли они по качеству хорошо написанный бриф с нуля.
Текст внутри видео
Сообщения о том, что математические формулы чисто отрисовываются внутри сгенерированного видео, технически показательны. Типографика внутри видео была заметной слабостью каждой крупной модели. Если Omni надёжно справляется со сложной типографикой, это открывает объясняющие ролики, образовательные материалы и моушен-графику, которым раньше требовался отдельный этап композитинга.
Как Omni встанет в линейку
Для креаторов, которые уже работают сразу с несколькими моделями ИИ-видео, важен вопрос не «победит ли Omni», а «где её место». Вот форма ответа, исходя из сообщаемых функций:
| Возможность | Gemini Omni (по сообщениям) | Veo 3.1 (подтверждено) | V6 / R1 | Sora 2 |
|---|---|---|---|---|
| Длительность | 10 с (по сообщениям) | До 8 с | 1–15 с | До 20 с |
| Разрешение | Неизвестно | До 1080p | До 1080p | 1080p, доступен 4K |
| Нативное аудио | Не подтверждено | Подтверждено | Есть | Есть |
| Правки и ремикс | По сообщениям: ремикс, чат, шаблоны | Ограниченно | Modify, Extend, сборка из нескольких клипов | Ограниченно |
| Доступ по API | Не подтверждено | Есть | Есть | Есть |
| Сильнее всего | Правки диалогом (по сообщениям) | Нативные 4K, пространственный звук | Кинематографический контроль, работа в реальном времени | Длинные непрерывные дубли |
Если набор функций из утечек подтвердится, полоса Omni — это «потребительское видео с правками в диалоге», удачное место для быстрых задач под соцсети и итераций через чат. Кинематографическая, вещательная и multi-shot полосы остаются за нынешними лидерами, пока не появятся доказательства обратного.
Что это значит для креаторов на этой неделе
Соблазн при утечке до анонса — подождать. Мы бы поспорили с этим для всех, у кого есть сдача в ближайшие десять дней.
Предупреждение
Считайте каждую функцию Omni в прессе сигналом до анонса, а не подтверждённой возможностью. Планы, построенные на сообщаемых характеристиках, переживают презентацию примерно в половине случаев.
Практический ход зависит от того, что именно вы отгружаете.
Если видео нужно сдать на этой неделе
Берите то, что работает и проверено. V6 для кинематографических кадров, Veo 3.1 для вещательных монтажей в нативном 4K, Kling 3.0 для многоязычных вариантов под соцсети, HappyHorse 1.0 для быстрых итераций. Внутри OmniArt между ними один клик, так что до презентации не нужно привязываться к одному инструменту.
Если вы планируете производство на третий квартал
Стройте бриф вокруг возможностей, а не брендов. Опишите, что вам действительно нужно, — длительность, разрешение, звук, модель правок, фиксацию персонажа, — и дайте линейке после I/O заново побороться за эту работу через две недели. Если Omni выйдет и оправдает ожидания, бриф подключится к ней без переписывания остального конвейера.
Если вы исследуете и учитесь
Смотрите презентацию. Сохраняйте тесты, а не мнения. Самое ценное, что у вас может быть после запуска, — прогон сравнения на равных условиях: один и тот же бриф, те же референсы, та же схема оценки — по всему, что выйдет, по Veo 3.1 и по устоявшейся линейке.
Сдвиг покрупнее, о котором сигналит Omni
Чем бы Omni ни оказалась, утечки рассказывают более ясную историю о категории, чем о самой Google.
Конкурентная поверхность смещается. Качество картинки с первого прохода у лидеров сходится. Реальная разница уходит в управляемость, постоянство между кадрами, синхронность звука и изображения, правки диалогом и в то, насколько модель ложится в реальный процесс, — а не в то, кто выигрывает бенчмарк.
Затраты по-прежнему реальны. Повторяющиеся сообщения о лимитах использования и вкладках расхода в интерфейсе Omni подтверждают: генерация видео высокой точности остаётся вычислительно дорогой в масштабе. Шаблоны и короткие ограничения по длине клипа — отчасти удобство, отчасти экономика.
Права и ремикс усложняются. Сценарии ремикса поверх сгенерированного видео поднимают вопросы интеллектуальной собственности, согласия и коммерческого использования, которые процессы «текст в видео» вскрывают не полностью. Любой команде, которая отдаёт результат ремикса в платные медиа, стоит подготовить чек-лист по правам ещё до выхода функции.
Как OmniArt прошла через запуск
Эта статья зафиксировала утечку до I/O такой, какой она выглядела 13 мая 2026 года. Позже Google выпустила Gemini Omni Flash, открыла доступ для разработчиков, и с тех пор модель вошла в видеопространство OmniArt для стандартной генерации по тексту и по изображению.
Теперь она стоит рядом с Veo 3.1, Sora 2, V6, Kling 3.0, Happy Horse 1.0, Seedance 2.0, Runway Gen-4.5, Hailuo и Grok Imagine — одна грамматика промптов, один баланс, одно место, чтобы сравнить её с остальными. Диалоговые элементы управления Google с сохранением состояния в OmniArt сейчас не представлены.
Для контекста по нынешней линейке видео смотрите обзор видеомоделей OmniArt. О том, как писать брифы, которые чисто переносятся на любую модель, что в итоге их отработает, читайте гайд по написанию промптов.
FAQ
Gemini Omni официально анонсирована?
Да. Эта статья написана до анонса; впоследствии Google представила Gemini Omni Flash на I/O 2026 и открыла доступ для разработчиков 30 июня. Gemini Omni Flash уже доступна в OmniArt для стандартной генерации.
Заменит ли Gemini Omni модель Veo 3.1?
Ясности нет. Три правдоподобных сценария такие: Omni переименовывает Veo для потребительских поверхностей, Omni работает рядом с Veo как родная для Gemini потребительская модель или Omni — по-настоящему омнимодальная единая система. На старте вероятнее всего смесь второго и третьего.
Какие функции сообщают для Gemini Omni?
Сообщают о правках диалогом внутри чата Gemini, сценарии ремикса, шаблонах промптов, сильной связности текста внутри видео (формулы отрисовываются чисто) и ограничении клипа в 10 секунд. Официально ничего из этого не подтверждено.
Стоит ли ждать Omni, прежде чем снимать видео на этой неделе?
Нет. Берите модели, которые работают и стабильны сегодня. Линейка уже закрывает кинематографические кадры, вещательное нативное 4K, многоязычные соцсети, быстрые итерации, непрерывность между кадрами и покадровые визуальные эффекты, а Gemini Omni Flash теперь тоже один из доступных вариантов.
Как Omni сравнивается с Veo 3.1?
Преимущество Omni — правки диалогом и гибкие входные данные; сильные стороны Veo 3.1 — нативное аудио и вывод в 4K. Обе уже доступны в OmniArt для стандартной генерации, так что вы можете сравнить их на одном брифе; собственные API Google берите тогда, когда тест требует именно правок диалогом с сохранением состояния.
Готовы создавать?
Начните генерировать впечатляющий контент с ИИ