UpdateМодели и аналитика11 мин чтения

Gemini Omni 1.1 Flash: что вышло для управления видео

Gemini Omni 1.1 Flash от Google — обновление видеомодели под продакшен: продлевайте сцены, задавайте первый и последний кадры, делайте черновики в 360p и генерируйте результат в 1080p или 4K.

Команда OmniArt
Gemini Omni 1.1 Flash: что вышло для управления видео

27 августа 2026 года Google выпустил Gemini Omni 1.1 Flash — первое обновление видеомодели Omni Flash, вышедшей на I/O, которое смотрит в сторону продакшена. Официальный анонс и тред Google в X подают его как релиз про управление, а не переименование: продлить сцену, зафиксировать начальный и конечный кадры, прикрепить короткие видеореференсы, дёшево набросать черновик в 360p, а затем сгенерировать 1080p или 4K для дублей, которые оставляете.

Это другая задача, чем потребительский дебют 19 мая, о котором мы писали в Gemini Omni Flash: что вышло и что Google намеренно придержал. Исходный тезис Flash — разговорное редактирование и вход любого типа в любой, жёсткий клип на 10 секунд и отсутствие продления сцены в API для разработчиков от 30 июня. 1.1 — это проход, который пытается сделать эти клипы достаточно длинными, достаточно резкими и достаточно направленными для производственного пайплайна.

Эта статья — обзор возможностей: что 1.1 действительно добавил, какие лимиты всё ещё действуют и какие из этих задач уже можно выполнять в OmniArt.

Что Gemini Omni 1.1 Flash выпустил на самом деле

Идентификатор API у Google — gemini-omni-1.1-flash (preview на Gemini Enterprise Agent Platform как gemini-omni-1.1-flash-preview). Вывод по умолчанию по-прежнему 720p в альбомной ориентации; 16:9 и 9:16 остаются двумя соотношениями сторон. Водяной знак SynthID по-прежнему обязателен.

ВозможностьОригинальный Omni FlashOmni 1.1 Flash
Длительность клипа10 секунд на генерациюГенерации по 10 секунд, продлеваемые шагами по 10 секунд до 40 секунд суммарно
Продление сценыНе было в API от 30 июняАнализирует до 10 секунд предыдущего материала (не только последнюю секунду)
Первый и последний кадрыНе полноценный режим APIИнтерполирует непрерывное движение между двумя ключевыми кадрами
ВидеореференсыОдин клип; клипы длиннее 3 секунд обрабатывались не полностьюДо трёх клипов по 3 секунды каждый
Разрешение черновика720p по умолчанию, без более дешёвого превьюЧерновики 360p, по словам Google — до 60 % быстрее и примерно треть стоимости 720p
Финальное разрешениеНа I/O не раскрыто; OmniArt отдаёт 720pВывод 1080p или 4K, в документации — как результат с повышенной детализацией поверх генерации 720p
ПоверхностиПриложение Gemini, Flow, YouTube, затем API от 30 июняGoogle AI Studio, Gemini API, Gemini Enterprise Agent Platform, Google Flow; продление сцены также в приложении Gemini для подписчиков Google AI Plus, Pro и Ultra

Список придержанного с I/O не сдвинулся. Текущая документация Google по-прежнему говорит, что редактирование речи не поддерживается, загрузка аудиореференса не поддерживается, а режим аватара в этот релиз никогда не входил. 1.1 добавляет направление и длину. Функции, придержанные из соображений безопасности, он не добавляет.

Продление сцены: 10 секунд контекста, до 40 секунд

Продление сцены — главный заголовок. Вы продолжаете с хвоста уже существующего клипа, а не надеетесь, что новая 10-секундная генерация к нему пристанет.

Цифры самого Google: модель теперь читает до 10 секунд предыдущего материала — «скачок относительно прежних моделей, которые опирались только на последнюю секунду», — а затем дописывает ещё 3–10 секунд. Повторяйте это шагами по 10 секунд, пока накопленный клип не достигнет 40 секунд. Часть последних кадров исходника переписывается, чтобы стык не был жёсткой склейкой. Добавить материал в начало нельзя, и продлить середину клипа тоже нельзя.

Демонстрация продления сцены в Gemini Omni 1.1 FlashОфициальное демо Google: Omni 1.1 Flash продолжает сцену по предыдущему материалу, удерживая идентичность персонажа, свет и нарративный контекст.Смотрите стык, а не только новое действие: идентичность, свет и саундтрек должны пережить продление, а не сброситься.

Промпт для продления может быть коротким, как "Continue the scene.", или конкретным — с новым движением камеры. Документация Google явно говорит: 0 секунд в промпте продления с таймкодами — это начало нового сегмента, а не начало исходного клипа. Опишите звук, если нужно сменить музыку; иначе модель старается держать её связной.

Два ограничения стоит учесть до того, как вы заложите вокруг этого 40-секундный ролик:

  • Загруженные исходные клипы для продления должны быть не длиннее 10 секунд, если только вы не продлеваете клип, который модель уже сгенерировала в той же многоходовой сессии.
  • Продление загруженного клипа недоступно в ЕЭЗ, Швейцарии и Великобритании. Продление клипа, сгенерированного моделью, доступно во всех регионах, где доступен сам API.

В OmniArt Seedance 2.5 уже закрывает смежную задачу: продлевать любой результат длительностью 30 секунд или меньше, многократно, до 60 секунд, либо генерировать 30–180 секунд за один проход Long Video. Это сегодняшний путь в пространстве для длинного режиссёрского видео. 40-секундная нативная для Omni цепочка 1.1 — версия той же идеи на поверхностях Google.

Первый и последний кадры

Задайте стартовое изображение и финальное; Omni 1.1 генерирует непрерывное движение между ними. Google ставит это на облёты камеры, зум-переходы и зацикленные клипы — последнее получается, если одно и то же изображение стоит и первым, и последним кадром.

Демонстрация первого и последнего кадра в Gemini Omni 1.1 FlashОфициальное демо Google: Omni 1.1 Flash интерполирует непрерывное движение камеры между заданным стартовым планом и конечным кадром.Полезный тест — читается ли промежуточное движение как один план: резкая панорама, наезд, петля, а не два стопкадра с наплывом.

Теги в промпте закрепляют роли. Google документирует простые теги FIRST_FRAME и LAST_FRAME внутри промпта; в более сложных промптах источники можно объявить явно:

[# Sources <FIRST_FRAME>@Image1 <LAST_FRAME>@Image2]

Теги остаются в промпте как написаны. Окружающая инструкция — место, где вы описываете движение: один непрерывный план, без скачков склейки, что делает камера между двумя стопкадрами.

В OmniArt PixVerse V6 уже открывает процесс перехода между утверждёнными начальным и конечным кадрами. Если бриф — «дойти из этого кадра в тот», ждать отдельный идентификатор модели Omni 1.1 не обязательно. Если бриф — «сделать это внутри диалогового треда Omni Flash», это по-прежнему живёт в Interactions API Google.

Видеореференсы, до трёх секунд каждый

1.1 позволяет положить короткое референсное видео в тот же мультимодальный промпт, что и текст с изображениями. Публичное демо Google накладывает три клипа с танцорами на три стопкадра персонажей и просит один непрерывный план.

Демонстрация видеореференса в Gemini Omni 1.1 FlashОфициальное демо Google: Omni 1.1 Flash использует короткие референсные клипы, чтобы перенести движение и игру персонажа в новую сцену.Каждый клип делает работу движения, а не внешности: стопкадры несут идентичность, трёхсекундные видео несут танец.

Задокументированный потолок жёстче маркетинговой формулировки. Видеореференсы лучше всего работают для сходства; звук внутри референсного клипа игнорируется; максимум — три клипа, до 3 секунд каждый. Google также пишет, что обращение к нескольким видео сразу или рассуждение по ним как по нарративному сравнению не поддерживается — считайте каждый клип референсом персонажа или движения, а не вторым исходником для монтажа.

Это реальное расширение относительно preview от 30 июня, который принимал один видеореференс и не полностью обрабатывал клипы длиннее 3 секунд. Это всё ещё не аудиовходная половина обещания any-to-any. Звук по-прежнему задаётся в промпте.

Текущая карточка Gemini Omni в OmniArt принимает одно референсное видео (MP4 или MOV, 1–10 секунд) вместе с максимум пятью референсными изображениями, а тарификация идёт от длительности исходного клипа. Для одного референса движения этого достаточно уже сегодня. Для более крупных наборов референсов Seedance 2.5 по-прежнему остаётся моделью пространства, собранной вокруг этой задачи.

Черновики 360p и вывод 1080p / 4K

Лестница разрешений — второе производственное изменение. Генерация по умолчанию — 720p. Теперь можно запросить:

  • 360p — дешёвый черновой уровень Google. Заявлен как до 60 % быстрее по пропускной способности и примерно треть стоимости 720p. В Flow можно сделать черновик в 360p, а затем скачать отобранный дубль в 720p.
  • 1080p или 4K — в документации это вывод с повышенной детализацией поверх генерации 720p, рассчитанный на соцсети, цифровую сдачу или эфирную доводку.

Полезный процесс здесь самый очевидный: исследуйте камеру, игру и точки склейки в 360p, а генерацию 1080p или 4K тратьте на дубль, который реально пойдёт в сдачу. Это та же дисциплина, что черновик на быстрой модели в OmniArt перед финалом на более дорогой — только теперь это переключатель разрешения на одной модели Omni.

Примечание

Google опубликовал таблицу цен API по разрешениям вместе с анонсом 1.1. Формулировку «360p — треть от 720p» воспринимайте как сравнение самого Google, а не как расчёт кредитов OmniArt. Карточка Gemini Omni в OmniArt сейчас тарифицирует поверхность 720p длительностью 3–10 секунд.

Нативная генерация 4K в этой линейке по-прежнему задача Veo 3.1. Путь 1.1 к 4K — финальный шаг на клипе Omni, а не заявление, что Omni заменил Veo для сдачи на большой экран.

Где это уже доступно и что OmniArt открывает сегодня

Google раскатывает 1.1 по своему стеку 27 августа:

  • Google AI Studio и Gemini API (gemini-omni-1.1-flash)
  • Gemini Enterprise Agent Platform (gemini-omni-1.1-flash-preview)
  • Google Flow, включая начальный и конечный кадры, черновики 360p и экспорт 1080p / 4K
  • Продление сцены в приложении Gemini для подписчиков Google AI Plus, Pro и Ultra

Стандартная генерация Gemini Omni уже есть в OmniArt: 720p, 3–10 секунд, нативное аудио, до пяти референсных изображений и одно референсное видео, тариф Starter и выше. OmniArt сейчас не открывает отдельный идентификатор модели gemini-omni-1.1-flash, 40-секундную цепочку продления, задачу первого и последнего кадра и лестницу разрешений 360p / 1080p / 4K. Диалоговые правки с сохранением сессии по-прежнему требуют Interactions API Google — как и тогда, когда мы разбирали API для разработчиков от 30 июня.

Предупреждение

Не планируйте сдачу 40-секундного ролика Omni 1.1 через текущий выбор Gemini Omni в OmniArt. Живая модель в пространстве — это поверхность Omni Flash на 720p и 10 секунд. Для элементов управления, специфичных для 1.1, используйте API или Flow Google, пока здесь не появится отдельная карточка модели.

Как выбирать рядом с Veo 3.1 и Seedance 2.5

1.1 не снимает остальную линейку Google и не делает Omni единственным вариантом направленного видео в OmniArt. Выбирайте под кадр:

Кадру нужноБерите
Правки через чат внутри одного треда OmniGemini Omni 1.1 на API / Flow Google
Нативный 4K, пространственный звук, эфирная доводкаVeo 3.1 в OmniArt
Одиночные дубли на 30 секунд, продление до 60 секунд или длинное видео на 180 секундSeedance 2.5 в OmniArt
Интерполяция от первого кадра к последнему в пространстве уже сегодняПереход PixVerse V6 или First and Last Frames в Seedance 2.5
Быстрая генерация Omni в 720p с одним видеореференсомGemini Omni в OmniArt
Крупные мультимодальные наборы референсовSeedance 2.5

Схема та же, что на I/O: новые релизы Omni — это дополнения. Вы оставляете модели, которые уже закрывают бриф, и добавляете 1.1, когда задача именно в разговорном управлении Omni плюс более длинный и более резкий финал.

Привычки промптинга, которые по-прежнему относятся к первому 10-секундному такту — одно ясное действие, звук, прописанный в промпте, без поля негативного промпта, — смотрите в руководстве по промптам Omni Flash. Язык продления на модели пространства, которая уже это умеет, — в руководстве по монтажу и продлению Seedance 2.5.

Что делать на этой неделе в OmniArt

Если хотите попробовать сам Omni, откройте Gemini Omni в видеопространстве и прогоните текущую поверхность на 10 секунд и 720p: текст, референсные изображения или один короткий видеореференс. Сравните её бок о бок с Veo 3.1, Seedance 2.5, PixVerse V6, Kling и остальной линейкой — один баланс, одна грамматика промпта.

Если бриф именно про новые элементы управления 1.1 — 40-секундное нативное для Omni продление, интерполяцию первого и последнего кадра внутри Omni или петлю «360p, затем 4K», — на этой неделе берите Google AI Studio, Flow или Gemini API, а OmniArt оставляйте местом, где вы уже генерируете остальной проект.

Этот разрыв временный так же, как был разрыв оригинального API Flash. Когда элементы управления 1.1 появятся как выбираемая модель OmniArt, они станут ещё одной опцией в пространстве, которое уже производит результат, а не поводом ждать.

Часто задаваемые вопросы

Что такое Gemini Omni 1.1 Flash?

Gemini Omni 1.1 Flash — обновление Omni Flash от Google от 27 августа 2026 года, мультимодальная модель генерации и редактирования видео. Она добавляет продление сцены, интерполяцию первого и последнего кадра, короткие видеореференсы, черновики 360p и вывод 1080p / 4K поверх исходного разговорного редактирования и входа текстом, изображением и видео.

Доступен ли Gemini Omni 1.1 Flash в OmniArt?

Не как отдельный идентификатор модели. OmniArt сейчас отдаёт стандартную генерацию Gemini Omni в 720p и 3–10 секунд. Элементы управления, специфичные для 1.1, — продление до 40 секунд, первый и последний кадры, черновики 360p и вывод 1080p / 4K — раскатываются в Google AI Studio, Flow, Gemini API и Gemini Enterprise Agent Platform.

Какой длины могут быть видео Omni 1.1 Flash?

Одна генерация по-прежнему даёт 10-секундный клип. Продление сцены дописывает по 3–10 секунд за раз, опираясь на до 10 секунд предыдущего материала как на контекст, до накопленного максимума 40 секунд. Загруженные исходники для продления должны быть не длиннее 10 секунд.

Генерирует ли Omni 1.1 Flash нативный 4K?

Google документирует 1080p и 4K как вывод с повышенной детализацией поверх генерации 720p по умолчанию, а не как нативный путь захвата в 4K. Для нативного видео 4K в OmniArt Veo 3.1 по-прежнему остаётся моделью линейки Google, собранной под такую сдачу.

Добавил ли 1.1 загрузку аудиореференса или редактирование речи?

Нет. Текущая документация Omni от Google по-прежнему указывает загрузку аудиореференса и редактирование речи как неподдерживаемые. Звук внутри видеореференса игнорируется. Звук по-прежнему направляется в промпте — это совпадает с тем, что мы фиксировали в статье про вход any-to-any.

Готовы создавать?

Начните генерировать впечатляющий контент с ИИ

Начать бесплатно