Gemini Omni 1.1 Flash: qué salió para el control de video
Gemini Omni 1.1 Flash de Google es una actualización de video lista para producción: extiende escenas, fija el primer y el último fotograma, arma borradores en 360p y genera salida en 1080p o 4K.

El 27 de agosto de 2026, Google lanzó Gemini Omni 1.1 Flash, la primera actualización pensada para producción del modelo de video Omni Flash que debutó en I/O. El anuncio oficial y el hilo de Google en X lo enmarcan como una versión de control, no como un cambio de nombre: extiende una escena, fija el fotograma de arranque y el de cierre, pega referencias cortas de video, arma borradores baratos en 360p y después genera 1080p o 4K en las tomas que sí te vas a quedar.
Eso es un trabajo distinto del debut para consumidores del 19 de mayo que cubrimos en Gemini Omni Flash: qué salió y qué se guardó Google. La apuesta original de Flash era edición conversacional y entrada any-to-any, con un clip duro de 10 segundos y sin extensión de escena en la API para desarrolladores del 30 de junio. La 1.1 es el pase que intenta dejar esos clips lo bastante largos, nítidos y dirigidos para un pipeline de producción.
Este artículo es el recuento de capacidades: qué agregó de verdad la 1.1, qué techos siguen vigentes y cuáles de esos trabajos ya puedes correr hoy en OmniArt.
Qué salió de verdad en Gemini Omni 1.1 Flash
El id de API de Google es gemini-omni-1.1-flash (vista previa en Gemini Enterprise Agent Platform como gemini-omni-1.1-flash-preview). La salida por defecto sigue en 720p horizontal; 16:9 y 9:16 siguen siendo las dos relaciones de aspecto. La marca de agua SynthID sigue siendo obligatoria.
| Capacidad | Omni Flash original | Omni 1.1 Flash |
|---|---|---|
| Duración del clip | 10 segundos por generación | Generaciones de 10 segundos, extensibles en pasos de 10 segundos hasta 40 segundos en total |
| Extensión de escena | No estaba en la API del 30 de junio | Analiza hasta 10 segundos de material previo (no solo el último segundo) |
| Primer y último fotogramas | No era un modo de API de primera clase | Interpola movimiento continuo entre dos fotogramas clave |
| Referencias de video | Un clip; los clips de más de 3 segundos no se procesaban del todo | Hasta tres clips, de 3 segundos cada uno |
| Resolución de borrador | 720p por defecto, sin un nivel de vista previa más barato | Borradores en 360p; Google dice hasta 60% más rápido y alrededor de un tercio del costo del 720p |
| Resolución final | No se reveló en I/O; OmniArt sirve 720p | Salida en 1080p o 4K, documentada como derivada de la generación en 720p |
| Superficies | App de Gemini, Flow, YouTube y después la API del 30 de junio | Google AI Studio, Gemini API, Gemini Enterprise Agent Platform, Google Flow; la extensión de escena también en la app de Gemini para Google AI Plus, Pro y Ultra |
La lista de lo retenido en I/O no se movió. La documentación actual de Google todavía dice que la edición de voz no está soportada, que la subida de referencia de audio no está soportada y que el modo avatar nunca formó parte de este lanzamiento. La 1.1 agrega dirección y duración. No agrega las funciones retenidas por seguridad.
Extensión de escena: 10 segundos de contexto, hasta 40 segundos
La extensión de escena es el titular. Sigues desde la cola de un clip que ya existe, en vez de esperar que una generación nueva de 10 segundos coincida con él.
Las cifras de Google: el modelo ahora lee hasta 10 segundos de material previo —“un salto respecto de modelos anteriores que solo referenciaban el último segundo”— y después anexa otros 3–10 segundos. Repite eso en incrementos de 10 segundos hasta que el clip acumulado llegue a 40 segundos. Algunos de los últimos fotogramas de la fuente se reescriben para que la unión no sea un corte seco. No puedes agregar al inicio ni extender el medio de un clip.
El prompt de una extensión puede ser tan corto como "Continue the scene." o tan específico como un movimiento de cámara nuevo. La documentación de Google es explícita: 0 segundos en un prompt de extensión con marcas de tiempo significa el inicio del segmento nuevo, no el inicio del clip original. Describe el audio si necesitas que cambie la música; si no, el modelo intenta mantenerla coherente.
Hay dos restricciones que importan antes de armar una pieza de 40 segundos alrededor de esto:
- Los clips fuente subidos para extensión tienen que durar 10 segundos o menos, salvo que estés extendiendo un clip que el propio modelo ya generó en la misma sesión de varios turnos.
- Extender un clip subido no está disponible en el EEE, Suiza ni el Reino Unido. Extender un clip generado por el modelo está disponible en todas las regiones donde está la API misma.
En OmniArt, Seedance 2.5 ya cubre un trabajo parecido: extender cualquier resultado de 30 segundos o menos, una y otra vez, hasta 60 segundos, o generar 30–180 segundos en una sola pasada Long Video. Ese es el camino del espacio de trabajo para video largo y dirigido hoy. La cadena nativa Omni de 40 segundos de la 1.1 es la versión en las superficies de Google de la misma idea.
Primer y último fotogramas
Define una imagen de arranque y una imagen de cierre; Omni 1.1 genera el movimiento continuo entre las dos. Google lo plantea para órbitas de cámara, transiciones de zoom y clips en loop: esto último usando la misma imagen como primer fotograma y como último fotograma.
Las etiquetas del prompt atan los roles. Google documenta etiquetas simples FIRST_FRAME y LAST_FRAME dentro del prompt; los prompts más complejos pueden declarar las fuentes de forma explícita:
[# Sources <FIRST_FRAME>@Image1 <LAST_FRAME>@Image2]
Las etiquetas se quedan en el prompt tal como están escritas. La instrucción de alrededor es donde describes el movimiento: un plano continuo, sin jump cuts, qué hace la cámara entre las dos fijas.
En OmniArt, PixVerse V6 ya expone un flujo de transición entre fotogramas de arranque y de cierre aprobados. Si el brief es “llegar de este fotograma a aquel”, no tienes que esperar a que Omni 1.1 aterrice como un id de modelo aparte. Si el brief es “hacerlo dentro del hilo conversacional de Omni Flash”, eso sigue viviendo en la Interactions API de Google.
Referencias de video, hasta tres segundos cada una
La 1.1 te deja soltar video de referencia corto en el mismo prompt multimodal que el texto y las imágenes. La demo pública de Google mapea tres clips de bailarines sobre tres fijas de personaje y pide un plano continuo.
El techo documentado es más estricto que la línea de marketing. Las referencias de video funcionan mejor para el parecido; el audio de un clip de referencia se ignora; el máximo es tres clips, de hasta 3 segundos cada uno. Google también dice que referenciar o razonar a través de varios videos no está soportado como una comparación narrativa: trata cada clip como referencia de sujeto o de movimiento, no como una segunda fuente para editar.
Eso es una expansión real frente a la vista previa del 30 de junio, que aceptaba una referencia de video y no procesaba del todo los clips de más de 3 segundos. Todavía no es la mitad de audio de la propuesta any-to-any. El sonido sigue siendo algo que describes en el prompt.
La entrada actual de Gemini Omni en OmniArt acepta un video de referencia (MP4 o MOV, 1–10 segundos) mezclado con hasta cinco imágenes de referencia, y cobra a partir de la duración del clip fuente. Úsalo hoy para una sola referencia de movimiento. Para paquetes de referencia más grandes, Seedance 2.5 sigue siendo el modelo del espacio de trabajo armado alrededor de ese trabajo.
Borradores en 360p y salida en 1080p / 4K
La escalera de resolución es el otro cambio de producción. La generación por defecto es 720p. Ahora puedes pedir:
- 360p — el nivel barato de borrador de Google. Declarado como hasta 60% más rápido en rendimiento y alrededor de un tercio del costo del 720p. Flow te deja armar el borrador en 360p y después descargar una toma final en 720p.
- 1080p o 4K — documentado como salida a partir de la generación en 720p, pensado para el acabado social, digital o de emisión.
El flujo útil es el obvio: explora cámara, interpretación y puntos de corte en 360p, y gasta la generación en 1080p o 4K en la toma que de verdad publicarías. Es la misma disciplina de armar el borrador en un modelo rápido de OmniArt antes de cerrar en uno más caro: solo que ahora es un interruptor de resolución en un único modelo Omni.
Nota
Google publicó una tabla de precios de API por resolución junto con el anuncio de la 1.1. Trata la línea del 360p “un tercio del 720p” como la comparación de Google, no como la cuenta de créditos de OmniArt. La entrada Gemini Omni de OmniArt cobra hoy contra una superficie de 720p y 3–10 segundos.
La generación nativa en 4K sigue siendo el trabajo de Veo 3.1 en esta línea. El camino 4K de la 1.1 es un paso de acabado sobre un clip Omni, no el reclamo de que Omni reemplazó a Veo para entrega en pantalla grande.
Dónde está en vivo, y qué expone OmniArt hoy
Google está desplegando la 1.1 en su propia pila el 27 de agosto:
- Google AI Studio y la Gemini API (
gemini-omni-1.1-flash) - Gemini Enterprise Agent Platform (
gemini-omni-1.1-flash-preview) - Google Flow, incluidos fotogramas de arranque/cierre, borradores en 360p y exportación en 1080p / 4K
- Extensión de escena en la app de Gemini, para suscriptores de Google AI Plus, Pro y Ultra
La generación estándar de Gemini Omni ya está en OmniArt: 720p, 3–10 segundos, audio nativo, hasta cinco imágenes de referencia y un video de referencia, plan Starter y superiores. OmniArt no expone ahora un id de modelo aparte gemini-omni-1.1-flash, la cadena de extensión de 40 segundos, la tarea de primer-y-último-fotograma ni la escalera de resolución 360p / 1080p / 4K. Las ediciones conversacionales que conservan la sesión siguen exigiendo la Interactions API de Google, como ya ocurría cuando cubrimos la API para desarrolladores del 30 de junio.
Advertencia
No armes una entrega Omni 1.1 de 40 segundos contra el selector actual de Gemini Omni de OmniArt. El modelo en vivo del espacio de trabajo es la superficie Omni Flash de 720p y 10 segundos. Usa la API o Flow de Google para los controles específicos de la 1.1 hasta que aterrice aquí una entrada de modelo distinta.
Cómo elegir frente a Veo 3.1 y Seedance 2.5
La 1.1 no retira el resto de la línea de Google y no convierte a Omni en la única opción de video dirigido en OmniArt. Elige por plano:
| Lo que necesita el plano | Recurre a |
|---|---|
| Revisiones por chat dentro de un hilo Omni | Gemini Omni 1.1 en la API / Flow de Google |
| 4K nativo, audio espacial, acabado de emisión | Veo 3.1 en OmniArt |
| Tomas únicas de 30 segundos, extensiones de 60 segundos o video largo de 180 segundos | Seedance 2.5 en OmniArt |
| Interpolación de primer a último fotograma en el espacio de trabajo hoy | Transición de PixVerse V6, o First and Last Frames de Seedance 2.5 |
| Generación Omni rápida en 720p con una sola referencia de video | Gemini Omni en OmniArt |
| Paquetes grandes de referencia multimodal | Seedance 2.5 |
El patrón es el mismo que usamos en I/O: los lanzamientos nuevos de Omni son adiciones. Conservas los modelos que ya cubren el brief y agregas la 1.1 cuando el trabajo es concretamente el control conversacional de Omni más un acabado más largo y más nítido.
Para los hábitos de prompt que siguen aplicando al primer beat de 10 segundos —una acción clara, el sonido escrito en el prompt, sin campo de prompt negativo— revisa la guía de prompt de Omni Flash. Para el lenguaje de extensión en el modelo del espacio de trabajo que ya lo hace, revisa la guía de edición y extensión de Seedance 2.5.
Qué hacer esta semana en OmniArt
Si quieres probar el propio Omni, abre Gemini Omni en el espacio de video y corre la superficie actual de 10 segundos a 720p: texto, imágenes de referencia o una referencia corta de video. Compáralo lado a lado con Veo 3.1, Seedance 2.5, PixVerse V6, Kling y el resto de la línea: un saldo, una gramática de prompt.
Si el brief es concretamente los controles nuevos de la 1.1 —extensión nativa Omni de 40 segundos, interpolación de primer/último fotograma dentro de Omni o un loop 360p-después-4K—, usa Google AI Studio, Flow o la Gemini API esta semana y trata OmniArt como el lugar en el que ya generas el resto del proyecto.
Esa división es temporal del mismo modo que lo fue el hueco original de la API de Flash. Cuando los controles de la 1.1 aterrizan como un modelo seleccionable en OmniArt, se vuelven otra opción dentro de un espacio de trabajo que ya está produciendo, no un motivo para esperar.
Preguntas frecuentes
¿Qué es Gemini Omni 1.1 Flash?
Gemini Omni 1.1 Flash es la actualización del 27 de agosto de 2026 de Omni Flash, un modelo multimodal de generación y edición de video. Agrega extensión de escena, interpolación de primer y último fotograma, referencias cortas de video, borradores en 360p y salida en 1080p / 4K encima de la edición conversacional original y de la entrada de texto/imagen/video.
¿Gemini Omni 1.1 Flash está disponible en OmniArt?
No como un id de modelo aparte. OmniArt sirve ahora generación estándar de Gemini Omni a 720p y 3–10 segundos. Los controles específicos de la 1.1 —extensión de 40 segundos, primer/último fotograma, borradores en 360p y salida en 1080p / 4K— se están desplegando en Google AI Studio, Flow, la Gemini API y Gemini Enterprise Agent Platform.
¿Cuánto pueden durar los videos de Omni 1.1 Flash?
Una sola generación sigue siendo un clip de 10 segundos. La extensión de escena anexa 3–10 segundos cada vez, usando hasta 10 segundos de material previo como contexto, hasta un máximo acumulado de 40 segundos. Las fuentes subidas para extensión tienen que durar 10 segundos o menos.
¿Omni 1.1 Flash genera 4K nativo?
Google documenta 1080p y 4K como salida a partir de la generación por defecto en 720p, no como una vía nativa de captura en 4K. Para video 4K nativo en OmniArt, Veo 3.1 sigue siendo el modelo de la línea Google construido para ese acabado.
¿La 1.1 agregó subida de referencia de audio o edición de voz?
No. La documentación actual de Omni de Google sigue listando la subida de referencia de audio y la edición de voz como no soportadas. El audio de una referencia de video se ignora. El sonido se sigue dirigiendo en el prompt, igual que registramos en el artículo de entrada any-to-any.
¿Todo listo para crear?
Empieza a generar contenido increíble con IA