UpdateModelos e insights14 min de lectura

Gemini Omni 1.1 Flash: lo que se ha lanzado para el control de vídeo

Gemini Omni 1.1 Flash de Google es una actualización de vídeo lista para producción: extiende escenas, fija el primer y el último fotograma, haz borradores en 360p y genera salida en 1080p o 4K.

Equipo OmniArt
Gemini Omni 1.1 Flash: lo que se ha lanzado para el control de vídeo

El 27 de agosto de 2026, Google ha lanzado Gemini Omni 1.1 Flash, la primera actualización orientada a producción del modelo de vídeo Omni Flash que debutó en el I/O. El anuncio oficial y el hilo de Google en X lo presentan como un lanzamiento de control, no como un cambio de nombre: extiende una escena, bloquea el fotograma inicial y el final, adjunta referencias cortas de vídeo, haz borradores baratos en 360p y después genera 1080p o 4K en las tomas que te quedes.

Ese es un trabajo distinto del debut de consumo del 19 de mayo que cubrimos en Gemini Omni Flash: lo que se lanzó y lo que Google se reservó. La propuesta original de Flash era la edición conversacional y la entrada any-to-any, con un clip rígido de 10 segundos y sin extensión de escena en la API para desarrolladores del 30 de junio. La 1.1 es el pase que intenta dejar esos clips lo bastante largos, nítidos y dirigidos para un pipeline de producción.

Este artículo es el repaso de capacidades: qué ha añadido de verdad la 1.1, qué límites siguen aplicando y cuáles de esos trabajos ya puedes ejecutar hoy en OmniArt.

Qué ha lanzado realmente Gemini Omni 1.1 Flash

El id de API de Google es gemini-omni-1.1-flash (vista previa en Gemini Enterprise Agent Platform como gemini-omni-1.1-flash-preview). La salida por defecto sigue siendo 720p apaisado; 16:9 y 9:16 continúan siendo las dos relaciones de aspecto. La marca de agua SynthID sigue siendo obligatoria.

CapacidadOmni Flash originalOmni 1.1 Flash
Duración del clip10 segundos por generaciónGeneraciones de 10 segundos, extensibles en pasos de 10 segundos hasta 40 segundos en total
Extensión de escenaNo estaba en la API del 30 de junioAnaliza hasta 10 segundos de metraje previo (no solo el último segundo)
Primer y último fotogramasNo era un modo de API de primera claseInterpola movimiento continuo entre dos fotogramas clave
Referencias de vídeoUn clip; los clips de más de 3 segundos no se procesaban por completoHasta tres clips, de 3 segundos cada uno
Resolución de borrador720p por defecto, sin un nivel de vista previa más baratoBorradores en 360p; Google afirma hasta un 60 % más de rapidez y alrededor de un tercio del coste del 720p
Resolución finalNo se reveló en el I/O; OmniArt sirve 720pSalida en 1080p o 4K, documentada como derivada de la generación en 720p
SuperficiesApp de Gemini, Flow, YouTube y después la API del 30 de junioGoogle AI Studio, Gemini API, Gemini Enterprise Agent Platform, Google Flow; la extensión de escena también en la app de Gemini para Google AI Plus, Pro y Ultra

La lista de lo retenido en el I/O no se ha movido. La documentación actual de Google sigue diciendo que la edición de voz no está soportada, que la subida de referencia de audio no está soportada y que el modo avatar nunca formó parte de este lanzamiento. La 1.1 añade dirección y duración. No añade las funciones retenidas por seguridad.

Extensión de escena: 10 segundos de contexto, hasta 40 segundos

La extensión de escena es el titular. Continuas desde la cola de un clip existente en lugar de esperar que una nueva generación de 10 segundos coincida con él.

Las cifras de Google: el modelo ahora lee hasta 10 segundos de metraje previo —«un salto respecto a modelos anteriores que solo referenciaban el último segundo»— y después añade otros 3–10 segundos. Repite eso en incrementos de 10 segundos hasta que el clip acumulado llegue a 40 segundos. Algunos de los últimos fotogramas de la fuente se reescriben para que la unión no sea un corte seco. No puedes anteponer material ni extender el medio de un clip.

Demo de extensión de escena de Gemini Omni 1.1 FlashDemo oficial de Google de Omni 1.1 Flash continuando una escena a partir de metraje previo y manteniendo la identidad del personaje, la iluminación y el contexto narrativo.Mira la unión, no solo la acción nueva: la identidad, la iluminación y la banda sonora deberían sobrevivir a la extensión en lugar de reiniciarse.

El prompt de una extensión puede ser tan breve como "Continue the scene." o tan concreto como un nuevo movimiento de cámara. La documentación de Google deja claro que 0 segundos en un prompt de extensión con marcas de tiempo significa el inicio del segmento nuevo, no el inicio del clip original. Describe el audio si necesitas que cambie la banda sonora; si no, el modelo intenta mantenerla coherente.

Hay dos restricciones que importan antes de planificar una pieza de 40 segundos alrededor de esto:

  • Los clips fuente subidos para extensión deben durar 10 segundos o menos, salvo que estés extendiendo un clip que el propio modelo ya haya generado en la misma sesión de varios turnos.
  • Extender un clip subido no está disponible en el EEE, Suiza ni el Reino Unido. Extender un clip generado por el modelo está disponible en todas las regiones en las que está la propia API.

En OmniArt, Seedance 2.5 ya cubre un trabajo emparentado: extender cualquier resultado de 30 segundos o menos, de forma repetida, hasta 60 segundos, o generar 30–180 segundos en un único pase Long Video. Esa es la vía del espacio de trabajo para vídeo largo y dirigido hoy. La cadena nativa Omni de 40 segundos de la 1.1 es la versión en las superficies de Google de la misma idea.

Primer y último fotogramas

Fija una imagen de inicio y una imagen de final; Omni 1.1 genera el movimiento continuo entre ambas. Google lo sitúa para órbitas de cámara, transiciones de zoom y clips en bucle: esto último usando la misma imagen como primer fotograma y como último fotograma.

Demo de primer y último fotograma de Gemini Omni 1.1 FlashDemo oficial de Google de Omni 1.1 Flash interpolando un movimiento de cámara continuo entre un plano de partida indicado y un fotograma final.La prueba útil es si el movimiento intermedio se lee como un solo plano —un whip-pan, un zoom, un bucle— y no como dos fijas con un fundido.

Las etiquetas del prompt atan los papeles. Google documenta etiquetas sencillas FIRST_FRAME y LAST_FRAME dentro del prompt; los prompts más complejos pueden declarar las fuentes de forma explícita:

[# Sources <FIRST_FRAME>@Image1 <LAST_FRAME>@Image2]

Las etiquetas se quedan en el prompt tal como están escritas. La instrucción de alrededor es donde describes el movimiento: un plano continuo, sin jump cuts, qué hace la cámara entre las dos fijas.

En OmniArt, PixVerse V6 ya expone un flujo de transición entre fotogramas de inicio y de final aprobados. Si el briefing es «pasar de este fotograma a aquel», no tienes que esperar a que Omni 1.1 aterrice como un id de modelo aparte. Si el briefing es «hacerlo dentro del hilo conversacional de Omni Flash», eso sigue viviendo en la Interactions API de Google.

Referencias de vídeo, hasta tres segundos cada una

La 1.1 te deja soltar vídeo de referencia corto en el mismo prompt multimodal que el texto y las imágenes. La demo pública de Google asigna tres clips de bailarines a tres fijas de personaje y pide un plano continuo.

Demo de referencia de vídeo de Gemini Omni 1.1 FlashDemo oficial de Google de Omni 1.1 Flash usando clips cortos de referencia para transferir movimiento y la interpretación del personaje a una escena nueva.Cada clip hace un trabajo de movimiento, no de aspecto: las fijas cargan la identidad y los vídeos de tres segundos cargan el baile.

El techo documentado es más estricto que la frase de marketing. Las referencias de vídeo funcionan mejor para el parecido; el audio de un clip de referencia se ignora; el máximo es tres clips, de hasta 3 segundos cada uno. Google también dice que referenciar o razonar a través de varios vídeos no está soportado como una comparación narrativa: trata cada clip como referencia de sujeto o de movimiento, no como una segunda fuente que editar.

Eso es una ampliación real respecto a la vista previa del 30 de junio, que aceptaba una referencia de vídeo y no procesaba por completo los clips de más de 3 segundos. Sigue sin ser la mitad de audio de la propuesta any-to-any. El sonido sigue siendo algo que describes en el prompt.

La entrada actual de Gemini Omni en OmniArt acepta un vídeo de referencia (MP4 o MOV, 1–10 segundos) mezclado con hasta cinco imágenes de referencia, y factura a partir de la duración del clip fuente. Úsalo hoy para una sola referencia de movimiento. Para paquetes de referencia más grandes, Seedance 2.5 sigue siendo el modelo del espacio de trabajo construido alrededor de ese trabajo.

Borradores en 360p y salida en 1080p / 4K

La escalera de resolución es el otro cambio de producción. La generación por defecto es 720p. Ahora puedes pedir:

  • 360p — el nivel barato de borrador de Google. Declarado como hasta un 60 % más rápido en rendimiento y alrededor de un tercio del coste del 720p. Flow te deja hacer el borrador en 360p y después descargar un clip definitivo en 720p.
  • 1080p o 4K — documentado como salida a partir de la generación en 720p, pensado para el acabado social, digital o de difusión.

El flujo útil es el obvio: explora cámara, interpretación y puntos de corte en 360p, y gasta la generación en 1080p o 4K en la toma que de verdad enviarías. Es la misma disciplina que hacer el borrador en un modelo rápido de OmniArt antes de finalizar en uno más caro; solo que ahora es un conmutador de resolución en un único modelo Omni.

Nota

Google ha publicado una tabla de precios de API por resolución junto con el anuncio de la 1.1. Trata la línea del 360p «un tercio del 720p» como la comparación de Google, no como la cuenta de créditos de OmniArt. La entrada Gemini Omni de OmniArt factura hoy contra una superficie de 720p y 3–10 segundos.

La generación nativa en 4K sigue siendo el trabajo de Veo 3.1 en esta línea. El camino 4K de la 1.1 es un paso de acabado sobre un clip Omni, no la afirmación de que Omni haya sustituido a Veo para la entrega en pantalla grande.

Dónde está activo, y qué expone OmniArt hoy

Google está desplegando la 1.1 en su propia pila el 27 de agosto:

  • Google AI Studio y la Gemini API (gemini-omni-1.1-flash)
  • Gemini Enterprise Agent Platform (gemini-omni-1.1-flash-preview)
  • Google Flow, incluidos fotogramas de inicio/final, borradores en 360p y exportación en 1080p / 4K
  • Extensión de escena en la app de Gemini, para suscriptores de Google AI Plus, Pro y Ultra

La generación estándar de Gemini Omni ya está en OmniArt: 720p, 3–10 segundos, audio nativo, hasta cinco imágenes de referencia y un vídeo de referencia, plan Starter y superiores. OmniArt no expone ahora un id de modelo aparte gemini-omni-1.1-flash, la cadena de extensión de 40 segundos, la tarea de primer-y-último-fotograma ni la escalera de resolución 360p / 1080p / 4K. Las ediciones conversacionales que conservan la sesión siguen exigiendo la Interactions API de Google, como ya ocurría cuando cubrimos la API para desarrolladores del 30 de junio.

Advertencia

No planifiques una entrega Omni 1.1 de 40 segundos contra el selector actual de Gemini Omni de OmniArt. El modelo activo del espacio de trabajo es la superficie Omni Flash de 720p y 10 segundos. Usa la API o Flow de Google para los controles específicos de la 1.1 hasta que aterrice aquí una entrada de modelo distinta.

Cómo elegir frente a Veo 3.1 y Seedance 2.5

La 1.1 no retira el resto de la línea de Google y no convierte a Omni en la única opción de vídeo dirigido en OmniArt. Elige por plano:

El plano necesitaRecurre a
Revisiones por chat dentro de un hilo OmniGemini Omni 1.1 en la API / Flow de Google
4K nativo, audio espacial, acabado de difusiónVeo 3.1 en OmniArt
Tomas únicas de 30 segundos, extensiones de 60 segundos o vídeo largo de 180 segundosSeedance 2.5 en OmniArt
Interpolación de primer a último fotograma en el espacio de trabajo hoyTransición de PixVerse V6, o First and Last Frames de Seedance 2.5
Generación Omni rápida en 720p con una sola referencia de vídeoGemini Omni en OmniArt
Paquetes grandes de referencia multimodalSeedance 2.5

El patrón es el mismo que usamos en el I/O: los nuevos lanzamientos Omni son adiciones. Conservas los modelos que ya cubren el briefing y añades la 1.1 cuando el trabajo es concretamente el control conversacional de Omni más un acabado más largo y más nítido.

Para los hábitos de prompt que siguen aplicando al primer beat de 10 segundos —una acción clara, el sonido escrito en el prompt, sin campo de prompt negativo— consulta la guía de prompt de Omni Flash. Para el lenguaje de extensión en el modelo del espacio de trabajo que ya lo hace, consulta la guía de edición y extensión de Seedance 2.5.

Qué hacer esta semana en OmniArt

Si quieres probar el propio Omni, abre Gemini Omni en el espacio de vídeo y ejecuta la superficie actual de 10 segundos a 720p: texto, imágenes de referencia o una referencia corta de vídeo. Compáralo en paralelo con Veo 3.1, Seedance 2.5, PixVerse V6, Kling y el resto de la línea: un saldo, una gramática de prompt.

Si el briefing es concretamente los controles nuevos de la 1.1 —extensión nativa Omni de 40 segundos, interpolación de primer/último fotograma dentro de Omni o un bucle 360p-luego-4K—, usa Google AI Studio, Flow o la Gemini API esta semana y trata OmniArt como el sitio en el que ya generas el resto del proyecto.

Esa división es temporal del mismo modo que lo fue el hueco original de la API de Flash. Cuando los controles de la 1.1 aterricen como un modelo seleccionable en OmniArt, se convierten en otra opción dentro de un espacio de trabajo que ya está produciendo, no en un motivo para esperar.

Preguntas frecuentes

¿Qué es Gemini Omni 1.1 Flash?

Gemini Omni 1.1 Flash es la actualización del 27 de agosto de 2026 de Omni Flash, un modelo multimodal de generación y edición de vídeo. Añade extensión de escena, interpolación de primer y último fotograma, referencias cortas de vídeo, borradores en 360p y salida en 1080p / 4K sobre la edición conversacional original y la entrada de texto/imagen/vídeo.

¿Gemini Omni 1.1 Flash está disponible en OmniArt?

No como un id de modelo aparte. OmniArt sirve ahora generación estándar de Gemini Omni a 720p y 3–10 segundos. Los controles específicos de la 1.1 —extensión de 40 segundos, primer/último fotograma, borradores en 360p y salida en 1080p / 4K— se están desplegando en Google AI Studio, Flow, la Gemini API y Gemini Enterprise Agent Platform.

¿Cuánto pueden durar los vídeos de Omni 1.1 Flash?

Una sola generación sigue siendo un clip de 10 segundos. La extensión de escena añade 3–10 segundos cada vez, usando hasta 10 segundos de metraje previo como contexto, hasta un máximo acumulado de 40 segundos. Las fuentes subidas para extensión deben durar 10 segundos o menos.

¿Omni 1.1 Flash genera 4K nativo?

Google documenta 1080p y 4K como salida a partir de la generación por defecto en 720p, no como una vía nativa de captura en 4K. Para vídeo 4K nativo en OmniArt, Veo 3.1 sigue siendo el modelo de la línea Google construido para ese acabado.

¿La 1.1 añadió subida de referencia de audio o edición de voz?

No. La documentación actual de Omni de Google sigue listando la subida de referencia de audio y la edición de voz como no soportadas. El audio de una referencia de vídeo se ignora. El sonido se sigue dirigiendo en el prompt, igual que registramos en el artículo de entrada any-to-any.

¿Listo para crear?

Empieza a generar contenido increíble con IA

Empezar gratis