Gemini Omni Flash: qué salió y qué se guardó Google
Google lanzó Gemini Omni Flash en I/O 2026. Esto es lo que hace el primer modelo Omni, lo que se retuvo a propósito y la jugada práctica para los creadores en OmniArt.

Google I/O 2026 cayó el 19 de mayo, y para cuando terminó la keynote Gemini Omni Flash ya estaba en vivo. Nada de “próximamente” ni de “vista previa limitada”: en vivo, el mismo día. Hace dos semanas publicamos nuestra lectura de las filtraciones previas a I/O, separando las señales confirmadas de la especulación. Ahora tenemos el modelo real. Esto es lo que salió, lo que Google deliberadamente no lanzó y lo que significa para quienes tienen trabajo que entregar esta semana.
Omni Flash es el primer modelo público del nuevo marco “Omni” de Google. No es Veo 4 ni un cambio de nombre de Veo 3.1: es una línea de producto aparte, con un Omni Pro de nivel superior que Google DeepMind ya confirmó como continuación. Sin fecha para Omni Pro. Flash es la fase uno.
Qué se confirmó y qué se retuvo
El artículo de la filtración describía al modelo como “video nativo de Gemini con ambiciones omnimodales”. Eso se sostuvo bien. Este es el panorama completo ahora que se asentó el polvo de la keynote.
| Función | Estado | Qué significa para los creadores |
|---|---|---|
| Clips de video de 10 segundos con audio sincronizado desde un solo prompt | Salió | Formato corto para redes, tráilers e identidades encajan de forma natural con esa duración |
| Entrada de cualquier tipo: texto, imagen, audio y video en un mismo prompt | Salió | Puedes darle una imagen de referencia, una nota de voz y un brief; una sola gramática de prompt para los tres |
| Edición conversacional por chat (“change the lighting”, “swap the dog for a cat”) | Salió | El cambio de flujo que la nota de la filtración marcaba como la verdadera noticia; más sobre esto abajo |
| Marca de agua SynthID en cada resultado | Salió, sin opción de desactivar ni interruptor en la API | Cuenta con resultados con marca de agua por defecto; revisa los términos de uso antes de una colocación comercial |
| Editar voz o audio dentro del video generado | Retenido por seguridad | Riesgo cercano al deepfake; Google confirmó que se retuvo a propósito y no por falta de capacidad |
| Modo avatar | Retenido | La misma categoría de preocupación que la edición de audio; sin plazo anunciado |
| API para desarrolladores | “En las próximas semanas” al lanzamiento; abrió el 30 de junio de 2026 | La generación estándar ya está disponible por la API y en OmniArt |
Advertencia
Google también reconoció públicamente tres limitaciones actuales: la consistencia visual durante las ediciones, las secuencias de movimiento complejo y el renderizado de texto legible dentro del video. Son los mismos puntos débiles que comparte toda la categoría de video con IA; Omni Flash no los resolvió.
La filtración frente a la realidad
Antes de I/O planteamos tres escenarios sobre lo que podía ser Omni: un cambio de nombre de Veo para consumidores, un modelo de video nativo de Gemini o un sistema omnimodal realmente unificado. Dijimos que lo más probable era “una mezcla de los escenarios 2 y 3”.
Fue acertado. Omni Flash es inconfundiblemente nativo de Gemini —corre dentro de la app de Gemini y de Google Flow, no como una superficie independiente de Veo— y es genuinamente de cualquier entrada a cualquier salida. El encuadre “omnimodal” que le dio Google no es exageración de marketing: combinar texto, imagen, audio y video en un mismo prompt es un cambio real de capacidad frente al modelo de entrada de Veo 3.1.
Lo que la especulación no vio bien: el encuadre filtrado de “remix” subestimaba la profundidad de la edición conversacional. No es solo rehacer desde cero. Preserva la consistencia entre ediciones de varios turnos, que es algo materialmente distinto.
La edición conversacional es la verdadera noticia
Hoy, todos los grandes modelos de video con IA funcionan igual a nivel de flujo: escribes un prompt, esperas, descargas el clip y vuelves a escribir el prompt si salió mal. Omni Flash rompe eso. La edición conversacional te deja escribir “change the lighting to golden hour” o “swap the dog for a cat” y recibir un clip revisado que mantiene la consistencia con los resultados anteriores en lugar de regenerar desde cero.
Esto importa porque el costo de iterar en video siempre fue el ciclo de regeneración, tanto en tiempo como en créditos. Una edición de varios turnos que preserva la consistencia comprime la distancia entre un primer borrador y un clip terminado. También significa que el modelo guarda estado sobre tu proyecto de una manera que los flujos de generar y descartar no tienen.
Los límites reconocidos hoy son reales: las secuencias de movimiento complejo pierden coherencia entre ediciones, y el modelo todavía puede desviarse en detalles visuales finos. Pero el principio del flujo es sólido, y es la función con más probabilidades de envejecer bien conforme mejore el modelo de base.
Dónde encaja Omni Flash dentro de la oferta
Las fortalezas de Omni Flash son la accesibilidad para el consumidor, la iteración conversacional y la flexibilidad de entradas multimodales. Sus límites —clips de 10 segundos, sin edición de voz, huecos reconocidos en movimiento y en renderizado de texto— definen su carril con claridad.
| Lo que necesita el plano | Recurre a |
|---|---|
| Iteración conversacional, refinamiento por chat | Omni Flash (en las superficies de Google) |
| 4K nativo, audio espacial, terminación de emisión | Veo 3.1 |
| Tomas largas sin cortes | Sora 2 |
| Continuidad de guion gráfico entre planos | Kling, V6 + BACH |
| Clips rápidos, estilizados y de mucha energía | Modelos PixVerse |
| Relación valor-precio a volumen | Kling, por su costo por segundo terminado |
Para un análisis más profundo de cómo se comparan Omni Flash y Veo 3.1 plano por plano, revisa Gemini Omni Flash frente a Veo 3.1: cuál para tu flujo de trabajo.
Dónde acceder de verdad
Al momento del lanzamiento del 19 de mayo, Omni Flash estaba en vivo en YouTube Shorts, YouTube Create, la app de Gemini y Google Flow, con la API para desarrolladores todavía prometida para “las próximas semanas”. Esa API abrió el 30 de junio de 2026; la generación estándar de video con Gemini Omni también está disponible ahora en la página del modelo en OmniArt.
Para contexto sobre la línea Veo en general, el estado del lanzamiento de Veo 4 y dónde encaja Veo en OmniArt cubre lo que Veo 3.1 ya hace y cómo se acomoda dentro de un espacio multimodelo.
Omni Pro está confirmado, pero sin calendario
Google DeepMind confirmó que viene un Omni Pro de nivel superior, descrito como “un salto por encima de Flash”. No hay fecha de salida, ni lista de funciones, ni acceso anticipado. Planea alrededor de lo que sale, no de lo que se promete.
Si tu flujo tiene una entrega en el tercer trimestre, constrúyela hoy contra las especificaciones confirmadas de Omni Flash. Cuando llegue Omni Pro, lo agregas como una opción dentro de un flujo que ya está produciendo: no lo esperas y no cambias de plataforma por él.
Nota
Qué hacer esta semana
Para el ciclo completo de edición conversacional con sesión persistente de Google, usa la app de Gemini, Google Flow o la API de Interactions. Para la generación estándar guiada por texto e imagen, Gemini Omni Flash ya está disponible en OmniArt junto con el resto de los modelos de video.
En OmniArt puedes comparar Gemini Omni Flash con Veo 3.1 y el resto de la oferta —modelos PixVerse, Sora 2, Kling, Happy Horse, Seedance 2 y más— entre imagen, video, audio y música en un mismo espacio. Un saldo, una gramática de prompt y un lugar para comparar resultados lado a lado.
Para los pasos prácticos de sacarle el máximo a Veo 3.1 mientras evalúas Omni Flash, la guía de prompts y estilo cinematográfico de Veo 3.1 cubre el flujo completo, del brief al clip terminado.
La jugada práctica: pasa tu brief actual por los modelos que están en vivo y estables, incluido Gemini Omni Flash, y agrega Omni Pro solo si llega con un trabajo que tu flujo actual todavía no pueda cubrir.
Preguntas frecuentes
¿Gemini Omni Flash está disponible ahora mismo?
Sí. Se lanzó en Google I/O 2026 el 19 de mayo, abrió su API para desarrolladores el 30 de junio y ya está disponible para generación estándar en la página del modelo Gemini Omni en OmniArt. Los controles conversacionales con sesión persistente de Google siguen siendo específicos de su propio producto y de sus superficies de API.
¿Cuál es la diferencia entre Omni Flash y Veo 3.1?
Omni Flash es nativo de Gemini, acepta entradas de cualquier tipo (texto, imagen, audio y video en un mismo prompt) y tiene edición conversacional de varios turnos. Veo 3.1 es un modelo de video dedicado con salida 4K nativa confirmada y audio espacial. La generación estándar de los dos vive hoy en OmniArt; la superficie completa de control conversacional de Google sigue aparte.
¿Qué funciones se guardó Google de Omni Flash?
Dos capacidades se retuvieron a propósito: la edición de voz y audio dentro del video, y el modo avatar. Google confirmó que se retuvieron por razones de seguridad y no por limitaciones técnicas. No hay fecha de salida para ninguna.
¿Gemini Omni Pro va a reemplazar a Flash?
Google DeepMind confirmó Omni Pro como un futuro modelo de nivel superior descrito como “un salto por encima de Flash”, pero no ha revelado funciones, precios ni fecha de salida. Planea alrededor de las capacidades confirmadas de Flash y trata a Omni Pro como una adición futura.
¿Omni Flash tiene marca de agua SynthID?
Sí. Cada resultado de Omni Flash incluye una marca de agua SynthID. No es opcional y no tiene interruptor en la API. Revisa los términos de servicio de la plataforma antes de usar los resultados en contextos comerciales.
¿Todo listo para crear?
Empieza a generar contenido increíble con IA