IndustryModelos y análisis9 min de lectura

Gemini Omni Flash: qué salió y qué se guardó Google

Google lanzó Gemini Omni Flash en I/O 2026. Esto es lo que hace el primer modelo Omni, lo que se retuvo a propósito y la jugada práctica para los creadores en OmniArt.

Equipo OmniArt
Gemini Omni Flash: qué salió y qué se guardó Google

Google I/O 2026 cayó el 19 de mayo, y para cuando terminó la keynote Gemini Omni Flash ya estaba en vivo. Nada de “próximamente” ni de “vista previa limitada”: en vivo, el mismo día. Hace dos semanas publicamos nuestra lectura de las filtraciones previas a I/O, separando las señales confirmadas de la especulación. Ahora tenemos el modelo real. Esto es lo que salió, lo que Google deliberadamente no lanzó y lo que significa para quienes tienen trabajo que entregar esta semana.

Omni Flash es el primer modelo público del nuevo marco “Omni” de Google. No es Veo 4 ni un cambio de nombre de Veo 3.1: es una línea de producto aparte, con un Omni Pro de nivel superior que Google DeepMind ya confirmó como continuación. Sin fecha para Omni Pro. Flash es la fase uno.

Qué se confirmó y qué se retuvo

El artículo de la filtración describía al modelo como “video nativo de Gemini con ambiciones omnimodales”. Eso se sostuvo bien. Este es el panorama completo ahora que se asentó el polvo de la keynote.

FunciónEstadoQué significa para los creadores
Clips de video de 10 segundos con audio sincronizado desde un solo promptSalióFormato corto para redes, tráilers e identidades encajan de forma natural con esa duración
Entrada de cualquier tipo: texto, imagen, audio y video en un mismo promptSalióPuedes darle una imagen de referencia, una nota de voz y un brief; una sola gramática de prompt para los tres
Edición conversacional por chat (“change the lighting”, “swap the dog for a cat”)SalióEl cambio de flujo que la nota de la filtración marcaba como la verdadera noticia; más sobre esto abajo
Marca de agua SynthID en cada resultadoSalió, sin opción de desactivar ni interruptor en la APICuenta con resultados con marca de agua por defecto; revisa los términos de uso antes de una colocación comercial
Editar voz o audio dentro del video generadoRetenido por seguridadRiesgo cercano al deepfake; Google confirmó que se retuvo a propósito y no por falta de capacidad
Modo avatarRetenidoLa misma categoría de preocupación que la edición de audio; sin plazo anunciado
API para desarrolladores“En las próximas semanas” al lanzamiento; abrió el 30 de junio de 2026La generación estándar ya está disponible por la API y en OmniArt

Advertencia

Dos capacidades importantes —la edición de audio dentro del video y el modo avatar— se retuvieron deliberadamente en el lanzamiento, y no por razones técnicas sino de seguridad. Google lo confirmó. Si tu flujo depende de alguna de las dos, no hay forma de rodearla ni fecha de salida.

Google también reconoció públicamente tres limitaciones actuales: la consistencia visual durante las ediciones, las secuencias de movimiento complejo y el renderizado de texto legible dentro del video. Son los mismos puntos débiles que comparte toda la categoría de video con IA; Omni Flash no los resolvió.

La filtración frente a la realidad

Antes de I/O planteamos tres escenarios sobre lo que podía ser Omni: un cambio de nombre de Veo para consumidores, un modelo de video nativo de Gemini o un sistema omnimodal realmente unificado. Dijimos que lo más probable era “una mezcla de los escenarios 2 y 3”.

Fue acertado. Omni Flash es inconfundiblemente nativo de Gemini —corre dentro de la app de Gemini y de Google Flow, no como una superficie independiente de Veo— y es genuinamente de cualquier entrada a cualquier salida. El encuadre “omnimodal” que le dio Google no es exageración de marketing: combinar texto, imagen, audio y video en un mismo prompt es un cambio real de capacidad frente al modelo de entrada de Veo 3.1.

Lo que la especulación no vio bien: el encuadre filtrado de “remix” subestimaba la profundidad de la edición conversacional. No es solo rehacer desde cero. Preserva la consistencia entre ediciones de varios turnos, que es algo materialmente distinto.

La edición conversacional es la verdadera noticia

Hoy, todos los grandes modelos de video con IA funcionan igual a nivel de flujo: escribes un prompt, esperas, descargas el clip y vuelves a escribir el prompt si salió mal. Omni Flash rompe eso. La edición conversacional te deja escribir “change the lighting to golden hour” o “swap the dog for a cat” y recibir un clip revisado que mantiene la consistencia con los resultados anteriores en lugar de regenerar desde cero.

Esto importa porque el costo de iterar en video siempre fue el ciclo de regeneración, tanto en tiempo como en créditos. Una edición de varios turnos que preserva la consistencia comprime la distancia entre un primer borrador y un clip terminado. También significa que el modelo guarda estado sobre tu proyecto de una manera que los flujos de generar y descartar no tienen.

Los límites reconocidos hoy son reales: las secuencias de movimiento complejo pierden coherencia entre ediciones, y el modelo todavía puede desviarse en detalles visuales finos. Pero el principio del flujo es sólido, y es la función con más probabilidades de envejecer bien conforme mejore el modelo de base.

Dónde encaja Omni Flash dentro de la oferta

Las fortalezas de Omni Flash son la accesibilidad para el consumidor, la iteración conversacional y la flexibilidad de entradas multimodales. Sus límites —clips de 10 segundos, sin edición de voz, huecos reconocidos en movimiento y en renderizado de texto— definen su carril con claridad.

Lo que necesita el planoRecurre a
Iteración conversacional, refinamiento por chatOmni Flash (en las superficies de Google)
4K nativo, audio espacial, terminación de emisiónVeo 3.1
Tomas largas sin cortesSora 2
Continuidad de guion gráfico entre planosKling, V6 + BACH
Clips rápidos, estilizados y de mucha energíaModelos PixVerse
Relación valor-precio a volumenKling, por su costo por segundo terminado

Para un análisis más profundo de cómo se comparan Omni Flash y Veo 3.1 plano por plano, revisa Gemini Omni Flash frente a Veo 3.1: cuál para tu flujo de trabajo.

Dónde acceder de verdad

Al momento del lanzamiento del 19 de mayo, Omni Flash estaba en vivo en YouTube Shorts, YouTube Create, la app de Gemini y Google Flow, con la API para desarrolladores todavía prometida para “las próximas semanas”. Esa API abrió el 30 de junio de 2026; la generación estándar de video con Gemini Omni también está disponible ahora en la página del modelo en OmniArt.

Para contexto sobre la línea Veo en general, el estado del lanzamiento de Veo 4 y dónde encaja Veo en OmniArt cubre lo que Veo 3.1 ya hace y cómo se acomoda dentro de un espacio multimodelo.

Omni Pro está confirmado, pero sin calendario

Google DeepMind confirmó que viene un Omni Pro de nivel superior, descrito como “un salto por encima de Flash”. No hay fecha de salida, ni lista de funciones, ni acceso anticipado. Planea alrededor de lo que sale, no de lo que se promete.

Si tu flujo tiene una entrega en el tercer trimestre, constrúyela hoy contra las especificaciones confirmadas de Omni Flash. Cuando llegue Omni Pro, lo agregas como una opción dentro de un flujo que ya está produciendo: no lo esperas y no cambias de plataforma por él.

Nota

Este es el argumento a favor de un espacio multimodelo en la práctica: los lanzamientos nuevos son adiciones, no interrupciones. Los comparas contra lo que ya estás publicando, no contra lo que estabas esperando.

Qué hacer esta semana

Para el ciclo completo de edición conversacional con sesión persistente de Google, usa la app de Gemini, Google Flow o la API de Interactions. Para la generación estándar guiada por texto e imagen, Gemini Omni Flash ya está disponible en OmniArt junto con el resto de los modelos de video.

En OmniArt puedes comparar Gemini Omni Flash con Veo 3.1 y el resto de la oferta —modelos PixVerse, Sora 2, Kling, Happy Horse, Seedance 2 y más— entre imagen, video, audio y música en un mismo espacio. Un saldo, una gramática de prompt y un lugar para comparar resultados lado a lado.

Para los pasos prácticos de sacarle el máximo a Veo 3.1 mientras evalúas Omni Flash, la guía de prompts y estilo cinematográfico de Veo 3.1 cubre el flujo completo, del brief al clip terminado.

La jugada práctica: pasa tu brief actual por los modelos que están en vivo y estables, incluido Gemini Omni Flash, y agrega Omni Pro solo si llega con un trabajo que tu flujo actual todavía no pueda cubrir.

Preguntas frecuentes

¿Gemini Omni Flash está disponible ahora mismo?

Sí. Se lanzó en Google I/O 2026 el 19 de mayo, abrió su API para desarrolladores el 30 de junio y ya está disponible para generación estándar en la página del modelo Gemini Omni en OmniArt. Los controles conversacionales con sesión persistente de Google siguen siendo específicos de su propio producto y de sus superficies de API.

¿Cuál es la diferencia entre Omni Flash y Veo 3.1?

Omni Flash es nativo de Gemini, acepta entradas de cualquier tipo (texto, imagen, audio y video en un mismo prompt) y tiene edición conversacional de varios turnos. Veo 3.1 es un modelo de video dedicado con salida 4K nativa confirmada y audio espacial. La generación estándar de los dos vive hoy en OmniArt; la superficie completa de control conversacional de Google sigue aparte.

¿Qué funciones se guardó Google de Omni Flash?

Dos capacidades se retuvieron a propósito: la edición de voz y audio dentro del video, y el modo avatar. Google confirmó que se retuvieron por razones de seguridad y no por limitaciones técnicas. No hay fecha de salida para ninguna.

¿Gemini Omni Pro va a reemplazar a Flash?

Google DeepMind confirmó Omni Pro como un futuro modelo de nivel superior descrito como “un salto por encima de Flash”, pero no ha revelado funciones, precios ni fecha de salida. Planea alrededor de las capacidades confirmadas de Flash y trata a Omni Pro como una adición futura.

¿Omni Flash tiene marca de agua SynthID?

Sí. Cada resultado de Omni Flash incluye una marca de agua SynthID. No es opcional y no tiene interruptor en la API. Revisa los términos de servicio de la plataforma antes de usar los resultados en contextos comerciales.

¿Todo listo para crear?

Empieza a generar contenido increíble con IA

Empezar gratis