UpdateModelos e insights14 min de leitura

Gemini Omni 1.1 Flash: o que foi lançado para controle de vídeo

O Gemini Omni 1.1 Flash do Google é uma atualização de vídeo pronta para produção: estenda cenas, defina o primeiro e o último frame, rascunhe em 360p e gere saída em 1080p ou 4K.

Equipe OmniArt
Gemini Omni 1.1 Flash: o que foi lançado para controle de vídeo

Em 27 de agosto de 2026, o Google lançou o Gemini Omni 1.1 Flash — a primeira atualização orientada à produção do modelo de vídeo Omni Flash que estreou no I/O. O anúncio oficial e o fio do Google no X tratam isso como um lançamento de controle, não como uma troca de nome: estenda uma cena, trave o frame inicial e o final, anexe referências curtas de vídeo, rascunhe barato em 360p e depois gere 1080p ou 4K nas tomadas que você for ficar.

Esse é um trabalho diferente da estreia para o consumidor em 19 de maio que cobrimos em Gemini Omni Flash: o que foi lançado e o que o Google reteve. A proposta original do Flash era edição conversacional e entrada any-to-any, com um clipe rígido de 10 segundos e sem extensão de cena na API para desenvolvedores de 30 de junho. A 1.1 é a passagem que tenta deixar esses clipes longos o bastante, nítidos o bastante e dirigidos o bastante para um pipeline de produção.

Este artigo é o panorama de capacidades: o que a 1.1 de fato adicionou, quais limites ainda valem e quais desses trabalhos você já consegue rodar na OmniArt hoje.

O que o Gemini Omni 1.1 Flash realmente lançou

O id de API do Google é gemini-omni-1.1-flash (prévia na Gemini Enterprise Agent Platform como gemini-omni-1.1-flash-preview). A saída padrão continua 720p horizontal; 16:9 e 9:16 seguem sendo as duas proporções. A marca-d'água SynthID continua obrigatória.

CapacidadeOmni Flash originalOmni 1.1 Flash
Duração do clipe10 segundos por geraçãoGerações de 10 segundos, extensíveis em passos de 10 segundos até 40 segundos no total
Extensão de cenaFora da API de 30 de junhoAnalisa até 10 segundos de material anterior (não só o último segundo)
Primeiro e último framesNão era um modo de API de primeira classeInterpola movimento contínuo entre dois frames-chave
Referências de vídeoUm clipe; clipes com mais de 3 segundos não eram processados por completoAté três clipes, 3 segundos cada
Resolução de rascunho720p por padrão, sem faixa mais barata de préviaRascunhos em 360p; o Google fala em até 60% mais rápido e cerca de um terço do custo do 720p
Resolução finalNão divulgada no I/O; a OmniArt serve 720pSaída em 1080p ou 4K, documentada como derivada da geração em 720p
SuperfíciesApp Gemini, Flow, YouTube e depois a API de 30 de junhoGoogle AI Studio, Gemini API, Gemini Enterprise Agent Platform, Google Flow; extensão de cena também no app Gemini para Google AI Plus, Pro e Ultra

A lista do que foi retido no I/O não se moveu. A documentação atual do Google ainda diz que edição de voz não é suportada, upload de referência de áudio não é suportado e o modo avatar nunca fez parte deste lançamento. A 1.1 adiciona direção e duração. Não adiciona os recursos retidos por segurança.

Extensão de cena: 10 segundos de contexto, até 40 segundos

Extensão de cena é a manchete. Você continua a partir da cauda de um clipe existente, em vez de torcer para que uma nova geração de 10 segundos coincida com ele.

Os números do próprio Google: o modelo agora lê até 10 segundos de material anterior — "um salto em relação a modelos anteriores que só referenciavam o último segundo" — e então anexa mais 3–10 segundos. Repita isso em incrementos de 10 segundos até o clipe acumulado chegar a 40 segundos. Alguns dos últimos frames da fonte são reescritos para que a emenda não seja um corte seco. Você não pode adicionar no início e não pode estender o meio de um clipe.

Demo de extensão de cena do Gemini Omni 1.1 FlashDemo oficial do Google do Omni 1.1 Flash continuando uma cena a partir de material anterior, mantendo identidade do personagem, iluminação e contexto narrativo.Olhe a emenda, não só a ação nova: identidade, iluminação e trilha devem sobreviver à extensão em vez de reiniciar.

O prompt de uma extensão pode ser tão curto quanto "Continue the scene." ou tão específico quanto um novo movimento de câmera. A documentação do Google é explícita: 0 segundos num prompt de extensão com marcação de tempo significa o início do segmento novo, não o início do clipe original. Descreva o áudio se você precisa que a trilha mude; caso contrário, o modelo tenta mantê-la coerente.

Dois limites importam antes de você planejar uma peça de 40 segundos em cima disso:

  • Clipe-fonte enviado para extensão precisa ter 10 segundos ou menos, a menos que você esteja estendendo um clipe que o próprio modelo já gerou na mesma sessão de múltiplos turnos.
  • Estender um clipe enviado não está disponível no EEE, na Suíça ou no Reino Unido. Estender um clipe gerado pelo modelo está disponível em todas as regiões em que a própria API está.

Na OmniArt, o Seedance 2.5 já cobre um trabalho parecido: estender qualquer resultado de 30 segundos ou menos, de forma repetida, até 60 segundos ou gerar 30–180 segundos numa única passagem Long Video. Esse é o caminho no espaço de trabalho para vídeo longo e dirigido hoje. A cadeia nativa Omni de 40 segundos da 1.1 é a versão nas superfícies do Google da mesma ideia.

Primeiro e último frames

Defina uma imagem inicial e uma imagem final; o Omni 1.1 gera o movimento contínuo entre elas. O Google posiciona isso para órbitas de câmera, transições de zoom e clipes em loop — este último usando a mesma imagem como primeiro frame e como último frame.

Demo de primeiro e último frame do Gemini Omni 1.1 FlashDemo oficial do Google do Omni 1.1 Flash interpolando movimento contínuo de câmera entre um plano inicial definido e um frame final.O teste útil é se o movimento no meio se lê como um único plano — uma whip-pan, um zoom, um loop — e não como duas imagens estáticas com um dissolve.

Tags no prompt amarram os papéis. O Google documenta tags simples FIRST_FRAME e LAST_FRAME dentro do prompt; prompts mais complexos podem declarar as fontes de forma explícita:

[# Sources <FIRST_FRAME>@Image1 <LAST_FRAME>@Image2]

As tags ficam no prompt como estão escritas. O texto ao redor é onde você descreve o movimento: um plano contínuo, sem jump cuts, o que a câmera faz entre as duas imagens estáticas.

Na OmniArt, o PixVerse V6 já expõe um fluxo de transição entre frames inicial e final aprovados. Se o briefing é "ir deste frame até aquele frame", você não precisa esperar o Omni 1.1 chegar como um id de modelo separado. Se o briefing é "fazer isso dentro do fio conversacional do Omni Flash", isso ainda vive na Interactions API do Google.

Referências de vídeo, até três segundos cada

A 1.1 deixa você soltar vídeo de referência curto no mesmo prompt multimodal que texto e imagens. A demo pública do Google mapeia três clipes de dançarinos em três imagens estáticas de personagem e pede um plano contínuo.

Demo de referência de vídeo do Gemini Omni 1.1 FlashDemo oficial do Google do Omni 1.1 Flash usando clipes curtos de referência para transferir movimento e performance de personagem para uma cena nova.Cada clipe faz um trabalho de movimento, não de aparência: as imagens estáticas carregam a identidade, os vídeos de três segundos carregam a dança.

O teto documentado é mais estrito do que a linha de marketing. Referências de vídeo funcionam melhor para semelhança; o áudio dentro de um clipe de referência é ignorado; você tem no máximo três clipes, de até 3 segundos cada. O Google também diz que referenciar ou raciocinar entre vários vídeos não é suportado como uma comparação narrativa — trate cada clipe como referência de sujeito ou de movimento, não como uma segunda fonte para editar.

Isso é uma expansão real em relação à prévia de 30 de junho, que aceitava uma referência de vídeo e não processava por completo clipes com mais de 3 segundos. Ainda não é a metade de áudio da proposta any-to-any. Som continua sendo algo que você descreve no prompt.

A entrada atual de Gemini Omni na OmniArt aceita um vídeo de referência (MP4 ou MOV, 1–10 segundos) misturado com até cinco imagens de referência e cobra a partir da duração do clipe-fonte. Use isso hoje para uma única referência de movimento. Para pacotes maiores de referência, o Seedance 2.5 continua sendo o modelo do espaço de trabalho construído em torno desse trabalho.

Rascunhos em 360p e saída em 1080p / 4K

A escada de resolução é a outra mudança de produção. A geração padrão é 720p. Agora você pode pedir:

  • 360p — a faixa barata de rascunho do Google. Declarada como até 60% mais rápida e cerca de um terço do custo do 720p. O Flow deixa você rascunhar em 360p e depois baixar a tomada que você vai ficar em 720p.
  • 1080p ou 4K — documentado como saída a partir da geração em 720p, pensado para finalização social, digital ou de broadcast.

O fluxo útil é o óbvio: explore câmera, performance e pontos de corte em 360p e gaste a geração em 1080p ou 4K na tomada que você de fato enviaria. É a mesma disciplina de rascunhar num modelo rápido na OmniArt antes de finalizar num mais caro — só que agora é um interruptor de resolução num único modelo Omni.

Nota

O Google publicou uma tabela de preço de API por resolução junto com o anúncio da 1.1. Trate a linha de 360p "um terço do 720p" como comparação do próprio Google, não como conta de créditos da OmniArt. A entrada Gemini Omni da OmniArt hoje cobra contra uma superfície de 720p, 3–10 segundos.

Geração nativa em 4K continua sendo o trabalho do Veo 3.1 nesta linha. O caminho 4K da 1.1 é um passo de finalização num clipe Omni, não a afirmação de que o Omni substituiu o Veo para entrega em tela grande.

Onde está no ar e o que a OmniArt expõe hoje

O Google está liberando a 1.1 na própria pilha em 27 de agosto:

  • Google AI Studio e a Gemini API (gemini-omni-1.1-flash)
  • Gemini Enterprise Agent Platform (gemini-omni-1.1-flash-preview)
  • Google Flow, incluindo frames inicial/final, rascunhos em 360p e exportação em 1080p / 4K
  • Extensão de cena no app Gemini, para assinantes Google AI Plus, Pro e Ultra

A geração padrão do Gemini Omni já está na OmniArt: 720p, 3–10 segundos, áudio nativo, até cinco imagens de referência e um vídeo de referência, plano Starter e acima. A OmniArt não expõe hoje um id de modelo separado gemini-omni-1.1-flash, a cadeia de extensão de 40 segundos, a tarefa de primeiro-e-último-frame nem a escada de resolução 360p / 1080p / 4K. Edições conversacionais que preservam a sessão ainda exigem a Interactions API do Google, como já exigiam quando cobrimos a API para desenvolvedores de 30 de junho.

Aviso

Não planeje uma entrega Omni 1.1 de 40 segundos contra o seletor atual de Gemini Omni da OmniArt. O modelo ao vivo no espaço de trabalho é a superfície Omni Flash de 720p e 10 segundos. Use a API ou o Flow do Google para os controles específicos da 1.1 até um id de modelo distinto chegar aqui.

Como escolher frente ao Veo 3.1 e ao Seedance 2.5

A 1.1 não aposenta o restante da linha Google e não faz do Omni a única opção de vídeo dirigido na OmniArt. Escolha por plano:

A cena precisaRecorra a
Revisões via chat dentro de um fio OmniGemini Omni 1.1 na API / Flow do Google
4K nativo, áudio espacial, acabamento broadcastVeo 3.1 na OmniArt
Tomadas únicas de 30 segundos, extensões de 60 segundos ou vídeo longo de 180 segundosSeedance 2.5 na OmniArt
Interpolação de primeiro a último frame no espaço de trabalho hojeTransição do PixVerse V6 ou First and Last Frames do Seedance 2.5
Geração Omni rápida em 720p com uma única referência de vídeoGemini Omni na OmniArt
Pacotes grandes de referência multimodalSeedance 2.5

O padrão é o mesmo que usamos no I/O: novos lançamentos Omni são adições. Você mantém os modelos que já cobrem o briefing e adiciona a 1.1 quando o trabalho é especificamente o controle conversacional do Omni mais um acabamento mais longo e mais nítido.

Para hábitos de prompt que ainda valem no primeiro beat de 10 segundos — uma ação clara, som escrito no prompt, sem campo de prompt negativo — veja o guia de prompt do Omni Flash. Para a linguagem de extensão no modelo do espaço de trabalho que já faz isso, veja o guia de edição e extensão do Seedance 2.5.

O que fazer essa semana na OmniArt

Se você quer experimentar o próprio Omni, abra o Gemini Omni no espaço de vídeo e rode a superfície atual de 10 segundos em 720p: texto, imagens de referência ou uma referência curta de vídeo. Compare lado a lado com Veo 3.1, Seedance 2.5, PixVerse V6, Kling e o restante da linha — um saldo, uma gramática de prompt.

Se o briefing é especificamente os controles novos da 1.1 — extensão nativa Omni de 40 segundos, interpolação de primeiro/último frame dentro do Omni ou um loop 360p-depois-4K — use o Google AI Studio, o Flow ou a Gemini API essa semana e trate a OmniArt como o lugar em que você já gera o restante do projeto.

Essa divisão é temporária do mesmo jeito que o hiato original da API do Flash foi. Quando os controles da 1.1 chegarem como um modelo selecionável na OmniArt, eles viram mais uma opção num espaço de trabalho que já está produzindo, não um motivo para esperar.

Perguntas frequentes

O que é o Gemini Omni 1.1 Flash?

O Gemini Omni 1.1 Flash é a atualização de 27 de agosto de 2026 do Omni Flash, um modelo multimodal de geração e edição de vídeo. Ele adiciona extensão de cena, interpolação de primeiro e último frame, referências curtas de vídeo, rascunhos em 360p e saída em 1080p / 4K por cima da edição conversacional original e da entrada de texto/imagem/vídeo.

O Gemini Omni 1.1 Flash está disponível na OmniArt?

Não como um id de modelo separado. A OmniArt hoje serve geração padrão do Gemini Omni em 720p e 3–10 segundos. Os controles específicos da 1.1 — extensão de 40 segundos, primeiro/último frames, rascunhos em 360p e saída em 1080p / 4K — estão sendo liberados no Google AI Studio, no Flow, na Gemini API e na Gemini Enterprise Agent Platform.

Qual o comprimento dos vídeos do Omni 1.1 Flash?

Uma única geração continua sendo um clipe de 10 segundos. A extensão de cena anexa 3–10 segundos por vez, usando até 10 segundos de material anterior como contexto, até um máximo acumulado de 40 segundos. Fontes enviadas para extensão precisam ter 10 segundos ou menos.

O Omni 1.1 Flash gera 4K nativo?

O Google documenta 1080p e 4K como saída a partir da geração padrão em 720p, não como um caminho nativo de captura em 4K. Para vídeo 4K nativo na OmniArt, o Veo 3.1 continua sendo o modelo da linhagem Google construído para esse acabamento.

A versão 1.1 adicionou upload de referência de áudio ou edição de voz?

Não. A documentação atual do Omni no Google ainda lista upload de referência de áudio e edição de voz como não suportados. O áudio de uma referência de vídeo é ignorado. O som ainda é dirigido no prompt, o que bate com o que registramos no artigo de entrada any-to-any.

Pronto para criar?

Comece a gerar conteúdo incrível com IA

Começar grátis