UpdateModèles et analyses14 min de lecture

Gemini Omni 1.1 Flash : ce qui a été livré pour le contrôle vidéo

Le Gemini Omni 1.1 Flash de Google est une mise à jour vidéo prête pour la production : étendez les scènes, fixez la première et la dernière image, faites des brouillons en 360p, puis générez une sortie 1080p ou 4K.

Équipe OmniArt
Gemini Omni 1.1 Flash : ce qui a été livré pour le contrôle vidéo

Le 27 août 2026, Google a livré Gemini Omni 1.1 Flash — la première mise à jour orientée production du modèle vidéo Omni Flash lancé à l’I/O. L’annonce officielle et le fil X de Google le présentent comme une version de contrôle, pas comme un renommage : étendre une scène, verrouiller une image de début et de fin, joindre de courtes références vidéo, brouillonner à bas coût en 360p, puis générer du 1080p ou du 4K pour les prises que vous gardez.

C’est un métier différent du lancement grand public du 19 mai, que nous avions couvert dans Gemini Omni Flash : ce qui a été livré et ce que Google a retenu. L’argument d’origine de Flash était l’édition conversationnelle et l’entrée toutes-modalités, avec un clip plafonné à 10 secondes et aucune extension de scène dans l’API développeur du 30 juin. La 1.1 est la passe qui tente de rendre ces clips assez longs, assez nets et assez dirigés pour un pipeline de production.

Cet article est le tour d’horizon des capacités : ce que la 1.1 a réellement ajouté, quelles limites s’appliquent encore, et lesquels de ces métiers vous pouvez déjà faire dans OmniArt aujourd’hui.

Ce que Gemini Omni 1.1 Flash a réellement livré

L’identifiant API de Google est gemini-omni-1.1-flash (aperçu sur la Gemini Enterprise Agent Platform sous gemini-omni-1.1-flash-preview). La sortie par défaut reste en 720p paysage ; 16:9 et 9:16 restent les deux formats. Le filigrane SynthID est toujours obligatoire.

CapacitéOmni Flash d’origineOmni 1.1 Flash
Durée du clip10 secondes par générationGénérations de 10 secondes, extensibles par pas de 10 secondes jusqu’à 40 secondes au total
Extension de scèneAbsente de l’API du 30 juinAnalyse jusqu’à 10 secondes d’images précédentes (pas seulement la dernière seconde)
Première et dernière imagePas un mode API de premier planInterpole un mouvement continu entre deux images clés
Références vidéoUn clip ; les clips de plus de 3 secondes n’étaient pas entièrement traitésJusqu’à trois clips, 3 secondes chacun
Résolution de brouillon720p par défaut, pas de niveau d’aperçu moins cherBrouillons 360p, Google annonce jusqu’à 60 % plus rapides et environ un tiers du coût du 720p
Résolution de finitionNon divulguée à l’I/O ; OmniArt sert du 720pSortie 1080p ou 4K, documentée comme obtenue à partir de la génération 720p
SurfacesApplication Gemini, Flow, YouTube, puis l’API du 30 juinGoogle AI Studio, Gemini API, Gemini Enterprise Agent Platform, Google Flow ; l’extension de scène aussi dans l’application Gemini pour Google AI Plus, Pro et Ultra

La liste de ce qui avait été retenu à l’I/O n’a pas bougé. La documentation actuelle de Google indique toujours que l’édition vocale n’est pas prise en charge, que l’envoi d’une référence audio n’est pas pris en charge, et que le mode avatar n’a jamais fait partie de cette version. La 1.1 ajoute de la direction et de la durée. Elle n’ajoute pas les fonctions retenues pour des raisons de sécurité.

Extension de scène : 10 secondes de contexte, jusqu’à 40 secondes

L’extension de scène est le titre. Vous continuez à partir de la queue d’un clip existant, au lieu d’espérer qu’une nouvelle génération de 10 secondes s’y accorde.

Les chiffres de Google : le modèle lit désormais jusqu’à 10 secondes d’images précédentes — « un saut par rapport aux modèles précédents qui ne prenaient en référence que la dernière seconde » — puis ajoute encore 3 à 10 secondes. Répétez cela par incréments de 10 secondes jusqu’à ce que le clip cumulé atteigne 40 secondes. Certaines des dernières images de la source sont réécrites pour que la jointure ne soit pas une coupe sèche. Vous ne pouvez pas préfixer, et vous ne pouvez pas étendre le milieu d’un clip.

Démo d’extension de scène de Gemini Omni 1.1 FlashLa démo officielle de Google d’Omni 1.1 Flash qui poursuit une scène à partir d’images précédentes tout en conservant l’identité du personnage, l’éclairage et le contexte narratif.Regardez la jointure, pas seulement la nouvelle action : l’identité, l’éclairage et la bande-son sont censés survivre à l’extension plutôt que de se réinitialiser.

Le prompt d’une extension peut être aussi court que "Continue the scene." ou aussi précis qu’un nouveau mouvement de caméra. La documentation de Google est explicite : 0 seconde dans un prompt d’extension horodaté désigne le début du nouveau segment, pas le début du clip d’origine. Décrivez l’audio si vous avez besoin que la bande-son change ; sinon le modèle essaie de la garder cohérente.

Deux contraintes comptent avant de concevoir une pièce de 40 secondes autour de cette fonction :

  • Les clips source envoyés pour une extension doivent durer 10 secondes ou moins, sauf si vous étendez un clip que le modèle a déjà généré dans la même session multi-tours.
  • Étendre un clip envoyé n’est pas disponible dans l’EEE, en Suisse ni au Royaume-Uni. Étendre un clip généré par le modèle est disponible dans toutes les régions où l’API elle-même l’est.

Sur OmniArt, Seedance 2.5 couvre déjà un métier voisin : étendre tout résultat de 30 secondes ou moins, de façon répétée, jusqu’à 60 secondes, ou générer 30 à 180 secondes en une passe Long Video. C’est le chemin de l’espace pour de la vidéo dirigée longue aujourd’hui. La chaîne native Omni de 40 secondes de la 1.1 est la version, sur les surfaces Google, de la même idée.

Première et dernière image

Définissez une image de départ et une image d’arrivée ; Omni 1.1 génère le mouvement continu entre les deux. Google positionne cela pour les orbites de caméra, les transitions en zoom et les clips en boucle — ces derniers en utilisant la même image comme première et comme dernière.

Démo première et dernière image de Gemini Omni 1.1 FlashLa démo officielle de Google d’Omni 1.1 Flash interpolant un mouvement de caméra continu entre un plan de départ et une image de fin spécifiés.Le test utile est de savoir si le mouvement intermédiaire se lit comme un seul plan — un whip-pan, un zoom, une boucle — plutôt que deux images fixes avec un fondu.

Les balises de prompt lient les rôles. Google documente des balises simples FIRST_FRAME et LAST_FRAME dans le prompt ; des prompts plus complexes peuvent déclarer les sources explicitement :

[# Sources <FIRST_FRAME>@Image1 <LAST_FRAME>@Image2]

Les balises restent dans le prompt telles quelles. L’instruction qui les entoure est l’endroit où vous décrivez le mouvement : un plan continu, pas de jump cuts, ce que fait la caméra entre les deux images fixes.

Sur OmniArt, PixVerse V6 expose déjà un flux de transition entre des images de début et de fin validées. Si le brief est « passer de cette image à celle-là », vous n’avez pas à attendre qu’Omni 1.1 arrive comme identifiant de modèle distinct. Si le brief est « le faire dans le fil conversationnel d’Omni Flash », cela vit toujours sur l’Interactions API de Google.

Références vidéo, jusqu’à trois secondes chacune

La 1.1 vous permet de déposer une courte vidéo de référence dans le même prompt multimodal que le texte et les images. La démo publique de Google projette trois clips de danseurs sur trois images fixes de personnages et demande un seul plan continu.

Démo de référence vidéo de Gemini Omni 1.1 FlashLa démo officielle de Google d’Omni 1.1 Flash utilisant de courts clips de référence pour transférer le mouvement et la performance d’un personnage dans une nouvelle scène.Chaque clip fait un travail de mouvement, pas un travail d’apparence : les images fixes portent l’identité, les vidéos de trois secondes portent la danse.

Le plafond documenté est plus strict que la ligne marketing. Les références vidéo fonctionnent le mieux pour les ressemblances ; l’audio à l’intérieur d’un clip de référence est ignoré ; vous avez droit à un maximum de trois clips, jusqu’à 3 secondes chacun. Google indique aussi que référencer ou raisonner à travers plusieurs vidéos n’est pas pris en charge comme une comparaison narrative — traitez chaque clip comme une référence de sujet ou de mouvement, pas comme une seconde source à éditer.

C’est une vraie expansion par rapport à l’aperçu du 30 juin, qui acceptait une seule référence vidéo et ne traitait pas entièrement les clips de plus de 3 secondes. Ce n’est toujours pas la moitié audio de la promesse toutes-modalités. Le son reste quelque chose que vous décrivez dans le prompt.

L’entrée Gemini Omni actuelle d’OmniArt accepte une vidéo de référence (MP4 ou MOV, 1 à 10 secondes) mélangée à jusqu’à cinq images de référence, et facture selon la durée du clip source. Utilisez-la pour une seule référence de mouvement aujourd’hui. Pour des packs de fichiers de référence plus larges, Seedance 2.5 reste le modèle de l’espace construit autour de ce métier.

Brouillons 360p et sortie 1080p / 4K

L’échelle de résolution est l’autre changement de production. La génération par défaut est en 720p. Vous pouvez désormais demander :

  • 360p — le niveau de brouillon économique de Google. Annoncé jusqu’à 60 % plus rapide en débit et environ un tiers du coût du 720p. Flow permet de brouillonner en 360p, puis de télécharger une version conservée en 720p.
  • 1080p ou 4K — documentés comme une sortie obtenue à partir de la génération 720p, destinés à la finition social, numérique ou broadcast.

Le flux utile est le plus évident : explorer la caméra, la performance et les points de coupe en 360p, puis dépenser la génération 1080p ou 4K sur la prise que vous expédieriez vraiment. C’est la même discipline que de brouillonner sur un modèle rapide dans OmniArt avant de finir sur un modèle plus coûteux — seulement, désormais, c’est un interrupteur de résolution sur un seul modèle Omni.

Note

Google a publié un tableau de prix API par résolution avec l’annonce de la 1.1. Traitez la ligne « un tiers du 720p » du 360p comme la comparaison de Google, pas comme le calcul des crédits OmniArt. L’entrée Gemini Omni d’OmniArt facture actuellement une surface 720p de 3 à 10 secondes.

La génération 4K native reste le métier de Veo 3.1 dans cette gamme. Le chemin 4K de la 1.1 est une étape de finition sur un clip Omni, pas l’affirmation qu’Omni a remplacé Veo pour la diffusion grand écran.

Où c’est disponible, et ce qu’OmniArt expose aujourd’hui

Google déploie la 1.1 sur sa propre pile le 27 août :

  • Google AI Studio et l’API Gemini (gemini-omni-1.1-flash)
  • Gemini Enterprise Agent Platform (gemini-omni-1.1-flash-preview)
  • Google Flow, y compris images de début/fin, brouillons 360p et export 1080p / 4K
  • Extension de scène dans l’application Gemini, pour les abonnés Google AI Plus, Pro et Ultra

La génération Gemini Omni standard est déjà sur OmniArt : 720p, 3 à 10 secondes, audio natif, jusqu’à cinq images de référence et une vidéo de référence, forfait Starter et au-dessus. OmniArt n’expose pas actuellement d’identifiant de modèle gemini-omni-1.1-flash distinct, la chaîne d’extension de 40 secondes, la tâche première-et-dernière-image, ni l’échelle de résolution 360p / 1080p / 4K. Les éditions conversationnelles qui préservent la session exigent toujours l’Interactions API de Google, comme lorsque nous avons couvert l’API développeur du 30 juin.

Avertissement

Ne planifiez pas une livraison Omni 1.1 de 40 secondes contre le sélecteur Gemini Omni actuel d’OmniArt. Le modèle live de l’espace est la surface Omni Flash 720p, 10 secondes. Utilisez l’API ou Flow de Google pour les commandes propres à la 1.1 jusqu’à ce qu’une entrée de modèle distincte arrive ici.

Comment choisir face à Veo 3.1 et Seedance 2.5

La 1.1 ne retire pas le reste de la ligne Google, et elle ne fait pas d’Omni la seule option de vidéo dirigée dans OmniArt. Choisissez plan par plan :

Le plan nécessiteUtilisez
Révisions pilotées par le chat dans un seul fil OmniGemini Omni 1.1 sur l’API / Flow de Google
4K natif, audio spatial, finition broadcastVeo 3.1 sur OmniArt
Prises uniques de 30 secondes, extensions de 60 secondes, ou vidéo longue de 180 secondesSeedance 2.5 sur OmniArt
Interpolation de la première à la dernière image dans l’espace dès aujourd’huiTransition PixVerse V6, ou First and Last Frames de Seedance 2.5
Génération Omni 720p rapide avec une seule référence vidéoGemini Omni sur OmniArt
Grands packs de fichiers de référence multimodauxSeedance 2.5

Le schéma est le même que celui que nous avions utilisé à l’I/O : les nouvelles versions Omni sont des ajouts. Vous gardez les modèles qui couvrent déjà le brief, et vous ajoutez la 1.1 lorsque le métier est précisément le contrôle conversationnel d’Omni plus une finition plus longue et plus nette.

Pour les habitudes de prompting qui s’appliquent encore au premier temps de 10 secondes — une action claire, le son écrit dans le prompt, pas de champ de prompt négatif — voir le guide de prompts Omni Flash. Pour le langage d’extension sur le modèle de l’espace qui le fait déjà, voir le guide d’édition et d’extension Seedance 2.5.

Que faire cette semaine sur OmniArt

Si vous voulez essayer Omni lui-même, ouvrez Gemini Omni dans l’espace vidéo et lancez la surface actuelle de 10 secondes en 720p : texte, images de référence, ou une courte vidéo de référence. Comparez-le côte à côte avec Veo 3.1, Seedance 2.5, PixVerse V6, Kling et le reste de la gamme — un solde, une grammaire de prompt.

Si le brief porte précisément sur les nouvelles commandes de la 1.1 — extension native Omni de 40 secondes, interpolation première/dernière image à l’intérieur d’Omni, ou une boucle 360p puis 4K — utilisez Google AI Studio, Flow ou l’API Gemini cette semaine, et traitez OmniArt comme l’endroit où vous générez déjà le reste du projet.

Cette scission est temporaire, de la même façon que l’était l’écart d’API original de Flash. Quand les commandes de la 1.1 arriveront comme modèle OmniArt sélectionnable, elles deviendront une option de plus dans un espace qui produit déjà, pas une raison d’attendre.

FAQ

Qu’est-ce que Gemini Omni 1.1 Flash ?

Gemini Omni 1.1 Flash est la mise à jour du 27 août 2026 d’Omni Flash par Google, un modèle multimodal de génération et d’édition vidéo. Il ajoute l’extension de scène, l’interpolation première-et-dernière-image, de courtes références vidéo, des brouillons 360p et une sortie 1080p / 4K, par-dessus l’édition conversationnelle d’origine et l’entrée texte/image/vidéo.

Gemini Omni 1.1 Flash est-il disponible sur OmniArt ?

Pas comme identifiant de modèle distinct. OmniArt sert actuellement la génération Gemini Omni standard en 720p et 3 à 10 secondes. Les commandes propres à la 1.1 — extension de 40 secondes, première/dernière image, brouillons 360p et sortie 1080p / 4K — sont en cours de déploiement sur Google AI Studio, Flow, l’API Gemini et la Gemini Enterprise Agent Platform.

Quelle durée peuvent atteindre les vidéos Omni 1.1 Flash ?

Une génération unique reste un clip de 10 secondes. L’extension de scène ajoute 3 à 10 secondes à la fois, en utilisant jusqu’à 10 secondes d’images précédentes comme contexte, jusqu’à un maximum cumulé de 40 secondes. Les sources envoyées pour une extension doivent durer 10 secondes ou moins.

Omni 1.1 Flash génère-t-il du 4K natif ?

Google documente le 1080p et le 4K comme une sortie obtenue à partir de la génération 720p par défaut, et non comme un chemin de capture 4K natif. Pour de la vidéo 4K native dans OmniArt, Veo 3.1 reste le modèle de la lignée Google conçu pour cette finition.

La 1.1 a-t-elle ajouté l’envoi de référence audio ou l’édition vocale ?

Non. La documentation Omni actuelle de Google liste toujours l’envoi de référence audio et l’édition vocale comme non pris en charge. L’audio d’une référence vidéo est ignoré. Le son se pilote toujours dans le prompt, ce qui correspond à ce que nous avions consigné dans l’article sur l’entrée toutes-modalités.

Prêt à créer ?

Commencez à générer du contenu incroyable avec l’IA

Commencer gratuitement