GuideTutorials en handleidingen8 min lezen

Zo prompt je Gemini Omni Flash voor video van 10 seconden

Gemini Omni Flash heeft een ongewoon promptoppervlak: geen negatieve prompt, twee beeldverhoudingen, alleen Engels en twee aparte manieren van prompten. Zo schrijf je ze allebei goed.

OmniArt-team
Zo prompt je Gemini Omni Flash voor video van 10 seconden

De meeste gidsen over AI-videoprompts leren je één ding schrijven: een rijke, gedetailleerde alinea die je het model één keer aanreikt. Gemini Omni Flash doorbreekt die aanname. De ontwikkelaars-API (live sinds 30 juni) is gebouwd rond twee verschillende prompthandelingen — de eerste generatie, en daarna een doorlopend gesprek van bewerkingen die dezelfde clip telkens opnieuw vormgeven. Schrijf je voor de ene en negeer je de andere, dan laat je het grootste deel van het model liggen.

Het promptoppervlak van Omni Flash is ook ongewoon in wat het weglaat. Er is geen veld voor een negatieve prompt, geen temperatuurknop, geen systeeminstructie en er zijn maar twee beeldverhoudingen. Dat zijn geen gaten om blind omheen te werken — elk ervan verandert hoe je een prompt formuleert. Deze gids behandelt beide modi en de beperkingen die ze vormgeven.

Let op

Sinds deze gids verscheen, is Gemini Omni Flash toegevoegd aan de videowerkruimte van OmniArt voor standaardgeneratie gestuurd door tekst en beeld. De secties hieronder beschrijven de conversationele workflow van Google nog rechtstreeks, omdat OmniArt de sessiebehoudende instellingen van de Interactions API op dit moment niet aanbiedt.

Twee promptmodi, niet één

Elke sessie met Omni Flash kent twee soorten prompts, en ze belonen verschillend schrijfwerk.

De prompt voor de eerste generatie is een complete briefing voor één beat van 10 seconden: onderwerp, beweging, camera, licht, geluid, stijl. Hij gedraagt zich als elke sterke prompt voor tekst-naar-video of beeld-naar-video — zet het detail vooraan, wees specifiek en beschrijf het hele shot in één keer.

De instructie voor een conversationele bewerking is het tegenovergestelde. Hij is kort, benoemt precies één verandering en gaat ervan uit dat het model de vorige clip al in context houdt. "Make the lighting golden hour." "Swap the sedan for a pickup." Het model past de verandering toe en behoudt alles wat je niet noemde — via de previous_interaction_id, die de sessiestatus over maximaal drie opeenvolgende bewerkingen via de Interactions API meedraagt. Prop je drie veranderingen in één bewerkingsinstructie, dan verlies je juist de precisie die deze modus de moeite waard maakt.

Het denkmodel: componeer in de eerste prompt, regisseer in de vervolgstappen. Zorg voor een stevige basisclip en verfijn die daarna zoals je een regisseur tijdens de opname zou bijsturen — één notitie per keer.

De API-beperkingen die je formulering bepalen

De lijst met parameters van Omni Flash is bewust kort. Elke weglating heeft gevolgen voor je prompt:

BeperkingWat het betekent voor de prompt
Geen veld voor een negatieve promptZet uitsluitingen in de prompt zelf — "an empty street, no pedestrians, no traffic" in plaats van een aparte negatieve lijst
Geen temperature, top_p of systeeminstructieJe kunt de variatie niet regelen of een blijvende stijlregel instellen — bak toon en stijl elke keer in de prompttekst
Beeldverhouding: alleen 9:16 of 16:9Kies de oriëntatie vooraf; er is geen vierkante of breed-filmische optie, dus kadreer vanaf het eerste woord verticaal of horizontaal
Audio wordt beschreven, nooit geüploadJe kunt geen track aanleveren om op aan te sluiten — je beschrijft het geluid dat je wilt in woorden (zie hieronder)
Engels wordt volledig ondersteund; andere talen zijn niet getestSchrijf je prompts in het Engels voor voorspelbare resultaten
Harde grens van 10 secondenEén duidelijke actie per generatie — geen shotlijst

Waarschuwing

Omni Flash kent geen upload van een audioreferentie. Je kunt het model geen muziekbed of stemvoorbeeld geven om op te synchroniseren. Het genereert standaard een audiospoor, en je enige sturing zijn de woorden in de prompt — sounddesign moet dus geschreven worden, niet bijgevoegd.

Een sjabloon voor de eerste generatie

Omdat 10 seconden één beat bevat, beschrijven de sterkste eerste prompts één doorlopend moment met elke laag ingevuld. Zes vakjes dekken zowat elk shot:

  1. Onderwerp — wie of wat er in beeld is, concreet beschreven
  2. Beweging — de ene actie die zich over de clip afspeelt
  3. Camera — één beweging, geen reeks ("slow push in", "locked-off wide")
  4. Licht — richting, kwaliteit, tijdstip van de dag
  5. Sounddesign — de audio die je gegenereerd wilt hebben, in woorden
  6. Stijl — palet, tijdvak, filmreferentie, textuur

Een uitgewerkt voorbeeld:

"A ceramic pour-over coffee dripper on a pale oak counter, steam rising as dark coffee streams into the glass carafe below. Slow push in on the drip. Soft morning light from a window camera-left, warm and diffused. Sound: gentle water trickle, distant kitchen ambience, no music. Muted editorial palette, shallow depth of field, shot on a fast prime lens."

Merk op dat de uitsluitingen in de zin zelf staan ("no music"), dat de camera één beweging maakt en dat het geluid is uitgeschreven. Dat is de hele discipline.

Conversationeel bewerken: het vocabulaire dat aankomt

Zodra je een basisclip hebt, zijn de bewerkingen het punt waarop Omni Flash workflows van genereren-en-weggooien voorbijstreeft. Houd elke instructie bij één bedoeling en leun op een consistent vocabulaire aan werkwoorden dat het model helder leest:

  • Opnieuw belichten — "make it golden hour", "add a cool rim light from behind"
  • Vervangen — "swap the coffee dripper for a French press"
  • Herstileren — "make it feel like 1970s film stock"
  • Verkleuren — "change the mug to matte black"
  • Hertimen — "slow the pour down", "let the steam linger longer"

Twee regels houden de draad samenhangend. Eén verandering per beurt — het model behoudt wat je niet noemt, dus een bewerking met één notitie is zowel voorspelbaarder als makkelijker terug te draaien met een nieuwe prompt. En bouw voort op de taal van de vorige beurt — hergebruik de zelfstandige naamwoorden die je hebt vastgelegd ("the mug", "the pour"), zodat het model zich aan dezelfde elementen vasthoudt in plaats van de scène opnieuw af te leiden.

Tip

De keten van drie bewerkingen is een budget, geen suggestie. Ontwerp de basisprompt zo dat er zo min mogelijk vervolgstappen nodig zijn — een sterke eerste generatie houdt je bewerkingsbeurten vrij voor echte creatieve keuzes en niet voor het repareren van dingen die de eerste prompt had kunnen benoemen.

Omgaan met de huidige grenzen

Een paar grenzen zijn niet met prompts op te lossen, en het loont om er rekening mee te houden in plaats van ertegen te vechten:

  • De grens van 10 seconden. De API kent geen scèneverlenging, dus schrijf geen prompts die een langere boog impliceren. Ontwerp één beat die op zichzelf staat.
  • Consistente personages over scènewisselingen is een erkend zwak punt. Doet gelijkenis ertoe, houd bewerkingen dan binnen dezelfde scène in plaats van het model te vragen een personage naar een nieuwe omgeving te verplaatsen.
  • Videoreferenties langer dan 3 seconden worden niet volledig verwerkt. Houd elke referentieclip kort en to the point.
  • Geen referenties naar meerdere video’s en geen stembewerking — allebei niet ondersteund, dus plan die stappen in een aparte tool en niet in de prompt.

Geen van deze punten diskwalificeert het als snelle tool voor korte iteraties. Ze betekenen alleen dat Omni Flash prompts beloont die zijn afgestemd op waar het goed in is: één strakke beat, conversationeel verfijnd.

Wat vandaag werkt op OmniArt

Gemini Omni Flash is nu beschikbaar op OmniArt, en zowat elke promptgewoonte hierboven is direct toepasbaar: één duidelijke beat, specifiek boven een soep van trefwoorden, en geluid dat je in de prompt schrijft. De belangrijkste uitzondering is bewerken over meerdere beurten met behoud van de sessie, wat een workflow op de API van Google blijft en geen instelling in de interface van OmniArt.

  • Generatie gestuurd door referenties vertaalt zich rechtstreeks naar Seedance 2.0, live op OmniArt, dat tot negen afbeeldingen, drie video’s en drie audiobestanden accepteert die met de syntaxis @image1 / @video1 aan rollen worden gekoppeld — het idee van “componeren uit materiaal”, met meer invoer dan Omni Flash biedt.
  • Filmische cameratermen vertalen zich naar Veo 3.1, dat bewegingswerkwoorden als "drift", "glide" en "dolly in" met terughoudendheid opvat.
  • Het sjabloon met zes vakjes (onderwerp, beweging, camera, licht, geluid, stijl) is hetzelfde skelet dat op elk videomodel in de werkruimte schone resultaten oplevert.

Open Gemini Omni Flash in de videowerkruimte en schrijf de eerste prompt als één complete beat. Heb je de bewerkingslus over meerdere beurten van Google nodig, doe dat deel dan op de Interactions API; voor standaardgeneratie en workflows met referentieafbeeldingen staat de modelpagina op OmniArt nu klaar.

Klaar om te maken?

Ga aan de slag en genereer content met AI

Gratis aan de slag