Seedance 2.0: pattern di prompt e sei casi d'uso per il video AI
Guida per creatori a Seedance 2.0 — input multi-riferimento, audio nativo, output fino a 4K, prompting per inquadrature e sei prompt testati su OmniArt.

Seedance 2.0 è il modello che scegli quando il brief suona da regia. Accetta testo, fino a nove immagini, tre video di riferimento e tre file audio in una singola richiesta, referenziabili con la sintassi @image1, @video1 e @audio1. Questa guida copre la grammatica dei prompt che rispetta il modello, i suoi limiti attuali su OmniArt e sei casi d'uso testati con prompt e risultati.
Cos'è Seedance 2.0
Seedance 2.0 genera clip da 4 a 15 secondi con audio nativo. Standard arriva a 4K; Fast e Mini si fermano a 720p. Il punto forte resta l'architettura multi-riferimento: una singola richiesta può combinare immagini, video e audio, purché contenga almeno un riferimento visivo.
| Specifica | Valore |
|---|---|
| Varianti | Standard, Fast, Mini |
| Risoluzione di output | Standard: 480p / 720p / 1080p / 4K; Fast e Mini: 480p / 720p |
| Durata | 4–15 secondi |
| Rapporti d'aspetto | 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16 |
| Budget di riferimenti | Fino a 12 materiali combinati; serve almeno un'immagine o un video |
| Input immagine | Fino a 9 (@image1–@image9) |
| Input video | Fino a 3; ciascuno 2–15 s a 24–60 fps, 15 s complessivi (@video1–@video3) |
| Input audio | Fino a 3; ciascuno 2–15 s, 15 s complessivi (@audio1–@audio3) |
| Output audio nativo | Sì — dialogo, SFX, ambiente, musica |
| Modalità di attività | Video, Transition, Reference, Extend, Modify |
| Accesso | Standard: Creator+; Fast e Mini: Starter+ |
Perché conta il sistema multi-riferimento
La maggior parte dei modelli video accetta un solo riferimento, o nessuno. Seedance 2.0 accetta uno stack e ti permette di assegnare ogni riferimento a un ruolo nel prompt. Usa @image1 per il volto del personaggio, @image2 per il costume, @image3 per la location, @video1 per il movimento di camera che vuoi, @audio1 per la base musicale. L'output rispetta ciascuno come istruzione distinta invece di mediare tutto in rumore.
È il motivo pratico per cui la somiglianza del personaggio regge tra gli shot: lo stesso riferimento @image entra in ogni shot della timeline e il modello lo usa come ancora d'identità invece di re-inferire il personaggio dal prompt ogni volta.
Struttura del prompt che funziona
Seedance 2.0 premia una struttura in sei parti.
- Soggetto — chi o cosa è in scena
- Azione / movimento — cosa fa
- Ambientazione — dove succede
- Stile visivo — riferimenti cinematografici, palette, epoca
- Direzione camera — termini cinematografici specifici
- Illuminazione — direzione, qualità, ora del giorno
Un buon template:
"Subject (with
@image1reference if applicable). Action. Setting. Visual style. Camera direction (specific cinematography term). Lighting detail."
Notazione timeline multi-shot
Seedance 2.0 risponde all'ordine delle inquadrature, non a timestamp al secondo. Numera le inquadrature e descrivi ogni momento in sequenza.
Shot 1: wide establishing shot, character (in @image1) walks into the scene
Shot 2: medium tracking shot follows them across the room
Shot 3: 360-degree orbit around the table they reach
Fissa lo stesso @image1 in ogni segmento. La somiglianza resta coerente al taglio.
Nota
Seedance 2.5 aggiunge il controllo con timestamp a secondi interi. Non copiare un template di timestamp 2.5 dentro una richiesta 2.0 aspettandoti che gli intervalli governino il timing; mantieni la struttura per numero di inquadratura mostrata sopra.
Disciplina dei tag di riferimento
Una regola breve che ripaga:
- Usa
@image1,@image2per foto volto e still di prodotto. - Usa
@video1per il movimento di camera da copiare. - Usa
@audio1quando la base audio conta più del default del modello. - Referenzia ogni tag esplicitamente nel testo. Non contare che il modello indovini quale riferimento fa quale ruolo.
Sei casi d'uso testati con prompt
Ogni prompt sotto l'abbiamo eseguito su Seedance 2.0. La colonna risultati è ciò che abbiamo ottenuto, con tempi misurati in Standard 720p.
1. Scena cinematografica
"A retired detective in a long dark coat walks through a rain-soaked alley at night. Neon signs reflect red and blue on the wet cobblestones. He pauses, lights a cigarette, and glances over his shoulder. Slow push-in from wide shot to medium close-up. Film noir style, anamorphic lens flare, teal-orange color grading, film grain."
Risultato. Push-in fluido. Riflessi pioggia convincenti, movimento naturale del cappotto. Accensione sigaretta senza distorsione delle mani. Audio pioggia e città in sync. ~70 secondi.
2. Spot prodotto
"A luxury perfume bottle rotates slowly on a black marble surface. Golden liquid catches the light as it turns. Soft particles of gold dust float in the air around it. Macro close-up, slow 360-degree orbit camera. Studio lighting with warm rim light, high-end commercial photography style."
Risultato. Rifrazione vetro e liquido accurati. Particelle naturali. Rotazione completa fluida, angoli luce corretti, texture marmo visibile. ~65 secondi.
3. Video musicale
"A female singer in a flowing red silk dress performs on a rooftop at sunset. City skyline stretches behind her. Wind blows her hair and dress dramatically. She sings with emotional intensity, arms spread wide. Dynamic tracking shot circling around her. Golden hour backlighting, lens flare, vibrant warm tones."
Risultato. Fisica del vestito realistica. Orbita fluida. Volto coerente durante la rotazione. Capelli allineati al vento. Traccia musicale ambient generata. ~75 secondi.
4. Ritratto in movimento
"An elderly Japanese craftsman in a traditional wooden workshop, morning light streaming through paper screens. He slowly lifts a hand-forged ceramic tea bowl, examining it with quiet pride. His weathered hands rotate the bowl gently. Close-up of his hands, then slow tilt up to reveal his face. Wabi-sabi aesthetic, warm natural light, documentary portrait quality."
Risultato. Conteggio dita corretto. Movimento articolazioni naturale. Tilt fluido mani-volto. Luce realistica attraverso gli shoji. Suoni bottega leggeri. Texture pelle realistica. ~80 secondi.
5. Natura e paesaggio
"Aerial drone shot gliding over a misty mountain valley at sunrise. Layers of fog roll between emerald green peaks. A winding river reflects the golden morning light below. Eagles soar through the frame at eye level. Smooth forward tracking with slight descent. Epic landscape, volumetric fog, golden hour lighting."
Risultato. Strati nebbia indipendenti creano profondità convincente. Riflessi fiume aggiornati con la camera. Bilanciamento palette forte. Nebbia volumetrica pulita. Audio vento e richiami uccelli. ~55 secondi — il più veloce dei sei.
6. Anime e fantasy
"An anime warrior princess stands atop a cliff overlooking a burning medieval city at night. Her long silver hair and crimson cape billow in the wind. She draws a glowing blue katana, electricity crackling along the blade. Cherry blossom petals swirl around her. Dynamic low-angle shot with slow push-in. Cel-shading style, vibrant neon accents, dramatic speed lines."
Risultato. Cel-shading coerente. Estrazione katana fluida. Effetto elettricità integrato. Petali in movimento indipendente. Interazione luce fuoco con mantello. Audio swoosh spada drammatico. ~70 secondi.
Errori comuni e fix
| Problema | Causa | Fix |
|---|---|---|
| Prompt rifiutato | Parole chiave volto o formulazione ambigua | Rimuovi descrizioni volto esplicite; usa riferimenti @image |
| Frame neri | Prompt troppo complesso | Una azione ogni 4–5 s; abbassa risoluzione per il test |
| Volto che cambia tra shot | Nessun riferimento coerente | Fissa lo stesso @image1 in ogni shot della timeline |
| Audio fuori sync | Mismatch diffusione congiunta | Rigenera senza audio, aggiungi base a parte |
| Distorsione mani/dita | Interazione mani complessa senza riferimento | Aggiungi immagine riferimento della posa mani |
| Texture «da AI» | Troppi keyword di stile | Aggiungi dettagli fisici — materiali, luce, tipo obiettivo |
Seedance 2.0 vs Seedance 1.0
Se hai usato 1.0, il salto a 2.0 è più ampio del numero di versione.
| Funzione | 1.0 | 2.0 |
|---|---|---|
| Architettura | Pipeline separate | Transformer diffusione unificato |
| Input immagine | 1 opzionale | fino a 9, con @tag |
| Input video | Nessuno | fino a 3 |
| Input audio | Nessuno | fino a 3 |
| Output audio nativo | No | Sì |
| Risoluzione max | 1080p | Fino a 4K su Standard |
| Durata | 5–10s | 4–15s |
| Multi-shot | Base | Storyboard timeline con coerenza cross-shot |
| Qualità mani | Artefatti frequenti | Miglioramento evidente |
| Editing in-video | No | Sì — swap personaggio/oggetto |
Quando scegliere altro
Seedance 2.0 non è lo strumento giusto per ogni brief.
| Esigenza | Punto di partenza migliore nel workspace attuale |
|---|---|
| Bozze Seedance al costo più basso con audio nativo | Seedance 2.0 Mini |
| Un secondo flusso ricco di riferimenti con output 2K | MiniMax H3 |
| Output 4K con audio nativo opzionale | Veo 3.1 Standard o Fast |
| Testo-video breve senza audio generato | Sora 2 |
| Iterazione generale a basso costo su molti rapporti d'aspetto | V6 |
Prezzi su OmniArt
Seedance 2.0 viene addebitato per secondo di output nel workspace video di OmniArt. A 720p, Standard costa 14 crediti al secondo, Fast 11 e Mini 8; una clip di cinque secondi costa rispettivamente 70, 55 o 40 crediti. Standard richiede Creator o Ultra, mentre Fast e Mini richiedono Starter o un piano superiore. Ultra offre attualmente la generazione di risorse senza consumo di crediti, non uno sconto percentuale.
Avviso
I permessi d'uso commerciale dipendono dai termini della route e dell'account usati per generare il file. Verifica i termini attuali della piattaforma prima di una consegna importante.
Iniziare su OmniArt
Seedance 2.0 Standard, Fast e Mini stanno nel workspace video di OmniArt insieme a MiniMax H3, Gemini Omni, Happy Horse, Kling, Grok Imagine, Veo 3.1, Sora 2, V6 e agli altri modelli video attuali. Condividono lo stesso saldo e la stessa cronologia di creazione, mentre ogni modello mantiene i propri parametri supportati e i propri limiti di riferimenti.
Inizia con il prompt della scena cinematografica sopra per sentire il flusso multi-riferimento, poi passa al brief music video quando vuoi testare la coerenza del volto in movimento.
Se stai scegliendo tra Seedance 2.0 e HappyHorse 1.0, il confronto HappyHorse 1 vs Seedance 2 percorre i compromessi inquadratura per inquadratura. Per il flusso di nuova generazione, leggi cosa cambia con Seedance 2.5 e scegli da lì la guida ai prompt adatta al tuo obiettivo.
Pronto a creare?
Inizia a generare contenuti straordinari con l’AI