Seedance 2.0: padrões de prompt e 6 casos de uso em vídeo IA
Guia Seedance 2.0 para criadores — entradas multi-referência, áudio nativo, saída até 4K, prompts orientados a planos e seis prompts testados na OmniArt com resultados.

O Seedance 2.0 é o modelo que criadores pegam quando o briefing lê como nota de direção. Ele aceita texto, até nove imagens, três vídeos de referência e três arquivos de áudio em uma única requisição, endereçáveis com a sintaxe @image1, @video1 e @audio1. Este guia cobre a gramática de prompt que respeita o modelo, seus limites atuais na OmniArt e seis casos de uso testados com prompts e resultados.
O que é o Seedance 2.0
O Seedance 2.0 gera clipes de 4 a 15 segundos com áudio nativo. O Standard chega a 4K; Fast e Mini chegam a 720p. O destaque continua sendo a arquitetura multi-referência: uma única requisição pode combinar imagens, vídeos e áudio, desde que inclua pelo menos uma referência visual.
| Especificação | Valor |
|---|---|
| Variantes | Standard, Fast, Mini |
| Resolução de saída | Standard: 480p / 720p / 1080p / 4K; Fast e Mini: 480p / 720p |
| Duração | 4–15 s |
| Proporções | 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16 |
| Orçamento de referências | Até 12 materiais combinados; pelo menos uma imagem ou um vídeo é obrigatório |
| Entrada de imagem | Até 9 (@image1–@image9) |
| Entrada de vídeo | Até 3; cada um de 2–15 s a 24–60 fps, 15 s combinados (@video1–@video3) |
| Entrada de áudio | Até 3; cada um de 2–15 s, 15 s combinados (@audio1–@audio3) |
| Saída de áudio nativa | Sim — diálogo, SFX, ambiente, música |
| Modos de tarefa | Video, Transition, Reference, Extend, Modify |
| Acesso | Standard: Creator ou superior; Fast e Mini: Starter ou superior |
Por que o sistema multi-referência importa
Muitos modelos de vídeo aceitam uma referência ou nenhuma. O Seedance 2.0 aceita a pilha e permite amarrar cada referência a um papel no prompt: @image1 para rosto, @image2 para roupa, @image3 para locação, @video1 para o movimento de câmera desejado, @audio1 para a base musical. A saída trata cada uma como instrução discreta, não média tudo em ruído.
A razão prática da consistência de likeness entre shots: a mesma referência @image entra em cada segmento da timeline e ancora identidade em vez de re-inferir do zero a cada corte.
Estrutura de prompt que funciona
Recompense prompts em seis partes:
- Sujeito — quem ou o quê na tela
- Ação/movimento — o que faz
- Cenário/ambiente — onde
- Estilo visual — referências de filme, paleta, época
- Instruções de câmera — termos cinematográficos concretos
- Iluminação — direção, qualidade, hora
Template útil:
«Subject (with
@image1reference if applicable). Action. Setting. Visual style. Camera direction (specific cinematography term). Lighting detail.»
Notação de timeline multi-shot
O Seedance 2.0 responde à ordem dos planos, não a marcações de tempo em segundos. Use planos numerados e descreva cada momento em sequência.
Shot 1: wide establishing shot, character (in @image1) walks into the scene
Shot 2: medium tracking shot follows them across the room
Shot 3: 360-degree orbit around the table they reach
Fixe o mesmo @image1 em cada segmento para manter likeness entre cortes.
Nota
O Seedance 2.5 acrescenta controle por marcações de tempo em segundos inteiros. Não copie um template de marcação do 2.5 para uma requisição do 2.0 esperando que os intervalos comandem o timing; mantenha a estrutura de planos numerados mostrada acima.
Disciplina de tags de referência
Um pequeno conjunto de regras que compensa:
@image1,@image2: retratos ou stills de produto.@video1: movimento de câmera a copiar.@audio1: quando a base importa mais que o default do modelo.- Referencie cada tag no texto; não deixe o modelo adivinhar papéis.
Seis casos de uso testados com prompts
Prompts executados em Standard 720p.
1. Cena cinematográfica
«A retired detective in a long dark coat walks through a rain-soaked alley at night. Neon signs reflect red and blue on the wet cobblestones. He pauses, lights a cigarette, and glances over his shoulder. Slow push-in from wide shot to medium close-up. Film noir style, anamorphic lens flare, teal-orange color grading, film grain.»
Resultado. Push-in suave; reflexos de chuva convincentes; movimento natural do casaco; sem distorção nas mãos ao acender. Ambiente de chuva e rua sincronizado. ~70 s.
2. Comercial de produto
«A luxury perfume bottle rotates slowly on a black marble surface. Golden liquid catches the light as it turns. Soft particles of gold dust float in the air around it. Macro close-up, slow 360-degree orbit camera. Studio lighting with warm rim light, high-end commercial photography style.»
Resultado. Refração de vidro e líquido corretas; drift natural de partículas; rotação completa suave. ~65 s.
3. Videoclipe
«A female singer in a flowing red silk dress performs on a rooftop at sunset. City skyline stretches behind her. Wind blows her hair and dress dramatically. She sings with emotional intensity, arms spread wide. Dynamic tracking shot circling around her. Golden hour backlighting, lens flare, vibrant warm tones.»
Resultado. Física realista do vestido; órbita fluida; rosto consistente na rotação; cabelo alinhado ao vento; trilha ambiente gerada. ~75 s.
4. Retrato com movimento
«An elderly Japanese craftsman in a traditional wooden workshop, morning light streaming through paper screens. He slowly lifts a hand-forged ceramic tea bowl, examining it with quiet pride. His weathered hands rotate the bowl gently. Close-up of his hands, then slow tilt up to reveal his face. Wabi-sabi aesthetic, warm natural light, documentary portrait quality.»
Resultado. Contagem correta de dedos; articulação natural; tilt suave mãos→rosto; luz shoji realista; micro-som ambiente da oficina. ~80 s.
5. Natureza e paisagem
«Aerial drone shot gliding over a misty mountain valley at sunrise. Layers of fog roll between emerald green peaks. A winding river reflects the golden morning light below. Eagles soar through the frame at eye level. Smooth forward tracking with slight descent. Epic landscape, volumetric fog, golden hour lighting.»
Resultado. Camadas de névoa independentes; reflexo do rio atualiza com a câmera; paleta forte; névoa limpa; vento e pássaros. ~55 s — o mais rápido dos seis.
6. Anime e fantasia
«An anime warrior princess stands atop a cliff overlooking a burning medieval city at night. Her long silver hair and crimson cape billow in the wind. She draws a glowing blue katana, electricity crackling along the blade. Cherry blossom petals swirl around her. Dynamic low-angle shot with slow push-in. Cel-shading style, vibrant neon accents, dramatic speed lines.»
Resultado. Cel-shading consistente; desembainhar fluido; eletricidade integrada; sakura independente; som de katana dramático. ~70 s.
Erros comuns e correções
| Problema | Causa | Correção |
|---|---|---|
| Prompt recusado | Palavras de rosto vagas | Remova descritores explícitos de rosto; use @image |
| Frame preto | Prompt excessivo | Uma ação por 4–5 s; teste resolução menor |
| Rosto muda entre shots | Sem referência | Mesmo @image1 em cada shot da timeline |
| Áudio dessincronizado | Mismatch na difusão conjunta | Regenere sem áudio; adicione bed depois |
| Mãos/dedos distorcidos | Mãos complexas sem ref | Imagem de referência da pose desejada |
| Textura «gerada por IA» | Excesso de keywords de estilo | Detalhe físico — material, luz, lente |
Seedance 2.0 vs 1.0
Se você já usou o 1.0, a distância até o 2.0 é maior do que o número da versão sugere.
| Recurso | 1.0 | 2.0 |
|---|---|---|
| Arquitetura | Pipeline separado | Transformer unificado |
| Imagens | 1 opcional | Até 9 com @tag |
| Entrada de vídeo | Não | Até 3 |
| Entrada de áudio | Não | Até 3 |
| Áudio nativo | Não | Sim |
| Resolução máx. | 1080p | Até 4K no Standard |
| Duração | 5–10 s | 4–15 s |
| Multi-shot | Básico | Timeline consistente |
| Mãos | Artefatos frequentes | Melhora clara |
| Edição dentro do vídeo | Não | Sim — troca de personagem ou objeto |
Quando escolher outro modelo
O Seedance 2.0 não é a ferramenta certa para todo briefing.
| Precisa de | Melhor ponto de partida no espaço atual |
|---|---|
| Rascunhos Seedance de menor custo com áudio nativo | Seedance 2.0 Mini |
| Um segundo fluxo com muitas referências e saída 2K | MiniMax H3 |
| Saída 4K com áudio nativo opcional | Veo 3.1 Standard ou Fast |
| Texto para vídeo curto sem áudio gerado | Sora 2 |
| Iteração geral de baixo custo em várias proporções | V6 |
Créditos na OmniArt
O Seedance 2.0 é cobrado por segundo de saída no espaço de vídeo da OmniArt. Em 720p, Standard custa 14 créditos por segundo, Fast 11 e Mini 8; um clipe de cinco segundos custa 70, 55 ou 40 créditos, respectivamente. Standard exige Creator ou Ultra; Fast e Mini exigem Starter ou superior. Atualmente, o Ultra oferece geração de recursos sem consumo de créditos, não um desconto percentual.
Aviso
Na redação, a ByteDance ainda não publicou direitos comerciais explícitos para saídas Seedance 2.0. Confirme licença da plataforma antes de uso comercial de alto risco.
Começar na OmniArt
Seedance 2.0 está ao lado de V6, Sora 2, Veo 3.1, Kling 3.0, HappyHorse 1.0 e Grok Imagine — mesmo saldo, mesmas referências, mesma gramática.
Teste multi-referência com o prompt de cena cinematográfica; depois brief de clipe com teste de consistência facial.
Para o fluxo de nova geração, leia o que mudou no Seedance 2.5 e escolha ali o guia de prompts adequado à sua tarefa.
Pronto para criar?
Comece a gerar conteúdo incrível com IA