Prompts com referência no Seedance 2.5: dê um papel a cada material
Prompts com referência no Seedance 2.5, passo a passo: atribua papel a cada imagem, vídeo e áudio, vincule sujeitos aos materiais e selecione referências por cena.

Os prompts com referência no Seedance 2.5 funcionam de forma diferente dos prompts de texto para vídeo que a maioria dos criadores aprendeu primeiro. O modelo aceita até 50 materiais de referência em uma geração — imagens, vídeos e áudio combinados — e, passado dois ou três deles, a parte difícil deixa de ser descrever uma cena. É dizer ao modelo qual material significa o quê, e quais pertencem a cada momento do vídeo.
Essa mudança vale nomear com clareza. Com uma imagem de referência, o modelo pode adivinhar sua intenção. Com doze, adivinhar produz rostos misturados, roupas trocadas, props duplicados e fundos invadindo a partir de imagens que você só enviou por um rosto. O conserto não é uma descrição de cena mais longa. É um bloco curto e explícito no topo do prompt que atribui a cada material um trabalho e um conjunto de exclusões.
O Seedance 2.5 está disponível no workspace de criação de vídeo da OmniArt, para que você possa acompanhar com suas próprias referências enquanto lê. Este guia cobre a fórmula central de prompt, os limites de material, o padrão de definição de papéis e o fluxo de quatro passos para prompts que carregam muitos sujeitos de uma vez.
Comece pela fórmula central de prompt
Antes de as referências entrarem em cena, o Seedance 2.5 responde a uma fórmula simples e flexível. Todo elemento depois dos dois primeiros é opcional — inclua o que muda o plano, descarte o que não muda.
Sujeito + ação ou evento + cena e ambiente + estilo visual + movimento de câmera ou corte + áudio
Escrita como um template:
<Subject> performs <primary action or event> in <scene and environment>.
The visuals feature <visual style>.
Use <shot size, camera angle, camera movement, or cuts>.
Audio includes <dialogue, ambience, sound effects, or music>.
E preenchida para um plano real:
A bicycle mechanic trues a wheel at a workbench in a narrow street-front workshop, then lifts the wheel onto a wall hook.
Late afternoon light comes through the roll-up door. Metal surfaces are worn and slightly oily, and the floor is swept.
Begin with a medium shot of the truing stand, push in slowly toward the spoke nipples, then cut to a frontal view of the wall.
Retain the ping of spoke tension, the click of the truing gauge, and quiet street ambience.
Parâmetros de geração como resolução e duração não pertencem ao prompt — defina-os na página de geração. Tudo no prompt deve ser conteúdo que o modelo tem de interpretar.
Conheça seu orçamento de materiais antes de escrever
O Seedance 2.5 combina até 50 materiais de referência em três tipos. Cada tipo tem um limite rígido de entrada e um intervalo recomendado separado. O intervalo recomendado não é um teto — é a zona em que as gerações permanecem estáveis.
| Tipo de material | Limite de entrada | Intervalo recomendado |
|---|---|---|
| Imagens | Até 30 imagens, cada uma com no máximo 4K | 1–8 sujeitos distintos em imagens de referência de sujeito |
| Vídeos | Até 10 vídeos, duração combinada de no máximo 30 segundos | 1–5 sujeitos distintos, 5–10 segundos por vídeo de sujeito |
| Áudio | Até 10 clips, duração combinada de no máximo 30 segundos | Só diálogo, voz, ambiente ou música relevantes à tarefa |
| Edição de vídeo | Um vídeo-fonte mais imagens de referência | Vídeo-fonte com menos de 20 segundos, 1–5 imagens de referência |
Você pode ir além das recomendações — 9–12 sujeitos em imagens de sujeito, 6–10 sujeitos em áudio ou vídeo de sujeito, 6–8 imagens de referência para uma edição. A estabilidade tende a cair conforme a contagem cresce, então trate qualquer coisa acima do intervalo recomendado como um experimento deliberado, não como padrão.
Uma regra de empacotamento importa mais do que as pessoas esperam: se mais de cinco sujeitos também precisam de múltiplas visões, coloque cada visão em sua própria imagem. Imagens de visão independentes costumam ser mais estáveis do que várias visões combinadas em uma única folha de colagem. Uma folha de contato de quatro painéis é lida pelo modelo como uma foto com quatro coisas dentro, que é exatamente a ambiguidade que você está tentando remover.
Dica
Ajuste antes de enviar. Dez materiais enxutos e de propósito único superam vinte sobrepostos, porque cada material extra é mais uma coisa que o modelo tem de desambiguar.
Defina o papel de cada material — e suas exclusões
Esta é a técnica sobre a qual o resto do guia se constrói. Depois de enviar, declare exatamente o que cada material contribui, e declare o que não deve ser carregado. Os mapeamentos de material pertencem ao texto do prompt; não confie em rótulos gravados nas imagens e não deixe o modelo inferir qual pessoa ou prop um arquivo representa.
O padrão:
@Image 1 defines <subject>'s <appearance, clothing, structure, or material>.
@Video 1 defines <motion, camera movement, or pacing>.
@Audio 1 defines <character or sound type>'s <voice, dialogue, ambience, or music>.
<Subject> completes <primary action or event> in <scene>.
The visuals feature <visual style>, with <camera treatment>.
Preenchido, com exclusões fazendo trabalho de verdade:
@Image 1 defines the mechanic's facial features, hairstyle, and navy work apron. Do not use the image background.
@Image 2 defines the workshop's bench layout, tool wall, and roll-up door light. Do not use the people in the image.
@Video 1 defines the pacing of spinning the wheel, pausing, and tightening a spoke. Do not use the person's identity, clothing, or scene from the video.
The mechanic trues a wheel at the workbench, then lifts it onto the wall hook.
Begin with a medium shot of the truing stand and push in slowly toward the spoke nipples. Retain spoke pings and quiet street ambience.
As linhas de exclusão não são enchimento. Uma referência de retrato carrega um fundo, uma direção de luz e muitas vezes outras pessoas. Sem "do not use the image background", esses atributos estão em jogo para o modelo, e vão aparecer em algum lugar.
Vincule múltiplas visões a um único objeto
Quando várias imagens mostram a mesma pessoa ou produto de ângulos diferentes, diga isso explicitamente, e diga quantas unidades do objeto devem existir na saída:
@Image 1 defines the front view of the same steel touring frame.
@Image 2 defines the left-side structure of the same steel touring frame.
@Image 3 defines the right-side structure of the same steel touring frame.
@Image 4 defines the rear structure of the same steel touring frame.
All four images define one steel touring frame. The output must contain only one frame throughout.
Sem essa frase de fechamento, quatro imagens de um objeto é uma descrição plausível de quatro objetos. A afirmação de contagem é o seguro mais barato do prompt inteiro.
O fluxo de quatro passos com múltiplas referências
Quando você passa de um punhado de materiais, percorra estes quatro passos em ordem. O objetivo é ajudar o modelo a escolher os materiais certos para a cena atual — não fazer tudo aparecer de uma vez.
Passo 1: Nomeie e mapeie cada sujeito individualmente
Vincule cada pessoa, produto e prop ao seu próprio material, uma linha por um:
<Character A> corresponds to @Image 1. Use only the appearance, hairstyle, and clothing.
<Character B> corresponds to @Image 2. Use only the appearance, hairstyle, and clothing.
<Prop A> corresponds to @Image 3. Use only the structure, material, and color.
<Scene A> references @Image 4. Use only the spatial layout, architecture, and lighting. Do not use the people in the image.
O anti-padrão a evitar: nunca escreva "@Images 1 through 4 define four characters respectively." Essa frase diz ao modelo que há quatro personagens e quatro imagens, mas nunca diz quem é quem — então ele fica livre para pareá-los como quiser.
Passo 2: Agrupe os materiais por tipo
Depois que cada mapeamento existe, organize-os sob cabeçalhos para que as relações fiquem legíveis de relance:
[Characters]
<Mechanic> corresponds to @Image 1. Use only the appearance, hairstyle, and clothing.
<Apprentice> corresponds to @Image 2. Use only the appearance, hairstyle, and clothing.
Do not interchange the two characters' appearances, clothing, actions, positions, or dialogue.
[Props]
<Truing Stand> corresponds to @Image 3 and belongs only to <Mechanic>.
<Parts Tray> corresponds to @Image 4 and belongs only to <Apprentice>.
[Scenes]
<Workshop> references @Image 5. Use only the space, materials, and lighting.
<Courtyard> references @Image 6. Use only the space, materials, and lighting.
[Motion and Audio]
@Video 1 defines the motion of <Mechanic> tightening a spoke. Do not use the person or scene from the video.
@Audio 1 defines <Apprentice>'s voice and specified dialogue.
Linhas de propriedade de prop importam tanto quanto linhas de personagem. "Belongs only to" é o que impede uma ferramenta de teleportar entre duas pessoas entre cortes.
Passo 3: Escreva um perfil para sujeitos importantes
Quando um personagem se apoia em vários materiais em múltiplas cenas, reúna-os em um bloco em vez de deixá-los espalhados:
[Subject Profile: Mechanic]
Appearance and clothing: @Image 1.
Fixed prop: <Truing Stand> from @Image 3.
Locations: <Workshop> and <Courtyard>.
Motion references: the spoke-tightening motion from @Video 1 and the wheel-lifting motion from @Video 2.
Do not use: the apprentice's clothing. Do not give this character <Parts Tray>.
Passo 4: Selecione referências por cena
Por fim, diga ao modelo qual subconjunto de materiais cada cena usa, e como a cena deve parecer quando terminar:
Scene 1 | Truing the wheel in the workshop
Use: <Mechanic>, <Truing Stand>, <Workshop>, and the spoke-tightening motion from @Video 1.
Event: <Mechanic> spins the wheel in <Truing Stand> and tightens one spoke.
End state: <Mechanic> stands on the inner side of the bench. <Truing Stand> stays at the left of the frame.
Scene 2 | Handoff in the courtyard
Use: <Apprentice>, <Parts Tray>, and <Courtyard>.
Event: <Apprentice> carries <Parts Tray> to the courtyard bench and sets it down.
End state: <Parts Tray> rests on the bench. No other character enters the courtyard.
A seleção em nível de cena é o que converte uma pilha de referências em uma lista de planos. Todo material que você não nomeia em uma cena é um material que o modelo sabe deixar de fora.
Sintaxe especial para áudio e texto
Os prompts podem ser escritos inteiramente em linguagem natural, mas quando você precisa manter música, efeitos sonoros, diálogo e legendas distintos, o Seedance 2.5 reconhece quatro tipos de colchetes:
| Conteúdo | Sintaxe | Exemplo |
|---|---|---|
| Música | () | (Soft, rhythmic piano music plays in the background) |
| Efeitos sonoros | <> | <A bell rings in the distance> |
| Diálogo | {} | {Hello, welcome back.} |
| Legendas | 【】 | 【Chapter One: Departure】 |
Reforce o idioma do diálogo
Quando o diálogo não está em chinês, nomeie o idioma antes da linha — por exemplo, The girl says softly in Japanese: {もう大丈夫です}. Se o texto escrito está em inglês mas o modelo o fala em outro idioma, ou você precisa de uma variedade regional particular, use esta fórmula:
Idioma do diálogo + variedade regional ou sotaque + estilo de entrega + falante + {dialogue}
Dialogue language: American English. The girl says in natural, conversational American English: {I thought you weren't coming.}
Dialogue language: authentic Los Angeles English. The young man says in natural Los Angeles vernacular: {No way, you actually made it.}
Não reafirme o que uma referência já define
Um hábito comum de superescrita: enviar um vídeo de referência de movimento e depois descrever o mesmo movimento de novo em prosa. Quando um vídeo de referência já define o movimento, o trabalho de câmera e a sequência com precisão, declare só quais atributos herdar. Repetir a descrição do movimento pode conflitar com a própria referência, e o modelo tem de reconciliar duas versões de uma instrução.
A exceção é um vídeo de blockout. Um blockout fornece principalmente movimento e estrutura espacial — caminhos, blocking, movimento de câmera, cortes — então o prompt ainda precisa definir os sujeitos pretendidos, a cena, a ação e o estilo visual. Herde o timing do vídeo; forneça o mundo a partir de imagens e texto. Se referências de blockout são seu fluxo principal, o guia de storyboards e blockouts do Seedance 2.5 aprofunda blockouts grosseiros versus finos.
Rode a lista de verificação antes de enviar
Antes de apertar gerar, leia seu prompt contra estas perguntas:
- O prompt declara com clareza o sujeito e a ação ou evento primário?
- Todo material de referência declara o que usar e o que não usar?
- Todo personagem, produto e prop distintos está nomeado e vinculado a uma referência?
- As referências são selecionadas por cena em vez de serem obrigadas a aparecer todas de uma vez?
- O número de personagens, vestuário, propriedade de props e relações espaciais permanecem consistentes?
- Emoções abstratas e termos de cinematografia estão pareados com pistas visíveis ou audíveis?
Aviso
Prompts com referência elevam a probabilidade de um resultado fiel; não garantem um. Para legendas, fórmulas, sinalização, especificações de produto ou timing em nível de frame que precise ser exato, combine materiais de referência preparados, geração e pós-produção.
Como começar na OmniArt
Abra o workspace de criação de vídeo da OmniArt, escolha Seedance 2.5 e monte seu primeiro prompt com múltiplas referências nesta ordem:
- Envie só os materiais que carregam informação que nenhum outro material carrega.
- Escreva uma linha de mapeamento por sujeito — nome, material e o que usar dele.
- Adicione uma exclusão a cada linha em que um fundo, pessoa ou composição possa vazar.
- Agrupe os mapeamentos sob
[Characters],[Props],[Scenes]e[Motion and Audio]. - Escreva um perfil de sujeito para qualquer personagem que atravessa múltiplas cenas.
- Liste cada cena com seu subconjunto de materiais, seu evento e seu estado final.
- Gere duas vezes com o mesmo prompt e então corrija mapeamentos — não adjetivos — onde as duas rodadas discordarem.
Para o que mudou neste lançamento e onde os novos modos se encaixam, leia o que foi lançado no Seedance 2.5. Para levar a mesma disciplina de referência a peças mais longas, continue com prompts de vídeos de 30 segundos no Seedance 2.5, e para controle de identidade que atravessa um projeto inteiro, veja nosso guia de personagens consistentes em vídeo com IA.
Pronto para criar?
Comece a gerar conteúdo incrível com IA