guideTutoriales y guías13 min de lectura

Prompts con referencias en Seedance 2.5: da un rol a cada material

Prompts con referencias en Seedance 2.5, paso a paso: asigna un rol a cada imagen, vídeo y audio, vincula sujetos a materiales y selecciona referencias por escena.

Equipo OmniArt
Prompts con referencias en Seedance 2.5: da un rol a cada material

Los prompts con referencias de Seedance 2.5 funcionan de forma distinta al prompting de texto a vídeo que la mayoría de creadores aprendió primero. El modelo acepta hasta 50 materiales de referencia en una sola generación —imágenes, vídeos y audio combinados— y, una vez pasas de dos o tres, lo difícil ya no es describir una escena. Es decirle al modelo qué significa cada material y cuáles pertenecen a cada momento del vídeo.

Ese cambio conviene nombrarlo con claridad. Con una sola imagen de referencia, el modelo puede adivinar tu intención. Con doce, adivinar produce caras mezcladas, ropa intercambiada, props duplicados y fondos que se cuelan desde imágenes que solo subiste por un rostro. La solución no es una descripción de escena más larga. Es un bloque corto y explícito al inicio de tu prompt que asigna a cada material un trabajo y un conjunto de exclusiones.

Seedance 2.5 está disponible en el espacio de creación de vídeo de OmniArt, así que puedes seguir el hilo con tus propias referencias mientras lees. Esta guía cubre la fórmula central del prompt, los límites de materiales, el patrón de definición de roles y el flujo de cuatro pasos para prompts que cargan muchos sujetos a la vez.

Empieza por la fórmula central del prompt

Antes de que entren las referencias, Seedance 2.5 responde a una fórmula simple y flexible. Cada elemento después de los dos primeros es opcional: incluye lo que cambia el plano, descarta lo que no.

Sujeto + acción o evento + escena y entorno + estilo visual + movimiento de cámara o corte + audio

Escrita como plantilla:

<Subject> performs <primary action or event> in <scene and environment>.
The visuals feature <visual style>.
Use <shot size, camera angle, camera movement, or cuts>.
Audio includes <dialogue, ambience, sound effects, or music>.

Y rellenada para un plano real:

A bicycle mechanic trues a wheel at a workbench in a narrow street-front workshop, then lifts the wheel onto a wall hook.
Late afternoon light comes through the roll-up door. Metal surfaces are worn and slightly oily, and the floor is swept.
Begin with a medium shot of the truing stand, push in slowly toward the spoke nipples, then cut to a frontal view of the wall.
Retain the ping of spoke tension, the click of the truing gauge, and quiet street ambience.

Parámetros de generación como la resolución y la duración no pertenecen al prompt: fíjalos en la página de generación. Todo lo que esté en el prompt debe ser contenido que el modelo tenga que interpretar.

Conoce tu presupuesto de materiales antes de escribir

Seedance 2.5 combina hasta 50 materiales de referencia en tres tipos. Cada tipo tiene un límite duro de entrada y un rango recomendado aparte. El rango recomendado no es un tope: es la zona en la que las generaciones se mantienen estables.

Tipo de materialLímite de entradaRango recomendado
ImágenesHasta 30 imágenes, cada una no mayor de 4K1–8 sujetos distintos en imágenes de referencia de sujeto
VídeosHasta 10 vídeos, duración combinada de no más de 30 segundos1–5 sujetos distintos, 5–10 segundos por vídeo de sujeto
AudioHasta 10 clips, duración combinada de no más de 30 segundosSolo diálogo, voz, ambiente o música relevantes para la tarea
Edición de vídeoUn vídeo fuente más imágenes de referenciaVídeo fuente de menos de 20 segundos, 1–5 imágenes de referencia

Puedes ir más allá de las recomendaciones: 9–12 sujetos en imágenes de sujeto, 6–10 sujetos en audio o vídeo de sujeto, 6–8 imágenes de referencia para una edición. La estabilidad tiende a bajar a medida que crece el recuento, así que trata cualquier cosa por encima del rango recomendado como un experimento deliberado, no como un valor por defecto.

Una regla de empaquetado importa más de lo que la gente espera: si más de cinco sujetos también necesitan varias vistas, pon cada vista en su propia imagen. Las imágenes de vista independientes suelen ser más estables que varias vistas combinadas en una hoja collage. Una hoja de contactos de cuatro paneles la lee el modelo como una sola imagen con cuatro cosas dentro, que es exactamente la ambigüedad que intentas eliminar.

Consejo

Recorta antes de subir. Diez materiales ajustados y de un solo propósito superan a veinte solapados, porque cada material extra es otra cosa que el modelo tiene que desambiguar.

Define el rol de cada material — y sus exclusiones

Esta es la técnica sobre la que se construye el resto de la guía. Tras subir, indica exactamente qué aporta cada material y qué no debe arrastrarse. Los mapeos de material van en el texto del prompt; no confíes en etiquetas quemadas en las imágenes y no dejes que el modelo infiera qué persona o prop representa un archivo.

El patrón:

@Image 1 defines <subject>'s <appearance, clothing, structure, or material>.
@Video 1 defines <motion, camera movement, or pacing>.
@Audio 1 defines <character or sound type>'s <voice, dialogue, ambience, or music>.

<Subject> completes <primary action or event> in <scene>.
The visuals feature <visual style>, with <camera treatment>.

Rellenado, con exclusiones que hacen trabajo real:

@Image 1 defines the mechanic's facial features, hairstyle, and navy work apron. Do not use the image background.
@Image 2 defines the workshop's bench layout, tool wall, and roll-up door light. Do not use the people in the image.
@Video 1 defines the pacing of spinning the wheel, pausing, and tightening a spoke. Do not use the person's identity, clothing, or scene from the video.

The mechanic trues a wheel at the workbench, then lifts it onto the wall hook.
Begin with a medium shot of the truing stand and push in slowly toward the spoke nipples. Retain spoke pings and quiet street ambience.

Las líneas de exclusión no son relleno. Una referencia de retrato arrastra un fondo, una dirección de luz y a menudo otras personas. Sin «do not use the image background», esos atributos son terreno libre para el modelo, y aparecerán en algún sitio.

Vincula varias vistas a un solo objeto

Cuando varias imágenes muestran a la misma persona o producto desde ángulos distintos, dilo de forma explícita, y di cuántas instancias del objeto deben existir en la salida:

@Image 1 defines the front view of the same steel touring frame.
@Image 2 defines the left-side structure of the same steel touring frame.
@Image 3 defines the right-side structure of the same steel touring frame.
@Image 4 defines the rear structure of the same steel touring frame.
All four images define one steel touring frame. The output must contain only one frame throughout.

Sin esa frase de cierre, cuatro imágenes de un objeto son una descripción plausible de cuatro objetos. La afirmación de recuento es el seguro más barato de todo el prompt.

El flujo de trabajo multi-referencia en cuatro pasos

Cuando pasas de un puñado de materiales, recorre estos cuatro pasos en orden. El objetivo es ayudar al modelo a elegir los materiales correctos para la escena actual, no hacer que todo aparezca a la vez.

Paso 1: Nombra y mapea cada sujeto de forma individual

Vincula cada persona, producto y prop a su propio material, una línea por cada uno:

<Character A> corresponds to @Image 1. Use only the appearance, hairstyle, and clothing.
<Character B> corresponds to @Image 2. Use only the appearance, hairstyle, and clothing.
<Prop A> corresponds to @Image 3. Use only the structure, material, and color.
<Scene A> references @Image 4. Use only the spatial layout, architecture, and lighting. Do not use the people in the image.

El anti-patrón a evitar: nunca escribas «@Images 1 through 4 define four characters respectively». Esa frase dice al modelo que hay cuatro personajes y cuatro imágenes, pero nunca dice cuál es cuál, así que es libre de emparejarlos como quiera.

Paso 2: Agrupa los materiales por tipo

Cuando cada mapeo exista, organízalos bajo encabezados para que las relaciones se lean de un vistazo:

[Characters]
<Mechanic> corresponds to @Image 1. Use only the appearance, hairstyle, and clothing.
<Apprentice> corresponds to @Image 2. Use only the appearance, hairstyle, and clothing.
Do not interchange the two characters' appearances, clothing, actions, positions, or dialogue.

[Props]
<Truing Stand> corresponds to @Image 3 and belongs only to <Mechanic>.
<Parts Tray> corresponds to @Image 4 and belongs only to <Apprentice>.

[Scenes]
<Workshop> references @Image 5. Use only the space, materials, and lighting.
<Courtyard> references @Image 6. Use only the space, materials, and lighting.

[Motion and Audio]
@Video 1 defines the motion of <Mechanic> tightening a spoke. Do not use the person or scene from the video.
@Audio 1 defines <Apprentice>'s voice and specified dialogue.

Las líneas de propiedad de los props importan tanto como las de personajes. «Belongs only to» es lo que impide que una herramienta teletransporte entre dos personas entre cortes.

Paso 3: Escribe un perfil de los sujetos importantes

Cuando un personaje se apoya en varios materiales a lo largo de varias escenas, reúnelos en un solo bloque en lugar de dejarlos dispersos:

[Subject Profile: Mechanic]
Appearance and clothing: @Image 1.
Fixed prop: <Truing Stand> from @Image 3.
Locations: <Workshop> and <Courtyard>.
Motion references: the spoke-tightening motion from @Video 1 and the wheel-lifting motion from @Video 2.
Do not use: the apprentice's clothing. Do not give this character <Parts Tray>.

Paso 4: Selecciona referencias por escena

Por último, dile al modelo qué subconjunto de materiales usa cada escena, y cómo debe verse la escena al terminar:

Scene 1 | Truing the wheel in the workshop
Use: <Mechanic>, <Truing Stand>, <Workshop>, and the spoke-tightening motion from @Video 1.
Event: <Mechanic> spins the wheel in <Truing Stand> and tightens one spoke.
End state: <Mechanic> stands on the inner side of the bench. <Truing Stand> stays at the left of the frame.

Scene 2 | Handoff in the courtyard
Use: <Apprentice>, <Parts Tray>, and <Courtyard>.
Event: <Apprentice> carries <Parts Tray> to the courtyard bench and sets it down.
End state: <Parts Tray> rests on the bench. No other character enters the courtyard.

La selección a nivel de escena es lo que convierte un montón de referencias en una lista de planos. Cada material que no nombras en una escena es un material que el modelo sabe que debe dejar fuera.

Sintaxis especial para audio y texto

Los prompts se pueden escribir enteramente en lenguaje natural, pero cuando necesitas mantener distintos la música, los efectos de sonido, el diálogo y los subtítulos, Seedance 2.5 reconoce cuatro tipos de corchetes:

ContenidoSintaxisEjemplo
Música()(Soft, rhythmic piano music plays in the background)
Efectos de sonido<><A bell rings in the distance>
Diálogo{}{Hello, welcome back.}
Subtítulos【】【Chapter One: Departure】

Cuando el diálogo no está en chino, nombra el idioma antes de la línea —por ejemplo, The girl says softly in Japanese: {もう大丈夫です}. Si el texto escrito está en inglés pero el modelo lo habla en otro idioma, o necesitas una variedad regional concreta, usa esta fórmula:

Idioma del diálogo + variedad regional o acento + estilo de entrega + hablante + {diálogo}

Dialogue language: American English. The girl says in natural, conversational American English: {I thought you weren't coming.}

Dialogue language: authentic Los Angeles English. The young man says in natural Los Angeles vernacular: {No way, you actually made it.}

No repitas lo que una referencia ya define

Un hábito habitual de sobreescritura: subir un vídeo de referencia de movimiento y luego describir el mismo movimiento otra vez en prosa. Cuando un vídeo de referencia ya define con precisión el movimiento, el trabajo de cámara y la secuencia, indica solo qué atributos heredar. Repetir la descripción del movimiento puede entrar en conflicto con la propia referencia, y el modelo tiene que reconciliar dos versiones de una misma instrucción.

La excepción es un vídeo de blockout. Un blockout aporta sobre todo movimiento y estructura espacial —trayectorias, blocking, movimiento de cámara, cortes—, así que el prompt sigue teniendo que definir los sujetos, la escena, la acción y el estilo visual previstos. Hereda el timing del vídeo; aporta el mundo desde imágenes y texto. Si las referencias de blockout son tu flujo principal, la guía de storyboards y blockouts de Seedance 2.5 profundiza en blockouts toscos frente a finos.

Pasa la lista de comprobación antes de enviar

Antes de pulsar generar, lee tu prompt contra estas preguntas:

  • ¿El prompt indica con claridad el sujeto y la acción o evento principal?
  • ¿Cada material de referencia indica qué usar y qué no usar?
  • ¿Cada personaje, producto y prop distinto está nombrado y vinculado a una referencia?
  • ¿Las referencias se seleccionan por escena en lugar de exigirse todas a la vez?
  • ¿El número de personajes, la ropa, la propiedad de props y las relaciones espaciales se mantienen consistentes?
  • ¿Las emociones abstractas y los términos de cinematografía van emparejados con pistas visibles o audibles?

Advertencia

Los prompts con referencias elevan la probabilidad de un resultado fiel; no garantizan uno. Para subtítulos, fórmulas, señalética, especificaciones de producto o timing a nivel de fotograma que deba ser exacto, combina materiales de referencia preparados, generación y postproducción.

Empezar en OmniArt

Abre el espacio de creación de vídeo de OmniArt, elige Seedance 2.5 y monta tu primer prompt multi-referencia en este orden:

  1. Sube solo los materiales que aportan información que ningún otro material aporta.
  2. Escribe una línea de mapeo por sujeto: nombre, material y qué usar de él.
  3. Añade una exclusión a cada línea donde un fondo, una persona o una composición puedan filtrarse.
  4. Agrupa los mapeos bajo [Characters], [Props], [Scenes] y [Motion and Audio].
  5. Escribe un perfil de sujeto para cualquier personaje que abarque varias escenas.
  6. Lista cada escena con su subconjunto de materiales, su evento y su estado final.
  7. Genera dos veces con el mismo prompt y luego corrige mapeos —no adjetivos— allí donde las dos pasadas no coincidan.

Para lo que cambió en este lanzamiento y dónde encajan los modos nuevos, lee qué se ha lanzado en Seedance 2.5. Para llevar la misma disciplina de referencias a piezas más largas, continúa con prompts de vídeos de 30 segundos en Seedance 2.5, y para el control de identidad a lo largo de todo un proyecto, consulta nuestra guía de personajes consistentes en vídeo con IA.

¿Listo para crear?

Empieza a generar contenido increíble con IA

Empezar gratis