GuideTutoriales y guías13 min de lectura

Prompts con referencias en Seedance 2.5: dale un rol a cada material

Prompts con referencias en Seedance 2.5, paso a paso: asígnale un rol a cada imagen, video y clip de audio, ata los sujetos a sus materiales y selecciona referencias por escena.

Equipo OmniArt
Prompts con referencias en Seedance 2.5: dale un rol a cada material

Escribir prompts con referencias en Seedance 2.5 funciona distinto del texto a video con el que la mayoría de los creadores aprendió primero. El modelo acepta hasta 50 entradas de referencia en una misma generación —imágenes, videos y audio combinados— y, una vez que pasas de dos o tres, la parte difícil deja de ser describir una escena. Es decirle al modelo qué significa cada material y cuáles corresponden a cada momento del video.

Vale la pena nombrar ese cambio con claridad. Con una sola imagen de referencia, el modelo puede adivinar tu intención. Con doce, adivinar produce caras mezcladas, ropa intercambiada, objetos duplicados y fondos que se filtran desde imágenes que solo subiste por una cara. La solución no es una descripción de escena más larga. Es un bloque corto y explícito al inicio de tu prompt que le asigna a cada material un trabajo y un conjunto de exclusiones.

Seedance 2.5 está disponible en el espacio de creación de video de OmniArt, así que puedes seguir la guía con tus propias referencias mientras lees. Este artículo cubre la fórmula base del prompt, los límites de materiales, el patrón de definición de roles y el flujo de cuatro pasos para prompts que cargan con muchos sujetos a la vez.

Parte de la fórmula base del prompt

Antes de que entren las referencias, Seedance 2.5 responde a una fórmula simple y flexible. Todos los elementos después de los dos primeros son opcionales: incluye lo que cambia el plano y descarta lo que no.

Sujeto + acción o evento + escena y entorno + estilo visual + movimiento de cámara o corte + audio

Escrita como plantilla:

<Subject> performs <primary action or event> in <scene and environment>.
The visuals feature <visual style>.
Use <shot size, camera angle, camera movement, or cuts>.
Audio includes <dialogue, ambience, sound effects, or music>.

Y completada para un plano real:

A bicycle mechanic trues a wheel at a workbench in a narrow street-front workshop, then lifts the wheel onto a wall hook.
Late afternoon light comes through the roll-up door. Metal surfaces are worn and slightly oily, and the floor is swept.
Begin with a medium shot of the truing stand, push in slowly toward the spoke nipples, then cut to a frontal view of the wall.
Retain the ping of spoke tension, the click of the truing gauge, and quiet street ambience.

Los parámetros de generación, como la resolución y la duración, no van en el prompt: eso se configura en la página de generación. Todo lo que esté en el prompt debería ser contenido que el modelo tenga que interpretar.

Conoce tu presupuesto de materiales antes de escribir

Seedance 2.5 combina hasta 50 entradas de referencia entre tres tipos. Cada tipo tiene un límite duro de entrada y un rango recomendado aparte. El rango recomendado no es un tope: es la zona donde las generaciones se mantienen estables.

Tipo de materialLímite de entradaRango recomendado
ImágenesHasta 30 imágenes, ninguna mayor a 4KDe 1 a 8 sujetos distintos entre las imágenes de referencia de sujeto
VideosHasta 10 videos, con duración combinada de no más de 30 segundosDe 1 a 5 sujetos distintos, de 5 a 10 segundos por video de sujeto
AudioHasta 10 clips, con duración combinada de no más de 30 segundosSolo diálogo, voz, ambiente o música relevantes para la tarea
Edición de videoUn video de origen más imágenes de referenciaVideo de origen de menos de 20 segundos, de 1 a 5 imágenes de referencia

Puedes pasarte de las recomendaciones: de 9 a 12 sujetos en imágenes de sujeto, de 6 a 10 sujetos en audio o video de sujeto, de 6 a 8 imágenes de referencia para una edición. La estabilidad tiende a bajar conforme sube la cuenta, así que trata cualquier cosa por encima del rango recomendado como un experimento deliberado y no como el valor por defecto.

Una regla de empaquetado importa más de lo que la gente espera: si más de cinco sujetos además necesitan varias vistas, pon cada vista en su propia imagen. Las imágenes de vista independientes suelen ser más estables que varias vistas combinadas en una sola hoja de collage. Una hoja de contactos de cuatro paneles se lee para el modelo como una sola imagen con cuatro cosas adentro, que es exactamente la ambigüedad que estás tratando de eliminar.

Consejo

Depura antes de subir. Diez materiales ajustados y de un solo propósito rinden más que veinte que se superponen, porque cada material extra es una cosa más que el modelo tiene que desambiguar.

Define el rol de cada material y también sus exclusiones

Esta es la técnica sobre la que se construye el resto de la guía. Después de subir, declara exactamente qué aporta cada material y qué no debe trasladarse. Los mapeos de materiales van en el texto del prompt; no confíes en etiquetas quemadas dentro de las imágenes y no dejes que el modelo deduzca qué persona u objeto representa cada archivo.

El patrón:

@Image 1 defines <subject>'s <appearance, clothing, structure, or material>.
@Video 1 defines <motion, camera movement, or pacing>.
@Audio 1 defines <character or sound type>'s <voice, dialogue, ambience, or music>.

<Subject> completes <primary action or event> in <scene>.
The visuals feature <visual style>, with <camera treatment>.

Completado, con exclusiones haciendo trabajo real:

@Image 1 defines the mechanic's facial features, hairstyle, and navy work apron. Do not use the image background.
@Image 2 defines the workshop's bench layout, tool wall, and roll-up door light. Do not use the people in the image.
@Video 1 defines the pacing of spinning the wheel, pausing, and tightening a spoke. Do not use the person's identity, clothing, or scene from the video.

The mechanic trues a wheel at the workbench, then lifts it onto the wall hook.
Begin with a medium shot of the truing stand and push in slowly toward the spoke nipples. Retain spoke pings and quiet street ambience.

Las líneas de exclusión no son relleno. Una referencia de retrato carga con un fondo, una dirección de luz y a menudo con otras personas. Sin “do not use the image background”, esos atributos quedan a disposición del modelo, y van a aparecer en alguna parte.

Ata varias vistas a un mismo objeto

Cuando varias imágenes muestran a la misma persona o al mismo producto desde ángulos distintos, dilo de forma explícita, y di cuántas unidades del objeto deben existir en el resultado:

@Image 1 defines the front view of the same steel touring frame.
@Image 2 defines the left-side structure of the same steel touring frame.
@Image 3 defines the right-side structure of the same steel touring frame.
@Image 4 defines the rear structure of the same steel touring frame.
All four images define one steel touring frame. The output must contain only one frame throughout.

Sin esa oración de cierre, cuatro imágenes de un objeto son una descripción plausible de cuatro objetos. La afirmación de cantidad es el seguro más barato de todo el prompt.

El flujo de cuatro pasos para varias referencias

Cuando ya pasaste de un puñado de materiales, recorre estos cuatro pasos en orden. La meta es ayudar al modelo a elegir los materiales correctos para la escena actual, no hacer que todo aparezca a la vez.

Paso 1: nombra y mapea cada sujeto por separado

Ata cada persona, producto y objeto a su propio material, una línea por cada uno:

<Character A> corresponds to @Image 1. Use only the appearance, hairstyle, and clothing.
<Character B> corresponds to @Image 2. Use only the appearance, hairstyle, and clothing.
<Prop A> corresponds to @Image 3. Use only the structure, material, and color.
<Scene A> references @Image 4. Use only the spatial layout, architecture, and lighting. Do not use the people in the image.

El antipatrón que hay que evitar: nunca escribas “@Images 1 through 4 define four characters respectively.” Esa oración le dice al modelo que hay cuatro personajes y cuatro imágenes, pero nunca dice cuál es cuál, así que queda libre de emparejarlos como se le antoje.

Paso 2: agrupa los materiales por tipo

Cuando ya existe cada mapeo, organízalos bajo encabezados para que las relaciones se lean de un vistazo:

[Characters]
<Mechanic> corresponds to @Image 1. Use only the appearance, hairstyle, and clothing.
<Apprentice> corresponds to @Image 2. Use only the appearance, hairstyle, and clothing.
Do not interchange the two characters' appearances, clothing, actions, positions, or dialogue.

[Props]
<Truing Stand> corresponds to @Image 3 and belongs only to <Mechanic>.
<Parts Tray> corresponds to @Image 4 and belongs only to <Apprentice>.

[Scenes]
<Workshop> references @Image 5. Use only the space, materials, and lighting.
<Courtyard> references @Image 6. Use only the space, materials, and lighting.

[Motion and Audio]
@Video 1 defines the motion of <Mechanic> tightening a spoke. Do not use the person or scene from the video.
@Audio 1 defines <Apprentice>'s voice and specified dialogue.

Las líneas de pertenencia de los objetos importan tanto como las de los personajes. “Belongs only to” es lo que impide que una herramienta se teletransporte entre dos personas de un corte a otro.

Paso 3: escribe un perfil para los sujetos importantes

Cuando un personaje se apoya en varios materiales a lo largo de varias escenas, reúnelos en un solo bloque en vez de dejarlos dispersos:

[Subject Profile: Mechanic]
Appearance and clothing: @Image 1.
Fixed prop: <Truing Stand> from @Image 3.
Locations: <Workshop> and <Courtyard>.
Motion references: the spoke-tightening motion from @Video 1 and the wheel-lifting motion from @Video 2.
Do not use: the apprentice's clothing. Do not give this character <Parts Tray>.

Paso 4: selecciona las referencias por escena

Por último, dile al modelo qué subconjunto de materiales usa cada escena y cómo debería verse la escena cuando termina:

Scene 1 | Truing the wheel in the workshop
Use: <Mechanic>, <Truing Stand>, <Workshop>, and the spoke-tightening motion from @Video 1.
Event: <Mechanic> spins the wheel in <Truing Stand> and tightens one spoke.
End state: <Mechanic> stands on the inner side of the bench. <Truing Stand> stays at the left of the frame.

Scene 2 | Handoff in the courtyard
Use: <Apprentice>, <Parts Tray>, and <Courtyard>.
Event: <Apprentice> carries <Parts Tray> to the courtyard bench and sets it down.
End state: <Parts Tray> rests on the bench. No other character enters the courtyard.

La selección a nivel de escena es lo que convierte un montón de referencias en una lista de planos. Cada material que no nombras en una escena es un material que el modelo sabe que debe dejar fuera.

Sintaxis especial para audio y texto

Los prompts se pueden escribir enteramente en lenguaje natural, pero cuando necesitas mantener separados la música, los efectos de sonido, el diálogo y los subtítulos, Seedance 2.5 reconoce cuatro tipos de corchetes:

ContenidoSintaxisEjemplo
Música()(Soft, rhythmic piano music plays in the background)
Efectos de sonido<><A bell rings in the distance>
Diálogo{}{Hello, welcome back.}
Subtítulos【】【Chapter One: Departure】

Cuando el diálogo no está en chino, nombra el idioma antes de la línea; por ejemplo, The girl says softly in Japanese: {もう大丈夫です}. Si el texto escrito está en inglés pero el modelo lo dice en otro idioma, o si necesitas una variedad regional específica, usa esta fórmula:

Idioma del diálogo + variedad regional o acento + estilo de entrega + hablante + {dialogue}

Dialogue language: American English. The girl says in natural, conversational American English: {I thought you weren't coming.}

Dialogue language: authentic Los Angeles English. The young man says in natural Los Angeles vernacular: {No way, you actually made it.}

No repitas lo que una referencia ya define

Un hábito común de sobreescritura: subir un video de referencia de movimiento y después volver a describir ese mismo movimiento en prosa. Cuando un video de referencia ya define el movimiento, el trabajo de cámara y la secuencia con precisión, declara únicamente qué atributos heredar. Repetir la descripción del movimiento puede entrar en conflicto con la propia referencia, y el modelo tiene que reconciliar dos versiones de una misma instrucción.

La excepción es un video de blockout. Un blockout aporta sobre todo movimiento y estructura espacial —trayectorias, puesta en escena, movimiento de cámara, cortes—, así que el prompt todavía tiene que definir los sujetos, la escena, la acción y el estilo visual buscados. Hereda los tiempos del video; aporta el mundo desde las imágenes y el texto. Si las referencias de blockout son tu flujo principal, la guía de guiones gráficos y blockouts de Seedance 2.5 profundiza en los blockouts gruesos frente a los finos.

Revisa la lista de verificación antes de enviar

Antes de presionar generar, lee tu prompt contra estas preguntas:

  • ¿El prompt declara con claridad el sujeto y la acción o el evento principal?
  • ¿Cada entrada de referencia declara qué usar y qué no usar?
  • ¿Cada personaje, producto y objeto distinto está nombrado y atado a una referencia?
  • ¿Las referencias se seleccionan por escena en lugar de exigir que aparezcan todas a la vez?
  • ¿La cantidad de personajes, la ropa, la pertenencia de los objetos y las relaciones espaciales se mantienen consistentes?
  • ¿Las emociones abstractas y los términos de cinematografía van acompañados de señales visibles o audibles?

Advertencia

Escribir prompts con referencias aumenta la probabilidad de un resultado fiel; no la garantiza. Para subtítulos, fórmulas, señalización, especificaciones de producto o tiempos exactos a nivel de cuadro, combina entradas de referencia preparadas, generación y posproducción.

Cómo empezar en OmniArt

Abre el espacio de creación de video de OmniArt, elige Seedance 2.5 y arma tu primer prompt con varias referencias en este orden:

  1. Sube solo los materiales que aporten información que ningún otro material aporte.
  2. Escribe una línea de mapeo por sujeto: nombre, material y qué usar de él.
  3. Agrega una exclusión en cada línea donde un fondo, una persona o una composición puedan filtrarse.
  4. Agrupa los mapeos bajo [Characters], [Props], [Scenes] y [Motion and Audio].
  5. Escribe un perfil de sujeto para cualquier personaje que abarque varias escenas.
  6. Enumera cada escena con su subconjunto de materiales, su evento y su estado final.
  7. Genera dos veces con el mismo prompt y luego corrige los mapeos —no los adjetivos— allí donde las dos corridas no coincidan.

Para saber qué cambió en este lanzamiento y dónde encajan los modos nuevos, lee qué trajo Seedance 2.5. Para llevar la misma disciplina de referencias a piezas más largas, sigue con prompts para videos de 30 segundos con Seedance 2.5, y para un control de identidad que se sostenga a lo largo de un proyecto entero, revisa nuestra guía sobre personajes consistentes en video con IA.

¿Todo listo para crear?

Empieza a generar contenido increíble con IA

Empezar gratis