Seedance 2.0: patrones de prompt y seis casos de uso para video con IA
Una guía de Seedance 2.0 para quienes crean: entradas con varias referencias, audio nativo, salida hasta 4K, prompts por tomas y seis prompts probados dentro de OmniArt.

Seedance 2.0 es el modelo al que recurre quien crea cuando el brief se lee como el brief de un director. Acepta texto, hasta nueve imágenes, tres videos de referencia y tres archivos de audio en una misma solicitud, direccionables con la sintaxis @image1, @video1 y @audio1. Esta guía cubre la gramática de prompt que el modelo respeta, sus límites actuales en OmniArt y seis casos de uso probados con prompts y resultados.
Qué es Seedance 2.0
Seedance 2.0 genera clips de 4 a 15 segundos con audio nativo. Standard llega a 4K; Fast y Mini llegan a 720p. El titular sigue siendo la arquitectura de varias referencias: una sola solicitud puede combinar imágenes, videos y audio, siempre que incluya al menos una referencia visual.
| Especificación | Valor |
|---|---|
| Variantes | Standard, Fast, Mini |
| Resolución de salida | Standard: 480p / 720p / 1080p / 4K; Fast y Mini: 480p / 720p |
| Duración | 4–15 s |
| Relaciones de aspecto | 21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16 |
| Presupuesto de referencias | Hasta 12 materiales combinados; se requiere al menos una imagen o un video |
| Entradas de imagen | Hasta 9 (@image1–@image9) |
| Entradas de video | Hasta 3; cada uno de 2–15 s a 24–60 fps, 15 s en total (@video1–@video3) |
| Entradas de audio | Hasta 3; cada uno de 2–15 s, 15 s en total (@audio1–@audio3) |
| Salida de audio nativo | Sí: diálogo, efectos de sonido, ambiente, música |
| Modos de tarea | Video, Transición, Referencia, Extensión, Modificación |
| Acceso | Standard: Creator o superior; Fast y Mini: Starter o superior |
Por qué importa el sistema de varias referencias
La mayoría de los modelos de video acepta una referencia, o ninguna. Seedance 2.0 acepta un conjunto y te deja atar cada referencia a un rol dentro del prompt. Usa @image1 para el rostro del personaje, @image2 para el vestuario, @image3 para la locación, @video1 para el movimiento de cámara que quieres y @audio1 para la cama musical. La salida respeta cada una como una instrucción discreta en lugar de promediarlas hasta volverlas ruido.
Esa es la razón práctica por la que el parecido del personaje se sostiene entre tomas: la misma referencia @image entra en cada toma de la línea de tiempo, y el modelo la usa como ancla de identidad en lugar de volver a inferir el personaje desde el prompt cada vez.
Una estructura de prompt que funciona
Seedance 2.0 premia una estructura de seis partes.
- Sujeto: quién o qué está en pantalla
- Acción / movimiento: qué hace
- Escenario / entorno: dónde ocurre
- Estilo visual: referencias de cine, paleta, época
- Dirección de cámara: términos de fotografía específicos
- Iluminación: dirección, calidad, hora del día
Una buena plantilla de prompt:
"Subject (with
@image1reference if applicable). Action. Setting. Visual style. Camera direction (specific cinematography term). Lighting detail."
Notación de línea de tiempo para multi-shot
Seedance 2.0 responde al orden de las tomas, no a marcas de tiempo al segundo. Usa tomas numeradas y describe cada beat en secuencia.
Shot 1: wide establishing shot, character (in @image1) walks into the scene
Shot 2: medium tracking shot follows them across the room
Shot 3: 360-degree orbit around the table they reach
Fija el mismo @image1 en todos los segmentos. El parecido se mantiene consistente a través del corte.
Nota
Seedance 2.5 agrega control por marcas de tiempo en segundos enteros. No copies una plantilla de marcas de tiempo de 2.5 dentro de una solicitud a 2.0 esperando que los rangos gobiernen el tiempo; conserva la estructura de tomas numeradas que se muestra arriba.
Disciplina al etiquetar referencias
Un reglamento corto que rinde:
- Usa
@image1,@image2para fotos de rostro y tomas de producto. - Usa
@video1para el movimiento de cámara que quieres copiar. - Usa
@audio1cuando la cama de audio importa más que el valor por defecto del modelo. - Menciona cada etiqueta explícitamente en el texto. No confíes en que el modelo infiera qué referencia cumple qué rol.
Seis casos de uso probados, con prompts
Cada prompt de abajo lo corrimos en Seedance 2.0. La columna de resultados es lo que obtuvimos, con el tiempo de generación medido en Standard a 720p.
1. Escena cinematográfica
"A retired detective in a long dark coat walks through a rain-soaked alley at night. Neon signs reflect red and blue on the wet cobblestones. He pauses, lights a cigarette, and glances over his shoulder. Slow push-in from wide shot to medium close-up. Film noir style, anamorphic lens flare, teal-orange color grading, film grain."
Resultado. Avance de cámara suave. Reflejos de lluvia convincentes, movimiento natural del abrigo. El encendido del cigarrillo se renderiza sin distorsión de manos. Audio ambiente de lluvia y ciudad generado en sincronía. ~70 segundos.
2. Comercial de producto
"A luxury perfume bottle rotates slowly on a black marble surface. Golden liquid catches the light as it turns. Soft particles of gold dust float in the air around it. Macro close-up, slow 360-degree orbit camera. Studio lighting with warm rim light, high-end commercial photography style."
Resultado. Refracción del vidrio y comportamiento del líquido precisos. Deriva de partículas natural. Rotación completa suave, ángulos de luz correctos, textura del mármol visible. ~65 segundos.
3. Video musical
"A female singer in a flowing red silk dress performs on a rooftop at sunset. City skyline stretches behind her. Wind blows her hair and dress dramatically. She sings with emotional intensity, arms spread wide. Dynamic tracking shot circling around her. Golden hour backlighting, lens flare, vibrant warm tones."
Resultado. Física del vestido realista. Órbita de seguimiento fluida. El rostro se mantiene consistente durante la rotación. El movimiento del cabello coincide con la dirección del viento. Generó una pista musical ambiental. ~75 segundos.
4. Retrato de personaje en movimiento
"An elderly Japanese craftsman in a traditional wooden workshop, morning light streaming through paper screens. He slowly lifts a hand-forged ceramic tea bowl, examining it with quiet pride. His weathered hands rotate the bowl gently. Close-up of his hands, then slow tilt up to reveal his face. Wabi-sabi aesthetic, warm natural light, documentary portrait quality."
Resultado. Cantidad de dedos correcta. Movimiento articular natural. Tilt suave de las manos al rostro. Luz realista a través de los paneles de papel. Sonidos ambientales tenues del taller. Textura de piel realista. ~80 segundos.
5. Naturaleza y paisaje
"Aerial drone shot gliding over a misty mountain valley at sunrise. Layers of fog roll between emerald green peaks. A winding river reflects the golden morning light below. Eagles soar through the frame at eye level. Smooth forward tracking with slight descent. Epic landscape, volumetric fog, golden hour lighting."
Resultado. Las capas independientes de niebla crean una profundidad convincente. Los reflejos del río se actualizan con la posición de la cámara. Buen equilibrio de paleta. La niebla volumétrica renderiza limpia. Audio de viento y llamados de aves. ~55 segundos: el más rápido de los seis.
6. Anime y fantasía
"An anime warrior princess stands atop a cliff overlooking a burning medieval city at night. Her long silver hair and crimson cape billow in the wind. She draws a glowing blue katana, electricity crackling along the blade. Cherry blossom petals swirl around her. Dynamic low-angle shot with slow push-in. Cel-shading style, vibrant neon accents, dramatic speed lines."
Resultado. Cel-shading consistente de punta a punta. Desenvaine de katana fluido. El efecto eléctrico se integra con naturalidad. Pétalos de cerezo con movimiento independiente. Interacción de la luz del fuego con la capa. Audio dramático del silbido de la espada. ~70 segundos.
Errores comunes y cómo arreglarlos
| Problema | Causa | Arreglo |
|---|---|---|
| El prompt es rechazado | Palabras sobre rostros o frases ambiguas | Quita las descripciones explícitas de rostro; usa referencias @image en su lugar |
| Fotogramas en negro | Prompt demasiado complejo | Reduce a una acción cada 4 o 5 segundos; baja la resolución para la prueba |
| El rostro del personaje cambia entre tomas | No hay una referencia consistente | Fija el mismo @image1 en cada toma de la línea de tiempo |
| Audio fuera de sincronía | Desajuste en la difusión conjunta | Vuelve a generar con el audio desactivado y agrega la cama por separado |
| Distorsión de manos o dedos | Interacción compleja de manos sin referencia | Agrega una imagen de referencia con la pose de mano deseada |
| Textura de "generado con IA" | Exceso de palabras de estilo | Agrega detalles físicos: materiales, iluminación, tipo de lente |
Seedance 2.0 vs Seedance 1.0
Si usaste 1.0, la distancia hasta 2.0 es mayor de lo que sugiere el número de versión.
| Función | 1.0 | 2.0 |
|---|---|---|
| Arquitectura | Pipelines separados | Transformer de difusión unificado |
| Entrada de imagen | 1 opcional | hasta 9, direccionables por @tag |
| Entrada de video | Ninguna | hasta 3 |
| Entrada de audio | Ninguna | hasta 3 |
| Salida de audio nativo | No | Sí |
| Resolución máxima | 1080p | Hasta 4K en Standard |
| Duración | 5–10 s | 4–15 s |
| Multi-shot | Básico | Storyboard en línea de tiempo con consistencia entre tomas |
| Calidad de manos | Artefactos frecuentes | Notablemente mejorada |
| Edición dentro del video | No | Sí: cambio de personaje u objeto |
Cuándo elegir otra cosa
Seedance 2.0 no es la herramienta correcta para todos los briefs.
| Necesidad | Mejor punto de partida en el espacio actual |
|---|---|
| Borradores de Seedance al menor costo con audio nativo | Seedance 2.0 Mini |
| Un segundo flujo cargado de referencias con salida 2K | MiniMax H3 |
| Salida 4K con audio nativo opcional | Veo 3.1 Standard o Fast |
| Texto a video corto sin audio generado | Sora 2 |
| Iteración general de bajo costo en muchas relaciones de aspecto | V6 |
Precios en OmniArt
Seedance 2.0 se cobra por segundo de salida dentro del espacio de video de OmniArt. A 720p, Standard cuesta 14 créditos por segundo, Fast cuesta 11 y Mini cuesta 8. Un clip de cinco segundos cuesta entonces 70, 55 o 40 créditos respectivamente. Standard requiere Creator o Ultra; Fast y Mini requieren Starter o superior. Ultra hoy incluye generación de recursos sin consumo de créditos en lugar de un descuento porcentual.
Advertencia
Los permisos de uso comercial dependen de las condiciones de la ruta y de la cuenta con la que se generó el recurso. Revisa las condiciones vigentes de la plataforma antes de una entrega de alto riesgo.
Cómo empezar en OmniArt
Seedance 2.0 Standard, Fast y Mini están dentro del espacio de video de OmniArt junto a MiniMax H3, Gemini Omni, Happy Horse, Kling, Grok Imagine, Veo 3.1, Sora 2, V6 y otros modelos de video actuales. Comparten el mismo saldo y el mismo historial de creaciones, mientras cada modelo conserva sus propios parámetros admitidos y sus límites de referencias.
Empieza con el prompt de la escena cinematográfica de arriba para tomarle el pulso al flujo con varias referencias, y después pasa al brief del video musical cuando quieras probar la consistencia del rostro en movimiento.
Si estás eligiendo entre Seedance 2.0 y HappyHorse 1.0, la comparación entre HappyHorse 1 y Seedance 2 recorre las concesiones toma por toma. Para el flujo de la siguiente generación, continúa con qué cambió en Seedance 2.5 y elige desde ahí la guía de prompts específica para tu tarea.
¿Todo listo para crear?
Empieza a generar contenido increíble con IA