Cómo escribir prompts para Seedance: el método Vibe Creating
Aprende a escribir prompts de Seedance con un núcleo creativo de cuatro capas y un brief de producción de siete partes: sujeto, acción, entorno, cámara, sonido y referencias.

La mayoría escribe prompts de Seedance como si escribiera un reporte de cámara: distancias focales, movimientos de grúa, números de plano, temperaturas de color. Se siente preciso, pero suele producir video rígido y sobrecontrolado. El equipo de Seedance viene promoviendo un enfoque distinto que llama Vibe Creating, y la idea central es contraintuitiva: un modelo capaz necesita que expreses la intención, no que microgestiones la ejecución.
Esta guía desarma el método Vibe Creating en algo que puedes aplicar en tu próxima generación. Vas a ver el núcleo creativo de cuatro capas, cómo ampliarlo a un brief de producción de siete partes, qué lenguaje de cámara cortar y cuál conservar, y dónde el control preciso sigue ganando. Seedance 2.0 (standard y fast) está disponible en OmniArt junto con otros modelos de video, así que puedes probar cada idea de aquí mientras lees.
Nota
Los clips de ejemplo de este artículo vienen del manual de práctica de “Vibe Creating” de Seedance, de ByteDance. Están aquí para ilustrar el método de prompts: los mismos principios se transfieren a los modelos de video dirigido disponibles en OmniArt, no solo a Seedance.
Qué significa realmente Vibe Creating
Vibe Creating es un cambio en quién hace qué. La vieja costumbre trata al modelo como un renderizador tonto al que hay que deletrearle cada parámetro. Vibe Creating lo trata como un colaborador capaz: le entregas la sensación y la intención, y dejas que resuelva los detalles visuales.
Eso no significa escribir menos porque sí, ni escribir prompts vagos. Un prompt como "freedom" o "a premium feeling" no le da al modelo nada de dónde agarrarse. La meta es cortar el ruido técnico de bajo valor y conservar —o agregar— la información que de verdad sostiene un plano: a quién o qué estamos mirando, qué está pasando y cómo debería sentirse.
La estructura de prompt en cuatro capas
La columna vertebral de un buen prompt de Seedance son cuatro capas de información. Cuando una generación sale pobre o genérica, casi siempre es porque falta una de ellas.
| Capa | Qué es | Ejemplo |
|---|---|---|
| Ancla visual | El sujeto o elemento más importante, uno solo | "An elder in a worn cotton coat"; "a neon-lit street in the rain" |
| Acción o estado | Qué hace, o el estado en el que está; elige uno | "slowly turns toward the camera"; "rain streaking down the glass" |
| Tonalidad local | La sensación de este plano, en una o dos palabras | "warm amber backlight"; "a slight handheld sway" |
| Tema del video | El caso de uso más el estilo visual de la pieza | "a short film about parting"; "a cyberpunk game cinematic" |
No hace falta interrogarte con las cuatro cada vez. Piénsalo como una lista de verificación de por qué un plano se siente plano: casi siempre falta el ancla visual o la acción, y agregar solo esa capa lo arregla.
Esta es la diferencia en la práctica. Los dos prompts de abajo describen la misma idea —una persona en un vagón de metro inundado con una ballena afuera—, pero el segundo completa las cuatro capas en vez de solo nombrar la escena.
Prompt normal: "A person stands in a subway car flooded with seawater, a whale swims past the window outside, quiet and suffocating."
Vibe Creating: "Inside a subway car half-sunk in seawater, a person stands quietly. The interior is steeped in deep blue underwater light; handrails, seats, and windows are soaked in a cold, damp stillness. Outside, the world has become the deep ocean, and a giant whale glides slowly past the window, its vast body dimming the carriage as it passes."
Prompt normal
Vibe creating
Los dos son prompts válidos. Pero el segundo le da al modelo la tonalidad (luz azul profunda, quietud fría) y una acción clara (la ballena deslizándose al pasar), así que el resultado carga con la sensación que el creador buscaba de verdad.
Amplía las cuatro capas a un brief de producción de siete partes
Las cuatro capas son el núcleo creativo: definen de qué trata el plano y cómo debería sentirse. Para entregarlo a producción, amplía ese núcleo con los siete campos prácticos que describe la guía de producción de PixVerse de julio de 2026: sujeto, acción, entorno, dirección visual, dirección de cámara, sonido y referencias. No es una fórmula rival. Es una forma de volver explícita la misma intención cuando el prompt además necesita materiales, audio y criterios de revisión.
| Campo de producción | Cómo se corresponde con Vibe Creating | Qué escribir |
|---|---|---|
| Sujeto | Ancla visual | La única persona, producto, criatura u objeto que el espectador debe reconocer |
| Acción | Acción o estado | El cambio principal durante el clip, idealmente como un solo arco de acción |
| Entorno | Ancla visual más tonalidad local | El lugar, la hora, el clima y la luz que afectan materialmente al plano |
| Dirección visual | Tonalidad local más tema del video | El tono emocional, los materiales, la paleta y el estilo que pide la pieza |
| Dirección de cámara | Experiencia del espectador | El encuadre o el movimiento que sirve a la historia, dicho de forma simple |
| Sonido | Restricción dura | El diálogo exacto, el ambiente, la música, el silencio o los efectos que importan |
| Referencias | Evidencia para el brief | Solo las imágenes, clips, señales de audio o cuadros de estilo que protegen el resultado |
Empieza por la frase de cuatro capas y después usa los siete campos como chequeo de huecos. Si el entorno no aporta nada, déjalo corto. Si no hay un sonido ni una referencia importante, no los inventes solo para completar la lista. Un prompt más largo no es automáticamente un prompt mejor.
Por ejemplo, la revelación de un producto puede conservar el núcleo de Vibe Creating y a la vez volver explícitas las entradas de producción:
A translucent skincare bottle stands on a pale stone pedestal in a sunlit studio. Condensation gathers on the glass as the camera moves closer, then gently circles the bottle. The mood is quiet, refined, and tactile. Preserve the supplied label exactly, use the product image as the identity reference, and keep only soft room ambience.
Ese brief contiene los siete campos, pero igual se lee como una experiencia dirigida y no como una pila de ajustes de lente. Cuando un modelo o un flujo acepta referencias multimodales, empieza con un conjunto chico y coherente —por ejemplo, una imagen de producto, un cuadro de estilo y una señal de entorno— y agrega un recurso solo si una prueba controlada mejora la exactitud o la continuidad.
Confía en el modelo: dale la cantidad correcta de información
El error más común es el exceso de control: apilar parámetros creyendo que más instrucciones significan más fidelidad. En la práctica, dejarle espacio al modelo produce un movimiento más fluido, transiciones más naturales y un resultado más cinematográfico.
Compara estas dos versiones de la misma idea: un niño de plastilina que da un mal paso y cae por un túnel surrealista de mundos. El primer prompt fija estilo, color, lente y señales de música. El segundo describe la experiencia y deja que el modelo la dirija.
Prompt normal: "Visual style: claymation stop-motion aesthetic. Real-world street: cold gray, muted tonality. Falling scene: frantic flickering, everything-everywhere color bursts. Destination lawn: bright sunlight, calm retro tonality. Distortion-lens shots, 85mm, dolly move. BGM: minimalist piano scale intro, experimental synth build."
Vibe Creating: "On a dull afternoon street, a claymation boy with a bulging backpack walks head-down, absorbed in kicking a pebble. Without warning he missteps into an open, pitch-dark manhole. As he plunges — wind roaring, weightless, terror on his face — cyberpunk neon signs, glowing deep-sea jellyfish, distant planets, and weightless nebulae flicker past in a frantic blur. At the instant before it all spins out of control, the noise and the falling vanish in a single beat."
Prompt normal
Vibe creating
Una historia más rica no es lo mismo que una pila de instrucciones más larga. El próximo ejemplo muestra que sí puedes conservar la intención de cámara, siempre que sirva a la historia en vez de dictar equipo.
Prompt normal: "Shot 1: 85mm f1.4 prime, contrast +10, vignette +15. Shot 2: tracking move at 0.7x. Shot 3: medium shot, subject left of center, color temp 4200K. An old watch-repair stall; an elder in reading glasses winds the crown of a pocket watch; a kid in a school uniform runs up holding candied haws; the elder hands him a fixed cartoon watch."
Vibe Creating: "At a watch-repair stall in an old alley, an elder in reading glasses bends over a worn pocket watch. The camera starts slightly high and close, watching his focused hands. A grandchild runs in holding candied haws, and the camera follows the child's light, quick steps. The elder looks up, smiles, and hands over the cartoon watch he just fixed. A medium shot settles on the bond between them — warm, nostalgic, with the lived-in intimacy of an old alley."
Prompt normal
Vibe creating
Lenguaje de cámara: qué cortar y qué conservar
El lenguaje de cámara no es todo malo. El truco es separar las instrucciones que le dicen al sistema cómo filmar de la intención que le dice al espectador cómo sentir.
Corta esto: es control técnico de bajo valor que encajona al modelo.
- Distancias focales y valores en milímetros
- Jerga de posición de cámara y de grúas, cámaras A/B, cobertura
- Parámetros de movimiento y multiplicadores de velocidad
- Números de plano
- Profundidad de campo, apertura, exposición, obturador
- Directivas puras de montaje
Conserva y traduce esto: la intención de cámara que moldea la sensación y llena el campo de dirección de cámara del brief de producción.
- Convierte “slow dolly-in” en “the gaze is drawn closer, a quiet sense of pressure”
- Convierte “handheld” en “a slight, restless sway”
- Conserva todo lo que le diga al espectador qué sentir, expresado como resultado y no como ajuste
La idea no es eliminar todo el lenguaje de movimiento: es expresarlo como una experiencia que el modelo pueda interpretar, no como un número que tenga que obedecer.
Conserva tus restricciones duras
Vibe Creating reescribe los visuales, nunca las cosas que especificas de forma explícita. El diálogo, la narración, las letras, las señales de música y los efectos de sonido son restricciones duras. Si ya los escribiste, consérvalos textuales: reordena si hace falta, pero no dejes que la “optimización” del prompt los parafrasee ni los descarte.
Un patrón práctico: cuando la imagen y el sonido van mezclados en un mismo prompt, reescribe la descripción visual con libertad, pero levanta tus líneas exactas y tus señales de audio al campo de sonido y consérvalas palabra por palabra.
Cuándo no usar Vibe Creating
Vibe Creating es más fuerte en atmósfera, emoción, tono narrativo y asociación visual. Es la herramienta equivocada cuando el trabajo tiene un estándar de entrega estricto. Recurre al control preciso a nivel de parámetro cuando necesites:
- Un lip-sync exacto, palabra por palabra, en una pieza de diálogo largo
- Recorridos de funciones, demos de interfaz o video instructivo paso a paso
- Entrega industrial contra una lista de planos fija y parámetros bloqueados
En esos casos, la precisión es el punto. Usa Vibe Creating para los planos donde la sensación importa más que la especificación, y cambia de modo a propósito para el resto.
Opcional: refina un prompt de Seedance 2.5 con la skill oficial
La guía de uso de Seedance 2.5 recomienda su skill sd25-pe como una pasada opcional de refinamiento de prompts. Instálala dentro del proyecto local donde uses tu asistente de IA:
npx --yes skills@latest add \
"https://arkdocs.tos-cn-beijing.volces.com/skills/" \
--skill sd25-pe \
--yes
Después escribe /sd25-pe seguido de tu prompt borrador en la conversación con la IA. Trata el resultado como una edición para revisar, no como un reemplazo del brief: conserva el diálogo y las señales de audio exactos, verifica cada asignación de material y rechaza cualquier instrucción agregada que cambie el plano previsto.
Para Seedance 2.5, elige la guía de tarea después de esta pasada general: entradas de referencia, timing de 30 segundos, edición y extensión o storyboards, fotogramas clave y blockouts.
Cómo empezar en OmniArt
Puedes poner esto en práctica ahora mismo. Seedance 2.0 —en sus variantes standard y fast— está disponible en el espacio de creación de video de OmniArt, junto con otros modelos de video dirigido a los que puedes aplicar el mismo método.
Una forma simple de empezar:
- Escribe primero tu ancla visual y una acción: esa es la espina del plano.
- Agrega una palabra de tonalidad y un tema para que el modelo conozca el estilo y el caso de uso.
- Amplía ese núcleo al brief de siete partes: sujeto, acción, entorno, dirección visual, dirección de cámara, sonido y referencias.
- Borra los campos o detalles que no cambien el plano. Traduce la mecánica de cámara a cómo debería sentirse el movimiento.
- Conserva el diálogo, la narración y las señales de música exactamente como están escritos, y adjunta solo las referencias que protegen el resultado.
- Corre dos o tres variaciones con el mismo paquete de prompt y después puntúa sujeto, acción, cámara, sonido, continuidad y necesidad de limpieza antes de revisar.
Para el mapa completo de capacidades y las diferencias con la 2.0, lee qué cambió en Seedance 2.5. Abre el espacio, escribe cuatro capas honestas, amplía solo donde el brief de producción lo necesite y compara los resultados con un mismo estándar.
¿Todo listo para crear?
Empieza a generar contenido increíble con IA