industryModelos e insights14 min de lectura

Seedance 2.5: qué se ha lanzado y qué cambia respecto a la 2.0

Seedance 2.5 ya está en OmniArt: generaciones de 30 segundos, extensiones de 60, vídeo largo de 180, 50 referencias y marcas de tiempo al segundo.

Equipo OmniArt
Seedance 2.5: qué se ha lanzado y qué cambia respecto a la 2.0

Seedance 2.5 ya se puede seleccionar en el espacio de vídeo de OmniArt, y es un lanzamiento más grande de lo que sugiere el número de versión. Seedance 2.0 fijó la premisa multimodal: imagen, vídeo, audio y texto alimentando un único prompt. Seedance 2.5 mantiene esa premisa y reconstruye las dos cosas que la limitaban en la práctica: cuánto puede durar una generación y cuánto material de referencia respeta de verdad el modelo.

Esto es un repaso de capacidades, no un tutorial de prompts: qué hay de nuevo, cuáles son los techos reales y dónde el lanzamiento sigue teniendo aristas. Cubríamos el anuncio antes a partir de información previa al lanzamiento en la vista previa de Seedance 2.5; varias de esas cifras se movieron cuando el modelo salió, y las resoluciones de abajo son las que cuentan.

Nota

Todas las especificaciones siguientes proceden de la documentación oficial de lanzamiento y uso de Dreamina Seedance 2.5. Donde esa documentación distingue un límite duro de un rango recomendado, este artículo también lo hace: esa distinción importa más que el número de titular.

Seedance 2.5 frente a Seedance 2.0 de un vistazo

CapacidadSeedance 2.0Seedance 2.5
Duración de una sola generación4–15 segundos (97–361 fotogramas)4–30 segundos (97–721 fotogramas)
Imágenes por petición0–9Hasta 30
Extensión de vídeoNo disponibleExtiende cualquier resultado de 30 segundos o menos, de forma repetida, hasta 60 segundos en total
Vídeo largoNo disponibleGeneración en un solo pase de 30–180 segundos
Control por marcas de tiempoNo disponibleNativo, preciso al segundo
Modos de generaciónOmni Reference, Smart Edit, Long Video, First and Last Frames
Resolución de salida480p, 720p

Dos de los cuatro modos son nuevos. Smart Edit y Long Video no existían en la 2.0. Smart Edit también tiene una superficie mejorada llamada Edit with marks, que te permite anotar un vídeo subido con cajas, pinceles, flechas, texto y puntos de referencia, más una variante Edit Video que aplica el mismo flujo de anotación a clips después de generados.

Tres formas distintas de superar los 15 segundos

El cambio más importante es que «cuánto puede durar» tiene ahora tres respuestas distintas, y elegir la incorrecta desperdicia una generación.

Generación única: de 4 a 30 segundos

El rango base se duplica. Un prompt compra ahora hasta 30 segundos, o 721 fotogramas, frente a 15 segundos y 361 fotogramas en la 2.0. La documentación afirma que la consistencia espacio-temporal y de corte a corte se mantiene en toda esa ventana de 30 segundos: la apariencia del personaje, la lógica espacial y las transiciones entre planos deben sobrevivir a la duración más larga en lugar de derivar en la segunda mitad.

Extensión de vídeo: muñecas rusas hasta 60 segundos

Cualquier resultado de 30 segundos o menos se puede extender con un prompt nuevo, y el resultado de esa extensión se puede extender otra vez. La documentación llama a esto apilamiento en muñeca rusa, y el techo acumulado es de 60 segundos.

Lo interesante no es el total. Es que cada nodo de extensión acepta una dirección nueva: la documentación lo llama control de dirección segmentado. Puedes generar diez segundos de un personaje corriendo, confirmarlo y luego indicar el salto en la siguiente extensión en lugar de apostar toda la acción en un solo envío. Para coreografías de pelea o un giro de trama que quieras clavar en un beat concreto, es un método de trabajo distinto a escribir un prompt más largo.

Las extensiones van hacia delante o hacia atrás, y la documentación recomienda restricciones de continuidad explícitas para la extensión de plano completo: extensión natural, conexión suave del movimiento, sin corte rígido del plano, sin objetos que aparezcan de la nada. Desglosamos ese flujo en la guía de edición y extensión de Seedance 2.5.

Long Video: de 30 a 180 segundos en un solo pase

Long Video es un modo aparte, no un ajuste más largo del estándar. Genera de 30 a 180 segundos de forma directa, sin uniones ni cadena de extensiones. Los objetivos de diseño declarados son la consistencia a largo plazo de rasgos del personaje, detalle de vestuario y arquitectura de la escena a lo largo de los tres minutos completos, más movimientos de cámara extendidos y fluidos: empujes lentos, órbitas y planos que atraviesan el espacio y se sostienen en una toma larga.

Como una generación de tres minutos es cara de fallar, la fórmula de prompt de vídeo largo de la documentación abre con parámetros globales: reafirma la duración y la relación de aspecto al inicio del prompt aunque ya las hayas fijado en la interfaz.

El presupuesto de referencias: 50 materiales, y cómo gastarlos

Seedance 2.5 acepta hasta 50 materiales de referencia en una sola petición. Ese techo se reparte en tres tipos, y cada tipo tiene un límite duro y un rango recomendado aparte.

TipoLímite duroRango recomendado
ImágenesHasta 30, cada una de 4K o menos1–8 sujetos distintos; 9–12 es posible, pero baja la estabilidad
VídeosHasta 10, 30 segundos combinados1–5 sujetos distintos, 5–10 segundos por vídeo de sujeto; 6–10 sujetos es posible, pero baja la estabilidad
AudioHasta 10, 30 segundos combinadosSolo el diálogo, la voz, el ambiente o la música que el plano necesita de verdad
Edición de vídeoUn vídeo fuente más imágenes de referenciaVídeo fuente de menos de 20 segundos, 1–5 imágenes de referencia; 6–8 es posible

La brecha entre las dos columnas es toda la historia. Treinta imágenes es lo que acepta la petición; ocho sujetos es lo que el modelo maneja con fiabilidad. Llenar el presupuesto no es una estrategia: la documentación es explícita en que la creación con varias referencias consiste en seleccionar los materiales correctos por escena, no en hacer que todos aparezcan a la vez.

Una regla práctica que conviene interiorizar: si más de cinco sujetos también necesitan varios ángulos de visión, pon cada vista en su propia imagen. Las imágenes independientes por vista son más estables que una sola hoja collage.

En higiene de entrada, las imágenes pueden ser jpeg, png, webp, bmp, tiff, gif, heic o heif, con una relación de aspecto entre 0,4 y 2,5, dimensiones entre 300 y 6000 px, menos de 30 MB cada una, y un cuerpo de petición de menos de 64 MB. Los vídeos de referencia admiten mp4 o mov a 480p–4K dentro de los mismos límites de ratio y dimensiones.

Para el orden y la asignación de roles de los packs de referencia, consulta la guía de prompts con referencias de Seedance 2.5.

Control por marcas de tiempo, al segundo

Seedance 2.5 admite de forma nativa el control de intervalos de trama y de plano por marca de tiempo. Escribes un marcador como [00.0-05] delante del plano, el diálogo o la acción, y luego guionizas el resto en orden cronológico. Los rangos deben ser consecutivos y sin solaparse.

El encuadre honesto de la documentación: un rango de tiempo es el presupuesto temporal de un evento, no un punto de edición a nivel de fotograma. Las acciones pueden aterrizar un poco antes o después de un límite. Muy poco contenido en un rango da al modelo libertad que quizá no quieras; demasiado provoca cortes excesivos o eventos caídos. Exigir una frecuencia como tres acciones distintas en un segundo no funciona.

Usado bien, sigue siendo la palanca más grande sobre el ritmo. Es lo que hace que una generación multiplano de 30 segundos se comporte como un guion en lugar de un montaje, y es la columna vertebral del enfoque de la guía de prompts de 30 segundos de Seedance.

Entrada y diálogo multilingüe

Seedance 2.5 acepta texto de entrada en muchos idiomas, con dos niveles documentados. La máxima prioridad de optimización cubre chino, inglés, español, indonesio y malayo. La cobertura completa se extiende a tailandés, árabe, portugués, vietnamita, japonés y coreano.

El lanzamiento también apunta a precisión de pronunciación, menos lecturas erróneas de palabras raras y mejor sincronización labial frente al habla multilingüe. Para quien produce variantes localizadas de anuncios o un cortometraje en el que los personajes hablan idiomas distintos, esa combinación —brief en tu idioma, diálogo en el idioma de destino, formas de boca que siguen— es el desbloqueo práctico.

Trabajo de calidad en el modelo base

No todo en la 2.5 es un botón nuevo. Una parte significativa del lanzamiento es la reconstrucción del modelo base orientada a lo que la documentación llama eliminar el sabor a IA:

  • Piel — se reduce el brillo plástico y los reflejos grasientos; se restauran poros reales y respuesta a la luz.
  • Pelo animal — más esponjoso y separado en lugar de apelmazado.
  • Voz — menos timbre mecánico de síntesis de voz en el diálogo generado.
  • Movimiento de cola larga — danzas poco habituales, artes marciales complejas y cambios sutiles de expresión se generan con fluidez en lugar de distorsionarse.
  • Consistencia — la lógica espacio-temporal y la continuidad del personaje de corte a corte se sostienen en una generación completa de 30 segundos.

Los asideros del lado del prompt son pequeños y concretos: frases como textura de piel nativa y raíces del pelo definidas para el realismo, y descripciones estables del personaje repetidas en cada plano para mantener la consistencia a través de los cortes.

Sin subtítulos, sin BGM: ahora sí se respeta

Es un arreglo pequeño con un efecto desproporcionado en el trabajo de producción. Las versiones anteriores quemaban subtítulos o añadían música de fondo aunque el prompt dijera que no. Seedance 2.5 respeta esas instrucciones, y la formulación documentada es un modificador del tipo «vídeo puro, sin subtítulos, sin música de fondo».

Si entregas placas limpias a un editor o a un diseñador de sonido, es la diferencia entre una salida usable y una que tienes que regenerar.

Las mejoras multimodales de referencia

El bloque más grande de las notas del lanzamiento es un grupo de capacidades del lado de las referencias. En conjunto empujan a Seedance de un generador hacia algo más cercano a una superficie de edición dirigida:

  • Separación de BGM — quita la música de fondo y conserva la voz que habla y, de forma notable, preserva los subtítulos en pantalla y otros elementos visuales intactos.
  • Transferencia de idea y lenguaje de cámara — migra la trayectoria de empuje/tirón/paneo de una referencia, la trepidación a mano, la lógica de color y la atmósfera emocional, no solo el movimiento superficial del cuerpo.
  • Eliminación y edición parcial — pinta o encierra una región para un borrado sin rastro, con fondo reconstruido según la lógica física y de iluminación, más sustitución direccional de elementos.
  • Modificación de la perspectiva espacial — reencuadra un plano existente a cenital, contrapicado o primera persona manteniendo proporciones y composición coherentes.
  • Referencia de tono — reproduce el timbre más la tensión emocional y el ritmo de una grabación de referencia.
  • Referencia multi-persona — sin mezcla de rasgos faciales entre personajes, sin intercambio de ropa, oclusión física correcta durante la interacción.
  • Croma — segmentación de primer plano de alta precisión con estabilidad a nivel de fotograma frente a fondos dinámicos.
  • Clay Renderer — un plugin de blockout y modelo blanco para Maya y Blender que restaura el lenguaje de cámara, bloquea espacio y composición, y controla la posición del personaje y la trayectoria de movimiento.
  • Transición sin costuras — genera el contenido puente entre dos clips independientes sin modificar ninguna de las fuentes, con transiciones de distancia focal, rotación o inmersión disparadas por acción, mirada u oclusión.
  • Storyboard multi-rejilla — alimenta una imagen de storyboard multipanel como referencia de trama.

Dos de estas vienen con notas de uso que conviene repetir. Clay Renderer produce hoy mejores resultados a partir de blockouts toscos —esferas, cilindros y cubos simples que dan un esqueleto dinámico— que a partir de modelos finos y completamente modelados. Los storyboards multi-rejilla funcionan mejor como línea limpia o monigotes, idealmente no más de 15 paneles, con etiquetas de texto al mínimo. Ambos se cubren en la guía de storyboards y blockouts de Seedance 2.5.

Parámetros que se bloquean solos

Tres tipos de tarea anulan ajustes que podrías esperar controlar. Saberlo antes de enviar evita una generación desperdiciada.

Tipo de tareaRelación de aspectoDuración
Edición de vídeoConserva la ratio del vídeo de entrada; no se puede fijar por separadoConserva aproximadamente la duración de entrada; no se puede fijar por separado, y el procesado de fotogramas de entrada puede desplazarla hasta unos 0,3 segundos
Primer fotograma / primer y último fotogramaUsa la ratio de la primera imagenSe puede fijar
Extensión de vídeoConserva la ratio del vídeo de entrada; no se puede fijar por separadoSe puede fijar

La regla del primer y último fotograma tiene una trampa: como la ratio viene de la primera imagen, una última imagen con ratio distinta se estirará. Iguala las dos antes de subirlas.

Restricciones que conviene planificar

La resolución de salida es 480p y 720p. Ese es el techo enviado, y es la restricción más probable de afectar a una decisión de entrega: una generación de tres minutos a 720p es un activo muy distinto de un master de tres minutos. Planifica Seedance 2.5 para previz, entrega social y material de referencia en consecuencia, y revisa tu especificación de entrega antes de comprometer una generación larga.

La documentación también es sincera sobre varios límites de comportamiento:

  • Las marcas de tiempo asignan tiempo a eventos; no son puntos de edición a nivel de fotograma.
  • Los prompts de edición elevan la probabilidad de que los eventos críticos se alineen con la fuente. No pueden garantizar solapamiento fotograma a fotograma.
  • La salida de edición de vídeo puede diferir de la entrada en hasta unos 0,3 segundos.
  • Los segmentos extendidos pueden diferir ligeramente en volumen respecto al clip fuente.
  • Las transiciones sin costuras buscan continuidad visual y de audio, no un empalme idéntico a nivel de píxel.
  • Los fotogramas de frontera en una extensión se conectan de forma natural a nivel visual, pero no son idénticos a nivel de píxel.
  • Para subtítulos, fórmulas, señalética, especificaciones de producto o timing a nivel de fotograma que deba ser exacto, combina material de referencia preparado, generación y postproducción.

Ninguno de estos descalifica. Son la diferencia entre tratar Seedance 2.5 como un generador dirigido dentro de un pipeline y tratarlo como una herramienta de acabado, que no lo es.

Empezar en OmniArt

Abre el espacio de vídeo de OmniArt y selecciona Seedance 2.5; luego trabaja el lanzamiento en el orden que de verdad construye habilidad:

  1. Empieza con una generación de 30 segundos con marcas de tiempo. Escribe tres o cuatro rangos consecutivos y sin solaparse y observa con qué precisión aterriza el ritmo. Esto te enseña el comportamiento temporal del modelo más rápido que cualquier otra cosa.
  2. Luego prueba la extensión. Genera diez segundos con los que estés contento, extiéndelos con una instrucción nueva y vuelve a extender ese resultado. Observa la costura y el volumen en cada frontera.
  3. Monta un pack de referencias dentro del rango recomendado, no del límite duro: un puñado de imágenes de sujeto con un trabajo claro cada una, y un vídeo de referencia corto si necesitas lenguaje de cámara.
  4. Reserva Long Video para briefs que ya hayas validado a duraciones más cortas. Tres minutos es mucho para apostar a un prompt no probado.
  5. Añade «vídeo puro, sin subtítulos, sin música de fondo» a todo lo que vaya a un editor.

Para la filosofía de prompting de base que aplica a todas las versiones de Seedance, empieza por cómo escribir prompts de Seedance. Luego elige la guía que encaje con tu trabajo: prompts con referencias, prompts de 30 segundos, edición y extensión o storyboards y blockouts.

¿Listo para crear?

Empieza a generar contenido increíble con IA

Empezar gratis