IndustryModelos y análisis15 min de lectura

Seedance 2.5: qué salió y qué cambia respecto de la 2.0

Seedance 2.5 ya está en OmniArt: generaciones de 30 segundos, extensiones de 60, video largo de 180, 50 referencias y marcas de tiempo al segundo.

Equipo OmniArt
Seedance 2.5: qué salió y qué cambia respecto de la 2.0

Seedance 2.5 ya se puede seleccionar en el espacio de video de OmniArt, y es un lanzamiento más grande de lo que sugiere el número de versión. Seedance 2.0 estableció la premisa multimodal: imagen, video, audio y texto alimentando un mismo prompt. Seedance 2.5 conserva esa premisa y reconstruye las dos cosas que la limitaban en la práctica: cuánto puede durar una generación y cuánta entrada de referencia respeta de verdad el modelo.

Este es un repaso de capacidades, no un tutorial de prompts: qué hay de nuevo, cuáles son los techos reales y dónde el lanzamiento todavía tiene bordes ásperos. Cubrimos el anuncio antes, con información previa al lanzamiento, en la vista previa del lanzamiento de Seedance 2.5; varias de esas cifras se movieron para cuando el modelo salió, y los números de resolución de más abajo son los que cuentan.

Nota

Cada especificación de abajo viene de la documentación oficial de lanzamiento y de uso de Seedance 2.5 en Dreamina. Donde ella distingue un límite duro de un rango recomendado, este artículo hace lo mismo: esa distinción importa más que el número del titular.

Seedance 2.5 frente a Seedance 2.0, de un vistazo

CapacidadSeedance 2.0Seedance 2.5
Duración de una sola generación4–15 segundos (97–361 fotogramas)4–30 segundos (97–721 fotogramas)
Imágenes por solicitud0–9Hasta 30
Extensión de videoNo disponibleExtiende cualquier resultado de 30 segundos o menos, de forma repetida, hasta 60 segundos en total
Video largoNo disponibleGeneración en una sola pasada de 30–180 segundos
Control por marcas de tiempoNo disponibleNativo, con precisión al segundo
Modos de generaciónOmni Reference, Smart Edit, Long Video, First and Last Frames
Resolución de salida480p, 720p

Dos de los cuatro modos son nuevos. Smart Edit y Long Video no existían en la 2.0. Smart Edit además tiene una superficie mejorada llamada Edit with marks, que te deja anotar un video subido con cajas, pinceles, flechas, texto y puntos de referencia, más una variante Edit Video que aplica el mismo flujo de anotación a clips ya generados.

Tres formas distintas de pasar de los 15 segundos

El cambio más consecuente es que “cuánto puede durar” ahora tiene tres respuestas separadas, y elegir la equivocada desperdicia una generación.

Generación única: de 4 a 30 segundos

El rango base se duplica. Un prompt ahora compra hasta 30 segundos, o 721 fotogramas, contra 15 segundos y 361 fotogramas en la 2.0. La documentación afirma que la consistencia espaciotemporal y entre cortes se sostiene a lo largo de toda esa ventana de 30 segundos: la apariencia del personaje, la lógica espacial y las transiciones entre planos deberían sobrevivir a la pasada más larga en vez de desviarse en la segunda mitad.

Extensión de video: muñecas rusas hasta 60 segundos

Cualquier resultado de 30 segundos o menos se puede extender con un prompt nuevo, y el resultado de esa extensión se puede volver a extender. La documentación lo llama apilado de muñecas rusas, y el techo acumulado es de 60 segundos.

Lo interesante no es el total. Es que cada nodo de extensión acepta dirección nueva: los documentos lo llaman control de director por segmentos. Puedes generar diez segundos de un personaje corriendo, confirmarlos y recién entonces indicar el salto en la siguiente extensión, en vez de apostar toda la acción a un solo envío. Para una coreografía de pelea o un giro de trama que quieres que caiga en un momento preciso, ese es un método de trabajo distinto a escribir un prompt más largo.

Las extensiones corren hacia adelante o hacia atrás, y la documentación recomienda restricciones de continuidad explícitas para la extensión de un plano completo: extensión natural, conexión suave del movimiento, sin cortes rígidos del plano, sin objetos que aparezcan de la nada. Desglosamos ese flujo en la guía de edición y extensión de Seedance 2.5.

Long Video: de 30 a 180 segundos en una sola pasada

Long Video es un modo aparte, no un ajuste más largo del modo estándar. Genera de 30 a 180 segundos de forma directa, sin cosido y sin cadena de extensiones. Los objetivos de diseño declarados son la consistencia de largo alcance en los rasgos del personaje, el detalle de la ropa y la arquitectura de la escena a lo largo de los tres minutos completos, más movimientos de cámara extendidos y suaves: acercamientos lentos, órbitas y planos que atraviesan el espacio y aguantan en una toma larga.

Como equivocarse en una generación de tres minutos sale caro, la fórmula de prompt para video largo de la documentación abre con parámetros globales: vuelve a declarar la duración y la relación de aspecto al comienzo del prompt aunque ya las hayas fijado en la interfaz.

El presupuesto de referencias: 50 materiales y cómo gastarlos

Seedance 2.5 acepta hasta 50 entradas de referencia en una sola solicitud. Ese techo se reparte de tres maneras, y cada tipo tiene un límite duro y un rango recomendado aparte.

TipoLímite duroRango recomendado
ImágenesHasta 30, cada una de 4K o menos1–8 sujetos distintos; 9–12 es posible, pero la estabilidad baja
VideosHasta 10, 30 segundos combinados1–5 sujetos distintos, 5–10 segundos por video de sujeto; 6–10 sujetos es posible, pero la estabilidad baja
AudioHasta 10, 30 segundos combinadosSolo el diálogo, la voz, el ambiente o la música que el plano de verdad necesita
Edición de videoUn video de origen más imágenes de referenciaVideo de origen de menos de 20 segundos, 1–5 imágenes de referencia; 6–8 es posible

La brecha entre las dos columnas es toda la historia. Treinta imágenes es lo que acepta la solicitud; ocho sujetos es lo que el modelo maneja de forma confiable. Llenar el presupuesto no es una estrategia: la documentación es explícita en que la creación con múltiples referencias se trata de elegir los materiales correctos por escena, no de hacer que todos aparezcan a la vez.

Una regla práctica que vale la pena interiorizar: si más de cinco sujetos también necesitan varios ángulos de vista, pon cada vista en su propia imagen. Las imágenes independientes por vista son más estables que una sola hoja de collage.

Sobre la higiene de las entradas, las imágenes pueden ser jpeg, png, webp, bmp, tiff, gif, heic o heif, con una relación de aspecto entre 0.4 y 2.5, dimensiones entre 300 y 6000 px, menos de 30 MB cada una y un cuerpo de solicitud por debajo de 64 MB. Los videos de referencia aceptan mp4 o mov de 480p a 4K dentro de los mismos límites de relación y dimensiones.

Para el lado del orden y la asignación de roles en los paquetes de referencias, mira la guía de prompts con referencias de Seedance 2.5.

Control por marcas de tiempo, al segundo

Seedance 2.5 admite de forma nativa el control de intervalos de trama y de plano por marca de tiempo. Escribes un marcador como [00.0-05] delante del plano, el diálogo o la acción, y después guionizas el resto en orden cronológico. Los rangos deben ser consecutivos y no superponerse.

El encuadre honesto de la documentación: un rango de marca de tiempo es el presupuesto de tiempo de un evento, no un punto de corte exacto al fotograma. Las acciones pueden caer un poco antes o después de una frontera. Poco contenido en un rango le da al modelo una libertad que quizá no quieres; demasiado provoca cortes excesivos o eventos perdidos. Exigir una frecuencia como tres acciones distintas dentro de un segundo no va a funcionar.

Bien usado, sigue siendo la palanca más grande sobre el ritmo. Es lo que hace que una generación multi-shot de 30 segundos se comporte como un guion y no como un montaje, y es la columna vertebral del enfoque de la guía de prompts de 30 segundos para Seedance.

Seedance 2.5 acepta texto de entrada en muchos idiomas, con dos niveles documentados. La máxima prioridad de optimización cubre chino, inglés, español, indonesio y malayo. La cobertura completa se extiende a tailandés, árabe, portugués, vietnamita, japonés y coreano.

El lanzamiento también apunta a la exactitud de la pronunciación, a menos errores de lectura en palabras raras y a un mejor lip-sync frente a habla multilingüe. Para quien produce variantes publicitarias localizadas o un cortometraje donde los personajes hablan idiomas distintos, esa combinación —el brief en tu idioma, el diálogo en el idioma objetivo, las formas de la boca que acompañan— es el desbloqueo práctico.

Trabajo de calidad en el modelo base

No todo en la 2.5 es un botón nuevo. Una parte significativa del lanzamiento es reconstrucción del modelo base apuntada a lo que la documentación llama quitar el sabor a IA:

  • Piel: menos brillo plástico y luces grasosas, con poros reales y respuesta a la luz restaurados.
  • Pelaje animal: más esponjoso y separado en vez de apelmazado.
  • Voz: menos timbre mecánico de TTS en el diálogo generado.
  • Movimiento de cola larga: bailes inusuales, artes marciales complejas y cambios sutiles de expresión ahora se generan de forma fluida en vez de distorsionarse.
  • Consistencia: la lógica espaciotemporal y la continuidad del personaje entre cortes se sostienen a lo largo de una generación completa de 30 segundos.

Las palancas del lado del prompt son pequeñas y específicas: frases como textura de piel nativa y raíz del cabello definida para el realismo, y descripciones estables de la caracterización repetidas en cada plano para sostener la consistencia a través de los cortes.

Sin subtítulos ni música de fondo, ahora sí respetado

Este es un arreglo chico con un efecto enorme en el trabajo de producción. Las versiones anteriores quemaban subtítulos o agregaban música de fondo incluso cuando el prompt decía que no. Seedance 2.5 respeta esas instrucciones, y la formulación documentada es un modificador como “pure video, no subtitles, no background music”.

Si entregas planos limpios a un montajista o a un diseñador de sonido, esa es la diferencia entre una salida utilizable y una que hay que volver a generar.

Las mejoras de referencias multimodales

El bloque más grande de las notas de lanzamiento es un grupo de capacidades del lado de las referencias. En conjunto empujan a Seedance de generador hacia algo más parecido a una superficie de edición dirigida:

  • Separación de música de fondo: quita la música dejando la voz que habla y, algo notable, conservando intactos los subtítulos en pantalla y otros elementos visuales.
  • Transferencia de idea y de lenguaje de cámara: migra la trayectoria de acercamiento, alejamiento y paneo de una referencia, su temblor de cámara en mano, su lógica de color y su atmósfera emocional, no solo el movimiento corporal de superficie.
  • Eliminación y edición parcial: pincela o encuadra una zona para un borrado sin rastros, con el fondo recompuesto según la lógica física y de iluminación, más el reemplazo dirigido de elementos.
  • Modificación de la perspectiva espacial: reencuadra un plano existente a vista cenital, contrapicado o primera persona manteniendo coherentes las proporciones y la disposición.
  • Referencia de tono: reproduce el timbre más la tensión emocional y el ritmo de una grabación de referencia.
  • Referencia de varias personas: sin mezcla de rasgos faciales entre personajes, sin intercambio de ropa, con oclusión física correcta durante la interacción.
  • Pantalla verde: segmentación de primer plano de alta precisión con estabilidad a nivel de fotograma frente a fondos dinámicos.
  • Clay Renderer: un plugin de blockout y modelo blanco para Maya y Blender que restaura el lenguaje de cámara, fija el espacio y la composición y controla la posición y la trayectoria de movimiento del personaje.
  • Transición sin costuras: genera el contenido puente entre dos clips independientes sin modificar ninguna de las fuentes, con transiciones de distancia focal, rotación o inmersión disparadas por la acción, la mirada o la oclusión.
  • Storyboard de varias viñetas: alimenta una imagen de storyboard de varios cuadros como referencia de trama.

Dos de estas traen notas de uso que vale la pena repetir. Clay Renderer hoy da mejores resultados con blockouts gruesos —esferas, cilindros y cubos simples que aportan un esqueleto dinámico— que con modelos finos y totalmente terminados. Los storyboards de varias viñetas funcionan mejor como línea simple o monigotes, idealmente con no más de 15 cuadros y con las etiquetas de texto al mínimo. Los dos se cubren en la guía de storyboards y blockouts de Seedance 2.5.

Parámetros que se bloquean solos

Seedance 2.5 divide el trabajo guiado por materiales en tareas bloqueadas y desbloqueadas. En una tarea bloqueada, una entrada pasa a formar parte de la línea de tiempo de salida y el resultado se adapta a ella. En una tarea desbloqueada, los materiales dan orientación semántica y tú conservas el control de la duración y la relación de aspecto de salida.

Tres tipos de tarea anulan ajustes que quizá creías controlar. Saberlo antes de enviar te ahorra una generación desperdiciada.

Tipo de tareaRelación de aspectoDuración
Edición de videoConserva la del video de entrada; no se puede fijar aparteConserva aproximadamente la duración de entrada; no se puede fijar aparte, y el procesamiento de fotogramas de entrada puede moverla hasta unos 0.3 segundos
Primer fotograma / primer y último fotogramaUsa la relación de la primera imagenSe puede fijar
Extensión de videoConserva la del video de entrada; no se puede fijar aparteSe puede fijar

La regla de primer y último fotograma aplica cuando las imágenes se envían con content.role = first_frame y content.role = last_frame. Como la relación viene del primer fotograma estricto, una última imagen con otra relación se va a estirar. Iguala las dos antes de subirlas. Las generaciones por referencia, las grillas de storyboard y las referencias de fotograma clave independientes están desbloqueadas. No heredan la relación de aspecto ni la duración de un material. También existe una técnica más laxa de primer y último fotograma: envía las imágenes como reference_image y nómbralas en el prompt como el primer y el último fotograma. Eso mantiene libres los ajustes de salida, pero los fotogramas de frontera generados solo se aproximan a las referencias en vez de igualarlas de forma estricta.

Restricciones que conviene planificar

La resolución de salida es 480p y 720p. Ese es el techo que salió, y es la restricción con más probabilidad de afectar una decisión de entrega: una generación de tres minutos a 720p es un recurso muy distinto de un máster de tres minutos. Planifica a Seedance 2.5 dentro de la previz, la entrega para redes y el material de referencia en consecuencia, y revisa tu especificación de entrega antes de comprometer una generación larga.

La documentación también es franca sobre varios límites de comportamiento:

  • Las marcas de tiempo asignan tiempo a los eventos; no son puntos de corte exactos al fotograma.
  • Los prompts de edición aumentan la probabilidad de que los eventos críticos se alineen con la fuente. No pueden garantizar una superposición fotograma a fotograma.
  • La salida de una edición de video puede diferir de la entrada hasta en unos 0.3 segundos.
  • Los segmentos extendidos pueden diferir un poco en volumen respecto del clip de origen.
  • Las transiciones sin costuras apuntan a la continuidad visual y sonora, no a un empalme idéntico píxel a píxel.
  • Los fotogramas de frontera de una extensión se conectan de forma natural a nivel visual, pero no son idénticos píxel a píxel.
  • Para subtítulos, fórmulas, señalética, especificaciones de producto o timing a nivel de fotograma que deban ser exactos, combina material de referencia preparado, generación y posproducción.

Ninguna de estas es descalificante. Son la diferencia entre tratar a Seedance 2.5 como un generador dirigido dentro de una cadena de producción y tratarlo como una herramienta de acabado, que no lo es.

Cómo empezar en OmniArt

Abre el espacio de video de OmniArt, selecciona Seedance 2.5 y recorre el lanzamiento en el orden que de verdad construye habilidad:

  1. Empieza con una generación de 30 segundos con marcas de tiempo. Escribe tres o cuatro rangos consecutivos y sin superposición, y mira qué tan cerca cae el ritmo. Esto te enseña el comportamiento temporal del modelo más rápido que cualquier otra cosa.
  2. Después prueba la extensión. Genera diez segundos que te gusten, extiéndelos con una instrucción nueva y vuelve a extender ese resultado. Observa la costura y el volumen en cada frontera.
  3. Arma un paquete de referencias dentro del rango recomendado, no del límite duro: un puñado de imágenes de sujeto con un trabajo claro cada una, y un video de referencia corto si necesitas lenguaje de cámara.
  4. Reserva Long Video para briefs que ya hayas validado en duraciones más cortas. Tres minutos es mucho para comprometer con un prompt sin probar.
  5. Agrega “pure video, no subtitles, no background music” a todo lo que vaya a un montajista.

Para la filosofía de prompts que sostiene a todas las versiones de Seedance, empieza con cómo escribir prompts para Seedance. Después elige la guía que corresponda a tu trabajo: prompts con referencias, prompts de 30 segundos, edición y extensión o storyboards y blockouts.

¿Todo listo para crear?

Empieza a generar contenido increíble con IA

Empezar gratis