Cómo expandir el encuadre de un video con IA: un flujo real
Cómo expandir el encuadre de un video con IA: un flujo práctico para reencuadrar a una nueva relación de aspecto con los modelos de imagen de OmniArt y una reconstrucción de imagen a video.

Grabaste en vertical y el cliente quiere 16:9. O un clip de archivo en 4:3 tiene que llenar un espacio protagonista en pantalla ancha. O un loop de producto en 1:1 tiene que salir como historia en 9:16 sin partir el producto por la mitad. El instinto es recortar, y recortar es donde se muere el buen metraje: pierdes los bordes de la composición, o aceptas bandas negras y un sujeto más chico.
La solución limpia es expandir el encuadre del video en lugar de meterle tijera: conservas cada píxel original y generas información nueva en los márgenes vacíos. Las herramientas dedicadas de outpainting de video hacen exactamente eso, fotograma por fotograma. OmniArt no: hoy no hay un expansor de encuadre de video de un clic en el espacio de trabajo.
Lo que OmniArt sí tiene son las dos mitades de un flujo compuesto que llega al mismo resultado: modelos de imagen que extienden una foto fija a una nueva relación de aspecto con control de región y de anclaje, y un catálogo de video que devuelve esa fija extendida al movimiento. Esta guía recorre las cinco etapas de punta a punta, y es honesta sobre el intercambio: estás reconstruyendo el plano, no extendiendo el metraje original. En un clip lento, estático y con mucho fondo, esa reconstrucción suele ser indistinguible de lo real. En un travelling en mano entre una multitud, no.
Qué significa realmente “expandir el encuadre de un video”
Cuatro operaciones distintas reciben el mismo nombre, y elegir la equivocada es casi todo el tiempo perdido en este trabajo.
| Enfoque | Qué pasa con tus píxeles | Qué te cuesta |
|---|---|---|
| Recorte / pan-and-scan | Se conservan los originales, se descartan los bordes | Composición y tamaño del sujeto |
| Bandas negras / pilar desenfocado | Se conserva todo, los márgenes se llenan con barras o una copia desenfocada | Área de pantalla; se lee como una republicación |
| Outpainting de video | Se conserva todo, los márgenes se generan por fotograma | Necesitas un modelo de outpainting dedicado |
| Reconstrucción compuesta (esta guía) | El original pasa a ser referencia; se genera un clip nuevo más ancho | Fidelidad fotograma a fotograma con el origen |
La reconstrucción compuesta queda entre el outpainting y volver a filmar: extiendes una fija representativa a la relación objetivo, la animas y después igualas el movimiento y el color del clip nuevo con el original, para que los dos convivan en el mismo montaje.
Advertencia
Ten claro qué es esto. OmniArt no tiene outpainting de video nativo: este flujo regenera el plano a partir de una fija extendida, en vez de ensanchar tus fotogramas existentes. No va a preservar tu metraje de origen píxel por píxel, y no va a sobrevivir a un plano con movimiento rápido de cámara o diálogo sincronizado. Si el clip es metraje protagonista que debe quedar exactamente como se filmó, usa una herramienta dedicada de outpainting de video o vuelve a filmar en la relación más ancha.
Cuándo funciona este enfoque y cuándo falla
Juzga el plano antes de gastar un crédito. La variable que decide todo es cuánta información nueva exige el encuadre más ancho.
Funciona bien:
- Planos fijos o casi estáticos. Una mesa de producto en trípode, una naturaleza muerta, un fondo ambiental lento: casi nada fuera del encuadre original necesita moverse por su cuenta.
- Entornos y texturas en los márgenes. Fondo de estudio, cielo, pared, agua, follaje, bokeh. Los modelos de imagen extienden textura continua de forma convincente.
- Movimientos de cámara lentos y en una sola dirección. Un acercamiento suave o una deriva que puedes volver a describir en un prompt.
- Clips cortos. De 3–6 s. Cuanto más corto el clip, menos deriva se acumula frente al origen.
- Sujetos centrados. Si el sujeto nunca entra al margen recién generado, hay mucho menos que acertar.
Falla, y casi siempre feo:
- Movimientos de cámara rápidos o complejos. Cámara en mano, barridos, movimientos de grúa: el margen nuevo necesitaría un paralaje geométricamente correcto que el modelo no tiene con qué inventar.
- Oclusión compleja. Sujetos que pasan detrás de objetos en primer plano, multitudes cruzando el encuadre, extremidades que entran y salen por el borde.
- Bustos parlantes con sincronía labial. No puedes regenerar una interpretación y mantener el diálogo alineado. Ni lo intentes.
- Personas reconocibles o productos licenciados en el margen. Lo que el modelo invente en los bordes es inventado: eso es un problema legal, no solo estético.
- Tomas largas. Pasados unos 8 s, un clip regenerado se aparta del origen de maneras que ningún etalonaje va a esconder.
Si tu plano está en la segunda lista, para acá. Unas bandas negras honestas, o un recorte con criterio, le ganan a una reconstrucción que se tambalea a la vista.
Etapa 1: exporta un fotograma representativo
Recorre el clip de origen y saca una sola fija en PNG a resolución completa. La palabra “representativo” está haciendo trabajo real: todo lo que viene después hereda la composición, la luz y la posición del sujeto de ese fotograma.
- Elige un fotograma donde el sujeto esté en su posición más típica, no en la más extrema.
- Evita fotogramas con desenfoque de movimiento. Ese desenfoque se hornea en la extensión y después el modelo de video lo vuelve a desenfocar.
- Si la cámara se mueve, prefiere un fotograma del medio del movimiento, así el movimiento regenerado tiene el mismo margen de cada lado.
- Exporta sin pérdida. Un artefacto de JPEG en el borde del fotograma se vuelve una costura en la imagen extendida.
Anota ya la relación, la resolución y la duración del origen: vas a necesitar las tres en la etapa 4.
Etapa 2: extiende la fija a la relación de aspecto objetivo
Abre el espacio de imagen de OmniArt y elige un modelo que tome tu fija como referencia y la relación de aspecto objetivo como parámetro. Seedream 5.0 Pro es la opción práctica acá porque admite edición por región y por anclaje, más fusión de varias imágenes: puedes sostener el original como referencia mientras le dices al modelo que el contenido nuevo va en un margen específico.
Sube el fotograma exportado, fija la relación de aspecto de salida en tu objetivo (16:9, 9:16, 4:5, lo que pida el emplazamiento) y escribe el prompt para el margen, no para la imagen.
Extender una foto de producto 9:16 a 16:9:
"Use the reference image as the exact center of the frame. Keep every element of the reference unchanged in content, scale, position, color, and lighting. Extend the scene outward to the left and right only, continuing the same walnut tabletop, the same seamless warm-gray backdrop, and the same soft key light from the upper left. Match the existing depth of field and grain. Add no new objects, no people, no text, no props."
Extender un exterior 4:3 a 16:9:
"Use the reference image as the anchor region and preserve it exactly. Continue the scene left and right: the same overcast sky gradient, the same treeline density, the same wet asphalt reflections. Keep the horizon at an identical height across the full width. Photographic, no stylization, no added vehicles or figures."
Tres hábitos separan una extensión limpia de una evidente:
- Di qué preservar antes de decir qué agregar. Los modelos derivan sobre la región original salvo que la fijes explícitamente.
- Nombra la dirección. “Solo izquierda y derecha” evita que el modelo reequilibre en silencio toda la composición.
- Nombra los anclajes de continuidad. Altura del horizonte, dirección de la luz principal, material de la superficie, profundidad de campo, grano: eso es lo que el ojo revisa en la costura.
Genera tres o cuatro variantes y compáralas en la costura al 100 %, no alejadas. Rechaza cualquiera con un escalón tonal visible, un horizonte que se curva o una textura que cambia de carácter a mitad de superficie. Si una variante está bien en todos lados menos en un margen, corre una segunda edición de región solo sobre esa zona en vez de volver a tirar la imagen entera.
Etapa 3: devuelve la fija extendida al movimiento
Lleva la fija ancha aprobada al espacio de video y genera desde ahí un clip de imagen a video. La fija extendida se vuelve el primer fotograma, así que el modelo anima un fotograma que ya tiene la relación de aspecto correcta: el problema del ensanche queda resuelto antes de que entre el movimiento.
Tu prompt tiene un solo trabajo: reproducir el movimiento del clip de origen. Mira el original varias veces y describe qué hacen de verdad la cámara y el sujeto, en ese orden.
"Animate the reference image. Camera pushes in very slowly over 5 seconds, no shake, no tilt. The subject stays centered and static. Steam drifts upward and to the right. Background remains still. Lighting unchanged throughout. Locked framing, no cuts, no zoom snap."
La elección del modelo sigue al plano. Seedance 2.0 te deja fijar la fija extendida como referencia etiquetada y sostener la identidad a través del movimiento. Veo 3.1 es la opción cuando el clip tiene que convivir con metraje 4K nativo. Kling 3.0 es la opción de valor para reconstruir muchos planos a la vez, y PixVerse resuelve rápido clips de corte social para pasadas de iteración baratas. Todos viven en el mismo espacio de trabajo, así que probar dos es cambiar un desplegable; para una comparación más completa, lee los mejores modelos de imagen a video con IA en 2026.
Iguala la duración del origen y genera dos o tres semillas. Juzga cada una específicamente por los márgenes recién generados, porque ahí es donde un modelo inestable se delata primero.
Etapa 4: iguala movimiento, tiempos y color con el origen
Esta es la etapa que decide si la reconstrucción pasa. Pon el clip nuevo en una línea de tiempo justo encima del original y compáralos.
| Qué revisar | Cómo revisarlo | Cómo arreglarlo |
|---|---|---|
| Velocidad del movimiento | Alterna entre clips en el mismo punto de reproducción | Retemporiza el clip generado; los cambios pequeños de velocidad son invisibles |
| Dirección del movimiento | Compara el primer y el último fotograma de cada uno | Vuelve a escribir el prompt con una dirección explícita; no lo arregles en el montaje |
| Duración | Iguala cantidades de fotogramas, no segundos redondeados | Recorta en vez de estirar más allá de un 10 % |
| Color y grano | Mide ambos clips con los medidores y compara una superficie plana al 100 % | Etalona hacia el origen y agrega grano equivalente; los renders salen demasiado limpios |
| Escala del sujeto | Superpón al 50 % de opacidad | Escala el clip; si la diferencia pasa de unos pocos por ciento, vuelve a extender en la etapa 2 |
Consejo
Etalona el clip generado para que coincida con el origen y después pasa una capa suave de grano sobre los dos. Una capa de grano compartida esconde las diferencias chicas de estructura de ruido mejor que cualquier cantidad de trabajo de color clip por clip.
Etapa 5: móntalo
El clip generado ya es un recurso ancho usable, pero el montaje más fuerte casi nunca se apoya solo en él.
- Sustitución directa. Si la reconstrucción aguanta, úsala como el plano. Es lo más simple y la respuesta correcta para fondos estáticos.
- Compón el original sobre la reconstrucción. Coloca el clip de origen a su tamaño original encima del clip ancho generado, alineado a la misma posición del sujeto. Tu metraje real se reproduce en el centro y los márgenes generados llenan los costados: es lo más cerca que llega este flujo del outpainting real, y la versión que conviene usar cuando el centro del encuadre debe seguir siendo auténtico.
- Monta a su alrededor. Usa el clip ancho para el plano de situación y corta al original, recortado, para los momentos más cercanos. El movimiento entre planos tapa la diferencia.
Exporta en la relación objetivo y revisa el resultado en un celular además de en un monitor. Las costuras que en una laptop se leen como “un poco suaves” en una pantalla chica y brillante se leen como “obviamente falsas”.
Limitaciones que conviene decir sin vueltas
- Esto no es outpainting. El clip generado es un render nuevo. La fidelidad fotograma a fotograma con tu origen se perdió por definición, y ningún prompt la recupera.
- El audio no sobrevive a la reconstrucción. El sonido atado a la acción en pantalla hay que resincronizarlo, y el diálogo, en la práctica, no se puede.
- El costo escala con la iteración, no con la duración. La mayor parte del gasto se va en variantes de extensión y comparaciones de semillas.
- Los clips largos derivan. Más allá de unos 8 s, reconstruye por segmentos y corta entre ellos.
- A veces otra herramienta es simplemente la respuesta correcta. Muchos planos por ensanchar, metraje irreemplazable o un cliente que va a comparar fotogramas apuntan todos a un outpainter dedicado o a volver a filmar en la relación más ancha. Saber cuándo no usar este flujo es parte de usarlo bien.
Preguntas frecuentes
¿OmniArt puede expandir el encuadre de un video en un solo paso?
No. No hay outpainting de video nativo en el espacio de trabajo. El flujo de arriba llega a un resultado parecido extendiendo una fija con un modelo de imagen y regenerando el movimiento con un modelo de imagen a video.
¿El resultado va a verse idéntico al clip original?
No, y no hay que venderlo así. En planos estáticos y con mucha textura, la diferencia suele ser imperceptible dentro de un montaje. En cualquier cosa con movimiento real de cámara, se nota.
¿Puedo conservar mi metraje original en el centro del encuadre?
Sí: esa es la opción compuesta de la etapa 5. Superpón el clip de origen a tamaño original sobre el clip ancho generado. Tus píxeles reales se reproducen en el centro y el contenido generado solo llena los márgenes.
Empezar en OmniArt
Elige un clip estático y una relación objetivo. Exporta un fotograma representativo, extiéndelo en el espacio de imagen con Seedream 5.0 Pro en la nueva relación de aspecto, anima el resultado con un modelo de imagen a video y después iguala el color y móntalo. Veinte minutos te dicen si la ruta de reconstrucción sirve para ese plano, antes de comprometer un lote entero.
Las dos mitades viven en el mismo lugar, así que el ciclo es un espacio de trabajo y un solo saldo, en vez de dos suscripciones. Empieza en el espacio de creación con un solo fotograma y un fondo liso.
¿Todo listo para crear?
Empieza a generar contenido increíble con IA