guideTutoriales y guías12 min de lectura

Cómo añadir una persona a una foto con IA: paso a paso

Añade una persona a una foto con IA en OmniArt: fusión de varias imágenes, fotos de referencia, ediciones por zonas y luz ajustada para un montaje creíble.

Equipo OmniArt
Cómo añadir una persona a una foto con IA: paso a paso

Para añadir una persona a una foto con IA no estás pegando en realidad un recorte: le estás pidiendo a un modelo de imagen que vuelva a renderizar una foto para que una segunda persona pertenezca a ella. El modelo tiene que colocarla en un sitio verosímil, ajustar su tamaño a la escena, reiluminarla para que encaje y ponerle una sombra bajo los pies. Si aciertas en esas cuatro cosas, el resultado se lee como una fotografía. Si falla una, se lee como una pegatina.

En OmniArt esto es trabajo de un modelo de imagen, no de un editor por capas. Subes la foto base, subes una foto de referencia de la persona y describes el montaje en el prompt. Seedream 5.0 Pro lo hace bien porque admite la fusión de varias imágenes —hasta 10 referencias fundidas en un único resultado— además de un lenguaje de zonas y de anclajes para controlar exactamente dónde cae la edición. GPT Image 2 acepta instrucciones de edición en lenguaje natural, y Nano Banana 2 hace ediciones guiadas por referencia cuando quieres una segunda opinión sobre el mismo par de materiales de partida.

Esta guía recorre todo el flujo de trabajo en orden: elegir las fotos, elegir el modelo, escribir el prompt de colocación, corregir lo que no cuadra y fijar un renderizado final. Incluye tres prompts listos para copiar y pegar.

Qué está haciendo el modelo en realidad

Conviene entender el mecanismo antes de escribir un prompt. Cuando le das dos imágenes y una instrucción, el modelo no está componiendo píxeles: está generando una imagen nueva condicionada por las dos entradas. Eso tiene dos consecuencias prácticas.

Primero, la foto base puede cambiar ligeramente incluso en zonas que no has mencionado. Los fondos se desplazan, el borde de una mesa se mueve, el texto de un cartel se descoloca. Esto se reduce protegiendo explícitamente el resto del encuadre en el prompt, la misma disciplina que hace que funcionen las ediciones por zonas.

Segundo, la identidad viene por completo de la foto de referencia. Si la referencia es pequeña, borrosa, muy filtrada o está tomada desde un ángulo que no se parece en nada al que quieres en el resultado, el modelo inventará la diferencia, y las caras inventadas se van a la deriva. Aquí la referencia trabaja más que el prompt.

Paso 1: elegir la foto base y la referencia de la persona

Un material de partida malo cuesta más iteraciones que un prompt malo, así que dedícale un minuto a esto.

La foto base debería tener un espacio vacío evidente donde una persona pueda estar de pie o sentada, una dirección de luz legible y suelo visible para que la sombra tenga dónde caer. Evita las fotos en las que cada posición verosímil está tapada por muebles, y evita los planos de gran angular extremo: la distorsión de perspectiva es difícil de igualar.

La referencia de la persona debería ser una única foto limpia y bien iluminada, tomada idealmente más o menos desde el ángulo y la distancia que quieres en la imagen final. De cuerpo entero si la persona va a aparecer de cuerpo entero en el resultado. Una luz neutra gana a una luz dramática, porque una luz plana es más fácil de reiluminar que un retrato con sombras duras. Si la persona tiene que aparecer con una ropa concreta, la referencia debería mostrar ya esa ropa.

Consejo

Si tienes varias fotos aprovechables de la misma persona, sube dos o tres en lugar de una. Seedream 5.0 Pro acepta hasta 10 referencias, y un segundo ángulo mejora de forma medible la coherencia facial. Aun así, mantenlas coherentes entre sí: mezclar una foto de 2019 con una actual le da al modelo dos identidades que promediar.

Paso 2: elegir el modelo

Los tres están en el espacio de trabajo de imagen de OmniArt y los tres aceptan imágenes de referencia subidas junto al prompt.

ModeloSu punto fuerte en este trabajoRecurre a él cuando
Seedream 5.0 ProFusión de varias imágenes, lenguaje de zonas y anclajes, instrucciones exactas de material y colorEl montaje es el trabajo principal: varias referencias, colocación precisa o un color de ropa concreto
GPT Image 2Edición en lenguaje natural que sigue de cerca las instrucciones conversacionalesQuieres describir el cambio con frases llanas e iterar hablando
Nano Banana 2Ediciones guiadas por referencia con entrega rápidaQuieres una segunda interpretación barata del mismo material antes de comprometerte

Un valor por defecto razonable: empieza con Seedream 5.0 Pro para todo aquello en lo que importan a la vez la colocación y la identidad. Si el montaje es sencillo —una persona, un hueco evidente, una luz indulgente—, GPT Image 2 suele llegar con menos palabras.

Paso 3: escribir el prompt de colocación

Un prompt que funciona en esta tarea tiene cuatro partes, en este orden:

  1. La instrucción: añade a la persona de la referencia a la foto base.
  2. Colocación y escala: dónde está, qué hace y de qué tamaño en relación con un objeto conocido del encuadre.
  3. Ajuste de luz y sombra: la dirección y la calidad de la luz de la foto base, y dónde cae la sombra.
  4. Protección: todo lo de la foto base que tiene que quedarse idéntico.

Esta es una versión que funciona y que puedes adaptar:

Añade a la mujer de la segunda foto de referencia a la primera foto. Colócala de pie en el lado izquierdo de la terraza de madera, mirando a la cámara, con el peso sobre la pierna derecha y con la cabeza a la altura aproximada de la parte superior de la barandilla que tiene detrás. Iguala exactamente la iluminación de la foto base: sol de última hora de la tarde desde la parte superior derecha, tono cálido y sombras de bordes suaves. Proyecta su sombra hacia abajo y hacia la izquierda sobre las tablas de la terraza. Mantén sin cambios la terraza, la barandilla, las plantas, el cielo y todos los demás elementos de la foto base.

Fíjate en que «la cabeza a la altura aproximada de la parte superior de la barandilla» hace más por la escala que «de tamaño medio». Anclar a la persona a algo que ya se puede medir en el encuadre es el truco de escala más útil de estos prompts.

Una variante sentada, para un montaje más pequeño y a menudo más fácil:

Inserta al hombre de las fotos de referencia en la escena de la cafetería, sentado en la silla vacía del lado derecho de la mesa, en vista de tres cuartos y ligeramente girado hacia la ventana, con las manos apoyadas en la mesa. Ajusta su escala para que los hombros queden justo por debajo de la parte superior del respaldo de la silla. Ilumínalo desde la ventana de la izquierda con una luz de día difusa y suave que coincida con la de la imagen base, con una sombra de contacto tenue donde los antebrazos se apoyan en la mesa. No modifiques la mesa, las tazas, las demás personas ni el fondo.

Paso 4: refinar con ediciones dirigidas a una zona

El primer renderizado casi nunca es el definitivo, y el error que comete la mayoría es volver a tirar el prompt completo. No lo hagas. Coge el resultado que acertó con la colocación y corrige una cosa a la vez con una instrucción limitada a una zona. Seedream 5.0 Pro está hecho para esto: nombrar una zona, un punto de anclaje o una ubicación como lo leería una persona en voz alta («abajo a la izquierda», «el segundo por la derecha») mantiene la edición local.

Con esta imagen, ajusta solo la figura añadida: suaviza el borde a lo largo de su hombro derecho para que se integre con la pared del fondo, calienta ligeramente sus tonos de piel para que coincidan con la luz de alrededor y alarga su sombra otro veinte por ciento hacia la izquierda. No cambies nada más del encuadre.

Dos o tres de estas pasadas dirigidas suelen ganar a diez tiradas completas, y cuestan menos. La guía de prompts de Seedream 5.0 Pro trata con más profundidad los patrones de zona, de anclaje y de color hexadecimal si quieres llevar esto más lejos.

Nota

OmniArt expone la generación de imágenes estándar y la generación con imágenes de referencia. Los recuadros de coordenadas, las superposiciones de boceto y los pines de anclaje son flujos de la API original, no controles propios de la interfaz de OmniArt: dentro del espacio de trabajo los expresas como texto en el prompt. Eso funciona; solo significa que es el lenguaje preciso el que está señalando.

Paso 5: fijar el renderizado final

Cuando la colocación, la identidad y la iluminación se sostienen, haz una pasada final a la resolución que realmente necesitas en lugar de seguir editando un borrador pequeño. Vuelve a renderizar el montaje aprobado al tamaño máximo que admita el modelo —Seedream 5.0 Lite ofrece 4K nativo si la resolución de salida es el factor decisivo— y revisa el resultado al 100 % antes de publicarlo. Los halos en los bordes y un grano que no coincide son invisibles a tamaño miniatura y evidentes a tamaño completo.

Igualar la luz, la perspectiva, la escala y la sombra

Estos cuatro modos de fallo explican la mayoría de los montajes que se ven mal sin que quien los mira sepa por qué.

  • Dirección de la luz. Lee primero las sombras de la foto base y luego indica la dirección en el prompt («desde la parte superior derecha», «desde la ventana de la izquierda»). Si la foto de referencia de la persona estaba iluminada desde el lado opuesto, dilo de forma explícita: «reilumina la figura desde la derecha; la iluminación lateral izquierda de la foto de referencia no debe conservarse».
  • Calidad de la luz. El sol duro da sombras de bordes marcados; el cielo cubierto y la luz de interior las dan suaves. Una persona con luz suave en una escena de sol duro parece pegada. Nombra la calidad, no solo la dirección.
  • Perspectiva y altura de cámara. Si la foto base se tomó a la altura de la cintura, una persona referenciada desde un móvil sostenido a la altura de los ojos quedará mal en el encuadre. Añade «iguala el ángulo bajo de cámara de la foto base, con la vista ligeramente desde abajo» y el modelo ajustará el escorzo de la figura.
  • Escala. Ata siempre la altura a algo del encuadre: una puerta, una barandilla, el respaldo de una silla, el hombro de otra persona. Las descripciones absolutas no sobreviven a la traducción a píxeles.
  • Sombra de contacto. Esa pequeña zona oscura donde un cuerpo se encuentra con una superficie es lo que vende la presencia física. Pídela por su nombre: «una sombra de contacto suave bajo los dos zapatos, donde tocan el pavimento».
  • Grano y color. Pídele al modelo que iguale el grano, la temperatura de color y cualquier blandura de la lente de la foto base. Una figura limpia en una foto con grano te delata.

Resolución de problemas

La cara no se parece a la persona. Tu referencia está trabajando demasiado poco. Sube ángulos adicionales de la misma persona, prioriza la resolución alta y descarta las fotos muy filtradas. Después pídelo de forma específica: «conserva los rasgos faciales, el nacimiento del pelo y el color del pelo de las fotos de referencia sin estilizarlos».

El fondo ha cambiado. Tu cláusula de protección era demasiado vaga. Enumera los elementos de forma explícita en lugar de decir «mantén el fondo». Después haz una pasada de corrección limitada a una zona en lugar de regenerar.

La persona flota. Falta la sombra de contacto, o los pies quedan cortados de forma ambigua. Pide la sombra de contacto directamente y comprueba que el plano del suelo sea visible donde la has colocado.

El tamaño no cuadra. Sustituye cualquier expresión de tamaño absoluto por una comparación con un objeto que ya esté en el encuadre.

Los bordes parecen recortados. Pide un límite suavizado y un grano igualado a lo largo del contorno de la figura, y comprueba si la foto de referencia tenía un fondo recortado en duro: los recortes sobre fondo blanco fomentan resultados con aspecto de pegatina.

La pose está rígida. Describe el reparto del peso y la posición de las manos. «El peso sobre la pierna derecha, una mano en el bolsillo de la chaqueta» produce una postura más natural que «de pie con naturalidad».

Advertencia

Añadir a una persona real e identificable a una foto en la que no estaba crea una imagen que insinúa algo falso. Consigue su permiso explícito antes de generar y antes de publicar. No montes a figuras públicas, compañeros de trabajo, exparejas ni menores en escenas sin su consentimiento. No crees imágenes que insinúen la asistencia a un evento, el respaldo a un producto o la presencia en un lugar. Revisa las normas de la plataforma en la que publiques —muchas exigen declarar las imágenes de personas reales alteradas con IA— y cumple las condiciones de OmniArt junto con cualquier legislación local sobre derechos de imagen.

Empezar en OmniArt

Elige una foto base con un espacio vacío evidente y una foto de referencia de la persona, limpia y bien iluminada. Abre el espacio de trabajo de imagen de OmniArt, elige Seedream 5.0 Pro, sube las dos y lanza el prompt de la terraza del paso 3 cambiando los detalles por los tuyos. En el primer renderizado juzga solo la colocación y la escala: la identidad y la luz son para lo que sirven las pasadas de refinamiento.

Después trabaja con correcciones pequeñas en lugar de con prompts nuevos. Dos pasadas limitadas a una zona y un renderizado final a resolución completa es el camino normal, y mantiene intacta la foto base mientras la figura se va resolviendo.

¿Listo para crear?

Empieza a generar contenido increíble con IA

Empezar gratis