GuideTutoriales y guías12 min de lectura

Cómo agregar una persona a una foto con IA: paso a paso

Agrega una persona a una foto con IA en OmniArt: fusión de varias imágenes, fotos de referencia, ediciones por zona y luz igualada para un montaje creíble.

Equipo OmniArt
Cómo agregar una persona a una foto con IA: paso a paso

Para agregar una persona a una foto con IA no estás pegando un recorte: le estás pidiendo a un modelo de imagen que vuelva a renderizar una foto para que una segunda persona pertenezca a ella. El modelo tiene que ubicarla en algún lugar plausible, dimensionarla según la escena, reiluminarla para que calce y ponerle una sombra bajo los pies. Si esas cuatro cosas salen bien, el resultado se lee como una fotografía. Si falla una, se lee como una calcomanía.

En OmniArt esto es trabajo de un modelo de imagen, no de un editor por capas. Subes la foto base, subes una foto de referencia de la persona y describes el montaje en el prompt. Seedream 5.0 Pro lo resuelve bien porque admite fusión de varias imágenes —hasta 10 imágenes de referencia fundidas en una sola salida— más un lenguaje de zonas y anclas para controlar exactamente dónde cae la edición. GPT Image 2 acepta instrucciones de edición en lenguaje natural, y Nano Banana 2 hace ediciones guiadas por referencia cuando quieres una segunda opinión sobre el mismo par de entradas.

Esta guía recorre el flujo completo en orden: elegir las fotos, elegir el modelo, escribir el prompt de ubicación, corregir lo que quedó mal y fijar el render final. Incluye tres prompts listos para copiar y pegar.

Qué está haciendo el modelo en realidad

Ayuda entender el mecanismo antes de escribir un prompt. Cuando le das dos imágenes y una instrucción, el modelo no está componiendo píxeles: está generando una imagen nueva condicionada por ambas entradas. Eso trae dos consecuencias prácticas.

Primero, la foto base puede cambiar un poco incluso en zonas que no mencionaste. Los fondos se corren, el borde de una mesa se mueve, el texto de un letrero se revuelve. Esto se reduce protegiendo de forma explícita el resto del encuadre en el prompt: la misma disciplina que hace funcionar las ediciones por zona.

Segundo, la identidad sale por completo de la foto de referencia. Si la referencia es chica, borrosa, muy filtrada o está tomada desde un ángulo que no se parece en nada al que quieres en la salida, el modelo va a inventar la diferencia, y las caras inventadas se desvían. Aquí la referencia trabaja más que el prompt.

Paso 1: elige la foto base y la referencia de la persona

Las malas entradas cuestan más iteraciones que un mal prompt, así que dedícale un minuto a esto.

La foto base debe tener un espacio vacío evidente donde una persona pueda pararse o sentarse, una dirección de luz legible y suelo o piso visible para que la sombra tenga dónde caer. Evita las fotos en las que cada posición plausible queda tapada por muebles, y evita los grandes angulares extremos: la distorsión de perspectiva es difícil de igualar.

La referencia de la persona debe ser una foto limpia y bien iluminada, tomada más o menos desde el ángulo y la distancia que quieres en la imagen final. De cuerpo entero si la persona va a aparecer de cuerpo entero. La luz neutra le gana a la luz dramática, porque una luz plana es más fácil de reiluminar que un retrato con sombras duras. Si la persona tiene que aparecer con una ropa específica, la referencia ya debería mostrar esa ropa.

Consejo

Si tienes varias fotos utilizables de la misma persona, sube dos o tres en vez de una. Seedream 5.0 Pro acepta hasta 10 referencias, y un segundo ángulo mejora de forma medible la consistencia facial. Eso sí, mantenlas coherentes entre sí: mezclar una foto de 2019 con una actual le da al modelo dos identidades para promediar.

Paso 2: elige el modelo

Los tres están en el espacio de imagen de OmniArt y los tres aceptan imágenes de referencia subidas junto con el prompt.

ModeloFortaleza para este trabajoRecurre a él cuando
Seedream 5.0 ProFusión de varias imágenes, lenguaje de zonas y anclas, instrucciones exactas de material y colorEl montaje es el trabajo principal: varias referencias, ubicación precisa o un color de ropa específico
GPT Image 2Edición en lenguaje natural que sigue de cerca las instrucciones conversacionalesQuieres describir el cambio en frases simples e iterar conversando
Nano Banana 2Ediciones guiadas por referencia con respuesta rápidaQuieres una segunda interpretación barata de las mismas entradas antes de comprometerte

Un valor por defecto razonable: empieza con Seedream 5.0 Pro para todo aquello en lo que importen a la vez la ubicación y la identidad. Si el montaje es simple —una persona, un lugar evidente, una luz indulgente—, GPT Image 2 suele llegar con menos palabras.

Paso 3: escribe el prompt de ubicación

Un prompt que funciona para esta tarea tiene cuatro partes, en este orden:

  1. La instrucción: agregar a la foto base la persona de la referencia.
  2. Ubicación y escala: dónde se para, qué está haciendo, qué tan grande respecto de un objeto conocido del encuadre.
  3. Igualar luz y sombra: la dirección y la calidad de la luz de la foto base, y hacia dónde cae la sombra.
  4. Protección: todo lo de la foto base que debe quedar idéntico.

Esta es una versión funcional que puedes adaptar:

Add the woman from the second reference photo into the first photo. Place her standing on the left side of the wooden deck, facing the camera, weight on her right leg, with her head roughly level with the top of the deck railing behind her. Match the base photo's lighting exactly: late-afternoon sun from the upper right, warm tone, soft-edged shadows. Cast her shadow down and to the left across the deck boards. Keep the deck, railing, plants, sky, and every other element of the base photo unchanged.

Fíjate en que “her head roughly level with the top of the deck railing” hace más por la escala de lo que jamás hará “medium size”. Anclar a la persona a algo que ya es medible dentro del encuadre es el truco de escala más útil de estos prompts.

Una variante sentada, para un montaje más chico y a menudo más fácil:

Insert the man from the reference photos into the café scene, seated in the empty chair on the right side of the table, three-quarter view turned slightly toward the window, hands resting on the table. Scale him so his shoulders sit just below the top of the chair back. Light him from the window on the left with soft diffused daylight matching the base image, with a faint contact shadow where his forearms meet the table. Do not alter the table, cups, other people, or the background.

Paso 4: refina con ediciones dirigidas por zona

El primer render rara vez es el definitivo, y el error más común es volver a tirar el prompt entero. No lo hagas. Toma la salida que acertó con la ubicación y corrige una cosa a la vez con una instrucción acotada a una zona. Seedream 5.0 Pro está hecho para esto: nombrar una zona, un punto de ancla o una ubicación como la diría una persona en voz alta (“bottom left”, “second from the right”) mantiene la edición local.

Using this image, adjust only the added figure: soften the edge along her right shoulder so it blends with the background wall, warm her skin tones slightly to match the surrounding light, and extend her shadow another twenty percent to the left. Change nothing else in the frame.

Dos o tres de estas pasadas dirigidas suelen ganarle a diez regeneraciones completas, y salen más baratas. La guía de prompts de Seedream 5.0 Pro cubre con más detalle los patrones de zona, ancla y color hexadecimal si quieres llevarlo más lejos.

Nota

OmniArt expone la generación estándar de imágenes y la generación por imagen de referencia. Las cajas de coordenadas, las capas de boceto y los pines de ancla son flujos de la API original, no controles dedicados en la interfaz de OmniArt: dentro del espacio los expresas como texto en el prompt. Funciona igual; solo significa que el lenguaje preciso es el que está señalando.

Paso 5: fija el render final

Cuando la ubicación, la identidad y la luz se sostienen, haz una pasada final a la resolución que de verdad necesitas en vez de seguir editando un borrador chico. Vuelve a renderizar el montaje aprobado al tamaño más grande que admita el modelo —Seedream 5.0 Lite ofrece 4K nativo si la resolución de salida es el factor decisivo— y revisa el resultado al 100 % antes de publicarlo. Los halos en los bordes y el grano desparejo son invisibles en miniatura y evidentes a tamaño completo.

Igualar luz, perspectiva, escala y sombra

Estos cuatro modos de falla explican la mayoría de los montajes que se ven mal sin que quien los mira sepa por qué.

  • Dirección de la luz. Lee primero las sombras de la foto base y después declara la dirección en el prompt (“from the upper right”, “from the window on the left”). Si la foto de referencia de la persona estaba iluminada desde el lado opuesto, dilo de forma explícita: “relight the figure from the right; the reference photo's left-side lighting should not carry over”.
  • Calidad de la luz. El sol duro da sombras de bordes marcados; el cielo nublado y la luz de interior las dan suaves. Una persona con luz suave en una escena de sol duro se ve pegada. Nombra la calidad, no solo la dirección.
  • Perspectiva y altura de cámara. Si la foto base se tomó a la altura de la cintura, una persona referenciada desde un celular sostenido a la altura de los ojos va a quedar mal en el encuadre. Agrega “match the base photo's low camera angle, viewed slightly from below” y el modelo ajustará el escorzo de la figura.
  • Escala. Ata siempre la altura a algo del encuadre: una puerta, una barandilla, el respaldo de una silla, el hombro de otra persona. Las descripciones absolutas no sobreviven al paso a píxeles.
  • Sombra de contacto. Esa pequeña zona oscura donde un cuerpo toca una superficie es lo que vende la presencia física. Pídela por su nombre: “a soft contact shadow under both shoes where they meet the pavement”.
  • Grano y color. Pídele al modelo que iguale el grano, la temperatura de color y cualquier blandura de lente de la foto base. Una figura limpia en una foto con grano te delata.

Solución de problemas

La cara no se parece a la persona. Tu referencia está trabajando muy poco. Sube ángulos adicionales de la misma persona, prioriza la resolución alta y descarta las tomas muy filtradas. Después pídelo de forma específica: “preserve the facial features, hairline, and hair color from the reference photos without stylizing them”.

El fondo cambió. Tu cláusula de protección fue demasiado vaga. Enumera los elementos de forma explícita en vez de decir “keep the background”. Después haz una pasada de corrección acotada a una zona en lugar de regenerar.

La persona flota. Falta la sombra de contacto, o los pies quedan cortados de forma ambigua. Pide la sombra de contacto directamente y verifica que el plano del suelo se vea donde la ubicaste.

El tamaño no cuadra. Reemplaza cualquier expresión de tamaño absoluto por una comparación con un objeto que ya esté en el encuadre.

Los bordes parecen recortados. Pide un límite suavizado y un grano igualado a lo largo del contorno de la figura, y revisa si la foto de referencia tenía un fondo recortado en duro: los recortes sobre fondo blanco fomentan resultados con aspecto de calcomanía.

La pose está rígida. Describe el reparto del peso y la posición de las manos. “Weight on her right leg, one hand in her jacket pocket” produce una postura más natural que “standing naturally”.

Advertencia

Agregar a una persona real e identificable a una foto en la que no estuvo crea una imagen que insinúa algo falso. Pídele su permiso explícito antes de generar y antes de publicar. No montes a figuras públicas, colegas, exparejas ni menores en escenas sin su consentimiento. No crees imágenes que insinúen asistencia a un evento, respaldo a un producto o presencia en un lugar. Revisa las reglas de la plataforma donde publicas —muchas exigen declarar las imágenes de personas reales alteradas con IA— y respeta los términos de OmniArt junto con la legislación local sobre derechos de imagen.

Cómo empezar en OmniArt

Elige una foto base con un espacio vacío evidente y una foto de referencia limpia y bien iluminada de la persona. Abre el espacio de imagen de OmniArt, elige Seedream 5.0 Pro, sube las dos y corre el prompt de la terraza del paso 3 con tus propios detalles cambiados. En el primer render juzga solo la ubicación y la escala: la identidad y la luz son para lo que sirven las pasadas de refinamiento.

Después trabaja con correcciones chicas en vez de prompts nuevos. Dos pasadas acotadas a una zona y un render final a resolución completa es el camino normal, y mantiene intacta la foto base mientras la figura se termina de armar.

¿Todo listo para crear?

Empieza a generar contenido increíble con IA

Empezar gratis