guideTutoriels et guides pratiques12 min de lecture

Comment ajouter une personne sur une photo avec l'IA : pas à pas

Ajoutez une personne sur une photo avec l'IA : intégrez quelqu'un dans une image sur OmniArt grâce à la fusion multi-images, aux photos de référence et à la lumière accordée.

Équipe OmniArt
Comment ajouter une personne sur une photo avec l'IA : pas à pas

Pour ajouter une personne sur une photo avec l'IA, vous ne collez pas vraiment un détourage : vous demandez à un modèle d'image de refabriquer une photo pour qu'une seconde personne y appartienne. Le modèle doit la placer à un endroit plausible, la mettre à l'échelle de la scène, la réclairer pour qu'elle s'accorde, et poser une ombre sous ses pieds. Réussissez ces quatre choses et le résultat se lit comme une photographie. Ratez-en une et il se lit comme un autocollant.

Sur OmniArt, c'est un travail de modèle d'image, pas une tâche d'éditeur à calques. Vous chargez la photo de base, vous chargez une photo de référence de la personne, et vous décrivez le montage dans le prompt. Seedream 5.0 Pro s'en sort bien parce qu'il prend en charge la fusion multi-images — jusqu'à 10 images de référence fusionnées en une seule sortie — plus un vocabulaire de zone et d'ancrage pour contrôler exactement où la retouche atterrit. GPT Image 2 accepte des instructions d'édition en langage naturel, et Nano Banana 2 réalise des retouches guidées par référence quand vous voulez un second avis sur la même paire d'entrées.

Ce guide parcourt tout le flux dans l'ordre : choisir les photos, choisir le modèle, écrire le prompt de placement, corriger ce qui ne va pas, puis verrouiller un rendu final. Trois prompts prêts à copier sont inclus.

Ce que le modèle fait réellement

Il est utile de comprendre le mécanisme avant d'écrire un prompt. Quand vous fournissez deux images et une instruction, le modèle ne compose pas des pixels : il génère une nouvelle image conditionnée par les deux entrées. Cela a deux conséquences pratiques.

D'abord, la photo de base peut changer légèrement, même dans des zones que vous n'avez pas mentionnées. Les arrière-plans se décalent, le bord d'une table bouge, le texte d'un panneau se brouille. Vous réduisez cela en protégeant explicitement le reste de l'image dans le prompt, la même discipline qui fait fonctionner les retouches de zone.

Ensuite, l'identité vient entièrement de la photo de référence. Si la référence est petite, floue, très filtrée, ou prise sous un angle très éloigné de celui que vous voulez en sortie, le modèle inventera la différence — et les visages inventés dérivent. Ici, la référence travaille plus que le prompt.

Étape 1 : choisir la photo de base et la référence de la personne

De mauvaises entrées coûtent plus d'itérations qu'un mauvais prompt : consacrez-y une minute.

La photo de base doit présenter un espace vide évident où une personne peut se tenir ou s'asseoir, une direction de lumière lisible, et un sol ou un plancher visible pour que l'ombre ait un endroit où atterrir. Évitez les photos où toutes les positions plausibles sont masquées par du mobilier, et évitez les prises de vue en très grand angle : la distorsion de perspective est difficile à faire correspondre.

La photo de référence de la personne doit être une photo unique, nette et bien éclairée, idéalement prise à peu près sous l'angle et à la distance voulus dans l'image finale. En pied si la personne doit apparaître en pied. Une lumière neutre vaut mieux qu'une lumière dramatique, car une lumière plate se réclaire plus facilement qu'un portrait aux ombres dures. Si la personne doit apparaître dans une tenue précise, la référence doit déjà montrer cette tenue.

Astuce

Si vous avez plusieurs photos exploitables de la même personne, chargez-en deux ou trois plutôt qu'une seule. Seedream 5.0 Pro accepte jusqu'à 10 références, et un second angle améliore sensiblement la cohérence du visage. Gardez-les cohérentes entre elles : mélanger une photo de 2019 avec une photo récente donne au modèle deux identités à moyenner.

Étape 2 : choisir le modèle

Ces trois modèles sont dans l'espace de travail image d'OmniArt, et tous les trois acceptent des images de référence chargées à côté du prompt.

ModèleSa force pour cette tâcheChoisissez-le quand
Seedream 5.0 ProFusion multi-images, vocabulaire de zone et d'ancrage, instructions exactes de matière et de couleurLe montage est la tâche principale : plusieurs références, un placement précis ou une couleur de tenue imposée
GPT Image 2Une édition en langage naturel qui suit de près les instructions conversationnellesVous voulez décrire le changement en phrases simples et itérer en dialoguant
Nano Banana 2Des retouches guidées par référence, avec un rendu rapideVous voulez une seconde interprétation peu coûteuse des mêmes entrées avant de vous engager

Un choix par défaut raisonnable : commencez par Seedream 5.0 Pro dès que le placement et l'identité comptent tous les deux. Si le montage est simple — une personne, un emplacement évident, une lumière indulgente — GPT Image 2 y arrive souvent en moins de mots.

Étape 3 : écrire le prompt de placement

Un prompt efficace pour cette tâche comporte quatre parties, dans cet ordre :

  1. L'instruction — ajouter la personne de la référence dans la photo de base.
  2. Placement et échelle — où elle se tient, ce qu'elle fait, quelle taille par rapport à un objet connu du cadre.
  3. Accord de la lumière et de l'ombre — la direction et la qualité de la lumière dans la photo de base, et l'endroit où tombe l'ombre.
  4. Protection — tout ce qui, dans la photo de base, doit rester identique.

Voici une version fonctionnelle que vous pouvez adapter :

Ajoute la femme de la deuxième photo de référence dans la première photo. Place-la debout sur le côté gauche de la terrasse en bois, face à l'objectif, le poids sur la jambe droite, la tête à peu près à hauteur du haut de la rambarde derrière elle. Reproduis exactement l'éclairage de la photo de base : soleil de fin d'après-midi venant d'en haut à droite, tonalité chaude, ombres aux contours doux. Projette son ombre vers le bas et vers la gauche, sur les lames de la terrasse. Garde la terrasse, la rambarde, les plantes, le ciel et tous les autres éléments de la photo de base inchangés.

Remarquez que « la tête à peu près à hauteur du haut de la rambarde » fait bien plus pour l'échelle que « de taille moyenne » ne le fera jamais. Ancrer la personne à quelque chose de déjà mesurable dans le cadre est l'astuce d'échelle la plus utile de ces prompts.

Une variante assise, pour un montage plus petit et souvent plus facile :

Insère l'homme des photos de référence dans la scène de café, assis sur la chaise vide à droite de la table, de trois quarts, légèrement tourné vers la fenêtre, les mains posées sur la table. Mets-le à l'échelle pour que ses épaules arrivent juste sous le haut du dossier de la chaise. Éclaire-le par la fenêtre à gauche, avec une lumière du jour douce et diffuse identique à celle de l'image de base, et une légère ombre de contact là où ses avant-bras rencontrent la table. Ne modifie ni la table, ni les tasses, ni les autres personnes, ni l'arrière-plan.

Étape 4 : affiner avec des retouches ciblées par zone

Le premier rendu est rarement définitif, et l'erreur que commettent la plupart des gens est de relancer tout le prompt. Ne le faites pas. Reprenez la sortie qui a réussi le placement et corrigez une seule chose à la fois, avec une instruction limitée à une zone. Seedream 5.0 Pro est bâti pour cela : nommer une zone, un point d'ancrage ou un emplacement comme une personne le lirait à voix haute (« en bas à gauche », « le deuxième en partant de la droite ») garde la retouche locale.

À partir de cette image, ajuste uniquement la silhouette ajoutée : adoucis le bord le long de son épaule droite pour qu'il se fonde avec le mur d'arrière-plan, réchauffe légèrement ses tons de peau pour qu'ils s'accordent à la lumière environnante, et allonge son ombre de vingt pour cent de plus vers la gauche. Ne change rien d'autre dans l'image.

Deux ou trois de ces passes ciblées valent généralement mieux que dix relances complètes, et elles coûtent moins cher. Le guide de prompts Seedream 5.0 Pro approfondit les schémas de zone, d'ancrage et de couleur hexadécimale si vous voulez pousser plus loin.

Note

OmniArt expose la génération d'images standard et la génération avec images de référence. Les boîtes de coordonnées, les calques de croquis et les épingles d'ancrage sont des flux d'API en amont, pas des contrôles dédiés de l'interface OmniArt — dans l'espace de travail, vous les exprimez sous forme de texte dans le prompt. Cela fonctionne, mais cela veut dire que c'est la précision du langage qui fait le pointage.

Étape 5 : verrouiller le rendu final

Une fois que le placement, l'identité et l'éclairage tiennent tous les trois, faites une passe finale à la résolution dont vous avez réellement besoin, plutôt que de continuer à retoucher un petit brouillon. Refaites le rendu du montage validé à la plus grande taille que le modèle prend en charge — Seedream 5.0 Lite propose de la 4K native si la résolution de sortie est le critère décisif — et vérifiez le résultat à 100 % avant de le livrer. Les halos de contour et le grain mal accordé sont invisibles en vignette et évidents en pleine taille.

Accorder la lumière, la perspective, l'échelle et l'ombre

Ces quatre modes d'échec expliquent la majorité des montages qui sonnent faux sans que le spectateur sache pourquoi.

  • La direction de la lumière. Lisez d'abord les ombres de la photo de base, puis énoncez la direction dans le prompt (« d'en haut à droite », « par la fenêtre à gauche »). Si la photo de référence de la personne était éclairée du côté opposé, dites-le explicitement : « réclaire la silhouette depuis la droite ; l'éclairage venant de la gauche sur la photo de référence ne doit pas être conservé ».
  • La qualité de la lumière. Un soleil dur donne des ombres à bords nets ; un ciel couvert et la lumière d'intérieur en donnent de douces. Une personne éclairée en douceur dans une scène en plein soleil a l'air collée. Nommez la qualité, pas seulement la direction.
  • La perspective et la hauteur de caméra. Si la photo de base a été prise à hauteur de taille, une personne photographiée avec un téléphone tenu à hauteur d'yeux tombera mal dans le cadre. Ajoutez « respecte l'angle de caméra bas de la photo de base, vue légèrement de dessous » et le modèle ajustera le raccourci de la silhouette.
  • L'échelle. Reliez toujours la hauteur à quelque chose du cadre : une porte, une rambarde, un dossier de chaise, l'épaule d'une autre personne. Les descriptions absolues ne survivent pas à la traduction en pixels.
  • L'ombre de contact. La petite zone sombre là où un corps rencontre une surface est ce qui vend la présence physique. Demandez-la par son nom : « une ombre de contact douce sous les deux chaussures, là où elles touchent le trottoir ».
  • Le grain et la couleur. Demandez au modèle de reproduire le grain, la température de couleur et l'éventuelle douceur d'objectif de la photo de base. Une silhouette nette dans une photo granuleuse se repère immédiatement.

Dépannage

Le visage ne ressemble pas à la personne. Votre référence ne travaille pas assez. Chargez d'autres angles de la même personne, préférez une résolution plus élevée, et écartez les prises très filtrées. Puis demandez explicitement : « conserve les traits du visage, la ligne des cheveux et la couleur des cheveux des photos de référence, sans les styliser ».

L'arrière-plan a changé. Votre clause de protection était trop vague. Énumérez les éléments explicitement au lieu de dire « garde l'arrière-plan ». Lancez ensuite une passe de correction limitée à une zone plutôt qu'une régénération complète.

La personne flotte. Ombre de contact manquante, ou pieds coupés de façon ambiguë. Demandez directement l'ombre de contact et vérifiez que le plan du sol est visible là où vous l'avez placée.

Mauvaise taille. Remplacez toute formulation de taille absolue par une comparaison avec un objet déjà présent dans le cadre.

Les bords ont l'air découpés. Demandez un contour adouci et un grain accordé le long de la silhouette, et vérifiez si la photo de référence avait un fond détouré net : les détourages sur fond blanc encouragent des résultats qui ont l'air découpés.

La pose est raide. Décrivez la répartition du poids et la position des mains. « Le poids sur la jambe droite, une main dans la poche de la veste » produit une posture plus naturelle que « debout naturellement ».

Avertissement

Ajouter une personne réelle et identifiable à une photo où elle ne se trouvait pas crée une image qui suggère quelque chose de faux. Obtenez son autorisation explicite avant de générer, et avant de publier. N'intégrez pas de personnalités publiques, de collègues, d'anciens partenaires ou d'enfants dans des scènes sans consentement. Ne créez pas d'images suggérant la présence à un événement, la recommandation d'un produit ou la présence dans un lieu. Vérifiez les règles de la plateforme où vous publiez — beaucoup exigent de signaler les images de personnes réelles modifiées par IA — et respectez les conditions d'OmniArt ainsi que toute loi locale sur le droit à l'image.

Premiers pas sur OmniArt

Choisissez une photo de base avec un espace vide évident et une photo de référence nette et bien éclairée de la personne. Ouvrez l'espace de travail image d'OmniArt, sélectionnez Seedream 5.0 Pro, chargez les deux images, et lancez le prompt de la terrasse de l'étape 3 en y glissant vos propres détails. Sur le premier rendu, ne jugez que le placement et l'échelle : l'identité et l'éclairage sont l'affaire des passes d'affinage.

Travaillez ensuite par petites corrections plutôt que par nouveaux prompts. Deux passes limitées à une zone et un rendu final en pleine résolution, voilà le parcours normal : il garde la photo de base intacte pendant que la silhouette se met en place.

Prêt à créer ?

Commencez à générer du contenu incroyable avec l’IA

Commencer gratuitement