Guideチュートリアルと使い方ガイド21分で読めます

AIで写真に人物を追加する方法:手順で学ぶ完全ガイド

AIで写真に人物を追加する手順を解説。OmniArtの複数画像の融合、参照写真、領域指定の編集、ライティングの一致を使って自然な合成に仕上げる方法をまとめました。

OmniArt チーム
AIで写真に人物を追加する方法:手順で学ぶ完全ガイド

AIで写真に人物を追加するとき、実際にやっているのは切り抜きを貼り付けることではありません。もう1人の人物がその中にいて自然だと感じられるように、画像モデルに1枚の写真を描き直させているのです。モデルはその人物をもっともらしい位置に置き、シーンに合う大きさにし、周囲に合わせて光を当て直し、足元に影を落とさなければなりません。この4つが決まれば結果は写真として読めますし、1つでも外すと貼り付けたステッカーのように見えます。

OmniArtでは、これはレイヤー式のエディターの作業ではなく画像モデルの仕事です。ベースとなる写真をアップロードし、人物の参照写真をアップロードし、合成の内容をプロンプトで説明します。Seedream 5.0 Proはこの作業に向いています。複数画像の融合、つまり最大10枚の参照画像を1つの出力に統合する機能に対応しており、加えて編集をどこに効かせるかを制御する領域とアンカーの言い方が使えるからです。GPT Image 2は自然な言葉での編集指示を受け付け、Nano Banana 2は同じ入力の組み合わせに対して別の解釈が欲しいときに参照を使った編集を担います。

このガイドでは、ワークフロー全体を順番にたどります。写真を選ぶ、モデルを選ぶ、配置のプロンプトを書く、ずれているところを直す、そして最終出力を確定する。コピーして使えるプロンプトを3つ載せています。

モデルが実際にやっていること

プロンプトを書く前に仕組みを理解しておくと役に立ちます。2枚の画像と1つの指示を渡したとき、モデルはピクセルを合成しているのではなく、両方の入力を条件として新しい画像を生成しています。ここから実務上の帰結が2つ出てきます。

1つめは、指示していない部分でもベース写真がわずかに変わりうることです。背景がずれる、テーブルの縁が動く、看板の文字が崩れる。これはプロンプトの中でそれ以外の画面を明示的に守ることで減らせます。領域指定の編集を成立させるのと同じ規律です。

2つめは、同一性が完全に参照写真から来ることです。参照が小さい、ぼやけている、加工が強い、あるいは出力で望む角度からかけ離れて撮られている場合、モデルはその差を捏造します。そして捏造された顔は漂います。ここでは参照写真がプロンプトより大きな仕事をしています。

ステップ1:ベース写真と人物の参照を選ぶ

入力の質が悪いと、プロンプトの質が悪いよりも多くの試行を消費します。ここに1分かけてください。

ベース写真には、人が立ったり座ったりできる明らかな空きスペースがあり、光の向きが読み取れて、影が落ちる先となる地面や床が見えていることが望ましいです。人が入れそうな位置がすべて家具で隠れている写真は避けてください。また極端な広角の写真も避けましょう。遠近の歪みを合わせるのが難しくなります。

人物の参照写真は、きれいで十分に明るい1枚を使い、できれば最終画像で望む角度と距離に近い条件で撮られたものを選びます。出力で全身を出すなら参照も全身にしてください。演出的なライティングより自然な平坦なライティングのほうが優れています。硬い影のあるポートレートより、平坦な光のほうが当て直しが容易だからです。特定の服装で登場させたい場合は、参照写真がすでにその服装であるべきです。

ヒント

同じ人物の使える写真が複数あるなら、1枚ではなく2〜3枚をアップロードしてください。Seedream 5.0 Proは最大10枚の参照を受け付け、角度が1つ増えるだけで顔の一貫性が測れるほど改善します。ただし条件は揃えてください。2019年の写真と現在の写真を混ぜると、モデルに平均を取るべき2つの同一性を与えることになります。

ステップ2:モデルを選ぶ

以下の3つはいずれもOmniArtの画像ワークスペースにあり、どれもプロンプトと一緒にアップロードした参照画像を受け付けます。

モデルこの作業での強み選ぶ場面
Seedream 5.0 Pro複数画像の融合、領域とアンカーの言い方、正確な素材と色の指定合成そのものが主目的のとき。参照が複数ある、配置が精密、服の色が指定されている場合
GPT Image 2会話的な指示に忠実な、自然な言葉での編集普通の文で変更を伝え、対話しながら詰めたいとき
Nano Banana 2参照を使った編集と速い仕上がり決める前に、同じ入力で安価な2つめの解釈を見たいとき

妥当な初期設定はこうです。配置と同一性の両方が重要な場合は、まずSeedream 5.0 Proから始めてください。合成が単純なとき、つまり人物が1人、入る位置が明らか、ライティングも寛容な場合は、GPT Image 2のほうが少ない言葉で到達することがよくあります。

ステップ3:配置のプロンプトを書く

この作業でうまく機能するプロンプトには、次の順序で4つの要素があります。

  1. 指示 — 参照写真の人物をベース写真に追加する。
  2. 配置と大きさ — どこに立つのか、何をしているのか、画面内の既知の物体に対してどのくらいの大きさか。
  3. 光と影の一致 — ベース写真の光の向きと質、そして影が落ちる方向。
  4. 保護 — ベース写真の中で変わってはいけないものすべて。

そのまま応用できる実例がこちらです。

Add the woman from the second reference photo into the first photo. Place her standing on the left side of the wooden deck, facing the camera, weight on her right leg, with her head roughly level with the top of the deck railing behind her. Match the base photo's lighting exactly: late-afternoon sun from the upper right, warm tone, soft-edged shadows. Cast her shadow down and to the left across the deck boards. Keep the deck, railing, plants, sky, and every other element of the base photo unchanged.

「頭の高さがデッキの手すりの上端とほぼ同じ」という書き方が、「中くらいの大きさ」よりもはるかに大きさを決めてくれることに注目してください。画面内ですでに測れるものに人物を結びつけることが、この種のプロンプトで最も役に立つ大きさの指定方法です。

より小さく、多くの場合より簡単な合成として、座った状態の例も挙げます。

Insert the man from the reference photos into the café scene, seated in the empty chair on the right side of the table, three-quarter view turned slightly toward the window, hands resting on the table. Scale him so his shoulders sit just below the top of the chair back. Light him from the window on the left with soft diffused daylight matching the base image, with a faint contact shadow where his forearms meet the table. Do not alter the table, cups, other people, or the background.

ステップ4:領域を絞った編集で詰める

最初の出力が完成品になることはまれです。そして多くの人がやってしまう間違いは、プロンプト全体を回し直すことです。それはやめてください。配置が決まった出力を残し、領域を限定した指示で1つずつ直していきます。Seedream 5.0 Proはこのために作られています。領域、アンカーとなる点、あるいは人が声に出して読むような位置の言い方(「左下」「右から2番目」)を指定することで、編集が局所に留まります。

Using this image, adjust only the added figure: soften the edge along her right shoulder so it blends with the background wall, warm her skin tones slightly to match the surrounding light, and extend her shadow another twenty percent to the left. Change nothing else in the frame.

こうした狙いを絞った工程を2〜3回行うほうが、全体を10回作り直すより結果が良く、コストも低く済みます。さらに踏み込みたい場合は、Seedream 5.0 Proプロンプトガイドが領域、アンカー、HEXコードによる色指定の型をより詳しく解説しています。

メモ

OmniArtが提供しているのは、標準の画像生成と参照画像を使った生成です。座標の枠、スケッチの重ね描き、アンカーの打ち込みは上流のAPIワークフローであり、OmniArt専用の操作項目ではありません。ワークスペースの中では、それらをプロンプトの文章として表現します。それでも機能しますが、指し示す役割を言葉の精度が担っているということです。

ステップ5:最終出力を確定する

配置、同一性、ライティングがすべて成立したら、小さなラフを編集し続けるのではなく、実際に必要な解像度で最終工程を回してください。承認した合成をモデルが対応する最大サイズで再生成してください。出力解像度が決定要因になるなら、Seedream 5.0 Liteがネイティブ4Kに対応しています。そして公開する前に、必ず100%表示で結果を確認します。輪郭の光のにじみや粒子感の不一致は、サムネイルの大きさでは見えず、原寸ではっきり見えます。

ライティング、遠近、大きさ、影を合わせる

不自然に見えるのに理由が分からない合成の大半は、この4つの失敗パターンで説明できます。

  • 光の向き。 まずベース写真の影を読み、そのうえで向きをプロンプトに書きます(「右上から」「左側の窓から」)。人物の参照写真が逆側から照らされていた場合は、そのことも明示してください。「人物には右から光を当て直し、参照写真の左側からのライティングは持ち込まないこと」のように書きます。
  • 光の質。 硬い日光は輪郭のはっきりした影を作り、曇天や室内の光は柔らかい影を作ります。硬い日差しのシーンに柔らかい光の人物がいると、貼り付けたように見えます。向きだけでなく質も指定してください。
  • 遠近とカメラの高さ。 ベース写真が腰の高さから撮られている場合、目の高さで構えたスマートフォンから参照した人物は画面の中で浮きます。「ベース写真の低いカメラ位置に合わせ、やや下から見上げた見え方にすること」と加えれば、モデルは人物の遠近による縮み方を調整します。
  • 大きさ。 身長は必ず画面内の何かに結びつけてください。戸口、手すり、椅子の背、他の人の肩などです。絶対的な言い方はピクセルへの翻訳を生き残れません。
  • 接地影。 体が面に接するところにできる小さな暗い部分が、物理的な存在感を成立させます。名前を出して依頼してください。「両足が舗道に接する部分に柔らかい接地影を入れること」のように書きます。
  • 粒子感と色。 ベース写真の粒子感、色温度、レンズによるにじみを合わせるようモデルに頼んでください。粒子の粗い写真の中にきれいな人物がいるのは、すぐに分かってしまいます。

うまくいかないときの対処

顔がその人に見えない。 参照写真の働きが足りていません。同じ人物の別角度を追加し、解像度の高いものを優先し、加工の強い写真は外してください。そのうえで具体的に指示します。「参照写真の顔の特徴、髪の生え際、髪の色を、様式化せずにそのまま保つこと」。

背景が変わってしまった。 保護の一文が曖昧でした。「背景を保つ」と書くのではなく、要素を明示的に列挙してください。そして全体を再生成するのではなく、領域を絞った修正の工程を回します。

人物が浮いている。 接地影がないか、足の切れ方が曖昧です。接地影を直接依頼し、置いた位置で地面が見えていることを確認してください。

大きさが違う。 絶対的な大きさの表現をすべて、画面内にすでにある物体との比較に置き換えてください。

輪郭が切り抜きに見える。 人物の輪郭に沿って境界を柔らげ、粒子感を合わせるよう依頼し、参照写真の背景が硬い切り抜きになっていなかったか確認してください。白背景の切り抜きは、切り抜きらしい結果を招きます。

ポーズが硬い。 体重のかけ方と手の位置を説明してください。「体重を右脚にかけ、片手はジャケットのポケットに入れる」は、「自然に立っている」よりも自然な立ち姿になります。

警告

実在する特定できる人物を、その人がいなかった写真に追加すると、事実でないことを示す画像になります。生成する前と公開する前に、その人物からの明確な許可を得てください。公人、同僚、元交際相手、子どもを、同意なくシーンに合成しないでください。イベントへの参加、商品の推奨、ある場所にいたことを示唆する画像を作らないでください。投稿先のプラットフォームの規定も確認してください。実在人物のAI加工画像には表示を求めるところが多くあります。あわせて、肖像権に関する各地域の法律とOmniArtの利用規約に従ってください。

OmniArtで始める

明らかな空きスペースのあるベース写真を1枚と、きれいで十分に明るい人物の参照写真を1枚選んでください。OmniArtの画像ワークスペースを開き、Seedream 5.0 Proを選び、両方をアップロードして、ステップ3のデッキのプロンプトを自分の内容に差し替えて実行します。最初の出力では配置と大きさだけを評価してください。同一性とライティングは、詰めの工程で解決するものです。

そのあとは新しいプロンプトではなく、小さな修正を積み重ねます。領域を絞った工程を2回と、最後に原寸で1回生成するのが通常の道筋で、この進め方ならベース写真をそのまま保ったまま人物を仕上げられます。

制作を始めますか?

AIで魅力的なコンテンツを生成しましょう

無料で始める