GuideУроки та покрокові посібники10 хв читання

Як додати людину на фото за допомогою ШІ: покроково

Додайте людину на фото за допомогою ШІ: як вмонтувати когось у знімок в OmniArt через злиття кількох зображень, референсні фото, локальні правки та узгоджене світло.

Команда OmniArt
Як додати людину на фото за допомогою ШІ: покроково

Коли ви додаєте людину на фото за допомогою ШІ, ви насправді не вклеюєте вирізку — ви просите модель зображень перемалювати знімок так, щоб друга людина в ньому була доречною. Модель має поставити її в правдоподібне місце, підігнати розмір під сцену, перезасвітити під наявне світло й покласти тінь під ноги. Зробіть ці чотири речі правильно — і результат читається як фотографія. Промахніться в одній — і він читається як наліпка.

В OmniArt це завдання для моделі зображень, а не для пошарового редактора. Ви вивантажуєте вихідне фото, вивантажуєте референсне фото людини й описуєте монтаж у промпті. Seedream 5.0 Pro дає з цим раду добре, бо підтримує злиття кількох зображень — до 10 референсів, зведених в один вивід, — плюс мову ділянок і опорних точок для контролю над тим, куди саме лягає правка. GPT Image 2 приймає вказівки природною мовою, а Nano Banana 2 робить правки за референсом, коли хочеться другої думки на тій самій парі входів.

Цей посібник проходить увесь процес по порядку: оберіть фото, оберіть модель, напишіть промпт розміщення, виправте те, що не так, і зафіксуйте фінальний рендер. Три промпти для копіювання додано.

Що модель робить насправді

Перш ніж писати промпт, варто зрозуміти механізм. Коли ви даєте два зображення й одну вказівку, модель не зводить пікселі — вона генерує нове зображення, зумовлене обома входами. Із цього випливають два практичні наслідки.

По-перше, вихідне фото може трохи змінитися навіть там, де ви нічого не згадували. Фон зсувається, край столу переїжджає, текст на вивісці перемішується. Це зменшується, якщо явно захистити решту кадру в промпті — та сама дисципліна, завдяки якій працюють локальні правки.

По-друге, ідентичність повністю приходить із референсного фото. Якщо референс дрібний, розмитий, важко відфільтрований або знятий під кутом, зовсім не схожим на потрібний, модель вигадає різницю — а вигадані обличчя пливуть. Тут референс працює більше, ніж промпт.

Крок 1: оберіть вихідне фото й референс людини

Погані входи коштують більше ітерацій, ніж поганий промпт, тож витратьте тут хвилину.

Вихідне фото має містити очевидне порожнє місце, де людина може стояти чи сидіти, читабельний напрям світла й видиму землю або підлогу, щоб тіні було куди лягти. Уникайте знімків, де кожна правдоподібна позиція перекрита меблями, і уникайте надширококутних кадрів — перспективні спотворення важко відтворити.

Референс людини має бути одним чистим, добре освітленим фото, знятим приблизно під тим кутом і з тієї відстані, які потрібні у фіналі. На повний зріст, якщо людина буде на повний зріст у результаті. Нейтральне світло краще за драматичне, бо рівне світло легше перезасвітити, ніж портрет із жорсткими тінями. Якщо людина має бути в конкретному вбранні, референс має вже показувати це вбрання.

Порада

Якщо у вас є кілька придатних фото тієї самої людини, вивантажте два-три, а не одне. Seedream 5.0 Pro приймає до 10 референсів, і другий ракурс помітно покращує сталість обличчя. Тільки тримайте їх узгодженими: змішавши знімок 2019 року з нинішнім, ви даєте моделі дві ідентичності, які вона усереднить.

Крок 2: оберіть модель

Усі три доступні в просторі для зображень OmniArt, і всі три приймають вивантажені референси разом із промптом.

МодельСильна сторона для цього завданняБеріть її, коли
Seedream 5.0 ProЗлиття кількох зображень, мова ділянок і опорних точок, точні вказівки щодо матеріалу й кольоруМонтаж і є головним завданням: кілька референсів, точне розміщення чи конкретний колір вбрання
GPT Image 2Редагування природною мовою, що близько тримається розмовних вказівокВи хочете описувати зміну звичайними реченнями й ітерувати в розмові
Nano Banana 2Правки за референсом зі швидким обігомВи хочете дешеву другу інтерпретацію тих самих входів, перш ніж на щось зважитися

Розумне значення за замовчуванням: починайте із Seedream 5.0 Pro всюди, де важливі й розміщення, і ідентичність. Якщо монтаж простий — одна людина, очевидне місце, поблажливе світло, — GPT Image 2 часто доходить до результату меншою кількістю слів.

Крок 3: напишіть промпт розміщення

Промпт, який працює для цього завдання, має чотири частини саме в такому порядку:

  1. Вказівка — додати людину з референсу у вихідне фото.
  2. Розміщення й масштаб — де вона стоїть, що робить, якого розміру відносно відомого об’єкта в кадрі.
  3. Узгодження світла й тіні — напрям і якість світла у вихідному фото та куди падає тінь.
  4. Захист — усе у вихідному фото, що має лишитися незмінним.

Ось робоча версія, яку можна адаптувати:

Add the woman from the second reference photo into the first photo. Place her standing on the left side of the wooden deck, facing the camera, weight on her right leg, with her head roughly level with the top of the deck railing behind her. Match the base photo's lighting exactly: late-afternoon sun from the upper right, warm tone, soft-edged shadows. Cast her shadow down and to the left across the deck boards. Keep the deck, railing, plants, sky, and every other element of the base photo unchanged.

Зверніть увагу: «her head roughly level with the top of the deck railing» робить для масштабу більше, ніж будь-коли зробить «medium size». Прив’язка людини до чогось уже вимірного в кадрі — найкорисніший трюк із масштабом у таких промптах.

Варіант із людиною, що сидить, — для меншого й часто простішого монтажу:

Insert the man from the reference photos into the café scene, seated in the empty chair on the right side of the table, three-quarter view turned slightly toward the window, hands resting on the table. Scale him so his shoulders sit just below the top of the chair back. Light him from the window on the left with soft diffused daylight matching the base image, with a faint contact shadow where his forearms meet the table. Do not alter the table, cups, other people, or the background.

Крок 4: доопрацьовуйте локальними правками

Перший рендер рідко буває фінальним, і найпоширеніша помилка — перезапускати весь промпт. Не робіть цього. Візьміть той вивід, де розміщення вдалося, і виправляйте по одній речі за раз вказівкою, обмеженою ділянкою. Seedream 5.0 Pro зроблена саме для цього: називання ділянки, опорної точки чи місця так, як людина сказала б це вголос («bottom left», «second from the right»), тримає правку локальною.

Using this image, adjust only the added figure: soften the edge along her right shoulder so it blends with the background wall, warm her skin tones slightly to match the surrounding light, and extend her shadow another twenty percent to the left. Change nothing else in the frame.

Два-три таких точкових проходи зазвичай кращі за десять повних перезапусків, і коштують менше. Посібник із промптів для Seedream 5.0 Pro детальніше розбирає патерни з ділянками, опорними точками й шістнадцятковими кодами кольору, якщо ви хочете зайти далі.

Примітка

OmniArt відкриває звичайну генерацію зображень і генерацію за референсним зображенням. Координатні рамки, накладені ескізи й опорні шпильки — це можливості API на боці провайдера, а не окремі елементи інтерфейсу OmniArt: усередині простору ви виражаєте їх текстом у промпті. Це працює, просто вказує тут точна мова.

Крок 5: зафіксуйте фінальний рендер

Щойно розміщення, ідентичність і світло тримаються, зробіть фінальний прохід у тій роздільній здатності, яка вам справді потрібна, замість того щоб і далі правити маленьку чернетку. Перерендерте затверджений монтаж у найбільшому розмірі, який підтримує модель — Seedream 5.0 Lite дає нативний 4K, якщо роздільна здатність виводу є вирішальним чинником, — і перевірте результат при 100 %, перш ніж віддавати. Ореоли по краях і невідповідне зерно невидимі на мініатюрі й очевидні в повному розмірі.

Узгодження світла, перспективи, масштабу й тіні

Ці чотири типи поламок пояснюють більшість монтажів, які виглядають неправильно, хоч глядач і не розуміє чому.

  • Напрям світла. Спершу прочитайте тіні у вихідному фото, а потім назвіть напрям у промпті («from the upper right», «from the window on the left»). Якщо референсне фото людини було освітлене з протилежного боку, скажіть це явно: «relight the figure from the right; the reference photo's left-side lighting should not carry over».
  • Якість світла. Жорстке сонце дає тіні з різким краєм; хмарність і кімнатне світло — м’які. Людина під м’яким світлом у сцені з жорстким сонцем виглядає вклеєною. Називайте якість, а не лише напрям.
  • Перспектива й висота камери. Якщо вихідне фото знімали з рівня пояса, людина з референсу, знятого телефоном на рівні очей, сидітиме в кадрі неправильно. Додайте «match the base photo's low camera angle, viewed slightly from below» — і модель підправить ракурсні скорочення фігури.
  • Масштаб. Завжди прив’язуйте зріст до чогось у кадрі: дверного отвору, поручня, спинки стільця, плеча іншої людини. Абсолютні описи не переживають перекладу в пікселі.
  • Контактна тінь. Маленька темна зона там, де тіло торкається поверхні, і продає фізичну присутність. Просіть її прямо: «a soft contact shadow under both shoes where they meet the pavement».
  • Зерно й колір. Попросіть модель узгодити зерно, колірну температуру й будь-яку м’якість об’єктива з вихідним фото. Чиста фігура на зернистому знімку одразу видає монтаж.

Розбір типових помилок

Обличчя не схоже на людину. Ваш референс робить надто мало роботи. Вивантажте додаткові ракурси тієї самої людини, віддавайте перевагу вищій роздільній здатності й приберіть усі важко відфільтровані кадри. Потім попросіть конкретно: «preserve the facial features, hairline, and hair color from the reference photos without stylizing them».

Змінився фон. Ваше застереження про захист було надто розмитим. Перелічіть елементи явно, замість казати «keep the background». Далі зробіть виправний прохід, обмежений ділянкою, а не перегенеровуйте все.

Людина висить у повітрі. Немає контактної тіні або ноги обрізані неоднозначно. Попросіть контактну тінь прямо й переконайтеся, що площина землі видима там, куди ви поставили фігуру.

Неправильний розмір. Замініть будь-які абсолютні формулювання розміру на порівняння з об’єктом, який уже є в кадрі.

Краї виглядають вирізаними. Попросіть пом’якшити межу й узгодити зерно вздовж контуру фігури, а ще перевірте, чи не мало референсне фото жорсткої вирізки — вирізки на білому тлі провокують результат із вигляду вирізки.

Поза дерев’яна. Опишіть розподіл ваги й положення рук. «Weight on her right leg, one hand in her jacket pocket» дає природнішу стійку, ніж «standing naturally».

Попередження

Додаючи реальну впізнавану людину на фото, де її не було, ви створюєте зображення, яке натякає на неправду. Отримайте явний дозвіл цієї людини до того, як генерувати, і до того, як публікувати. Не вмонтовуйте в сцени публічних осіб, колег, колишніх партнерів чи дітей без згоди. Не створюйте зображень, що натякають на присутність на події, схвалення товару чи перебування в певному місці. Перевіряйте правила платформи, де публікуєте, — багато з них вимагають позначати змінені ШІ зображення реальних людей, — і дотримуйтеся умов OmniArt разом із місцевим законодавством про право на власне зображення.

Як почати в OmniArt

Візьміть одне вихідне фото з очевидним порожнім місцем і одне чисте, добре освітлене референсне фото людини. Відкрийте простір OmniArt для зображень, оберіть Seedream 5.0 Pro, вивантажте обидва знімки й запустіть промпт із дерев’яною терасою з кроку 3, підставивши власні деталі. На першому рендері оцінюйте лише розміщення та масштаб — ідентичність і світло існують для того, щоб ними займалися проходи доопрацювання.

Далі працюйте маленькими виправленнями замість нових промптів. Два проходи, обмежені ділянкою, і один фінальний рендер у повній роздільній здатності — це нормальний шлях, який зберігає вихідне фото цілим, поки фігура доводиться до ладу.

Готові творити?

Почніть створювати вражаючий контент зі ШІ

Почати безкоштовно