guideРуководства и инструкции9 мин чтения

Как добавить человека на фото с помощью ИИ: пошаговое руководство

Как добавить человека на фото с помощью ИИ: вписываем человека в снимок в OmniArt через слияние изображений, референсы, правки по области и подбор освещения.

Команда OmniArt
Как добавить человека на фото с помощью ИИ: пошаговое руководство

Когда вы добавляете человека на фото с помощью ИИ, вы не вклеиваете вырезанную фигуру — вы просите модель изображений перерисовать снимок так, чтобы второй человек в нём был на своём месте. Модель должна поставить его в достоверную точку, соотнести с масштабом сцены, переосветить под кадр и положить тень под ноги. Сделайте эти четыре вещи правильно — и результат читается как фотография. Промахнитесь в одной — и он читается как наклейка.

В OmniArt это задача для модели изображений, а не для послойного редактора. Вы загружаете базовое фото, загружаете референсное фото человека и описываете совмещение в промпте. Seedream 5.0 Pro справляется с этим хорошо, потому что поддерживает слияние нескольких изображений — до 10 референсов в один результат — плюс язык областей и якорей, который позволяет управлять тем, куда именно попадёт правка. GPT Image 2 принимает инструкции по редактированию на естественном языке, а Nano Banana 2 делает правки по референсу, когда хочется второго мнения по той же паре исходников.

Это руководство проходит весь воркфлоу по порядку: выбрать фотографии, выбрать модель, написать промпт с размещением, исправить неточности и зафиксировать финальный рендер. Внутри — три готовых к копированию промпта.

Что модель на самом деле делает

Полезно понять механику до того, как писать промпт. Когда вы подаёте два изображения и одну инструкцию, модель не совмещает пиксели — она генерирует новое изображение, обусловленное обоими исходниками. Отсюда два практических следствия.

Во-первых, базовое фото может слегка измениться даже там, где вы ничего не упоминали. Фон смещается, край стола сдвигается, текст на вывеске превращается в кашу. Это уменьшается, если явно защитить остальной кадр в промпте — та же дисциплина, благодаря которой работают правки по области.

Во-вторых, внешность целиком приходит из референсного фото. Если референс маленький, размытый, сильно обработанный фильтрами или снят с ракурса, далёкого от нужного вам в результате, модель придумает разницу — а придуманные лица плывут. Здесь референс делает больше работы, чем промпт.

Шаг 1. Выберите базовое фото и референс человека

Плохие исходники обходятся дороже в итерациях, чем плохой промпт, поэтому потратьте здесь минуту.

Базовое фото должно иметь очевидное свободное место, где человек может стоять или сидеть, читаемое направление света и видимую землю или пол, чтобы тени было куда лечь. Избегайте снимков, где любое разумное место закрыто мебелью, и избегайте съёмки на сверхшироком угле — перспективные искажения трудно повторить.

Референс человека должен быть одной чистой, хорошо освещённой фотографией, желательно снятой примерно с того же ракурса и расстояния, что нужны в финальном кадре. В полный рост, если в результате человек будет в полный рост. Нейтральный свет лучше драматического: плоский свет проще переосветить, чем портрет с жёсткими тенями. Если человек должен быть в определённой одежде, референс должен уже показывать эту одежду.

Совет

Если у вас есть несколько пригодных фотографий одного человека, загрузите две или три, а не одну. Seedream 5.0 Pro принимает до 10 референсов, и второй ракурс заметно улучшает сходство лица. Но держите их согласованными: если смешать снимок 2019 года с сегодняшним, модель получит две внешности и усреднит их.

Шаг 2. Выберите модель

Все три модели находятся в студии изображений OmniArt, и все три принимают загруженные референсы вместе с промптом.

МодельСильная сторона для этой задачиКогда её брать
Seedream 5.0 ProСлияние нескольких изображений, язык областей и якорей, точные указания по материалу и цветуСовмещение и есть основная задача: несколько референсов, точное размещение или конкретный цвет одежды
GPT Image 2Редактирование на естественном языке, точно следующее разговорным указаниямВы хотите описать изменение обычными предложениями и уточнять его словами
Nano Banana 2Правки по референсу с быстрым результатомНужна дешёвая вторая трактовка тех же исходников до окончательного выбора

Разумное значение по умолчанию: начинайте с Seedream 5.0 Pro всюду, где важны и размещение, и сходство. Если совмещение простое — один человек, очевидное место, нетребовательный свет — GPT Image 2 часто добирается до результата меньшим числом слов.

Шаг 3. Напишите промпт с размещением

Промпт, который работает для этой задачи, состоит из четырёх частей в таком порядке:

  1. Инструкция — добавить человека с референса в базовое фото.
  2. Размещение и масштаб — где он стоит, что делает, насколько велик относительно известного объекта в кадре.
  3. Совпадение света и тени — направление и характер света на базовом фото и то, куда падает тень.
  4. Защита — всё на базовом фото, что должно остаться неизменным.

Вот рабочая версия, которую можно приспособить под себя:

Добавь женщину со второго референсного фото на первое фото. Помести её стоящей в левой части деревянной террасы, лицом к камере, с опорой на правую ногу, так чтобы её голова была примерно на уровне верха перил террасы за ней. Точно повтори освещение базового фото: солнце позднего дня сверху справа, тёплый тон, тени с мягкими краями. Отбрось её тень вниз и влево по доскам террасы. Террасу, перила, растения, небо и все остальные элементы базового фото оставь без изменений.

Обратите внимание: «голова примерно на уровне верха перил» делает для масштаба больше, чем когда-либо сделает «среднего размера». Привязка человека к чему-то уже измеримому в кадре — самый полезный приём масштабирования в таких промптах.

Вариант с сидящим человеком — для более мелкого и обычно более простого совмещения:

Вставь мужчину с референсных фотографий в сцену в кафе, сидящим на пустом стуле справа от стола, в три четверти, слегка повёрнутым к окну, руки лежат на столе. Масштабируй его так, чтобы плечи были чуть ниже верхнего края спинки стула. Освети его от окна слева мягким рассеянным дневным светом, совпадающим с базовым изображением, и добавь слабую тень касания там, где предплечья соприкасаются со столом. Не меняй стол, чашки, других людей и фон.

Шаг 4. Доводите правками по областям

Первый рендер редко бывает финальным, и самая частая ошибка — перезапускать промпт целиком. Не делайте так. Возьмите тот результат, где размещение получилось, и правьте по одной вещи за раз инструкцией с ограниченной областью. Seedream 5.0 Pro создан именно для этого: если назвать область, точку-якорь или место так, как человек прочитал бы вслух («снизу слева», «второй справа»), правка останется локальной.

Используя это изображение, измени только добавленную фигуру: смягчи край по её правому плечу, чтобы он сливался с фоновой стеной, слегка утепли тон её кожи под окружающий свет и удлини её тень ещё на двадцать процентов влево. Больше ничего в кадре не меняй.

Два-три таких точечных прохода обычно лучше десяти полных перезапусков и стоят дешевле. Руководство по промптам для Seedream 5.0 Pro подробнее разбирает приёмы с областями, якорями и цветом по HEX, если хочется пойти дальше.

Примечание

OmniArt предоставляет стандартную генерацию изображений и генерацию по референсным изображениям. Координатные рамки, наложение эскиза и якорные метки — это воркфлоу вышестоящего API, а не отдельные элементы интерфейса OmniArt: внутри рабочего пространства вы выражаете их текстом в промпте. Это работает, просто указывать приходится точным языком.

Шаг 5. Зафиксируйте финальный рендер

Когда размещение, сходство и свет держатся, сделайте финальный проход в том разрешении, которое вам действительно нужно, а не продолжайте править маленький черновик. Перерендерьте утверждённое совмещение в максимальном размере, который поддерживает модель — Seedream 5.0 Lite даёт нативные 4K, если решающим фактором является разрешение — и проверьте результат при масштабе 100% до публикации. Ореолы по краям и несовпадающее зерно незаметны на миниатюре и очевидны в полном размере.

Как совместить свет, перспективу, масштаб и тень

Эти четыре типа сбоев объясняют большинство совмещений, которые выглядят неправильно, хотя зритель не понимает почему.

  • Направление света. Сначала прочитайте тени на базовом фото, затем укажите направление в промпте («сверху справа», «от окна слева»). Если референсное фото человека было освещено с противоположной стороны, скажите об этом прямо: «переосвети фигуру справа; левое освещение с референсного фото переносить не нужно».
  • Характер света. Жёсткое солнце даёт тени с резкими краями, пасмурная погода и комнатный свет — мягкие. Человек с мягким светом в сцене под жёстким солнцем выглядит вклеенным. Называйте характер, а не только направление.
  • Перспектива и высота камеры. Если базовое фото снято с уровня пояса, человек с референса, снятого телефоном на уровне глаз, встанет в кадр неправильно. Добавьте «повтори низкий ракурс базового фото, вид слегка снизу», и модель поправит ракурсные сокращения фигуры.
  • Масштаб. Всегда привязывайте рост к чему-то в кадре: к дверному проёму, перилам, спинке стула, плечу другого человека. Абсолютные описания не переживают перевод в пиксели.
  • Тень касания. Именно небольшая тёмная зона там, где тело соприкасается с поверхностью, и создаёт ощущение физического присутствия. Просите её прямо: «мягкая тень касания под обеими подошвами там, где они встречаются с тротуаром».
  • Зерно и цвет. Попросите модель повторить зерно, цветовую температуру и любую мягкость объектива базового фото. Чистая фигура на зернистом снимке выдаёт себя сразу.

Разбор частых проблем

Лицо не похоже на человека. Ваш референс делает слишком мало работы. Загрузите дополнительные ракурсы того же человека, отдавайте предпочтение более высокому разрешению и уберите все кадры с сильными фильтрами. Затем попросите прямо: «сохрани черты лица, линию роста волос и цвет волос с референсных фотографий, не стилизуя их».

Изменился фон. Ваша защитная оговорка была слишком расплывчатой. Перечислите элементы явно, вместо того чтобы писать «сохрани фон». Затем сделайте корректирующий проход с ограниченной областью, а не полную перегенерацию.

Человек висит в воздухе. Нет тени касания или неоднозначно обрезаны ступни. Попросите тень касания напрямую и убедитесь, что плоскость земли видна там, куда вы поместили фигуру.

Неверный размер. Замените любые абсолютные формулировки размера сравнением с объектом, который уже есть в кадре.

Края выглядят вырезанными. Попросите смягчить границу и повторить зерно вдоль контура фигуры, а также проверьте, не был ли у референсного фото жёстко вырезанный фон: вырезки на белом фоне провоцируют результат, похожий на аппликацию.

Поза скованная. Опишите распределение веса и положение рук. «Вес на правой ноге, одна рука в кармане куртки» даёт более естественную стойку, чем «стоит естественно».

Предупреждение

Добавление реального узнаваемого человека на фото, где его не было, создаёт изображение, подразумевающее неправду. Получите его явное разрешение до генерации и до публикации. Не вставляйте в сцены публичных людей, коллег, бывших партнёров или детей без согласия. Не создавайте изображения, подразумевающие присутствие на событии, поддержку продукта или нахождение в определённом месте. Проверяйте правила платформы, где публикуете: многие требуют раскрывать, что изображение реального человека изменено с помощью ИИ. Соблюдайте условия OmniArt и местное законодательство о правах на изображение.

Как начать в OmniArt

Возьмите одно базовое фото с очевидным свободным местом и одно чистое, хорошо освещённое референсное фото человека. Откройте студию изображений OmniArt, выберите Seedream 5.0 Pro, загрузите оба снимка и запустите промпт с террасой из шага 3, подставив свои детали. На первом рендере судите только размещение и масштаб — сходство и свет доводятся последующими проходами.

Дальше работайте небольшими правками, а не новыми промптами. Два прохода с ограниченной областью и один финальный рендер в полном разрешении — обычный путь, и он сохраняет базовое фото нетронутым, пока фигура складывается.

Готовы создавать?

Начните генерировать впечатляющий контент с ИИ

Начать бесплатно