GuideTutorial dan panduan cara10 menit baca

Cara menambahkan orang ke dalam foto dengan AI: langkah demi langkah

Tambahkan orang ke dalam foto dengan AI: satukan seseorang ke sebuah gambar di OmniArt lewat peleburan multi-gambar, foto referensi, suntingan area, dan cahaya serasi.

Tim OmniArt
Cara menambahkan orang ke dalam foto dengan AI: langkah demi langkah

Untuk menambahkan orang ke dalam foto dengan AI, Anda sebenarnya tidak sedang menempelkan potongan gambar — Anda meminta sebuah model gambar untuk membuat ulang satu foto agar orang kedua terasa memang berada di sana. Model harus menempatkannya di posisi yang masuk akal, menyesuaikan ukurannya dengan adegan, mengubah pencahayaannya agar cocok, dan meletakkan bayangan di bawah kakinya. Kalau keempat hal itu benar, hasilnya terbaca sebagai foto. Kalau satu saja terlewat, hasilnya terbaca sebagai stiker.

Di OmniArt ini adalah pekerjaan model gambar, bukan pekerjaan editor berbasis lapisan. Anda mengunggah foto dasarnya, mengunggah foto referensi orangnya, lalu menguraikan komposit yang Anda inginkan di dalam prompt. Seedream 5.0 Pro menangani ini dengan baik karena ia mendukung peleburan multi-gambar — sampai 10 gambar referensi dilebur menjadi satu hasil — plus bahasa area dan jangkar untuk mengendalikan persis di mana suntingannya mendarat. GPT Image 2 menerima instruksi penyuntingan dalam bahasa sehari-hari, dan Nano Banana 2 mengerjakan suntingan berpandu referensi ketika Anda ingin pendapat kedua atas pasangan masukan yang sama.

Panduan ini menjalani seluruh alur kerjanya secara berurutan: pilih fotonya, pilih modelnya, tulis prompt penempatannya, betulkan yang belum pas, lalu kunci hasil render finalnya. Tiga prompt siap salin disertakan di dalamnya.

Apa yang sebenarnya dikerjakan model

Ada gunanya memahami mekanismenya sebelum Anda menulis prompt. Ketika Anda memberi dua gambar dan satu instruksi, model tidak sedang menyusun piksel — ia membuat gambar baru yang dikondisikan oleh kedua masukan itu. Ada dua konsekuensi praktisnya.

Pertama, foto dasarnya bisa sedikit berubah bahkan di area yang tidak Anda sebutkan. Latar bergeser, tepi meja berpindah, teks di sebuah papan nama jadi kacau. Anda menekan risiko ini dengan melindungi sisa bingkainya secara tegas di dalam prompt, disiplin yang sama yang membuat suntingan area berhasil.

Kedua, identitas sepenuhnya berasal dari foto referensinya. Kalau referensinya kecil, buram, penuh filter, atau diambil dari sudut yang jauh dari sudut yang Anda inginkan pada hasilnya, model akan mengarang selisihnya — dan wajah yang dikarang akan melenceng. Di sini referensi bekerja lebih keras daripada prompt.

Langkah 1: pilih foto dasar dan foto referensi orangnya

Masukan yang buruk memakan lebih banyak pengulangan daripada prompt yang buruk, jadi luangkan satu menit di sini.

Foto dasarnya sebaiknya punya ruang kosong yang jelas tempat seseorang bisa berdiri atau duduk, arah cahaya yang terbaca, serta tanah atau lantai yang terlihat supaya bayangannya punya tempat mendarat. Hindari foto yang setiap posisi masuk akalnya terhalang perabot, dan hindari bidikan sudut sangat lebar — distorsi perspektifnya sulit dicocokkan.

Foto referensi orangnya sebaiknya satu foto yang bersih dan terang, idealnya diambil dari sudut serta jarak yang mendekati keinginan Anda pada gambar final. Seluruh badan kalau orangnya akan tampil seluruh badan di hasilnya. Cahaya netral lebih baik daripada cahaya dramatis, karena cahaya rata lebih mudah diubah daripada potret dengan bayangan keras. Kalau orangnya harus tampil dengan pakaian tertentu, referensinya sebaiknya sudah menunjukkan pakaian itu.

Tips

Kalau Anda punya beberapa foto yang layak dari orang yang sama, unggah dua atau tiga sekaligus alih-alih satu. Seedream 5.0 Pro menerima sampai 10 referensi, dan sudut kedua terbukti meningkatkan konsistensi wajah. Tetap jaga konsistensinya: mencampur foto tahun 2019 dengan foto terkini memberi model dua identitas untuk dirata-ratakan.

Langkah 2: pilih modelnya

Ketiga model ini ada di ruang kerja gambar OmniArt, dan ketiganya menerima gambar referensi yang diunggah bersama prompt.

ModelKekuatannya untuk pekerjaan iniPakai saat
Seedream 5.0 ProPeleburan multi-gambar, bahasa area dan jangkar, instruksi material dan warna yang persisKompositnya adalah pekerjaan utama — beberapa referensi, penempatan presisi, atau warna pakaian tertentu
GPT Image 2Penyuntingan bahasa sehari-hari yang mengikuti instruksi percakapan dengan cermatAnda ingin menguraikan perubahannya dalam kalimat biasa dan mengulanginya lewat percakapan
Nano Banana 2Suntingan berpandu referensi dengan hasil cepatAnda ingin tafsir kedua yang murah atas masukan yang sama sebelum memutuskan

Pilihan bawaan yang wajar: mulai dengan Seedream 5.0 Pro untuk apa pun yang penempatan dan identitasnya sama-sama penting. Kalau kompositnya sederhana — satu orang, tempat yang jelas, pencahayaan yang mudah — GPT Image 2 sering sampai ke sana dengan lebih sedikit kata.

Langkah 3: tulis prompt penempatannya

Prompt yang berhasil untuk tugas ini punya empat bagian, dalam urutan ini:

  1. Instruksinya — tambahkan orang dari foto referensi ke dalam foto dasar.
  2. Penempatan dan skala — di mana ia berdiri, sedang apa, dan seberapa besar relatif terhadap benda yang sudah dikenali di dalam bingkai.
  3. Pencocokan cahaya dan bayangan — arah serta sifat cahaya di foto dasar, dan ke mana bayangannya jatuh.
  4. Perlindungan — segala hal di foto dasar yang harus tetap identik.

Berikut versi yang bekerja dan bisa Anda sesuaikan:

Add the woman from the second reference photo into the first photo. Place her standing on the left side of the wooden deck, facing the camera, weight on her right leg, with her head roughly level with the top of the deck railing behind her. Match the base photo's lighting exactly: late-afternoon sun from the upper right, warm tone, soft-edged shadows. Cast her shadow down and to the left across the deck boards. Keep the deck, railing, plants, sky, and every other element of the base photo unchanged.

Perhatikan bahwa "kepalanya kira-kira setinggi bagian atas pagar dek" jauh lebih berguna untuk skala daripada "ukuran sedang". Mengaitkan orangnya ke sesuatu yang sudah bisa diukur di dalam bingkai adalah trik skala paling berguna dalam prompt semacam ini.

Varian dalam posisi duduk, untuk komposit yang lebih kecil dan biasanya lebih mudah:

Insert the man from the reference photos into the café scene, seated in the empty chair on the right side of the table, three-quarter view turned slightly toward the window, hands resting on the table. Scale him so his shoulders sit just below the top of the chair back. Light him from the window on the left with soft diffused daylight matching the base image, with a faint contact shadow where his forearms meet the table. Do not alter the table, cups, other people, or the background.

Langkah 4: haluskan dengan suntingan bersasaran area

Hasil render pertama jarang menjadi yang final, dan kesalahan yang paling sering dilakukan orang adalah menjalankan ulang seluruh prompt. Jangan. Ambil hasil yang penempatannya sudah benar lalu betulkan satu hal saja dengan instruksi yang cakupannya terbatas pada satu area. Seedream 5.0 Pro dibangun untuk ini — menyebut sebuah area, sebuah titik jangkar, atau sebuah posisi persis seperti orang mengucapkannya ("kiri bawah", "kedua dari kanan") menjaga suntingannya tetap lokal.

Using this image, adjust only the added figure: soften the edge along her right shoulder so it blends with the background wall, warm her skin tones slightly to match the surrounding light, and extend her shadow another twenty percent to the left. Change nothing else in the frame.

Dua atau tiga putaran bersasaran seperti ini biasanya mengalahkan sepuluh kali pengulangan penuh, dan biayanya lebih murah. Panduan prompt Seedream 5.0 Pro membahas pola area, jangkar, dan warna heksadesimal secara lebih mendalam kalau Anda ingin mendorong ini lebih jauh.

Catatan

OmniArt menyediakan pembuatan gambar standar dan pembuatan gambar berbasis referensi. Kotak koordinat, lapisan sketsa, dan pin jangkar adalah alur kerja API di hulu, bukan kendali antarmuka khusus di OmniArt — di dalam ruang kerja, Anda mengungkapkannya sebagai teks di dalam prompt. Cara itu berhasil, hanya saja bahasa yang presisilah yang bertugas menunjuk.

Langkah 5: kunci hasil render finalnya

Begitu penempatan, identitas, dan pencahayaan semuanya bertahan, lakukan satu putaran terakhir pada resolusi yang benar-benar Anda butuhkan alih-alih terus menyunting draf kecil. Render ulang komposit yang sudah disetujui pada ukuran terbesar yang didukung model — Seedream 5.0 Lite menyediakan 4K asli kalau resolusi keluaran adalah penentunya — dan periksa hasilnya pada 100% sebelum Anda menayangkannya. Lingkaran cahaya di tepi dan butiran gambar yang tidak cocok tidak terlihat pada ukuran gambar mini dan sangat kentara pada ukuran penuh.

Mencocokkan pencahayaan, perspektif, skala, dan bayangan

Empat pola kegagalan ini menjelaskan sebagian besar komposit yang terlihat salah tanpa penontonnya tahu kenapa.

  • Arah cahaya. Baca bayangan di foto dasar lebih dulu, lalu sebutkan arahnya di prompt ("dari kanan atas", "dari jendela di sebelah kiri"). Kalau foto referensi orangnya diterangi dari sisi sebaliknya, katakan secara tegas: "terangi ulang figurnya dari kanan; pencahayaan dari sisi kiri di foto referensi tidak boleh terbawa".
  • Sifat cahaya. Matahari keras menghasilkan bayangan bertepi tajam; cuaca mendung dan cahaya dalam ruangan menghasilkan bayangan lembut. Orang yang diterangi cahaya lembut di dalam adegan bermatahari keras akan terlihat ditempel. Sebutkan sifatnya, bukan cuma arahnya.
  • Perspektif dan tinggi kamera. Kalau foto dasarnya diambil dari ketinggian pinggang, orang yang direferensikan dari ponsel yang dipegang setinggi mata akan terasa salah di dalam bingkai. Tambahkan "cocokkan dengan sudut kamera rendah pada foto dasar, tampak sedikit dari bawah" dan model akan menyesuaikan pemendekan bentuk figurnya.
  • Skala. Selalu kaitkan tingginya dengan sesuatu di dalam bingkai — kusen pintu, pagar, sandaran kursi, bahu orang lain. Deskripsi absolut tidak bertahan saat diterjemahkan menjadi piksel.
  • Bayangan sentuh. Area gelap kecil tempat tubuh bertemu permukaan itulah yang menjual kehadiran fisiknya. Mintalah secara eksplisit: "bayangan sentuh yang lembut di bawah kedua sepatu tempat keduanya menyentuh trotoar".
  • Butiran dan warna. Minta model mencocokkan butiran gambar, suhu warna, dan kelembutan lensa dari foto dasarnya. Figur yang bersih di dalam foto berbutir langsung membocorkan semuanya.

Mengatasi masalah

Wajahnya tidak mirip orangnya. Referensi Anda kurang bekerja. Unggah sudut tambahan dari orang yang sama, utamakan resolusi lebih tinggi, dan buang foto yang penuh filter. Lalu mintalah secara spesifik: "pertahankan fitur wajah, garis rambut, dan warna rambut dari foto referensi tanpa membuatnya bergaya".

Latarnya berubah. Klausul perlindungan Anda terlalu kabur. Sebutkan elemennya satu per satu alih-alih berkata "pertahankan latarnya". Lalu jalankan satu putaran koreksi yang terbatas pada satu area, bukan membuat ulang seluruhnya.

Orangnya seperti melayang. Bayangan sentuhnya tidak ada, atau kakinya terpotong secara ambigu. Minta bayangan sentuhnya secara langsung dan pastikan bidang tanahnya terlihat di tempat Anda menempatkannya.

Ukurannya salah. Ganti semua bahasa ukuran absolut dengan perbandingan terhadap benda yang sudah ada di dalam bingkai.

Tepinya terlihat seperti potongan tempelan. Minta batas yang lebih lunak dan butiran yang cocok di sepanjang garis luar figurnya, dan periksa apakah foto referensinya berlatar potongan keras — potongan berlatar putih memang mendorong hasil yang terlihat seperti tempelan.

Posenya kaku. Uraikan distribusi berat badan dan posisi tangannya. "Berat badan bertumpu pada kaki kanan, satu tangan di kantong jaket" menghasilkan sikap yang lebih alami daripada "berdiri dengan wajar".

Peringatan

Menambahkan orang nyata yang bisa dikenali ke dalam foto yang sebenarnya tidak ia hadiri menciptakan gambar yang menyiratkan sesuatu yang tidak benar. Mintalah izin tegas dari orang tersebut sebelum Anda membuatnya, dan sebelum Anda menayangkannya. Jangan menyatukan figur publik, rekan kerja, mantan pasangan, atau anak-anak ke dalam sebuah adegan tanpa persetujuan. Jangan membuat gambar yang menyiratkan kehadiran di sebuah acara, dukungan terhadap sebuah produk, atau keberadaan di sebuah tempat. Periksa aturan platform tempat Anda mengunggahnya — banyak yang mewajibkan pengungkapan bahwa gambar orang nyata telah diubah dengan AI — dan patuhi ketentuan OmniArt bersama hukum setempat mengenai hak atas kemiripan diri.

Mulai di OmniArt

Pilih satu foto dasar dengan ruang kosong yang jelas dan satu foto referensi orangnya yang bersih serta terang. Buka ruang kerja gambar OmniArt, pilih Seedream 5.0 Pro, unggah keduanya, lalu jalankan prompt dek dari langkah 3 dengan detail Anda sendiri. Nilai hanya penempatan dan skalanya pada render pertama — identitas dan pencahayaan adalah urusan putaran penghalusan.

Setelah itu bekerjalah dengan koreksi kecil alih-alih prompt baru. Dua putaran bersasaran area dan satu render final beresolusi penuh adalah jalur yang normal, dan cara itu menjaga foto dasarnya tetap utuh sementara figurnya perlahan menyatu.

Siap membuat?

Mulai membuat konten menakjubkan dengan AI

Mulai gratis