Cara menambahkan orang ke dalam foto dengan AI: langkah demi langkah
Tambahkan orang ke dalam foto dengan AI: satukan seseorang ke sebuah gambar di OmniArt lewat peleburan multi-gambar, foto referensi, suntingan area, dan cahaya serasi.

Untuk menambahkan orang ke dalam foto dengan AI, Anda sebenarnya tidak sedang menempelkan potongan gambar — Anda meminta sebuah model gambar untuk membuat ulang satu foto agar orang kedua terasa memang berada di sana. Model harus menempatkannya di posisi yang masuk akal, menyesuaikan ukurannya dengan adegan, mengubah pencahayaannya agar cocok, dan meletakkan bayangan di bawah kakinya. Kalau keempat hal itu benar, hasilnya terbaca sebagai foto. Kalau satu saja terlewat, hasilnya terbaca sebagai stiker.
Di OmniArt ini adalah pekerjaan model gambar, bukan pekerjaan editor berbasis lapisan. Anda mengunggah foto dasarnya, mengunggah foto referensi orangnya, lalu menguraikan komposit yang Anda inginkan di dalam prompt. Seedream 5.0 Pro menangani ini dengan baik karena ia mendukung peleburan multi-gambar — sampai 10 gambar referensi dilebur menjadi satu hasil — plus bahasa area dan jangkar untuk mengendalikan persis di mana suntingannya mendarat. GPT Image 2 menerima instruksi penyuntingan dalam bahasa sehari-hari, dan Nano Banana 2 mengerjakan suntingan berpandu referensi ketika Anda ingin pendapat kedua atas pasangan masukan yang sama.
Panduan ini menjalani seluruh alur kerjanya secara berurutan: pilih fotonya, pilih modelnya, tulis prompt penempatannya, betulkan yang belum pas, lalu kunci hasil render finalnya. Tiga prompt siap salin disertakan di dalamnya.
Apa yang sebenarnya dikerjakan model
Ada gunanya memahami mekanismenya sebelum Anda menulis prompt. Ketika Anda memberi dua gambar dan satu instruksi, model tidak sedang menyusun piksel — ia membuat gambar baru yang dikondisikan oleh kedua masukan itu. Ada dua konsekuensi praktisnya.
Pertama, foto dasarnya bisa sedikit berubah bahkan di area yang tidak Anda sebutkan. Latar bergeser, tepi meja berpindah, teks di sebuah papan nama jadi kacau. Anda menekan risiko ini dengan melindungi sisa bingkainya secara tegas di dalam prompt, disiplin yang sama yang membuat suntingan area berhasil.
Kedua, identitas sepenuhnya berasal dari foto referensinya. Kalau referensinya kecil, buram, penuh filter, atau diambil dari sudut yang jauh dari sudut yang Anda inginkan pada hasilnya, model akan mengarang selisihnya — dan wajah yang dikarang akan melenceng. Di sini referensi bekerja lebih keras daripada prompt.
Langkah 1: pilih foto dasar dan foto referensi orangnya
Masukan yang buruk memakan lebih banyak pengulangan daripada prompt yang buruk, jadi luangkan satu menit di sini.
Foto dasarnya sebaiknya punya ruang kosong yang jelas tempat seseorang bisa berdiri atau duduk, arah cahaya yang terbaca, serta tanah atau lantai yang terlihat supaya bayangannya punya tempat mendarat. Hindari foto yang setiap posisi masuk akalnya terhalang perabot, dan hindari bidikan sudut sangat lebar — distorsi perspektifnya sulit dicocokkan.
Foto referensi orangnya sebaiknya satu foto yang bersih dan terang, idealnya diambil dari sudut serta jarak yang mendekati keinginan Anda pada gambar final. Seluruh badan kalau orangnya akan tampil seluruh badan di hasilnya. Cahaya netral lebih baik daripada cahaya dramatis, karena cahaya rata lebih mudah diubah daripada potret dengan bayangan keras. Kalau orangnya harus tampil dengan pakaian tertentu, referensinya sebaiknya sudah menunjukkan pakaian itu.
Tips
Kalau Anda punya beberapa foto yang layak dari orang yang sama, unggah dua atau tiga sekaligus alih-alih satu. Seedream 5.0 Pro menerima sampai 10 referensi, dan sudut kedua terbukti meningkatkan konsistensi wajah. Tetap jaga konsistensinya: mencampur foto tahun 2019 dengan foto terkini memberi model dua identitas untuk dirata-ratakan.
Langkah 2: pilih modelnya
Ketiga model ini ada di ruang kerja gambar OmniArt, dan ketiganya menerima gambar referensi yang diunggah bersama prompt.
| Model | Kekuatannya untuk pekerjaan ini | Pakai saat |
|---|---|---|
| Seedream 5.0 Pro | Peleburan multi-gambar, bahasa area dan jangkar, instruksi material dan warna yang persis | Kompositnya adalah pekerjaan utama — beberapa referensi, penempatan presisi, atau warna pakaian tertentu |
| GPT Image 2 | Penyuntingan bahasa sehari-hari yang mengikuti instruksi percakapan dengan cermat | Anda ingin menguraikan perubahannya dalam kalimat biasa dan mengulanginya lewat percakapan |
| Nano Banana 2 | Suntingan berpandu referensi dengan hasil cepat | Anda ingin tafsir kedua yang murah atas masukan yang sama sebelum memutuskan |
Pilihan bawaan yang wajar: mulai dengan Seedream 5.0 Pro untuk apa pun yang penempatan dan identitasnya sama-sama penting. Kalau kompositnya sederhana — satu orang, tempat yang jelas, pencahayaan yang mudah — GPT Image 2 sering sampai ke sana dengan lebih sedikit kata.
Langkah 3: tulis prompt penempatannya
Prompt yang berhasil untuk tugas ini punya empat bagian, dalam urutan ini:
- Instruksinya — tambahkan orang dari foto referensi ke dalam foto dasar.
- Penempatan dan skala — di mana ia berdiri, sedang apa, dan seberapa besar relatif terhadap benda yang sudah dikenali di dalam bingkai.
- Pencocokan cahaya dan bayangan — arah serta sifat cahaya di foto dasar, dan ke mana bayangannya jatuh.
- Perlindungan — segala hal di foto dasar yang harus tetap identik.
Berikut versi yang bekerja dan bisa Anda sesuaikan:
Tambahkan perempuan dari foto referensi kedua ke dalam foto pertama. Tempatkan ia berdiri di sisi kiri dek kayu, menghadap kamera, berat badan bertumpu pada kaki kanannya, dengan kepalanya kira-kira setinggi bagian atas pagar dek di belakangnya. Cocokkan pencahayaannya persis dengan foto dasar: sinar matahari sore dari kanan atas, nada hangat, bayangan bertepi lembut. Jatuhkan bayangannya ke bawah dan ke kiri melintasi papan dek. Pertahankan dek, pagar, tanaman, langit, dan semua elemen lain di foto dasar tanpa perubahan.
Perhatikan bahwa "kepalanya kira-kira setinggi bagian atas pagar dek" jauh lebih berguna untuk skala daripada "ukuran sedang". Mengaitkan orangnya ke sesuatu yang sudah bisa diukur di dalam bingkai adalah trik skala paling berguna dalam prompt semacam ini.
Varian dalam posisi duduk, untuk komposit yang lebih kecil dan biasanya lebih mudah:
Sisipkan pria dari foto referensi ke dalam adegan kafe, duduk di kursi kosong di sisi kanan meja, tampak tiga perempat sedikit menoleh ke arah jendela, tangan bertumpu di meja. Atur skalanya sehingga bahunya berada sedikit di bawah bagian atas sandaran kursi. Beri cahaya dari jendela di sebelah kiri dengan sinar siang yang lembut menyebar, cocok dengan foto dasarnya, disertai bayangan sentuh yang tipis di tempat lengan bawahnya menyentuh meja. Jangan ubah meja, cangkir, orang lain, atau latar belakangnya.
Langkah 4: haluskan dengan suntingan bersasaran area
Hasil render pertama jarang menjadi yang final, dan kesalahan yang paling sering dilakukan orang adalah menjalankan ulang seluruh prompt. Jangan. Ambil hasil yang penempatannya sudah benar lalu betulkan satu hal saja dengan instruksi yang cakupannya terbatas pada satu area. Seedream 5.0 Pro dibangun untuk ini — menyebut sebuah area, sebuah titik jangkar, atau sebuah posisi persis seperti orang mengucapkannya ("kiri bawah", "kedua dari kanan") menjaga suntingannya tetap lokal.
Dengan gambar ini, sesuaikan hanya figur yang ditambahkan: lunakkan tepi di sepanjang bahu kanannya agar menyatu dengan dinding latar, hangatkan sedikit warna kulitnya agar cocok dengan cahaya di sekelilingnya, dan panjangkan bayangannya dua puluh persen lagi ke arah kiri. Jangan ubah apa pun yang lain di dalam bingkai.
Dua atau tiga putaran bersasaran seperti ini biasanya mengalahkan sepuluh kali pengulangan penuh, dan biayanya lebih murah. Panduan prompt Seedream 5.0 Pro membahas pola area, jangkar, dan warna heksadesimal secara lebih mendalam kalau Anda ingin mendorong ini lebih jauh.
Catatan
OmniArt menyediakan pembuatan gambar standar dan pembuatan gambar berbasis referensi. Kotak koordinat, lapisan sketsa, dan pin jangkar adalah alur kerja API di hulu, bukan kendali antarmuka khusus di OmniArt — di dalam ruang kerja, Anda mengungkapkannya sebagai teks di dalam prompt. Cara itu berhasil, hanya saja bahasa yang presisilah yang bertugas menunjuk.
Langkah 5: kunci hasil render finalnya
Begitu penempatan, identitas, dan pencahayaan semuanya bertahan, lakukan satu putaran terakhir pada resolusi yang benar-benar Anda butuhkan alih-alih terus menyunting draf kecil. Render ulang komposit yang sudah disetujui pada ukuran terbesar yang didukung model — Seedream 5.0 Lite menyediakan 4K asli kalau resolusi keluaran adalah penentunya — dan periksa hasilnya pada 100% sebelum Anda menayangkannya. Lingkaran cahaya di tepi dan butiran gambar yang tidak cocok tidak terlihat pada ukuran gambar mini dan sangat kentara pada ukuran penuh.
Mencocokkan pencahayaan, perspektif, skala, dan bayangan
Empat pola kegagalan ini menjelaskan sebagian besar komposit yang terlihat salah tanpa penontonnya tahu kenapa.
- Arah cahaya. Baca bayangan di foto dasar lebih dulu, lalu sebutkan arahnya di prompt ("dari kanan atas", "dari jendela di sebelah kiri"). Kalau foto referensi orangnya diterangi dari sisi sebaliknya, katakan secara tegas: "terangi ulang figurnya dari kanan; pencahayaan dari sisi kiri di foto referensi tidak boleh terbawa".
- Sifat cahaya. Matahari keras menghasilkan bayangan bertepi tajam; cuaca mendung dan cahaya dalam ruangan menghasilkan bayangan lembut. Orang yang diterangi cahaya lembut di dalam adegan bermatahari keras akan terlihat ditempel. Sebutkan sifatnya, bukan cuma arahnya.
- Perspektif dan tinggi kamera. Kalau foto dasarnya diambil dari ketinggian pinggang, orang yang direferensikan dari ponsel yang dipegang setinggi mata akan terasa salah di dalam bingkai. Tambahkan "cocokkan dengan sudut kamera rendah pada foto dasar, tampak sedikit dari bawah" dan model akan menyesuaikan pemendekan bentuk figurnya.
- Skala. Selalu kaitkan tingginya dengan sesuatu di dalam bingkai — kusen pintu, pagar, sandaran kursi, bahu orang lain. Deskripsi absolut tidak bertahan saat diterjemahkan menjadi piksel.
- Bayangan sentuh. Area gelap kecil tempat tubuh bertemu permukaan itulah yang menjual kehadiran fisiknya. Mintalah secara eksplisit: "bayangan sentuh yang lembut di bawah kedua sepatu tempat keduanya menyentuh trotoar".
- Butiran dan warna. Minta model mencocokkan butiran gambar, suhu warna, dan kelembutan lensa dari foto dasarnya. Figur yang bersih di dalam foto berbutir langsung membocorkan semuanya.
Mengatasi masalah
Wajahnya tidak mirip orangnya. Referensi Anda kurang bekerja. Unggah sudut tambahan dari orang yang sama, utamakan resolusi lebih tinggi, dan buang foto yang penuh filter. Lalu mintalah secara spesifik: "pertahankan fitur wajah, garis rambut, dan warna rambut dari foto referensi tanpa membuatnya bergaya".
Latarnya berubah. Klausul perlindungan Anda terlalu kabur. Sebutkan elemennya satu per satu alih-alih berkata "pertahankan latarnya". Lalu jalankan satu putaran koreksi yang terbatas pada satu area, bukan membuat ulang seluruhnya.
Orangnya seperti melayang. Bayangan sentuhnya tidak ada, atau kakinya terpotong secara ambigu. Minta bayangan sentuhnya secara langsung dan pastikan bidang tanahnya terlihat di tempat Anda menempatkannya.
Ukurannya salah. Ganti semua bahasa ukuran absolut dengan perbandingan terhadap benda yang sudah ada di dalam bingkai.
Tepinya terlihat seperti potongan tempelan. Minta batas yang lebih lunak dan butiran yang cocok di sepanjang garis luar figurnya, dan periksa apakah foto referensinya berlatar potongan keras — potongan berlatar putih memang mendorong hasil yang terlihat seperti tempelan.
Posenya kaku. Uraikan distribusi berat badan dan posisi tangannya. "Berat badan bertumpu pada kaki kanan, satu tangan di kantong jaket" menghasilkan sikap yang lebih alami daripada "berdiri dengan wajar".
Peringatan
Menambahkan orang nyata yang bisa dikenali ke dalam foto yang sebenarnya tidak ia hadiri menciptakan gambar yang menyiratkan sesuatu yang tidak benar. Mintalah izin tegas dari orang tersebut sebelum Anda membuatnya, dan sebelum Anda menayangkannya. Jangan menyatukan figur publik, rekan kerja, mantan pasangan, atau anak-anak ke dalam sebuah adegan tanpa persetujuan. Jangan membuat gambar yang menyiratkan kehadiran di sebuah acara, dukungan terhadap sebuah produk, atau keberadaan di sebuah tempat. Periksa aturan platform tempat Anda mengunggahnya — banyak yang mewajibkan pengungkapan bahwa gambar orang nyata telah diubah dengan AI — dan patuhi ketentuan OmniArt bersama hukum setempat mengenai hak atas kemiripan diri.
Mulai di OmniArt
Pilih satu foto dasar dengan ruang kosong yang jelas dan satu foto referensi orangnya yang bersih serta terang. Buka ruang kerja gambar OmniArt, pilih Seedream 5.0 Pro, unggah keduanya, lalu jalankan prompt dek dari langkah 3 dengan detail Anda sendiri. Nilai hanya penempatan dan skalanya pada render pertama — identitas dan pencahayaan adalah urusan putaran penghalusan.
Setelah itu bekerjalah dengan koreksi kecil alih-alih prompt baru. Dua putaran bersasaran area dan satu render final beresolusi penuh adalah jalur yang normal, dan cara itu menjaga foto dasarnya tetap utuh sementara figurnya perlahan menyatu.
Siap membuat?
Mulai hasilkan konten menakjubkan dengan AI