guideHướng dẫn và cách làm14 phút đọc

Cách thêm người vào ảnh bằng AI: hướng dẫn từng bước

Thêm người vào ảnh bằng AI: ghép một người vào ảnh trên OmniArt bằng hợp nhất nhiều ảnh, ảnh tham chiếu, chỉnh sửa theo vùng và ánh sáng được khớp chính xác.

Đội ngũ OmniArt
Cách thêm người vào ảnh bằng AI: hướng dẫn từng bước

Khi thêm người vào ảnh bằng AI, thực chất bạn không dán một hình cắt sẵn — bạn đang yêu cầu một mô hình ảnh kết xuất lại tấm ảnh sao cho người thứ hai thuộc về khung hình đó. Mô hình phải đặt họ vào một chỗ hợp lý, chỉnh tỷ lệ cho khớp bối cảnh, chiếu sáng lại cho ăn nhập, và đặt một vệt bóng dưới chân họ. Làm đúng bốn việc đó thì kết quả đọc ra một tấm ảnh chụp. Sai một việc thì nó đọc ra một miếng dán.

Trên OmniArt, đây là công việc của mô hình ảnh, không phải của một trình chỉnh sửa theo lớp. Bạn tải ảnh nền lên, tải một ảnh tham chiếu của người cần thêm, rồi mô tả bản ghép trong prompt. Seedream 5.0 Pro xử lý việc này tốt vì nó hỗ trợ hợp nhất nhiều ảnh — tối đa 10 ảnh tham chiếu hòa vào một kết quả — cộng với ngôn ngữ chỉ vùng và điểm neo để kiểm soát chính xác nơi thay đổi diễn ra. GPT Image 2 nhận chỉ dẫn chỉnh sửa bằng ngôn ngữ tự nhiên, còn Nano Banana 2 làm các lần sửa dẫn bởi tham chiếu khi bạn muốn một cách diễn giải thứ hai trên cùng bộ đầu vào.

Hướng dẫn này đi qua toàn bộ quy trình theo đúng trình tự: chọn ảnh, chọn mô hình, viết prompt xác định vị trí, sửa những chỗ chưa đúng, rồi chốt bản kết xuất cuối. Trong bài có ba prompt bạn có thể sao chép và dùng ngay.

Mô hình thực sự đang làm gì

Hiểu cơ chế trước khi viết prompt sẽ giúp bạn rất nhiều. Khi bạn đưa hai tấm ảnh và một chỉ dẫn, mô hình không ghép các điểm ảnh — nó tạo ra một tấm ảnh mới dựa trên điều kiện là cả hai đầu vào. Điều đó có hai hệ quả thực tế.

Thứ nhất, ảnh nền có thể thay đổi nhẹ ngay ở những chỗ bạn không hề nhắc tới. Phần nền dịch đi, cạnh bàn xê dịch, chữ trên biển hiệu bị lộn. Bạn giảm điều này bằng cách bảo vệ rõ ràng phần còn lại của khung hình trong prompt — đúng cái kỷ luật khiến các lần chỉnh sửa theo vùng hoạt động được.

Thứ hai, nhận dạng đến hoàn toàn từ ảnh tham chiếu. Nếu ảnh tham chiếu nhỏ, mờ, bị lọc màu nặng, hoặc chụp ở một góc chẳng liên quan gì tới góc bạn muốn ở kết quả, mô hình sẽ tự bịa ra phần khác biệt — và những khuôn mặt bịa ra thì luôn trôi dạt. Ở đây, ảnh tham chiếu làm nhiều việc hơn cả prompt.

Bước 1: chọn ảnh nền và ảnh tham chiếu của người cần thêm

Đầu vào tệ tốn nhiều lần thử lại hơn cả một prompt tệ, nên hãy dành ra một phút cho bước này.

Ảnh nền nên có một khoảng trống rõ ràng để một người có thể đứng hoặc ngồi, một hướng ánh sáng đọc được, và thấy được mặt đất hoặc mặt sàn để bóng đổ có chỗ rơi xuống. Hãy tránh những tấm ảnh mà mọi vị trí hợp lý đều bị đồ đạc che khuất, và tránh ảnh góc siêu rộng — độ biến dạng phối cảnh của chúng rất khó khớp.

Ảnh tham chiếu của người cần thêm nên là một tấm ảnh sạch, đủ sáng, lý tưởng nhất là chụp ở khoảng góc và khoảng cách gần với những gì bạn muốn ở ảnh cuối. Chụp toàn thân nếu người đó sẽ xuất hiện toàn thân. Ánh sáng trung tính tốt hơn ánh sáng kịch tính, vì sáng phẳng dễ chiếu lại hơn một bức chân dung có bóng gắt. Nếu người đó cần xuất hiện trong một bộ trang phục cụ thể, ảnh tham chiếu nên có sẵn bộ trang phục đó.

Mẹo

Nếu bạn có vài tấm ảnh dùng được của cùng một người, hãy tải lên hai hoặc ba tấm thay vì một. Seedream 5.0 Pro nhận tối đa 10 ảnh tham chiếu, và một góc chụp thứ hai giúp độ nhất quán khuôn mặt tốt lên rõ rệt. Nhưng hãy giữ chúng đồng nhất — trộn một tấm ảnh từ năm 2019 với một tấm hiện tại là đưa cho mô hình hai nhận dạng để lấy trung bình.

Bước 2: chọn mô hình

Cả ba mô hình dưới đây đều nằm trong không gian làm việc ảnh của OmniArt, và cả ba đều nhận ảnh tham chiếu tải lên bên cạnh prompt.

Mô hìnhĐiểm mạnh cho việc nàyHãy chọn khi
Seedream 5.0 ProHợp nhất nhiều ảnh, ngôn ngữ chỉ vùng và điểm neo, chỉ dẫn chính xác về vật liệu và màuBản ghép là việc chính — nhiều ảnh tham chiếu, vị trí phải chính xác, hoặc cần đúng màu một bộ trang phục
GPT Image 2Chỉnh sửa bằng ngôn ngữ tự nhiên, theo sát các chỉ dẫn kiểu hội thoạiBạn muốn mô tả thay đổi bằng câu văn thường và chỉnh dần qua đối thoại
Nano Banana 2Chỉnh sửa dẫn bởi tham chiếu, trả kết quả nhanhBạn muốn một cách diễn giải thứ hai với giá rẻ trên cùng bộ đầu vào trước khi chốt

Một lựa chọn mặc định hợp lý: bắt đầu với Seedream 5.0 Pro cho mọi trường hợp mà cả vị trí lẫn nhận dạng đều quan trọng. Nếu bản ghép đơn giản — một người, vị trí quá rõ, ánh sáng dễ tính — thì GPT Image 2 thường tới đích với ít lời hơn.

Bước 3: viết prompt xác định vị trí

Một prompt hiệu quả cho việc này có bốn phần, theo đúng thứ tự sau:

  1. Chỉ dẫn — thêm người từ ảnh tham chiếu vào ảnh nền.
  2. Vị trí và tỷ lệ — họ đứng ở đâu, đang làm gì, lớn cỡ nào so với một vật đã có trong khung.
  3. Khớp ánh sáng và bóng đổ — hướng và tính chất ánh sáng trong ảnh nền, và bóng rơi về phía nào.
  4. Bảo vệ — mọi thứ trong ảnh nền phải giữ nguyên y hệt.

Đây là một phiên bản dùng được mà bạn có thể tùy biến:

Thêm người phụ nữ từ ảnh tham chiếu thứ hai vào tấm ảnh thứ nhất. Đặt cô ấy đứng ở phía bên trái sàn gỗ ngoài trời, hướng về ống kính, dồn trọng lượng vào chân phải, đỉnh đầu ngang tầm với mép trên của tay lan can phía sau cô ấy. Khớp chính xác ánh sáng của ảnh nền: nắng chiều muộn từ phía trên bên phải, tông ấm, bóng có biên mềm. Đổ bóng của cô ấy xuống và về phía bên trái, trải trên các thanh gỗ của sàn. Giữ nguyên sàn gỗ, tay lan can, cây cối, trời và mọi chi tiết khác của ảnh nền.

Hãy để ý rằng "đỉnh đầu ngang tầm với mép trên của tay lan can" làm được nhiều việc cho tỷ lệ hơn bất kỳ cách nói "cỡ trung bình" nào. Neo người vào một thứ đã đo được trong khung hình chính là mẹo xử lý tỷ lệ hữu ích nhất trong những prompt kiểu này.

Một biến thể ở thế ngồi, thường là bản ghép nhỏ hơn và dễ hơn:

Chèn người đàn ông từ các ảnh tham chiếu vào bối cảnh quán cà phê, ngồi trên chiếc ghế trống ở bên phải bàn, góc ba phần tư hơi hướng về phía cửa sổ, hai tay đặt trên bàn. Chỉnh tỷ lệ sao cho vai anh ấy nằm ngay dưới mép trên của tựa ghế. Chiếu sáng anh ấy từ cửa sổ bên trái bằng ánh sáng ban ngày tán xạ mềm khớp với ảnh nền, kèm một vệt bóng tiếp xúc mờ ở chỗ hai cẳng tay chạm mặt bàn. Không thay đổi mặt bàn, các tách cà phê, những người khác hay phần nền.

Bước 4: tinh chỉnh bằng các lần sửa theo vùng

Bản kết xuất đầu tiên rất ít khi là bản cuối, và sai lầm phần lớn mọi người mắc là chạy lại toàn bộ prompt. Đừng làm vậy. Hãy lấy kết quả đã đặt đúng vị trí và sửa từng thứ một bằng một chỉ dẫn giới hạn trong một vùng. Seedream 5.0 Pro được xây cho đúng việc này — gọi tên một vùng, một điểm neo, hoặc một vị trí theo cách người ta đọc ra miệng ("góc dưới bên trái", "thứ hai từ bên phải") sẽ giữ cho thay đổi ở lại đúng chỗ.

Dùng tấm ảnh này, chỉ điều chỉnh nhân vật vừa được thêm vào: làm mềm đường biên dọc vai phải của cô ấy để hòa vào bức tường phía sau, làm ấm nhẹ tông da cho khớp với ánh sáng xung quanh, và kéo dài bóng của cô ấy thêm hai mươi phần trăm về phía bên trái. Không thay đổi bất cứ thứ gì khác trong khung hình.

Hai hoặc ba lượt sửa có mục tiêu như vậy thường hơn hẳn mười lần tạo lại toàn bộ, và tốn ít hơn. Hướng dẫn viết prompt cho Seedream 5.0 Pro trình bày sâu hơn về các khuôn mẫu chỉ vùng, điểm neo và mã màu hex nếu bạn muốn đi xa hơn.

Ghi chú

OmniArt cung cấp tính năng tạo ảnh chuẩn và tạo ảnh có ảnh tham chiếu. Khung tọa độ, lớp nét vẽ phác và ghim điểm neo là các quy trình API ở lớp trên, không phải công cụ riêng trên giao diện OmniArt — bên trong không gian làm việc, bạn diễn đạt chúng bằng chữ trong prompt. Cách đó hoạt động tốt, chỉ có nghĩa là ngôn ngữ chính xác đang thay bạn chỉ trỏ.

Bước 5: chốt bản kết xuất cuối

Khi vị trí, nhận dạng và ánh sáng đều đã vững, hãy chạy một lượt cuối ở đúng độ phân giải bạn cần thay vì tiếp tục sửa trên một bản nháp nhỏ. Kết xuất lại bản ghép đã duyệt ở kích thước lớn nhất mà mô hình hỗ trợ — Seedream 5.0 Lite cho 4K gốc nếu độ phân giải đầu ra là yếu tố quyết định — và kiểm tra kết quả ở mức 100% trước khi đem dùng. Viền sáng quanh nhân vật và độ nhiễu hạt không khớp thì vô hình ở kích thước ảnh thu nhỏ nhưng lộ rõ ở kích thước đầy đủ.

Khớp ánh sáng, phối cảnh, tỷ lệ và bóng đổ

Bốn kiểu lỗi sau chiếm phần lớn những bản ghép trông sai mà người xem không biết vì sao.

  • Hướng ánh sáng. Hãy đọc bóng đổ trong ảnh nền trước, rồi nêu hướng đó trong prompt ("từ phía trên bên phải", "từ cửa sổ bên trái"). Nếu ảnh tham chiếu của người đó được chiếu sáng từ phía đối diện, hãy nói rõ: "chiếu sáng lại nhân vật từ bên phải; ánh sáng bên trái trong ảnh tham chiếu không được mang sang".
  • Tính chất ánh sáng. Nắng gắt cho bóng biên sắc; trời râm và đèn trong nhà cho bóng mềm. Một người được chiếu sáng mềm đặt trong cảnh nắng gắt sẽ trông như dán vào. Hãy nêu cả tính chất, đừng chỉ nêu hướng.
  • Phối cảnh và độ cao máy ảnh. Nếu ảnh nền được chụp ở tầm ngang hông, một người được tham chiếu từ điện thoại giơ ngang mắt sẽ nằm sai trong khung. Thêm câu "khớp với góc máy thấp của ảnh nền, nhìn hơi từ dưới lên" và mô hình sẽ điều chỉnh độ co phối cảnh của nhân vật.
  • Tỷ lệ. Luôn gắn chiều cao với một thứ đã có trong khung — một khung cửa, một tay lan can, một tựa ghế, vai của một người khác. Những mô tả tuyệt đối không sống sót khi được dịch thành điểm ảnh.
  • Bóng tiếp xúc. Vùng tối nhỏ ở chỗ cơ thể chạm vào một bề mặt chính là thứ thuyết phục người xem về sự hiện diện vật lý. Hãy yêu cầu nó bằng đúng tên: "một vệt bóng tiếp xúc mềm dưới cả hai chiếc giày ở chỗ chúng chạm mặt đường".
  • Nhiễu hạt và màu. Hãy yêu cầu mô hình khớp độ nhiễu hạt, nhiệt độ màu và độ mềm của ống kính trong ảnh nền. Một nhân vật sạch bong trong một tấm ảnh nhiều hạt là dấu hiệu lộ ngay.

Khắc phục sự cố

Khuôn mặt không giống người thật. Ảnh tham chiếu của bạn đang làm quá ít việc. Hãy tải thêm các góc khác của cùng người đó, ưu tiên ảnh độ phân giải cao hơn, và bỏ hết những tấm bị lọc màu nặng. Rồi yêu cầu cụ thể: "giữ nguyên đường nét khuôn mặt, chân tóc và màu tóc từ các ảnh tham chiếu, không cách điệu chúng".

Phần nền bị thay đổi. Câu bảo vệ của bạn quá chung chung. Hãy liệt kê rõ từng thành phần thay vì chỉ nói "giữ nguyên phần nền". Sau đó chạy một lượt sửa giới hạn trong vùng thay vì tạo lại từ đầu.

Người bị lơ lửng. Thiếu bóng tiếp xúc, hoặc bàn chân bị cắt một cách nhập nhằng. Hãy yêu cầu bóng tiếp xúc trực tiếp và xác nhận rằng mặt sàn nhìn thấy được ở chỗ bạn đặt họ vào.

Kích thước sai. Hãy thay mọi cách nói về kích thước tuyệt đối bằng một so sánh với một vật đã có trong khung.

Đường biên trông như bị cắt dán. Hãy yêu cầu làm mềm đường biên và khớp độ nhiễu hạt dọc theo đường viền nhân vật, đồng thời kiểm tra xem ảnh tham chiếu có phải là ảnh đã tách nền cứng hay không — ảnh tách nền trắng rất dễ dẫn tới kết quả trông như cắt dán.

Dáng đứng bị cứng. Hãy mô tả cách dồn trọng lượng và vị trí bàn tay. "Dồn trọng lượng vào chân phải, một tay đút túi áo khoác" cho ra dáng tự nhiên hơn "đứng một cách tự nhiên".

Cảnh báo

Thêm một người thật, có thể nhận dạng được, vào một tấm ảnh mà họ không có mặt là tạo ra một hình ảnh hàm ý điều không đúng sự thật. Hãy xin phép rõ ràng từ người đó trước khi bạn tạo ảnh, và trước khi bạn đăng tải. Đừng ghép người nổi tiếng, đồng nghiệp, người yêu cũ hay trẻ em vào các bối cảnh khi chưa có sự đồng ý. Đừng tạo ra hình ảnh hàm ý ai đó đã dự một sự kiện, đã ủng hộ một sản phẩm, hay đã có mặt ở một nơi nào đó. Hãy kiểm tra quy định của nền tảng bạn đăng lên — nhiều nơi yêu cầu công bố rõ khi ảnh về người thật đã bị AI chỉnh sửa — và tuân thủ điều khoản của OmniArt cùng luật pháp địa phương về quyền hình ảnh.

Bắt đầu trên OmniArt

Hãy chọn một ảnh nền có khoảng trống rõ ràng và một ảnh tham chiếu sạch, đủ sáng của người cần thêm. Mở không gian làm việc ảnh của OmniArt, chọn Seedream 5.0 Pro, tải cả hai ảnh lên, và chạy prompt sàn gỗ ở bước 3 với các chi tiết của riêng bạn. Ở bản kết xuất đầu tiên, chỉ đánh giá vị trí và tỷ lệ — nhận dạng và ánh sáng là việc của các lượt tinh chỉnh sau.

Sau đó hãy làm việc bằng những chỉnh sửa nhỏ thay vì bằng các prompt mới. Hai lượt sửa giới hạn theo vùng và một lượt kết xuất cuối ở độ phân giải đầy đủ là con đường bình thường, và nó giữ cho ảnh nền còn nguyên vẹn trong khi nhân vật dần hoàn chỉnh.

Sẵn sàng sáng tạo?

Bắt đầu tạo nội dung tuyệt vời bằng AI

Bắt đầu miễn phí