Prompt tham chiếu Seedance 2.5: giao vai cho từng tư liệu
Hướng dẫn viết prompt tham chiếu Seedance 2.5: giao vai cho từng ảnh, video và âm thanh, gắn chủ thể với tư liệu và chọn tư liệu tham chiếu theo từng cảnh quay.

Viết prompt tham chiếu cho Seedance 2.5 khác với kiểu prompt văn bản sang video mà phần lớn nhà sáng tạo học đầu tiên. Mô hình nhận tối đa 50 tư liệu tham chiếu trong một lượt tạo — gồm cả ảnh, video và âm thanh — và khi đã vượt quá hai hoặc ba tư liệu, phần khó không còn là mô tả một cảnh quay nữa. Phần khó là nói cho mô hình biết mỗi tư liệu mang ý nghĩa gì, và tư liệu nào thuộc về khoảnh khắc nào trong video.
Sự dịch chuyển đó đáng được nói thẳng. Với một ảnh tham chiếu, mô hình có thể đoán ý bạn. Với mười hai ảnh, việc đoán sẽ tạo ra khuôn mặt bị pha trộn, trang phục bị hoán đổi, đạo cụ bị nhân đôi và hậu cảnh rò rỉ từ những bức ảnh bạn chỉ tải lên để lấy khuôn mặt. Cách khắc phục không phải là viết mô tả cảnh dài hơn, mà là một khối văn bản ngắn và rõ ràng ở đầu prompt, nơi bạn giao cho mỗi tư liệu một nhiệm vụ kèm danh sách những gì không được lấy.
Seedance 2.5 có sẵn trong không gian video của OmniArt, nên bạn có thể vừa đọc vừa thực hành với tư liệu của mình. Hướng dẫn này trình bày công thức prompt cốt lõi, các giới hạn tư liệu, mẫu định nghĩa vai trò và quy trình bốn bước cho những prompt mang nhiều chủ thể cùng lúc.
Bắt đầu từ công thức prompt cốt lõi
Trước khi tư liệu tham chiếu xuất hiện, Seedance 2.5 phản hồi rất tốt với một công thức đơn giản và linh hoạt. Mọi thành phần sau hai thành phần đầu đều là tùy chọn — giữ lại những gì làm thay đổi cảnh quay, bỏ đi những gì không.
Chủ thể + hành động hoặc sự kiện + cảnh và môi trường + phong cách hình ảnh + chuyển động máy quay hoặc cắt cảnh + âm thanh
Viết thành mẫu:
<Subject> performs <primary action or event> in <scene and environment>.
The visuals feature <visual style>.
Use <shot size, camera angle, camera movement, or cuts>.
Audio includes <dialogue, ambience, sound effects, or music>.
Và điền cho một cảnh quay thực tế:
A bicycle mechanic trues a wheel at a workbench in a narrow street-front workshop, then lifts the wheel onto a wall hook.
Late afternoon light comes through the roll-up door. Metal surfaces are worn and slightly oily, and the floor is swept.
Begin with a medium shot of the truing stand, push in slowly toward the spoke nipples, then cut to a frontal view of the wall.
Retain the ping of spoke tension, the click of the truing gauge, and quiet street ambience.
Các tham số của lượt tạo như độ phân giải và thời lượng không thuộc về prompt — hãy đặt chúng trên trang tạo video. Mọi thứ nằm trong prompt nên là nội dung mà mô hình phải diễn giải.
Nắm ngân sách tư liệu trước khi viết
Seedance 2.5 kết hợp tối đa 50 tư liệu tham chiếu thuộc ba loại. Mỗi loại có một giới hạn cứng cho đầu vào và một khoảng khuyến nghị riêng. Khoảng khuyến nghị không phải mức trần — đó là vùng mà các lượt tạo giữ được độ ổn định.
| Loại tư liệu | Giới hạn đầu vào | Khoảng khuyến nghị |
|---|---|---|
| Ảnh | Tối đa 30 ảnh, mỗi ảnh không lớn hơn 4K | 1–8 chủ thể riêng biệt trên toàn bộ ảnh tham chiếu chủ thể |
| Video | Tối đa 10 video, tổng thời lượng không quá 30 giây | 1–5 chủ thể riêng biệt, 5–10 giây cho mỗi video chủ thể |
| Âm thanh | Tối đa 10 đoạn, tổng thời lượng không quá 30 giây | Chỉ lời thoại, giọng nói, âm thanh môi trường hoặc nhạc liên quan đến yêu cầu |
| Chỉnh sửa video | Một video nguồn cộng với các ảnh tham chiếu | Video nguồn dưới 20 giây, 1–5 ảnh tham chiếu |
Bạn có thể vượt qua mức khuyến nghị — 9–12 chủ thể trong ảnh chủ thể, 6–10 chủ thể trong âm thanh hoặc video chủ thể, 6–8 ảnh tham chiếu cho một lần chỉnh sửa. Độ ổn định thường giảm khi số lượng tăng lên, nên hãy xem mọi con số vượt khoảng khuyến nghị là một thử nghiệm có chủ đích chứ không phải lựa chọn mặc định.
Có một quy tắc đóng gói quan trọng hơn nhiều người tưởng: nếu hơn năm chủ thể còn cần nhiều góc nhìn, hãy đặt mỗi góc nhìn vào một ảnh riêng. Các ảnh góc nhìn độc lập thường ổn định hơn việc gộp nhiều góc nhìn vào cùng một ảnh ghép. Một tấm ảnh ghép bốn ô được mô hình đọc là một bức ảnh chứa bốn thứ, và đó đúng là sự mơ hồ mà bạn đang cố loại bỏ.
Mẹo
Hãy cắt gọn trước khi tải lên. Mười tư liệu gọn gàng, mỗi tư liệu một mục đích, sẽ hiệu quả hơn hai mươi tư liệu chồng chéo, vì mỗi tư liệu thừa là thêm một thứ mà mô hình phải phân biệt.
Định nghĩa vai trò của từng tư liệu — và cả phần phải loại trừ
Đây là kỹ thuật mà toàn bộ phần còn lại của hướng dẫn dựa vào. Sau khi tải lên, hãy nêu chính xác mỗi tư liệu đóng góp điều gì, và nêu rõ điều gì không được mang sang. Việc gắn tư liệu với vai trò thuộc về phần văn bản của prompt; đừng dựa vào nhãn in sẵn trên ảnh, và đừng để mô hình tự suy đoán một tệp đại diện cho người hay đạo cụ nào.
Mẫu như sau:
@Image 1 defines <subject>'s <appearance, clothing, structure, or material>.
@Video 1 defines <motion, camera movement, or pacing>.
@Audio 1 defines <character or sound type>'s <voice, dialogue, ambience, or music>.
<Subject> completes <primary action or event> in <scene>.
The visuals feature <visual style>, with <camera treatment>.
Khi điền vào, với các dòng loại trừ thực sự phát huy tác dụng:
@Image 1 defines the mechanic's facial features, hairstyle, and navy work apron. Do not use the image background.
@Image 2 defines the workshop's bench layout, tool wall, and roll-up door light. Do not use the people in the image.
@Video 1 defines the pacing of spinning the wheel, pausing, and tightening a spoke. Do not use the person's identity, clothing, or scene from the video.
The mechanic trues a wheel at the workbench, then lifts it onto the wall hook.
Begin with a medium shot of the truing stand and push in slowly toward the spoke nipples. Retain spoke pings and quiet street ambience.
Các dòng loại trừ không phải phần thừa. Một ảnh chân dung luôn mang theo hậu cảnh, một hướng ánh sáng và thường có cả những người khác. Nếu thiếu câu “Do not use the image background.”, những thuộc tính đó là phần mô hình được phép sử dụng, và chúng sẽ xuất hiện ở đâu đó.
Gắn nhiều góc nhìn vào cùng một vật thể
Khi nhiều ảnh cho thấy cùng một người hoặc cùng một sản phẩm từ các góc khác nhau, hãy nói rõ điều đó, và nói rõ đầu ra được phép có bao nhiêu vật thể như vậy:
@Image 1 defines the front view of the same steel touring frame.
@Image 2 defines the left-side structure of the same steel touring frame.
@Image 3 defines the right-side structure of the same steel touring frame.
@Image 4 defines the rear structure of the same steel touring frame.
All four images define one steel touring frame. The output must contain only one frame throughout.
Nếu thiếu câu kết đó, bốn ảnh của một vật thể cũng là mô tả hợp lý cho bốn vật thể. Câu khẳng định số lượng là khoản bảo hiểm rẻ nhất trong cả prompt.
Quy trình bốn bước cho prompt nhiều tham chiếu
Khi đã vượt qua vài tư liệu đầu tiên, hãy đi lần lượt bốn bước sau. Mục tiêu là giúp mô hình chọn đúng tư liệu cho cảnh đang dựng — chứ không phải bắt mọi thứ xuất hiện cùng lúc.
Bước 1: Đặt tên và gắn từng chủ thể một
Gắn mỗi người, mỗi sản phẩm và mỗi đạo cụ với tư liệu riêng của nó, mỗi thứ một dòng:
<Character A> corresponds to @Image 1. Use only the appearance, hairstyle, and clothing.
<Character B> corresponds to @Image 2. Use only the appearance, hairstyle, and clothing.
<Prop A> corresponds to @Image 3. Use only the structure, material, and color.
<Scene A> references @Image 4. Use only the spatial layout, architecture, and lighting. Do not use the people in the image.
Lối viết cần tránh: đừng bao giờ viết “@Images 1 through 4 define four characters respectively.” Câu đó nói với mô hình rằng có bốn nhân vật và bốn ảnh, nhưng không hề nói cái nào ứng với cái nào — nên mô hình được tự do ghép cặp theo ý nó.
Bước 2: Nhóm tư liệu theo loại
Khi đã có đủ các dòng gắn kết, hãy sắp xếp chúng dưới những tiêu đề rõ ràng để quan hệ giữa chúng dễ đọc chỉ trong một cái nhìn:
[Characters]
<Mechanic> corresponds to @Image 1. Use only the appearance, hairstyle, and clothing.
<Apprentice> corresponds to @Image 2. Use only the appearance, hairstyle, and clothing.
Do not interchange the two characters' appearances, clothing, actions, positions, or dialogue.
[Props]
<Truing Stand> corresponds to @Image 3 and belongs only to <Mechanic>.
<Parts Tray> corresponds to @Image 4 and belongs only to <Apprentice>.
[Scenes]
<Workshop> references @Image 5. Use only the space, materials, and lighting.
<Courtyard> references @Image 6. Use only the space, materials, and lighting.
[Motion and Audio]
@Video 1 defines the motion of <Mechanic> tightening a spoke. Do not use the person or scene from the video.
@Audio 1 defines <Apprentice>'s voice and specified dialogue.
Các dòng xác định quyền sở hữu đạo cụ quan trọng không kém các dòng nhân vật. Chính cụm “belongs only to” mới ngăn một dụng cụ dịch chuyển tức thời giữa hai người qua các lần cắt cảnh.
Bước 3: Viết hồ sơ cho những chủ thể quan trọng
Khi một nhân vật dựa vào nhiều tư liệu trải qua nhiều cảnh, hãy gom chúng vào một khối thay vì để rải rác:
[Subject Profile: Mechanic]
Appearance and clothing: @Image 1.
Fixed prop: <Truing Stand> from @Image 3.
Locations: <Workshop> and <Courtyard>.
Motion references: the spoke-tightening motion from @Video 1 and the wheel-lifting motion from @Video 2.
Do not use: the apprentice's clothing. Do not give this character <Parts Tray>.
Bước 4: Chọn tư liệu tham chiếu theo từng cảnh
Cuối cùng, hãy cho mô hình biết mỗi cảnh dùng tập con tư liệu nào, và cảnh đó phải trông ra sao khi kết thúc:
Scene 1 | Truing the wheel in the workshop
Use: <Mechanic>, <Truing Stand>, <Workshop>, and the spoke-tightening motion from @Video 1.
Event: <Mechanic> spins the wheel in <Truing Stand> and tightens one spoke.
End state: <Mechanic> stands on the inner side of the bench. <Truing Stand> stays at the left of the frame.
Scene 2 | Handoff in the courtyard
Use: <Apprentice>, <Parts Tray>, and <Courtyard>.
Event: <Apprentice> carries <Parts Tray> to the courtyard bench and sets it down.
End state: <Parts Tray> rests on the bench. No other character enters the courtyard.
Việc chọn tư liệu ở cấp độ từng cảnh là thứ biến một đống tham chiếu thành một danh sách cảnh quay. Mọi tư liệu bạn không nêu tên trong một cảnh là tư liệu mà mô hình biết phải để ra ngoài.
Cú pháp riêng cho âm thanh và văn bản
Prompt có thể viết hoàn toàn bằng ngôn ngữ tự nhiên, nhưng khi bạn cần tách bạch nhạc, hiệu ứng âm thanh, lời thoại và phụ đề, Seedance 2.5 nhận biết bốn loại dấu ngoặc:
| Nội dung | Cú pháp | Ví dụ |
|---|---|---|
| Nhạc | () | (Soft, rhythmic piano music plays in the background) |
| Hiệu ứng âm thanh | <> | <A bell rings in the distance> |
| Lời thoại | {} | {Hello, welcome back.} |
| Phụ đề | 【】 | 【Chapter One: Departure】 |
Nhấn mạnh ngôn ngữ của lời thoại
Khi lời thoại không phải tiếng Trung, hãy nêu tên ngôn ngữ trước câu thoại — ví dụ The girl says softly in Japanese: {もう大丈夫です}. Nếu phần chữ được viết bằng tiếng Anh nhưng mô hình lại nói bằng ngôn ngữ khác, hoặc bạn cần một biến thể vùng miền cụ thể, hãy dùng công thức sau:
Ngôn ngữ lời thoại + biến thể vùng miền hoặc chất giọng + phong cách thể hiện + người nói + {dialogue}
Dialogue language: American English. The girl says in natural, conversational American English: {I thought you weren't coming.}
Dialogue language: authentic Los Angeles English. The young man says in natural Los Angeles vernacular: {No way, you actually made it.}
Đừng nhắc lại điều mà tư liệu tham chiếu đã xác định
Một thói quen viết thừa rất phổ biến: tải lên một video tham chiếu chuyển động rồi lại mô tả đúng chuyển động đó bằng lời. Khi một video tham chiếu đã xác định chính xác chuyển động, cách vận hành máy quay và trình tự, hãy chỉ nêu những thuộc tính cần kế thừa. Lặp lại phần mô tả chuyển động có thể mâu thuẫn với chính tư liệu tham chiếu, và mô hình sẽ phải dung hòa hai phiên bản của cùng một chỉ dẫn.
Ngoại lệ là video khối dựng thô. Khối dựng thô chủ yếu cung cấp chuyển động và cấu trúc không gian — đường di chuyển, cách sắp đặt vị trí, chuyển động máy quay, cắt cảnh — nên prompt vẫn phải xác định chủ thể, cảnh, hành động và phong cách hình ảnh mong muốn. Hãy kế thừa nhịp từ video, còn thế giới thì cung cấp bằng ảnh và văn bản. Nếu tham chiếu khối dựng thô là quy trình chính của bạn, hướng dẫn storyboard và khối dựng thô cho Seedance 2.5 đi sâu hơn về khối dựng thô mức thô và mức tinh.
Chạy qua danh sách kiểm tra trước khi gửi
Trước khi nhấn nút tạo video, hãy đọc lại prompt theo những câu hỏi sau:
- Prompt có nêu rõ chủ thể cùng hành động hoặc sự kiện chính không?
- Mỗi tư liệu tham chiếu đã nêu rõ những gì được dùng và những gì không được dùng chưa?
- Mọi nhân vật, sản phẩm và đạo cụ riêng biệt đã được đặt tên và gắn với một tư liệu tham chiếu chưa?
- Tư liệu đã được chọn theo từng cảnh, thay vì bị buộc phải xuất hiện cùng một lúc chưa?
- Số lượng nhân vật, trang phục, quyền sở hữu đạo cụ và quan hệ không gian có giữ được tính nhất quán không?
- Những cảm xúc trừu tượng và thuật ngữ quay phim đã đi kèm dấu hiệu nhìn thấy hoặc nghe thấy được chưa?
Cảnh báo
Prompt tham chiếu làm tăng xác suất có được kết quả trung thành, chứ không đảm bảo điều đó. Với phụ đề, công thức, biển hiệu, thông số sản phẩm hoặc thời điểm chính xác đến từng khung hình, hãy kết hợp tư liệu tham chiếu đã chuẩn bị sẵn, lượt tạo và khâu hậu kỳ.
Bắt đầu trên OmniArt
Mở không gian video của OmniArt, chọn Seedance 2.5 và dựng prompt nhiều tham chiếu đầu tiên theo thứ tự sau:
- Chỉ tải lên những tư liệu mang thông tin mà không tư liệu nào khác có.
- Viết một dòng gắn kết cho mỗi chủ thể — tên, tư liệu và những gì được lấy từ tư liệu đó.
- Thêm một điều loại trừ vào mọi dòng có nguy cơ rò rỉ hậu cảnh, con người hoặc bố cục.
- Nhóm các dòng gắn kết dưới
[Characters],[Props],[Scenes]và[Motion and Audio]. - Viết một hồ sơ chủ thể cho bất kỳ nhân vật nào trải dài qua nhiều cảnh.
- Liệt kê từng cảnh cùng tập con tư liệu, sự kiện và trạng thái kết thúc của cảnh đó.
- Tạo hai lượt với cùng một prompt, rồi sửa phần gắn kết tư liệu — không phải các tính từ — ở bất cứ chỗ nào hai lượt cho kết quả khác nhau.
Để biết bản phát hành này thay đổi những gì và các chế độ mới nằm ở đâu, hãy đọc những gì Seedance 2.5 mang lại. Để mang cùng kỷ luật tham chiếu này vào những tác phẩm dài hơn, hãy đọc tiếp cách viết prompt cho video Seedance 2.5 dài 30 giây, và để kiểm soát nhận dạng xuyên suốt cả một dự án, xem hướng dẫn của chúng tôi về nhân vật nhất quán trong video AI.
Sẵn sàng sáng tạo?
Bắt đầu tạo nội dung tuyệt vời bằng AI