Seedance 2.0:AI 影片的提示詞模式與六個應用情境
一份給創作者的 Seedance 2.0 指南——多參考素材輸入、原生音訊、最高 4K 輸出、以鏡頭為單位的提示詞寫法,以及在 OmniArt 上實測過的六條提示詞。

當一份需求讀起來像導演的分場說明時,創作者會找的模型就是 Seedance 2.0。它可以在同一次請求裡吃文字、最多九張圖片、三支參考影片和三個音訊檔,並用 @image1、@video1、@audio1 這樣的語法點名。這份指南會談這個模型吃得下的提示詞文法、它目前在 OmniArt 上的限制,以及六個實測過的應用情境,附提示詞和結果。
Seedance 2.0 是什麼
Seedance 2.0 生成 4–15 秒、帶原生音訊的片段。Standard 做得到 4K,Fast 和 Mini 到 720p。真正的重點仍然是多參考素材架構:只要至少含一份視覺參考,一次請求就能把圖片、影片和音訊混在一起。
| 規格 | 數值 |
|---|---|
| 版本 | Standard、Fast、Mini |
| 輸出解析度 | Standard:480p、720p、1080p、4K;Fast 和 Mini:480p、720p |
| 時長 | 4–15 秒 |
| 畫面比例 | 21:9、16:9、4:3、1:1、3:4、9:16 |
| 參考素材額度 | 合計最多 12 份素材;至少要有一張圖片或一支影片 |
| 圖片輸入 | 最多 9 張(@image1–@image9) |
| 影片輸入 | 最多 3 支;每支 2–15 秒、24–60fps,合計 15 秒(@video1–@video3) |
| 音訊輸入 | 最多 3 段;每段 2–15 秒,合計 15 秒(@audio1–@audio3) |
| 原生音訊輸出 | 有——對白、音效、環境音、音樂 |
| 任務模式 | Video、Transition、Reference、Extend、Modify |
| 使用權限 | Standard:Creator 以上;Fast 和 Mini:Starter 以上 |
多參考素材系統為什麼重要
多數影片模型只吃一份參考素材,或完全不吃。Seedance 2.0 吃一整疊,而且讓你在提示詞裡把每一份參考綁到一個角色上。@image1 放角色的臉,@image2 放服裝,@image3 放場景,@video1 放你要複製的運鏡,@audio1 放襯底音樂。輸出會把每一份都當成獨立指令看待,而不是把它們平均成雜訊。
這就是角色長相能跨鏡頭撐住的實際原因:同一份 @image 參考素材會進到時間軸上的每一顆鏡頭,模型把它當成身分錨點,而不是每次都從提示詞重新推論這個角色長什麼樣。
有效的提示詞結構
Seedance 2.0 對六段式結構的回報最好。
- 主體——畫面上是誰或什麼
- 動作/運動——他們在做什麼
- 場景/環境——事情發生在哪裡
- 視覺風格——電影參考、色調、年代
- 運鏡指示——具體的攝影術語
- 光線——方向、質感、一天中的時間
一條好用的範本提示詞:
"Subject (with
@image1reference if applicable). Action. Setting. Visual style. Camera direction (specific cinematography term). Lighting detail."
多鏡頭時間軸的寫法
Seedance 2.0 認的是鏡頭順序,不是以秒為單位的時間戳。用編號的鏡頭,照順序描述每一個節拍。
Shot 1: wide establishing shot, character (in @image1) walks into the scene
Shot 2: medium tracking shot follows them across the room
Shot 3: 360-degree orbit around the table they reach
每一段都釘住同一個 @image1。長相就會在剪接之間保持一致。
說明
Seedance 2.5 加了整數秒的時間戳控制。不要把 2.5 的時間戳範本複製到 2.0 的請求裡,還期待那些區間會管住時間;請維持上面這種鏡頭編號結構。
參考素材標記的紀律
一份短短的規則,很值得遵守:
- 臉部照片和產品照用
@image1、@image2。 - 想被複製的運鏡用
@video1。 - 當襯底音訊比模型預設更重要時,用
@audio1。 - 在文字裡明確點名每一個標記。不要指望模型自己推論哪一份參考是哪個角色。
六個實測過的應用情境與提示詞
下面每一條提示詞都是我們在 Seedance 2.0 上真的跑過的。結果那一段是我們拿到的東西,生成時間是在 Standard 720p 上量的。
1. 電影感場景
"A retired detective in a long dark coat walks through a rain-soaked alley at night. Neon signs reflect red and blue on the wet cobblestones. He pauses, lights a cigarette, and glances over his shoulder. Slow push-in from wide shot to medium close-up. Film noir style, anamorphic lens flare, teal-orange color grading, film grain."
結果。 推鏡順暢。雨水反光可信,大衣的動態自然。點菸的動作生出來沒有手部變形。雨聲和城市環境音同步生成。約 70 秒。
2. 產品廣告
"A luxury perfume bottle rotates slowly on a black marble surface. Golden liquid catches the light as it turns. Soft particles of gold dust float in the air around it. Macro close-up, slow 360-degree orbit camera. Studio lighting with warm rim light, high-end commercial photography style."
結果。 玻璃折射和液體行為準確。粒子飄動自然。整圈旋轉順暢、光線角度正確、大理石質感看得出來。約 65 秒。
3. 音樂影片
"A female singer in a flowing red silk dress performs on a rooftop at sunset. City skyline stretches behind her. Wind blows her hair and dress dramatically. She sings with emotional intensity, arms spread wide. Dynamic tracking shot circling around her. Golden hour backlighting, lens flare, vibrant warm tones."
結果。 裙擺物理寫實。環繞跟拍流暢。旋轉全程臉部保持一致。頭髮的擺動符合風向。生成了氛圍配樂。約 75 秒。
4. 會動的角色肖像
"An elderly Japanese craftsman in a traditional wooden workshop, morning light streaming through paper screens. He slowly lifts a hand-forged ceramic tea bowl, examining it with quiet pride. His weathered hands rotate the bowl gently. Close-up of his hands, then slow tilt up to reveal his face. Wabi-sabi aesthetic, warm natural light, documentary portrait quality."
結果。 手指數量正確。關節運動自然。從手往上搖到臉的動作順暢。穿過紙門的光線寫實。工坊裡有淡淡的環境音。皮膚質感寫實。約 80 秒。
5. 自然與風景
"Aerial drone shot gliding over a misty mountain valley at sunrise. Layers of fog roll between emerald green peaks. A winding river reflects the golden morning light below. Eagles soar through the frame at eye level. Smooth forward tracking with slight descent. Epic landscape, volumetric fog, golden hour lighting."
結果。 各自獨立的霧層造出可信的縱深。河面反光隨鏡頭位置更新。色調平衡很好。體積霧乾淨。有風聲和鳥鳴。約 55 秒——六個裡面最快的。
6. 動畫與奇幻
"An anime warrior princess stands atop a cliff overlooking a burning medieval city at night. Her long silver hair and crimson cape billow in the wind. She draws a glowing blue katana, electricity crackling along the blade. Cherry blossom petals swirl around her. Dynamic low-angle shot with slow push-in. Cel-shading style, vibrant neon accents, dramatic speed lines."
結果。 賽璐珞著色全程一致。拔刀動作流暢。電流特效融合自然。櫻花花瓣各自獨立飄動。火光和披風有互動。有戲劇性的揮刀破空聲。約 70 秒。
常見錯誤與修法
| 問題 | 原因 | 修法 |
|---|---|---|
| 提示詞被拒 | 臉部關鍵字或語意含糊 | 刪掉明確的臉部描述,改用 @image 參考素材 |
| 出現黑畫面 | 提示詞太複雜 | 縮到每 4–5 秒一個動作;測試時把解析度調低 |
| 角色的臉在鏡頭之間變了 | 沒有一致的參考素材 | 在時間軸的每一顆鏡頭都釘同一個 @image1 |
| 音訊沒對上 | 聯合擴散不同步 | 關掉音訊重新生成,襯底另外加 |
| 手或手指變形 | 複雜的手部互動又沒給參考 | 加一張你要的手勢參考圖 |
| 一看就是「AI 生成」的質感 | 太依賴風格關鍵字 | 補上物理細節——材質、光線、鏡頭類型 |
Seedance 2.0 對上 Seedance 1.0
如果你用過 1.0,到 2.0 的落差比版本號看起來的還大。
| 功能 | 1.0 | 2.0 |
|---|---|---|
| 架構 | 分開的流程 | 統一的 diffusion Transformer |
| 圖片輸入 | 1 張,選填 | 最多 9 張,可用 @tag 點名 |
| 影片輸入 | 沒有 | 最多 3 支 |
| 音訊輸入 | 沒有 | 最多 3 段 |
| 原生音訊輸出 | 沒有 | 有 |
| 最高解析度 | 1080p | Standard 最高 4K |
| 時長 | 5–10 秒 | 4–15 秒 |
| 多鏡頭 | 基本 | 時間軸分鏡,跨鏡頭保持一致 |
| 手部品質 | 常有瑕疵 | 明顯改善 |
| 影片內編輯 | 沒有 | 有——角色/物件替換 |
什麼時候該選別的
Seedance 2.0 不是每一種需求的正確工具。
| 需求 | 目前工作台裡更好的起點 |
|---|---|
| 成本最低、又要原生音訊的 Seedance 草稿 | Seedance 2.0 Mini |
| 另一條吃大量參考素材、輸出 2K 的流程 | MiniMax H3 |
| 4K 輸出,原生音訊選配 | Veo 3.1 Standard 或 Fast |
| 不要生成音訊的短文字生成影片 | Sora 2 |
| 低成本、跨多種畫面比例的一般迭代 | V6 |
OmniArt 上的價格
在 OmniArt 影片工作台裡,Seedance 2.0 依成片每秒計價。720p 時,Standard 每秒 14 點數,Fast 是 11,Mini 是 8。所以一段五秒的片段分別要 70、55 或 40 點數。Standard 需要 Creator 或 Ultra 方案;Fast 和 Mini 需要 Starter 以上。Ultra 目前提供的是不扣點數的素材生成,而不是百分比折扣。
注意
商業使用權限取決於你用哪條路線、哪個帳號生成素材時所適用的條款。在高風險的交付之前,先確認目前的平台條款。
在 OmniArt 上開始
Seedance 2.0 的 Standard、Fast 和 Mini 都在 OmniArt 影片工作台裡,旁邊是 MiniMax H3、Gemini Omni、Happy Horse、Kling、Grok Imagine、Veo 3.1、Sora 2、V6 和其他目前的影片模型。它們共用同一筆餘額和同一份作品紀錄,但每個模型各自保有自己支援的參數和參考素材上限。
先用上面那條電影感場景的提示詞,摸清楚多參考素材流程,等你想測動態中的臉部一致性時,再換到音樂影片那一則需求。
如果你正在 Seedance 2.0 和 HappyHorse 1.0 之間猶豫,HappyHorse 1 對上 Seedance 2 的比較會逐顆鏡頭走過這些取捨。想看下一代的流程,可以接著讀 Seedance 2.5 到底改了什麼,再從那裡挑對應任務的提示詞指南。
準備好開始創作了嗎?
用 AI 生成精彩內容