Tutorial教學與操作指南閱讀時間 15 分鐘

Seedance 2.5 的 30 秒影片提示詞:階段與時間控制

寫出撐得住的 Seedance 2.5 30 秒影片提示詞:把故事拆成階段,每段只給一個狀態變化和看得見的結束狀態,需要精準時再疊時間戳。

OmniArt 團隊
Seedance 2.5 的 30 秒影片提示詞:階段與時間控制

五秒的片段是一段描述。三十秒的片段是一份腳本。這個轉換,正是那些短提示詞寫得很好的人一要長度就變一團糊的全部原因:他們還在寫一個更豐富的場景,而模型現在需要的是一連串檢查點。Seedance 2.5 在 OmniArt 影片工作台裡就能用,單次生成 4 到 30 秒,長影片模式再加 30 到 180 秒——這代表你的 Seedance 2.5 30 秒影片提示詞,結構比裡面的形容詞更重要。

下面這套做法,來自模型實際上怎麼讀一段長提示詞。你把故事切成連續的階段,每個階段只給一個主要的狀態變化,再寫一個觀眾能在畫面上指出來的結束狀態。等這些都到位了,才疊上時間戳,而且只疊在你真的需要精準的地方。

這不是回頭去寫編號鏡頭表。鏡頭表告訴模型怎麼操作攝影機;階段告訴模型這一段結束時什麼必須成立。想看「不要過度指定短片段」的論證,別再寫鏡頭表了那篇仍然成立。階段是狀態檢查點,不是攝影機設定。

長影片壞掉的方式跟短影片不一樣

四秒的片段很少來得及自相矛盾。三十秒來得及,而且失敗都集中在四個地方。

  • 角色身分。 第 2 秒那個人和第 24 秒那個人,是表親,不是同一個人。
  • 服裝和道具。 外套換了一個色調、緞帶變了顏色、本來在工作檯上的工具突然到了手上——或者反過來。
  • 道具歸屬。 東西交接之後,模型就搞不清楚誰拿著什麼,這是任何雙人段落裡最常見的一次崩壞。
  • 空間方向。 一次剪接之後工作檯轉向了,或是一個從左邊出去的角色又從同一邊走回來。

這些都不是靠多寫描述就能修好的。修法是在每一個交界上告訴模型:它繼承到的是什麼狀態。Seedance 2.5 在一次長生成裡守住角色特徵、服裝細節和場景架構的能力,明顯比舊版好,但它還是需要有檢查點可以抵著。

是腳本階段,不是場景

長影片的結構,是一小組有標籤的區塊。把這個抄下來填。

[Generation Goal]
Generate a <video type>. The central subject is <subject>, and the primary event is <story summary>.

[Stage 1]
Initial state: <initial state of characters, props, and scene>.
Primary event: <one primary action or event>.
End state: <character positions, prop ownership, or visible scene state>.

[Stage 2]
Continue from the previous stage: <state that must remain unchanged>.
Primary event: <one primary action or event>.
End state: <observable state>.

[Stage 3]
Primary event: <closing event>.
End state: <final visible state>.

[Maintain Consistency]
Keep <character identity, number of characters, clothing, prop ownership, spatial direction, and audio relationships> consistent.

30 秒的生成,三個階段是個好用的預設。下面是填好的版本,一個維修咖啡館的段落——兩個人,一個物件換手兩次,正是那種寫成一大段就會跑掉的形狀。

[Generation Goal]
Generate a documentary-style instructional video. The central subjects are <Volunteer> and <Owner>, and the primary event is repairing a desk lamp with a frayed cord and returning it working.

[Stage 1]
Initial state: <Volunteer> stands behind a wooden repair bench in a bright community hall. The desk lamp sits unlit on the bench, and a small metal tray and screwdriver lie to the right of it.
Primary event: <Volunteer> unscrews the lamp base and lifts it away, exposing the wiring.
End state: the lamp base is open on the bench, three screws are in the metal tray, and the screwdriver is back on the right side of the bench.

[Stage 2]
Continue from the previous stage: both characters keep the same identities and clothing, the lamp base stays open on the bench, and the screws stay in the tray.
Primary event: <Volunteer> cuts away the frayed cord and fits a new braided cord into the base while <Owner> holds the lamp head steady.
End state: the frayed cord lies coiled at the left edge of the bench, the new braided cord runs from the base to the floor socket, and <Owner> still holds the lamp head with both hands.

[Stage 3]
Primary event: <Volunteer> closes the base, plugs the cord in, and <Owner> presses the switch.
End state: the lamp stands upright and lit in the center of the bench, and both characters look at the lit lamp from behind the bench.

[Maintain Consistency]
Keep <Volunteer> and <Owner>'s identities, clothing, the bench orientation, the tray position, and lamp ownership at each handoff consistent. Only two people are in frame throughout. Pure video, no subtitles, no background music.

每個階段只放一個狀態變化

讓這套方法成立的紀律,既無聊又不容妥協:每個階段只有一個主要事件。如果一個階段裡寫了 "unscrews the base, replaces the cord, and tests the lamp",模型就得自己把時間預算分配給三個節拍,通常會趕掉兩個或漏掉一個。把它拆開。

結束狀態必須看得見

結束狀態是一格你可以截圖下來的畫面,不是一種感覺。"The repair is finished" 沒給模型任何可以收斂的東西。"The lamp stands upright and lit in the center of the bench" 給了它一個目標,而且順便免費給了_下一個_階段它要繼承的狀態。寫結束狀態時,用位置、歸屬和看得見的場景狀態來寫——東西在哪、誰拿著它、什麼開著或關著。

小技巧

如果你沒辦法把結束狀態寫成觀眾能指出來的東西,那這個階段裝了不只一件事。把它拆開,兩個結束狀態自己就寫出來了。

時間戳,用在真的需要精準的地方

Seedance 2.5 原生支援用時間戳做劇情和鏡頭區間控制,精確到秒。依照發布指引,你在鏡頭、台詞或動作的正前方直接寫一個區間標記,例如 [00.0-05],然後按時間順序寫下去。

預設用階段。當你需要控制一次交接、一次進場或出場、一次轉場,或一個明確的節拍時再拿出秒級精度——音樂對點、產品揭曉,或一個你已經畫好分鏡的剪接點。

模式範例
時間區間0-3 seconds... 3-7 seconds... 7-12 seconds...
精確時間點At 5 seconds, the camera whip-pans rapidly to the left and completes the transition.
相對時間Three seconds after the character presses the button, the room lights gradually turn off.

規則很短:

  • 連續且不重疊。 各區間要把時間軸鋪滿。留空隙或重疊,就會得到你預期中的那種混亂。
  • 一個區間是時間預算,不是剪接點。 動作可能落在交界之前或之後一點。如果你的交付物需要幀準的剪接,那是後期的工作。
  • 內容密度決定節奏感。 一個區間裡放太少,等於把自由交給模型,它就會自己編填充內容。放太多會造成切太碎或事件被丟掉。
  • 絕對不要要求頻率。 "Complete three actions in one second" 不是節奏指示,是在點一盤混亂。

時間戳和階段可以疊得很好:保留階段區塊,只在你真的在意節奏的那一兩個階段上掛一個區間。

全域設定與抗崩塌區塊

發布指引為長提示詞在階段之上多加了一個區塊:一段全域設定,把世界觀一次固定下來,這樣就不用在每個階段裡重新推導一次。它涵蓋基礎環境與質感、視覺風格、鏡頭語言、角色造型、表演核心,以及一份禁止事項清單。

最後那份清單才是有用的部分。Seedance 2.5 在遵守負面指令上進步了,所以把正向的一行(畫面內容、運鏡、動作、對白、音效)和反向的一行(什麼不能出現)分開來寫,除了寫在全域,也值得寫在每個階段。"No subtitles, no background music" 現在是一條真的指令,不再是一個願望,而建議的措辭很直接——"pure video, no subtitles, no background music"。再加上你這顆鏡頭特有的失敗樣態:no extra people, no large body movements, no invented dialogue。

用一致性區塊收尾

[Maintain Consistency] 區塊不是裝飾。在結尾一個地方重述:角色身分、畫面裡的人數、服裝、道具歸屬、空間方向,以及音訊關係(誰在說話、什麼保持安靜)。它只花兩行,卻是對付本文開頭那些跑掉樣態最便宜的防線。

選哪個模式:單次生成、延長,還是長影片

從 Seedance 2.5 拿到長度有三條路,而且它們不能互換。

做法長度畫面比例什麼時候用
單次生成一次 4 到 30 秒可設定整個想法塞得進一段連續的畫面,而且你要最強的內部一致性
影片延長延長任何 30 秒以內的結果,累積最多到 60 秒鎖定為輸入影片的比例你已經喜歡某一次的結果,想一段一段繼續往下導
長影片模式一次 30 到 180 秒可設定這支片本來就是長篇,硬接會把它接壞

延長是「分段導演」那條路:先生成十秒,看一看,再指示下一段。每次延長的時長可以設定,但畫面比例繼承自輸入,不能改。長影片模式則完全跳過拼接,直接做一段 30 到 180 秒的片——橫式的宣傳片、音樂錄影帶,以及情緒弧線需要空間的獨白短片。

對於超長提示詞,發布指引在以上所有東西之上再加一件事:在提示詞文字的最開頭,把全域參數——目標時長和畫面比例——重述一次。這次生成夠長,在介面上講一次、在提示詞裡再講一次,是比較安全的習慣。其餘的形狀你已經熟悉了:全域參數、一段說明哪個上傳素材是哪個的創意素材描述、一句話的整體概述、當成時間軸寫的具體劇情描述,最後一段全域補充。

輸出解析度是 480p 或 720p,長片的完稿流程請依此規劃。

誠實說說限制

  • 時間戳分配的是事件的時間。它們不是幀準的剪接點。
  • 修改提示詞會提高關鍵事件跟來源對齊的機率;它們不保證逐格重合。
  • 多參考素材的工作,重點是為每個場景挑對素材,不是讓每個素材同時出現。
  • 需要精確的字幕、公式、招牌、產品規格或幀級的時間控制時,請結合準備好的參考素材、生成和後期。不要指望提示詞一個人扛。
  • 延長的交界畫面在視覺層次上自然銜接,而不是像素完全相同,而且延長段落的音量可能跟來源略有差異。

在 OmniArt 上開始

拿一個你已經失敗過一次的 30 秒想法。把它重寫成三個階段,每個階段一個主要事件加一個你能截圖下來的結束狀態,最後補上一致性區塊。在影片工作台用 Seedance 2.5 生成,然後只看階段的交界——檢查點有沒有守住,就在那裡看得出來。

如果某個交界壞了,修法幾乎永遠是把那個階段拆開,而不是再加描述。接下來,Seedance 2.5 帶來了什麼講的是更完整的功能組合,而影片修改與延長則接手單次生成不夠用之後的部分。

準備好開始創作了嗎?

用 AI 生成精彩內容

免費開始