Seedance 2.5:這次帶來了什麼,跟 2.0 差在哪
Seedance 2.5 已在 OmniArt 上線:單次生成 30 秒、延長到 60 秒、長影片 180 秒、50 份參考素材,還有秒級的時間戳控制。

Seedance 2.5 已經可以在 OmniArt 影片工作台裡選用,而它是一次比版號聽起來更大的發布。Seedance 2.0 立下了多模態的前提——圖片、影片、音訊和文字全都餵進同一段提示詞。Seedance 2.5 保留了那個前提,並把實務上最限制它的兩件事重蓋了一遍:一次生成能跑多久,以及模型真正會尊重多少參考素材。
這是一份能力清單,不是提示詞教學:有什麼新東西、真正的上限在哪,以及這一版還有哪些毛邊。我們先前依照發布前的資訊寫過Seedance 2.5 發布前瞻;其中好幾個數字到模型實際出貨時已經變了,下面的解析度數字才是算數的那些。
說明
以下每一項規格都來自 Dreamina 官方的 Seedance 2.5 發布與使用文件。文件在哪裡區分硬性上限和建議範圍,這篇文章就在哪裡跟著區分——那個區分比標題上的數字更重要。
Seedance 2.5 與 Seedance 2.0 一覽
| 能力 | Seedance 2.0 | Seedance 2.5 |
|---|---|---|
| 單次生成時長 | 4 到 15 秒(97 到 361 格) | 4 到 30 秒(97 到 721 格) |
| 每次請求的圖片數 | 0 到 9 | 最多 30 |
| 影片延長 | 不支援 | 任何 30 秒以內的結果都能反覆延長,最多累積到 60 秒 |
| 長影片 | 不支援 | 單次生成 30 到 180 秒 |
| 時間戳控制 | 不支援 | 原生支援,精確到秒 |
| 生成模式 | — | Omni Reference、Smart Edit、Long Video、First and Last Frames |
| 輸出解析度 | — | 480p、720p |
四個模式裡有兩個是新的。Smart Edit 和 Long Video 在 2.0 裡都不存在。Smart Edit 另外有一個升級版介面叫 Edit with marks,可以在你上傳的影片上用方框、筆刷、箭頭、文字和地標點做標註;還有一個 Edit Video 變體,把同一套標註流程套用在生成之後的片段上。
突破 15 秒的三條不同路
影響最大的改變是,「它能跑多久」現在有三個各自獨立的答案,而選錯那一個就浪費一次生成。
單次生成:4 到 30 秒
基礎區間翻倍。一段提示詞現在買得到最多 30 秒、也就是 721 格,相對於 2.0 的 15 秒、361 格。文件宣稱時空一致性和跨剪接的一致性能撐過整個 30 秒的窗口——角色外觀、空間邏輯和鏡頭之間的銜接,應該能活過比較長的生成,而不是到後半段就開始跑掉。
影片延長:像俄羅斯娃娃一路疊到 60 秒
任何 30 秒以內的結果,都可以用一段新的提示詞延長,而那次延長的結果還可以再被延長。文件把這叫做俄羅斯娃娃式的堆疊,累積的上限是 60 秒。
有意思的地方不在總長。而在於每一個延長節點都能接受新的指導——文件把這叫做分段導演控制。你可以先生成十秒的角色奔跑,確認沒問題,再在下一次延長裡下達那個跳躍的指令,而不是把整套動作押在一次送出上。對於武打編排,或一個你希望剛好落在某個節拍上的劇情轉折,這是一種跟「把提示詞寫更長」完全不同的工作方法。
延長可以向前或向後跑,而文件建議整顆鏡頭的延長要明確寫上連續性限制:自然延長、動作銜接流暢、不要硬切鏡頭、不要有物件憑空出現。這套流程我們在 Seedance 2.5 修改與延長指南裡拆得更細。
長影片:一次生成 30 到 180 秒
長影片是一個獨立的模式,不是在標準模式上調長一點。它直接生成 30 到 180 秒,不用拼接,也不用延長鏈。它宣示的設計目標,是角色特徵、服裝細節和場景架構在整整三分鐘裡的長距一致性,再加上流暢的長運鏡——慢推、環繞,以及在一個長鏡次裡撐得住的穿行鏡頭。
因為一次三分鐘的生成做錯了很貴,文件裡的長影片提示詞公式以全域參數開頭——就算你已經在介面上設好了,還是要在提示詞最前面把時長和畫面比例重述一次。
參考素材的預算:50 份素材,以及怎麼花
Seedance 2.5 單次請求最多接受 50 份參考素材。這個上限分成三類,而每一類都有一個硬性上限和一個另外的建議範圍。
| 類型 | 硬性上限 | 建議範圍 |
|---|---|---|
| 圖片 | 最多 30 張,每張 4K 以內 | 1 到 8 個不同主體;9 到 12 個也可以,但穩定度會下降 |
| 影片 | 最多 10 支,合計 30 秒 | 1 到 5 個不同主體,每個主體的影片 5 到 10 秒;6 到 10 個也可以,但穩定度會下降 |
| 音訊 | 最多 10 段,合計 30 秒 | 只放這顆鏡頭真正需要的對白、聲線、環境音或音樂 |
| 影片修改 | 一支來源影片,加上參考圖 | 來源影片 20 秒以內,1 到 5 張參考圖;6 到 8 張也可以 |
兩欄之間的落差就是全部的重點。三十張是請求接受的數量;八個主體才是模型穩定處理得了的數量。把預算填滿不是策略——文件說得很明白,多參考素材的創作,重點是為每個場景挑對素材,不是讓每份素材同時出現。
有一條實用規則值得記進骨子裡:如果超過五個主體還各自需要多個視角,就把每個視角放進自己的一張圖。每個視角獨立成圖,比一張拼貼總表穩定。
在素材規格上,圖片可以是 jpeg、png、webp、bmp、tiff、gif、heic 或 heif,畫面比例介於 0.4 到 2.5,尺寸介於 300 到 6000 px,單張 30 MB 以內,整個請求主體 64 MB 以內。參考影片接受 mp4 或 mov,480p 到 4K,比例和尺寸的界線跟圖片相同。
參考素材包的排序和角色分配,請看 Seedance 2.5 參考素材提示詞指南。
時間戳控制,精確到秒
Seedance 2.5 原生支援用時間戳做劇情和鏡頭區間控制。你在鏡頭、對白或動作前面寫一個標記,例如 [00.0-05],其餘按時間順序寫下去。各區間必須連續且不重疊。
文件裡誠實的說法是:一個時間戳區間是一個事件的時間預算,不是幀準的剪接點。動作可能落在交界前後一點。一個區間裡放太少,等於給了模型你未必想給的自由;放太多會造成切太碎或事件被丟掉。要求「一秒鐘之內完成三個不同動作」這種頻率,是行不通的。
用對的話,它仍然是節奏上最大的一根槓桿。它是讓一次 30 秒的多鏡頭生成表現得像一份腳本、而不是一段混剪的東西,也是30 秒 Seedance 提示詞指南那套做法的骨幹。
多語言輸入與對白
Seedance 2.5 接受多種語言的文字輸入,文件裡分成兩個層級。最高最佳化優先度涵蓋中文、英文、西班牙文、印尼文和馬來文。完整涵蓋範圍再延伸到泰文、阿拉伯文、葡萄牙文、越南文、日文和韓文。
這一版也針對發音準確度、減少生僻字誤讀,以及多語言語音的對嘴做了改善。對於要做在地化廣告變體,或拍一部角色講不同語言的短片的人來說,這個組合——用你自己的語言寫簡報、對白用目標語言、嘴型跟得上——才是實際的解鎖點。
基礎模型的品質工程
2.5 裡不是每件事都是一顆新按鈕。這一版有相當比例是基礎模型的重建,目標是文件裡說的「去掉 AI 味」:
- 皮膚——塑膠感的光澤和油膩的高光減少了,真實的毛孔和光線反應回來了。
- 動物毛髮——更蓬鬆、更分明,不再糊成一團。
- 聲音——生成對白裡的機械 TTS 音色變少了。
- 長尾動作——罕見的舞蹈、複雜的武術和細微的表情變化,現在能順順生成,不會扭曲。
- 一致性——時空邏輯和跨剪接的角色連續性,能撐過完整的 30 秒生成。
提示詞這一側的把手又小又具體:像 native skin texture 和 hair root distinct 這類詞可以加寫實感,而穩定的角色設定描述在每顆鏡頭裡重複一次,可以把一致性守過剪接。
不要字幕、不要背景音樂——現在真的會照做
這是一個很小、但對量產工作影響極大的修正。舊版就算提示詞說了不要,還是會把字幕燒進去或加上背景音樂。Seedance 2.5 會遵守這些指令,而文件裡的措辭是一個修飾語,像 "pure video, no subtitles, no background music"。
如果你要交乾淨的素材給剪接師或音效設計師,這就是「可以用的輸出」和「得重生成一次」的差別。
多模態參考素材的升級
發布說明裡最大的一個區塊,是一組參考素材面的能力。合起來看,它們把 Seedance 從一個生成器,往一個更接近「可被執導的修改介面」的東西推:
- 背景音樂分離——把背景音樂剝掉、留住說話的聲音,而且值得注意的是,畫面上的字幕和其他視覺元素會完整保留。
- 創意與鏡頭語言轉移——把參考素材的推拉搖軌跡、手持晃動、色彩邏輯和情緒氛圍搬過來,不只是表面的肢體動作。
- 局部消除與修改——用筆刷或方框圈出一個區域做無痕擦除,背景會依照物理和光線邏輯補完,另外還有定向的元素替換。
- 空間視角修改——把已經有的鏡頭改成俯視、仰角或第一人稱,同時維持比例和佈局的一致。
- 音色參考——重現音色,連同一段參考錄音的情緒張力和節奏。
- 多人參考——角色之間不會發生五官融合、不會換錯衣服,互動時的物理遮擋正確。
- 綠幕——高精度的前景切割,在動態背景下也有幀級的穩定度。
- Clay Renderer——一個給 Maya 和 Blender 用的白模外掛,可以還原鏡頭語言、鎖住空間和構圖,並控制角色位置和移動路徑。
- 無縫轉場——在兩支獨立的片之間生成銜接內容,不改動任何一支來源,用焦段、旋轉或俯衝式轉場,由動作、視線或遮擋觸發。
- 多格分鏡——把一張多格分鏡圖當成劇情參考餵進去。
其中兩項附帶的使用說明值得再講一次。Clay Renderer 目前從粗略白模——用簡單的球體、圓柱和方塊提供動態骨架——得到的結果,比從精細的完整模型好。多格分鏡則以簡單線稿或火柴人效果最好,最好不超過 15 格,文字標籤降到最少。這兩項在 Seedance 2.5 分鏡與白模指南裡都有講。
會自己鎖住的參數
Seedance 2.5 把素材驅動的工作分成鎖定和未鎖定兩種任務。在鎖定任務裡,輸入會變成輸出時間軸的一部分,結果要去配合它。在未鎖定任務裡,素材提供的是語意上的引導,輸出時長和畫面比例仍然由你控制。
有三種任務類型會覆蓋掉你以為自己能控制的設定。送出之前先知道這件事,可以省下一次白花的生成。
| 任務類型 | 畫面比例 | 時長 |
|---|---|---|
| 影片修改 | 沿用輸入影片的比例,不能另外設定 | 大致沿用輸入的時長,不能另外設定,而且輸入影格的處理可能讓它偏移約 0.3 秒以內 |
| 首格/首尾格 | 用第一張圖的比例 | 可以設定 |
| 影片延長 | 沿用輸入影片的比例,不能另外設定 | 可以設定 |
首尾格那條規則,適用於圖片以 content.role = first_frame 和 content.role = last_frame 送出的時候。因為比例來自那格嚴格的首格,尾圖如果用了不同比例就會被拉伸。上傳前先把兩張對齊。
參考生成、分鏡格和獨立的關鍵影格參考都屬於未鎖定。它們不會繼承素材的畫面比例或時長。另外還有一種比較寬鬆的首尾格做法:把圖片當成 reference_image 送出,並在提示詞裡指名它們是首格和尾格。這樣輸出設定仍然自由,但生成出來的頭尾只會近似參考,不會嚴格吻合。
值得先規劃進去的限制
輸出解析度是 480p 和 720p。這就是出貨的上限,也是最可能影響交付決策的那道限制——一段三分鐘的 720p 生成,和一份三分鐘的母帶,是非常不一樣的素材。請照這個前提,把 Seedance 2.5 規劃進前期視覺化、社群交付和參考素材的用途,並在投入一次長生成之前先確認你的交付規格。
文件對幾項行為限制也講得很坦白:
- 時間戳分配的是事件的時間,它們不是幀準的剪接點。
- 修改提示詞會提高關鍵事件跟來源對齊的機率,但無法保證逐格重合。
- 影片修改的輸出可能跟輸入差到約 0.3 秒。
- 延長段的音量可能跟來源片段略有差異。
- 無縫轉場追求的是視覺和聲音的連續,不是像素完全相同的剪接點。
- 延長裡的交界影格是在視覺層次上自然銜接,但不會像素完全相同。
- 字幕、公式、招牌、產品規格或幀級的時間控制如果必須精確,請結合準備好的參考素材、生成和後期。
這些都不構成淘汰理由。它們區分的是「把 Seedance 2.5 當成產線裡一個可被執導的生成器」和「把它當成一個完稿工具」——而它不是後者。
在 OmniArt 上開始
打開 OmniArt 影片工作台選 Seedance 2.5,然後照著真的能長出手感的順序走一遍這次的發布:
- 先做一次帶時間戳的 30 秒生成。 寫三到四個連續、不重疊的區間,看看節奏落點有多準。這件事教會你這個模型的時間行為,比任何其他方法都快。
- 接著測延長。 生成十秒你滿意的畫面,用一段新指令延長它,再把那個結果延長一次。每個交界都看一下那道縫和音量。
- 在建議範圍內組一個參考素材包,不要衝到硬性上限——幾張各自職責清楚的主體圖,需要鏡頭語言的話再加一支短的參考影片。
- 長影片留給你已經在較短時長驗證過的簡報。 三分鐘,對一段沒測過的提示詞來說是很大的一筆押注。
- 要交給剪接師的東西,記得加上 "pure video, no subtitles, no background music"。
想了解適用於每一代 Seedance 的底層提示詞哲學,先從Seedance 提示詞怎麼寫開始。接著挑一份符合你任務的指南:參考素材提示詞、30 秒提示詞、修改與延長,或分鏡與白模。
準備好開始創作了嗎?
用 AI 生成精彩內容