Industry模型與觀察閱讀時間 21 分鐘

Seedance 2.5:這次帶來了什麼,跟 2.0 差在哪

Seedance 2.5 已在 OmniArt 上線:單次生成 30 秒、延長到 60 秒、長影片 180 秒、50 份參考素材,還有秒級的時間戳控制。

OmniArt 團隊
Seedance 2.5:這次帶來了什麼,跟 2.0 差在哪

Seedance 2.5 已經可以在 OmniArt 影片工作台裡選用,而它是一次比版號聽起來更大的發布。Seedance 2.0 立下了多模態的前提——圖片、影片、音訊和文字全都餵進同一段提示詞。Seedance 2.5 保留了那個前提,並把實務上最限制它的兩件事重蓋了一遍:一次生成能跑多久,以及模型真正會尊重多少參考素材。

這是一份能力清單,不是提示詞教學:有什麼新東西、真正的上限在哪,以及這一版還有哪些毛邊。我們先前依照發布前的資訊寫過Seedance 2.5 發布前瞻;其中好幾個數字到模型實際出貨時已經變了,下面的解析度數字才是算數的那些。

說明

以下每一項規格都來自 Dreamina 官方的 Seedance 2.5 發布與使用文件。文件在哪裡區分硬性上限和建議範圍,這篇文章就在哪裡跟著區分——那個區分比標題上的數字更重要。

Seedance 2.5 與 Seedance 2.0 一覽

能力Seedance 2.0Seedance 2.5
單次生成時長4 到 15 秒(97 到 361 格)4 到 30 秒(97 到 721 格)
每次請求的圖片數0 到 9最多 30
影片延長不支援任何 30 秒以內的結果都能反覆延長,最多累積到 60 秒
長影片不支援單次生成 30 到 180 秒
時間戳控制不支援原生支援,精確到秒
生成模式Omni Reference、Smart Edit、Long Video、First and Last Frames
輸出解析度480p、720p

四個模式裡有兩個是新的。Smart Edit 和 Long Video 在 2.0 裡都不存在。Smart Edit 另外有一個升級版介面叫 Edit with marks,可以在你上傳的影片上用方框、筆刷、箭頭、文字和地標點做標註;還有一個 Edit Video 變體,把同一套標註流程套用在生成之後的片段上。

突破 15 秒的三條不同路

影響最大的改變是,「它能跑多久」現在有三個各自獨立的答案,而選錯那一個就浪費一次生成。

單次生成:4 到 30 秒

基礎區間翻倍。一段提示詞現在買得到最多 30 秒、也就是 721 格,相對於 2.0 的 15 秒、361 格。文件宣稱時空一致性和跨剪接的一致性能撐過整個 30 秒的窗口——角色外觀、空間邏輯和鏡頭之間的銜接,應該能活過比較長的生成,而不是到後半段就開始跑掉。

影片延長:像俄羅斯娃娃一路疊到 60 秒

任何 30 秒以內的結果,都可以用一段新的提示詞延長,而那次延長的結果還可以再被延長。文件把這叫做俄羅斯娃娃式的堆疊,累積的上限是 60 秒。

有意思的地方不在總長。而在於每一個延長節點都能接受新的指導——文件把這叫做分段導演控制。你可以先生成十秒的角色奔跑,確認沒問題,再在下一次延長裡下達那個跳躍的指令,而不是把整套動作押在一次送出上。對於武打編排,或一個你希望剛好落在某個節拍上的劇情轉折,這是一種跟「把提示詞寫更長」完全不同的工作方法。

延長可以向前或向後跑,而文件建議整顆鏡頭的延長要明確寫上連續性限制:自然延長、動作銜接流暢、不要硬切鏡頭、不要有物件憑空出現。這套流程我們在 Seedance 2.5 修改與延長指南裡拆得更細。

長影片:一次生成 30 到 180 秒

長影片是一個獨立的模式,不是在標準模式上調長一點。它直接生成 30 到 180 秒,不用拼接,也不用延長鏈。它宣示的設計目標,是角色特徵、服裝細節和場景架構在整整三分鐘裡的長距一致性,再加上流暢的長運鏡——慢推、環繞,以及在一個長鏡次裡撐得住的穿行鏡頭。

因為一次三分鐘的生成做錯了很貴,文件裡的長影片提示詞公式以全域參數開頭——就算你已經在介面上設好了,還是要在提示詞最前面把時長和畫面比例重述一次。

參考素材的預算:50 份素材,以及怎麼花

Seedance 2.5 單次請求最多接受 50 份參考素材。這個上限分成三類,而每一類都有一個硬性上限和一個另外的建議範圍。

類型硬性上限建議範圍
圖片最多 30 張,每張 4K 以內1 到 8 個不同主體;9 到 12 個也可以,但穩定度會下降
影片最多 10 支,合計 30 秒1 到 5 個不同主體,每個主體的影片 5 到 10 秒;6 到 10 個也可以,但穩定度會下降
音訊最多 10 段,合計 30 秒只放這顆鏡頭真正需要的對白、聲線、環境音或音樂
影片修改一支來源影片,加上參考圖來源影片 20 秒以內,1 到 5 張參考圖;6 到 8 張也可以

兩欄之間的落差就是全部的重點。三十張是請求接受的數量;八個主體才是模型穩定處理得了的數量。把預算填滿不是策略——文件說得很明白,多參考素材的創作,重點是為每個場景挑對素材,不是讓每份素材同時出現。

有一條實用規則值得記進骨子裡:如果超過五個主體還各自需要多個視角,就把每個視角放進自己的一張圖。每個視角獨立成圖,比一張拼貼總表穩定。

在素材規格上,圖片可以是 jpeg、png、webp、bmp、tiff、gif、heic 或 heif,畫面比例介於 0.4 到 2.5,尺寸介於 300 到 6000 px,單張 30 MB 以內,整個請求主體 64 MB 以內。參考影片接受 mp4 或 mov,480p 到 4K,比例和尺寸的界線跟圖片相同。

參考素材包的排序和角色分配,請看 Seedance 2.5 參考素材提示詞指南

時間戳控制,精確到秒

Seedance 2.5 原生支援用時間戳做劇情和鏡頭區間控制。你在鏡頭、對白或動作前面寫一個標記,例如 [00.0-05],其餘按時間順序寫下去。各區間必須連續且不重疊。

文件裡誠實的說法是:一個時間戳區間是一個事件的時間預算,不是幀準的剪接點。動作可能落在交界前後一點。一個區間裡放太少,等於給了模型你未必想給的自由;放太多會造成切太碎或事件被丟掉。要求「一秒鐘之內完成三個不同動作」這種頻率,是行不通的。

用對的話,它仍然是節奏上最大的一根槓桿。它是讓一次 30 秒的多鏡頭生成表現得像一份腳本、而不是一段混剪的東西,也是30 秒 Seedance 提示詞指南那套做法的骨幹。

多語言輸入與對白

Seedance 2.5 接受多種語言的文字輸入,文件裡分成兩個層級。最高最佳化優先度涵蓋中文、英文、西班牙文、印尼文和馬來文。完整涵蓋範圍再延伸到泰文、阿拉伯文、葡萄牙文、越南文、日文和韓文。

這一版也針對發音準確度、減少生僻字誤讀,以及多語言語音的對嘴做了改善。對於要做在地化廣告變體,或拍一部角色講不同語言的短片的人來說,這個組合——用你自己的語言寫簡報、對白用目標語言、嘴型跟得上——才是實際的解鎖點。

基礎模型的品質工程

2.5 裡不是每件事都是一顆新按鈕。這一版有相當比例是基礎模型的重建,目標是文件裡說的「去掉 AI 味」:

  • 皮膚——塑膠感的光澤和油膩的高光減少了,真實的毛孔和光線反應回來了。
  • 動物毛髮——更蓬鬆、更分明,不再糊成一團。
  • 聲音——生成對白裡的機械 TTS 音色變少了。
  • 長尾動作——罕見的舞蹈、複雜的武術和細微的表情變化,現在能順順生成,不會扭曲。
  • 一致性——時空邏輯和跨剪接的角色連續性,能撐過完整的 30 秒生成。

提示詞這一側的把手又小又具體:像 native skin texture 和 hair root distinct 這類詞可以加寫實感,而穩定的角色設定描述在每顆鏡頭裡重複一次,可以把一致性守過剪接。

不要字幕、不要背景音樂——現在真的會照做

這是一個很小、但對量產工作影響極大的修正。舊版就算提示詞說了不要,還是會把字幕燒進去或加上背景音樂。Seedance 2.5 會遵守這些指令,而文件裡的措辭是一個修飾語,像 "pure video, no subtitles, no background music"。

如果你要交乾淨的素材給剪接師或音效設計師,這就是「可以用的輸出」和「得重生成一次」的差別。

多模態參考素材的升級

發布說明裡最大的一個區塊,是一組參考素材面的能力。合起來看,它們把 Seedance 從一個生成器,往一個更接近「可被執導的修改介面」的東西推:

  • 背景音樂分離——把背景音樂剝掉、留住說話的聲音,而且值得注意的是,畫面上的字幕和其他視覺元素會完整保留。
  • 創意與鏡頭語言轉移——把參考素材的推拉搖軌跡、手持晃動、色彩邏輯和情緒氛圍搬過來,不只是表面的肢體動作。
  • 局部消除與修改——用筆刷或方框圈出一個區域做無痕擦除,背景會依照物理和光線邏輯補完,另外還有定向的元素替換。
  • 空間視角修改——把已經有的鏡頭改成俯視、仰角或第一人稱,同時維持比例和佈局的一致。
  • 音色參考——重現音色,連同一段參考錄音的情緒張力和節奏。
  • 多人參考——角色之間不會發生五官融合、不會換錯衣服,互動時的物理遮擋正確。
  • 綠幕——高精度的前景切割,在動態背景下也有幀級的穩定度。
  • Clay Renderer——一個給 Maya 和 Blender 用的白模外掛,可以還原鏡頭語言、鎖住空間和構圖,並控制角色位置和移動路徑。
  • 無縫轉場——在兩支獨立的片之間生成銜接內容,不改動任何一支來源,用焦段、旋轉或俯衝式轉場,由動作、視線或遮擋觸發。
  • 多格分鏡——把一張多格分鏡圖當成劇情參考餵進去。

其中兩項附帶的使用說明值得再講一次。Clay Renderer 目前從粗略白模——用簡單的球體、圓柱和方塊提供動態骨架——得到的結果,比從精細的完整模型好。多格分鏡則以簡單線稿或火柴人效果最好,最好不超過 15 格,文字標籤降到最少。這兩項在 Seedance 2.5 分鏡與白模指南裡都有講。

會自己鎖住的參數

Seedance 2.5 把素材驅動的工作分成鎖定和未鎖定兩種任務。在鎖定任務裡,輸入會變成輸出時間軸的一部分,結果要去配合它。在未鎖定任務裡,素材提供的是語意上的引導,輸出時長和畫面比例仍然由你控制。

有三種任務類型會覆蓋掉你以為自己能控制的設定。送出之前先知道這件事,可以省下一次白花的生成。

任務類型畫面比例時長
影片修改沿用輸入影片的比例,不能另外設定大致沿用輸入的時長,不能另外設定,而且輸入影格的處理可能讓它偏移約 0.3 秒以內
首格/首尾格用第一張圖的比例可以設定
影片延長沿用輸入影片的比例,不能另外設定可以設定

首尾格那條規則,適用於圖片以 content.role = first_framecontent.role = last_frame 送出的時候。因為比例來自那格嚴格的首格,尾圖如果用了不同比例就會被拉伸。上傳前先把兩張對齊。

參考生成、分鏡格和獨立的關鍵影格參考都屬於未鎖定。它們不會繼承素材的畫面比例或時長。另外還有一種比較寬鬆的首尾格做法:把圖片當成 reference_image 送出,並在提示詞裡指名它們是首格和尾格。這樣輸出設定仍然自由,但生成出來的頭尾只會近似參考,不會嚴格吻合。

值得先規劃進去的限制

輸出解析度是 480p 和 720p。這就是出貨的上限,也是最可能影響交付決策的那道限制——一段三分鐘的 720p 生成,和一份三分鐘的母帶,是非常不一樣的素材。請照這個前提,把 Seedance 2.5 規劃進前期視覺化、社群交付和參考素材的用途,並在投入一次長生成之前先確認你的交付規格。

文件對幾項行為限制也講得很坦白:

  • 時間戳分配的是事件的時間,它們不是幀準的剪接點。
  • 修改提示詞會提高關鍵事件跟來源對齊的機率,但無法保證逐格重合。
  • 影片修改的輸出可能跟輸入差到約 0.3 秒。
  • 延長段的音量可能跟來源片段略有差異。
  • 無縫轉場追求的是視覺和聲音的連續,不是像素完全相同的剪接點。
  • 延長裡的交界影格是在視覺層次上自然銜接,但不會像素完全相同。
  • 字幕、公式、招牌、產品規格或幀級的時間控制如果必須精確,請結合準備好的參考素材、生成和後期。

這些都不構成淘汰理由。它們區分的是「把 Seedance 2.5 當成產線裡一個可被執導的生成器」和「把它當成一個完稿工具」——而它不是後者。

在 OmniArt 上開始

打開 OmniArt 影片工作台選 Seedance 2.5,然後照著真的能長出手感的順序走一遍這次的發布:

  1. 先做一次帶時間戳的 30 秒生成。 寫三到四個連續、不重疊的區間,看看節奏落點有多準。這件事教會你這個模型的時間行為,比任何其他方法都快。
  2. 接著測延長。 生成十秒你滿意的畫面,用一段新指令延長它,再把那個結果延長一次。每個交界都看一下那道縫和音量。
  3. 在建議範圍內組一個參考素材包,不要衝到硬性上限——幾張各自職責清楚的主體圖,需要鏡頭語言的話再加一支短的參考影片。
  4. 長影片留給你已經在較短時長驗證過的簡報。 三分鐘,對一段沒測過的提示詞來說是很大的一筆押注。
  5. 要交給剪接師的東西,記得加上 "pure video, no subtitles, no background music"。

想了解適用於每一代 Seedance 的底層提示詞哲學,先從Seedance 提示詞怎麼寫開始。接著挑一份符合你任務的指南:參考素材提示詞30 秒提示詞修改與延長,或分鏡與白模

準備好開始創作了嗎?

用 AI 生成精彩內容

免費開始