industry模型与洞察20 分钟阅读

Seedance 2.5 正式上线:相比 2.0 到底更新了什么

Seedance 2.5 已在 OmniArt 上线:单次生成最长 30 秒、续写累计 60 秒、长视频模式 180 秒、单次最多 50 个参考素材,并支持精确到秒的时间戳控制。

OmniArt 团队
Seedance 2.5 正式上线:相比 2.0 到底更新了什么

Seedance 2.5 已经可以在 OmniArt 视频工作台里选用,而它的更新幅度比版本号看起来大得多。Seedance 2.0 立下了多模态的前提——图片、视频、音频和文本共同喂给同一条提示词。Seedance 2.5 保留了这个前提,并重建了此前在实际使用中限制它的两件事:一次生成能跑多长,以及模型到底会认真对待多少参考素材。

这是一篇能力盘点,不是提示词教程:新增了什么、真正的上限在哪里,以及这次发布还有哪些粗糙的地方。我们此前根据发布前信息写过 Seedance 2.5 发布状态指南,其中几项数字在模型正式上线时已经变化,下面的分辨率数据才是最终结果。

说明

下面每一项规格都来自 Dreamina 官方的 Seedance 2.5 发布与使用文档。文档在哪里区分了硬性上限与推荐范围,本文也照样区分——这个区别比标题上的数字更重要。

Seedance 2.5 与 Seedance 2.0 速览

能力Seedance 2.0Seedance 2.5
单次生成时长4–15 秒(97–361 帧)4–30 秒(97–721 帧)
单次请求图片数0–9 张最多 30 张
视频续写不支持任何 30 秒以内的结果都可反复续写,累计最长 60 秒
长视频不支持单次生成 30–180 秒
时间戳控制不支持原生支持,精确到秒
生成模式Omni 参考、智能编辑、长视频、首尾帧
输出分辨率480p、720p

四种模式里有两种是全新的。智能编辑和长视频在 2.0 中并不存在。智能编辑还带来了一个增强版界面,叫作「标注编辑」:你可以在上传的视频上用方框、画笔、箭头、文字和标记点做标注;另外还有一个「视频编辑」变体,把同一套标注流程用在已经生成出来的片段上。

三种突破 15 秒的方式

影响最大的变化是,「到底能生成多长」现在有三个不同的答案,选错一个就浪费一次生成。

单次生成:4 到 30 秒

基础区间翻倍。一条提示词现在最多可以换来 30 秒、也就是 721 帧,而 2.0 是 15 秒、361 帧。文档称时空一致性和镜头之间的连贯性在整个 30 秒窗口内都能保持——角色外观、空间逻辑和镜头转换应当撑过更长的时长,而不是在后半段开始跑偏。

视频续写:套娃式叠加到 60 秒

任何 30 秒以内的结果都可以用一条新的提示词续写,而续写出来的结果还能继续被续写。文档把这种做法称为套娃式叠加,累计上限是 60 秒。

有意思的地方不在总时长,而在于每个续写节点都能接受新的指令——文档称之为分段导演控制。你可以先生成十秒的角色奔跑,确认没问题,再在下一段续写里指挥那个跳跃,而不是把整套动作押在一次提交上。对于打斗设计,或者你希望落在某个具体节拍上的剧情反转,这是一种和「写一条更长的提示词」完全不同的工作方法。

续写可以向前也可以向后。文档建议在整镜续写时写明连贯性约束:自然延续、运动衔接顺滑、禁止镜头硬切、禁止物体凭空出现。这套流程我们在 Seedance 2.5 视频编辑与续写指南里拆得更细。

长视频:单次跑出 30 到 180 秒

长视频是一个独立模式,不是在标准模式上把时长调大。它直接生成 30 到 180 秒,不需要拼接,也不需要续写链条。官方给出的设计目标是:角色特征、服装细节和场景结构在整整三分钟里保持长程一致,同时支持平滑的长时镜头运动——慢推、环绕,以及能在长镜头中撑住的穿越运镜。

因为三分钟的生成一旦出错代价很高,文档里的长视频提示词公式开头就是全局参数:即使你已经在界面上设置过,也要在提示词开头把时长和画幅比例再写一遍。

参考素材预算:50 个素材该怎么花

Seedance 2.5 在一次请求里最多接收 50 个参考素材。这个上限分成三类,每一类都有一个硬性上限和一个单独的推荐范围。

类型硬性上限推荐范围
图片最多 30 张,每张不超过 4K1–8 个不同主体;9–12 个也能跑,但稳定性下降
视频最多 10 个,合计不超过 30 秒1–5 个不同主体,每个主体视频 5–10 秒;6–10 个主体也能跑,但稳定性下降
音频最多 10 个,合计不超过 30 秒只放这个镜头真正需要的对白、人声、环境声或音乐
视频编辑一个源视频加参考图片源视频不超过 20 秒,1–5 张参考图;6–8 张也可以

两列之间的差距才是全部重点。30 张是请求能接收的数量,8 个主体才是模型能稳定处理的数量。把预算填满不是策略——文档说得很明确:多参考创作的关键,是为每个场景挑选正确的素材,而不是让所有素材同时出现。

有一条值得记住的实操规则:如果主体超过五个、而且还需要多个视角,就把每个视角单独放进一张图片。按视角拆分的独立图片,比一张拼贴图更稳定。

在输入规范上,图片支持 jpeg、png、webp、bmp、tiff、gif、heic 和 heif,画幅比例在 0.4 到 2.5 之间,边长在 300 到 6000 像素之间,单张不超过 30 MB,请求体不超过 64 MB。参考视频支持 mp4 和 mov,分辨率 480p 到 4K,比例和尺寸限制相同。

关于参考素材包的排序与职责分配,见 Seedance 2.5 参考素材提示词指南

时间戳控制,精确到秒

Seedance 2.5 原生支持按时间戳控制剧情和镜头区间。你在镜头、台词或动作前面写一个标记,例如 [00.0-05],然后按时间顺序把后面的内容写下去。区间必须连续且不重叠。

文档里的说法很诚实:一个时间戳区间是某个事件的时间预算,而不是精确到帧的剪辑点。动作可能稍早或稍晚于边界落下。区间里内容太少,模型就获得了你未必想给的自由;内容太多,则会导致过度切分或事件被丢掉。要求「一秒之内出现三个不同动作」这种频率是行不通的。

用对了,它仍然是控制节奏最大的那根杠杆。它让一次 30 秒的多镜头生成表现得像剧本而不是混剪,也是 30 秒 Seedance 提示词指南里那套方法的骨架。

多语言输入与对白

Seedance 2.5 支持多种语言的文本输入,文档给出了两个层级。优化优先级最高的是中文、英语、西班牙语、印尼语和马来语;完整覆盖还包括泰语、阿拉伯语、葡萄牙语、越南语、日语和韩语。

这次发布还针对发音准确度、生僻字误读,以及多语种语音的口型同步做了优化。如果你要制作本地化广告变体,或者拍一部角色说不同语言的短片,那么「用母语写简报、用目标语言写台词、口型还能对上」这个组合就是真正的解锁点。

基础模型的画质工程

2.5 里并不是所有更新都是新按钮。这次发布有相当一部分是基础模型重建,目标是文档所说的去掉「AI 味」:

  • 皮肤——塑料光泽和油腻高光减少,真实毛孔和光线反应回来了。
  • 动物毛发——更蓬松、更分缕,而不是黏成一坨。
  • 人声——生成对白里的机械朗读音色明显变少。
  • 长尾动作——罕见舞蹈、复杂武打和细微表情变化现在能顺畅生成,而不是发生形变。
  • 一致性——时空逻辑和跨镜头的角色连贯性能撑过完整的 30 秒生成。

提示词这一侧能用的抓手很小也很具体:写实感可以写「皮肤原生纹理」「发根分明」这类描述,跨镜头一致性则靠在每个镜头里重复稳定的角色设定描述。

「无字幕、无背景音乐」这次真的被听进去了

这是一个小修复,但对制作流程的影响很大。此前的版本即使提示词里写了不要,也会烧录字幕或者自作主张加上背景音乐。Seedance 2.5 会遵守这类指令,文档给出的写法是一句修饰语:「纯视频,无字幕,无背景音乐」。

如果你要把干净的素材交给剪辑师或声音设计师,这就是「可用的成片素材」和「必须重做」之间的差别。

多模态参考能力升级

这次更新说明里篇幅最大的一块,是一组围绕参考素材的能力。把它们放在一起看,Seedance 正在从一个生成器,往更接近「可指挥的编辑台」的方向走:

  • 背景音乐分离——去掉背景音乐但保留说话人声,而且值得注意的是,画面上的字幕和其他视觉元素会保持完整。
  • 创意与镜头语言迁移——迁移参考素材的推拉摇移轨迹、手持晃动、色彩逻辑和情绪氛围,而不只是表层的肢体动作。
  • 局部消除与编辑——用画笔或方框圈出区域做无痕擦除,背景会按物理和光照逻辑重新补全,还支持定向的元素替换。
  • 空间视角改写——把已有镜头改成俯视、仰视或第一人称视角,同时保持比例和布局合理。
  • 音色参考——复现音色,以及参考录音里的情绪张力和节奏。
  • 多人参考——角色之间不会发生五官融合,不会互换服装,互动时的遮挡关系正确。
  • 绿幕——高精度前景分割,面对动态背景也能保持逐帧稳定。
  • Clay Renderer——面向 Maya 和 Blender 的白模插件,可以还原镜头语言、锁定空间与构图,并控制角色位置和运动路径。
  • 无缝转场——在两个互相独立的片段之间生成衔接内容,不修改任何一个源片段,可用焦段、旋转或俯冲式转场,由动作、视线或遮挡触发。
  • 多宫格分镜——把多格分镜图当作剧情参考喂进去。

其中两项附带的使用说明值得重复一遍。Clay Renderer 目前从粗颗粒白模——用简单的球体、圆柱和立方体搭出动态骨架——得到的结果,比从精细完整的模型更好。多宫格分镜最好是简单线稿或火柴人,最好不超过 15 格,文字标注越少越好。这两项在 Seedance 2.5 分镜与白模指南里有详细说明。

会自己锁死的参数

有三类任务会覆盖你以为能控制的设置。提交之前知道这一点,可以省下一次白费的生成。

任务类型画幅比例时长
视频编辑沿用输入视频的比例,不能单独设置大致沿用输入视频的时长,不能单独设置,输入帧处理还可能让它偏移约 0.3 秒
首帧 / 首尾帧使用第一张图片的比例可以设置
视频续写沿用输入视频的比例,不能单独设置可以设置

首尾帧这条规则里藏着一个坑:既然比例取自第一张图片,那么比例不同的尾帧图就会被拉伸。上传前先把两张图对齐。

值得提前规划的限制

输出分辨率是 480p 和 720p。这是上线时的上限,也是最可能影响交付决策的约束——一段 720p 的三分钟生成,和一条三分钟的成片母版完全是两种东西。据此把 Seedance 2.5 安排进预演、社媒交付和参考素材的环节,并在投入一次长时生成之前先确认你的交付规格。

文档对几项行为上的限制也很坦白:

  • 时间戳是给事件分配时间,不是精确到帧的剪辑点。
  • 编辑类提示词能提高关键事件与源视频对齐的概率,但不能保证逐帧重合。
  • 视频编辑的输出时长可能与输入相差约 0.3 秒。
  • 续写片段的音量可能与源片段略有差异。
  • 无缝转场追求的是视觉和听觉上的连贯,而不是像素级一致的拼接。
  • 续写的边界帧在视觉层面自然衔接,但并非像素级一致。
  • 字幕、公式、招牌文字、产品参数,或者必须精确的帧级时间点,都要靠事先准备的参考素材、生成和后期共同完成。

这些都不是致命问题。它们决定的只是:你把 Seedance 2.5 当成流程里一个可指挥的生成器,还是当成一个成片工具——而它并不是后者。

在 OmniArt 上开始使用

打开 OmniArt 视频工作台并选择 Seedance 2.5,然后按照真正能积累经验的顺序把这次更新走一遍:

  1. 先做一次带时间戳的 30 秒生成。 写三到四个连续、不重叠的区间,看看节奏落得有多准。这比任何方式都更快地让你摸清模型的时间行为。
  2. 然后测试续写。 先生成十秒你满意的内容,用一条新指令续写,再对续写结果继续续写。每个衔接处都留意接缝和音量。
  3. 在推荐范围内组建参考素材包,而不是按硬性上限去堆——几张各自职责明确的主体图,需要镜头语言时再加一段短参考视频。
  4. 把长视频留给已经在短时长上验证过的方案。 三分钟的投入,不值得押在一条没测过的提示词上。
  5. 给要交给剪辑师的片子加上「纯视频,无字幕,无背景音乐」。

关于适用于每个 Seedance 版本的底层提示词理念,可以从 Seedance 提示词怎么写开始。然后挑一份和你的任务匹配的指南:参考素材提示词30 秒提示词视频编辑与续写,或者分镜与白模

准备好创作了吗?

开始用 AI 生成精彩内容

免费开始