Guide模型与洞察13 分钟阅读

Seedance 2.0 提示词指南:6 个 AI 视频用例

面向创作者的 Seedance 2.0 实操指南:多参考输入、原生音频、最高 4K 输出、按镜头写的提示词,以及 6 个在 OmniArt 内实测过的提示词案例。

OmniArt 团队
Seedance 2.0 提示词指南:6 个 AI 视频用例

当你拿到的简报像一份导演阐述时,Seedance 2.0 通常就是创作者会拿起的那个模型。它在一次请求里可以同时接收文本、最多 9 张图像、3 段参考视频和 3 段音频文件,全部用 @image1@video1@audio1 语法寻址。本文讲的是尊重这个模型的提示词语法、它在 OmniArt 上当前的限制,以及六个实测用例,附提示词和结果。

Seedance 2.0 是什么

Seedance 2.0 生成 4–15 秒的片段,带原生音频。Standard 最高到 4K,Fast 和 Mini 最高到 720p。真正的看点仍然是多参考架构:一次请求可以同时组合图片、视频和音频,只要其中至少有一份视觉参考。

规格数值
变体Standard、Fast、Mini
输出分辨率Standard:480p / 720p / 1080p / 4K;Fast 和 Mini:480p / 720p
时长4–15 秒
画面比例21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16
参考额度最多合并 12 份素材;至少需要一张图片或一段视频
图像输入最多 9 张(@image1@image9
视频输入最多 3 段;每段 2–15 秒、24–60fps,合计 15 秒(@video1@video3
音频输入最多 3 段;每段 2–15 秒,合计 15 秒(@audio1@audio3
原生音频输出支持——对白、音效、环境音、配乐
任务模式Video、Transition、Reference、Extend、Modify
使用门槛Standard:Creator 及以上;Fast 和 Mini:Starter 及以上

多参考系统为什么重要

大多数视频模型只接受一张参考图,或者干脆不接受。Seedance 2.0 接受一整组参考素材,并且允许你在提示词内部把每一份参考绑定到一个角色上。用 @image1 指代角色面孔,@image2 指代服装,@image3 指代场景,@video1 指代你想要的运镜,@audio1 指代背景音乐。模型会把每一份参考视为独立指令,而不是把它们平均成一团噪声。

这就是为什么角色形象能跨镜头保持一致的实际原因:同一份 @image 参考被传入时间线中的每一个镜头,模型把它当作身份锚点,而不是每次都从提示词文本里重新推断角色长什么样。

真正好用的提示词结构

Seedance 2.0 偏爱六段式结构。

  1. 主体 — 画面里出现的是谁或什么
  2. 动作 / 运动 — 他们在做什么
  3. 场景 / 环境 — 发生在哪里
  4. 视觉风格 — 影片参考、调色板、年代
  5. 镜头指令 — 具体的电影摄影术语
  6. 灯光 — 方向、质感、时段

一条好用的模板提示词:

"Subject (with @image1 reference if applicable). Action. Setting. Visual style. Camera direction (specific cinematography term). Lighting detail."

多镜头时间线写法

Seedance 2.0 响应的是镜头顺序,而不是秒级时间戳。用编号镜头,按顺序描述每一个节拍。

Shot 1: wide establishing shot, character (in @image1) walks into the scene
Shot 2: medium tracking shot follows them across the room
Shot 3: 360-degree orbit around the table they reach

把同一个 @image1 钉死在每一段里。剪到下一镜时,形象保持一致。

说明

Seedance 2.5 增加了整秒级的时间戳控制。不要把 2.5 的时间戳模板直接搬进 2.0 的请求,然后指望那些时间区间能控制节奏;请继续使用上面这种镜头编号结构。

参考标签的使用纪律

一份很短但很值钱的小规则:

  • @image1@image2 表示人脸照与产品图。
  • @video1 表示你想被复用的运镜。
  • 当背景音比模型默认音轨更重要时,用 @audio1
  • 在文本里显式引用每一个标签。不要指望模型自己去推断哪一份参考对应哪一个角色。

6 个实测过的用例与提示词

下面每一条提示词我们都在 Seedance 2.0 上跑过。结果列写的是我们实际拿到的产物,生成时间在 Standard 720p 下测得。

1. 电影感场景

"A retired detective in a long dark coat walks through a rain-soaked alley at night. Neon signs reflect red and blue on the wet cobblestones. He pauses, lights a cigarette, and glances over his shoulder. Slow push-in from wide shot to medium close-up. Film noir style, anamorphic lens flare, teal-orange color grading, film grain."

结果。 推镜流畅。雨水反射可信,大衣运动自然。点烟动作完成,没有手部畸变。雨声与城市环境音同步生成。约 70 秒。

2. 产品广告片

"A luxury perfume bottle rotates slowly on a black marble surface. Golden liquid catches the light as it turns. Soft particles of gold dust float in the air around it. Macro close-up, slow 360-degree orbit camera. Studio lighting with warm rim light, high-end commercial photography style."

结果。 玻璃折射与液体行为准确。颗粒漂浮自然。完整旋转流畅,光线角度正确,大理石纹理清晰可见。约 65 秒。

3. 音乐视频

"A female singer in a flowing red silk dress performs on a rooftop at sunset. City skyline stretches behind her. Wind blows her hair and dress dramatically. She sings with emotional intensity, arms spread wide. Dynamic tracking shot circling around her. Golden hour backlighting, lens flare, vibrant warm tones."

结果。 裙摆物理表现真实。环绕跟拍流畅。整段旋转中面孔保持一致。头发运动方向与风向匹配。生成了氛围化的配乐音轨。约 75 秒。

4. 人物动态肖像

"An elderly Japanese craftsman in a traditional wooden workshop, morning light streaming through paper screens. He slowly lifts a hand-forged ceramic tea bowl, examining it with quiet pride. His weathered hands rotate the bowl gently. Close-up of his hands, then slow tilt up to reveal his face. Wabi-sabi aesthetic, warm natural light, documentary portrait quality."

结果。 手指数量正确。关节运动自然。从手到脸的上摇流畅。透过障子的光线真实。微弱的工坊环境声。皮肤纹理逼真。约 80 秒。

5. 自然与风光

"Aerial drone shot gliding over a misty mountain valley at sunrise. Layers of fog roll between emerald green peaks. A winding river reflects the golden morning light below. Eagles soar through the frame at eye level. Smooth forward tracking with slight descent. Epic landscape, volumetric fog, golden hour lighting."

结果。 独立的雾层营造出可信的纵深。河面反射随相机位置实时更新。色彩平衡有力。体积雾渲染干净。风声与鸟鸣音轨齐备。约 55 秒——6 个里最快的。

6. 二次元与奇幻

"An anime warrior princess stands atop a cliff overlooking a burning medieval city at night. Her long silver hair and crimson cape billow in the wind. She draws a glowing blue katana, electricity crackling along the blade. Cherry blossom petals swirl around her. Dynamic low-angle shot with slow push-in. Cel-shading style, vibrant neon accents, dramatic speed lines."

结果。 全程保持赛璐璐上色风格。拔刀动作流畅。电流特效自然融入。樱花独立运动。火光与披风产生光影互动。戏剧性的挥刀音效齐备。约 70 秒。

常见错误与修复

问题原因修复
提示词被拒出现面孔关键词或语义模糊删除显式的面孔描述;改用 @image 参考
出现黑帧提示词过于复杂把动作切成每 4–5 秒一个;测试时降低分辨率
角色面孔在镜头之间变化没有一致的参考在时间线的每一个镜头里钉同一个 @image1
音画不同步联合扩散对位错配关掉音频重新生成,再单独叠加音轨
手部或手指畸变复杂的手部交互缺乏参考加一张目标手部姿态的参考图
"AI 感"质感过度依赖风格关键词加入物理细节——材质、灯光、镜头类型

Seedance 2.0 对比 Seedance 1.0

如果你用过 1.0,会发现 2.0 与之的差距比版本号暗示的要大得多。

特性1.02.0
架构分离式管线统一扩散 Transformer
图像输入1 张可选最多 9 张,可通过 @tag 寻址
视频输入最多 3 段
音频输入最多 3 段
原生音频输出
最高分辨率1080p4K
时长5–10 秒4–15 秒
多镜头基础时间线分镜,跨镜头一致性
手部质量经常出现伪影显著改善
视频内编辑不支持支持——角色 / 物体替换

何时该选别的模型

Seedance 2.0 并不是每种简报的最优解。

需求当前工作台里更合适的起点
成本最低、带原生音频的 Seedance 草稿Seedance 2.0 Mini
另一条重参考、2K 输出的工作流MiniMax H3
4K 输出,可选原生音频Veo 3.1 Standard 或 Fast
短文生视频,不需要生成音频Sora 2
低成本、跨多种画面比例的通用迭代V6

OmniArt 上的计费

Seedance 2.0 在 OmniArt 视频工作台中按输出秒数计费。720p 下,Standard 每秒 14 积分、Fast 每秒 11 积分、Mini 每秒 8 积分;5 秒片段分别为 70、55、40 积分。Standard 需要 Creator 或 Ultra,Fast 与 Mini 需要 Starter 或更高等级。Ultra 当前提供免积分素材生成,而不是百分比折扣。

警告

截至本文撰写时,ByteDance 尚未对 Seedance 2.0 输出物的商业使用权做出明确公开说明。对于高风险的商业项目,请在交付前再次核对平台的授权条款。

在 OmniArt 上开始使用

Seedance 2.0 与 V6、Sora 2、Veo 3.1、Kling 3.0、HappyHorse 1.0、Grok Imagine 一起,位于 OmniArt 的视频工作台里。同一份积分余额、同一套参考上传、同一套提示词语法。

建议先用上面的电影感场景提示词跑一遍,体会多参考的工作流,再切到音乐视频那条简报,去测试运动中的面孔一致性。

下一代工作流请继续阅读 Seedance 2.5 的变化,再从中选择与你任务对应的提示词指南。

准备好创作了吗?

开始用 AI 生成精彩内容

免费开始