guide教程与操作指南6 分钟阅读
AI 音频生成器:在 OmniArt 创作配音与音乐
在 OmniArt 使用 MiniMax、ElevenLabs 和 Lyria 模型创作配音与音乐,再到剪辑软件中与视频和音效完成合成。
OmniArt 团队

声音往往是创作者最容易交给运气的部分。当旁白、音乐和画面围绕同一份 brief 制作时,一个好镜头会更有力量。OmniArt 的音频工作台目前支持生成语音和音乐,但没有独立的文字转 SFX、环境音或拟音模型。本指南会说明工作台真正能做什么、如何选模型,以及哪些环节仍应交给独立剪辑软件。
把生成资产留在同一个项目里依然能减少交接。你可以先制作配音和音乐底,再生成匹配的图片或视频,最后到其他软件中完成时间线组装。
你可以生成什么
OmniArt 的音频模型覆盖两类制作任务:
- 配音——把文字生成旁白、角色台词和多语言对白;具体控制项因语音模型而异。
- 音乐——按曲风、情绪、配器和结构生成完整曲目或音乐构思。
说明
部分视频模型会把原生音频作为视频结果的一部分生成。这不等同于独立 SFX 生成器:请以所选视频模型实际显示的控制项为准,不要假设每个模型都支持音频。
OmniArt 上的音频模型
不同模型擅长不同任务。OmniArt 把它们放在同一个工作台,让你按任务而不是按平台选择。
| 模型 | 最适合 | 说明 |
|---|---|---|
| MiniMax Speech 2.8 HD | 高保真配音与旁白 | 适合成片级 VO 的清晰度 |
| MiniMax Speech 2.8 Turbo | 快速草稿与批量对白 | 适合快速测试不同台词 |
| Eleven Multilingual v2 | 稳定的多语言配音 | 可用于多种语言 |
| Eleven v3 | 更有表现力和情绪变化的演绎 | 适合需要较大表演幅度的内容 |
| Eleven Turbo v2.5 | 低延迟语音 | 适合长脚本和快速迭代 |
| MiniMax Music 2.6 | 按曲风和情绪生成完整音乐 | 适合背景配乐和品牌提示音 |
| ElevenLabs Music | 有结构的歌曲与循环段落 | 支持按段落组织音乐 |
| Google Lyria 3 Pro | 高质量器乐与电影配乐 | 适合预告片和叙事视频配乐 |
选择取决于 brief:成片旁白用 HD,测试多个台词版本用 Turbo,画面底下的配乐则交给音乐模型。切换模型时不需要搬走项目里的其他资产。
分步生成音频
- 在音频工作台选择 Speech 或 Music。
- **按任务选择模型。**语音模型负责对白,音乐模型负责配乐或歌曲。
- **写制作 brief。**语音要包含准确台词和预期演绎;音乐要描述曲风、情绪、配器、速度和结构。
- **生成并检查。**确认发音、节奏、音乐转场,以及结果是否给对白留出空间。
- **一次只改一个变量。**有意识地调整演绎或结构,不要每次都重写整份 brief。
- **导出选中的资产,**再到常用的视频或音频剪辑软件中与画面、环境音和 SFX 合成。
把音频与图片和视频配合起来
有效的交接始于共享 brief。无脸解说可以先生成旁白,再按它的节奏制作画面;产品短片可以生成一条给核心信息留足空间的音乐底,并在剪辑阶段加入已授权或自行录制的 SFX 与环境音。
提示
先围绕配音时长搭结构,再精修画面。通常,把生成片段剪到稳定旁白上,比强行把成片旁白塞进已经锁定的剪辑容易。
开始使用 OmniArt
从一段短脚本开始。生成两版不同演绎的语音,再制作一条支持相同情绪的音乐底。导出两项资产,在剪辑软件中加入 SFX 或环境音,并对着画面完成混音。打开音频工作台创作配音或音乐;如果 brief 还需要生成画面,可继续阅读在同一个工作台使用所有 AI 视频模型。
准备好创作了吗?
开始用 AI 生成精彩内容