Tutorial教程与操作指南7 分钟阅读

肖像用的 AI 说话头像与对口型指南

为一句图书馆欢迎词做一张得到同意的说话肖像:锁住 脸,录下声音,在 OmniArt 之外测试嘴部时机,并复查你要 发布的裁切。

OmniArt 团队

说话头像是一张看起来在说话的肖像。有用的场合很窄:一句图书馆 欢迎词、一句产品旁白,或一两句课前引入。本指南用虚构的 图书馆助理 Mara Chen 做规划示例。她的台词是:Your hold is ready at the front desk.

在 OmniArt 上,你可以在图像工作台里设计肖像,并用 音频工作台里的语音模型生成声音。公开的模型目录里有图像模型、视频模型 和语音模型。目录里没有专门的对口型或说话头像控件,不能把 台词映射成嘴型。到 OmniArt 之外的对口型编辑器里完成对齐,再按 你要发布的裁切复查文件。这一类的背景说明见 头像笔记、 对口型笔记和 照片头像笔记。

说话肖像用来做什么

脸承载信息、镜头又保持很近时,再用说话肖像。Mara 的台词行得通,是因为观众只需要一个事实和一个注视点:取书前台,而不是把整栋楼逛一遍。 计划一个想法、一张脸、一种取景。 书架镜头属于另一条片段。

先拿到同意,再让一张脸动起来

让你自己创作的脸动起来,或者让明确同意这一次用途的真人动起来。如果 Mara 取材于 同事,就为肖像、声音,以及你会发布片段的地方,拿到书面同意。

警告

跳过你无权模仿的私人、公众人物和客户的声音。如果 结果是逼真的合成人物,就按目标平台的要求加上披露, 写在说明文字里,或直接放在画面上。

写台词,并选定声音

写成一口气能读完。Your hold is ready at the front desk 落得很干净。把这句 出声读一遍。如果打绊,先删词,再生成。

在 OmniArt 的音频工作台里生成声音,整段只用一个预设。 MiniMax Speech 2.8 指南 讲了 HD 和 Turbo 的成片,以及标点。从测试句到最终 那句,都用同一个预设,包括两端的短暂停顿。

用一句短台词跑同步测试

用任何外部工具之前,先为 Mara 做一条短的图生视频测试,带一个小点头或一次眨眼。 这条测试检查光线、肩膀,以及这张脸是不是还是 Mara。它并不声称嘴 对上了词。接受图像的视频模型可以让静帧动起来。那种运动并不是 把帧绑到你的声音文件上的控件。

把通过的声音放进 OmniArt 之外的对口型编辑器,只同步这一句。 打开声音,用正常速度播放。嘴应该在第一个词张开,并在 这句话结束时稳住,下巴仍然连在脸上。

如果测试失败,只改一个输入。用更清楚的正面静帧、更慢的朗读,或 更干净的音频文件。例如,如果一张下巴内收的四分之三自拍挡住了 下唇,就否掉它:同步工具可能得去发明缺失的嘴沿。这是一条否决标准, 不是我们做过的某次测试的结果。

让脸在各条成片之间保持不动

Mara 在静帧、运动测试和 同步后的导出里,需要同一双眼睛、同一条发缝和敞开的领口。重复使用已通过的图像。 角色指南 在这里也适用,哪怕表演只有一句话。

已通过的静帧是平视,图书馆窗户在她左肩后面,没有东西 挡住嘴。墨镜、手托下巴、严重模糊和很陡的侧脸,会藏住 对口型编辑器必须读到的形状。

按最终取景复查片段

按你要发布的裁切复查导出文件。9:16 的图书馆帖子,把字幕 放在下巴下面,免得穿过嘴。检查裁切之后眼睛是否仍然看向镜头, 声音里没有房间底噪,以及画面上的字是否和口播的那句一致。

看一遍意思,再看一遍嘴。暂停时看起来很清晰的一帧, 句子一开始仍可能觉得晚了。音乐要压在声音下面。如果裁切切到 领口,就回到已通过的静帧。

在 OmniArt 上开始

在图像工作台里把 Mara 做成原创的正面肖像,两只眼睛和 嘴都不要被挡住。在音频工作台里生成那一句声音,并保存这一条。 视频模型只用来给静帧做短的运动测试。在外部 编辑器里完成对口型,然后在字幕就位后,看一遍最终取景,再发布。

准备好创作了吗?

开始用 AI 生成精彩内容

免费开始