肖像用的 AI 說話頭像與對口型指南
為一句圖書館歡迎詞做一張得到同意的說話肖像:鎖住 臉,錄下聲音,在 OmniArt 之外測試嘴部時機,並複查你要 發布的裁切。
說話頭像是一張看起來在說話的肖像。有用的場合很窄:一句圖書館 歡迎詞、一句產品旁白,或一兩句課前引入。本指南用虛構的 圖書館助理 Mara Chen 做規劃示例。她的台詞是:Your hold is ready at the front desk.
在 OmniArt 上,你可以在圖像工作台裡設計肖像,並用 音訊工作台裡的語音模型生成聲音。公開的模型目錄裡有圖像模型、影片模型 和語音模型。目錄裡沒有專門的對口型或說話頭像控制項,不能把 台詞映射成嘴型。到 OmniArt 之外的對口型編輯器裡完成對齊,再按 你要發布的裁切複查檔案。這一類的背景說明見 頭像筆記、 對口型筆記和 照片頭像筆記。
說話肖像用來做什麼
臉承載資訊、鏡頭又保持很近時,再用說話肖像。Mara 的台詞行得通,是因為觀眾只需要一個事實和一個注視點:取書櫃台,而不是把整棟樓逛一遍。 計畫一個想法、一張臉、一種取景。 書架鏡頭屬於另一條片段。
先拿到同意,再讓一張臉動起來
讓你自己創作的臉動起來,或者讓明確同意這一次用途的真人動起來。如果 Mara 取材於 同事,就為肖像、聲音,以及你會發布片段的地方,拿到書面同意。
注意
跳過你無權模仿的私人、公眾人物和客戶的聲音。如果 結果是逼真的合成人物,就按目標平台的要求加上揭露, 寫在說明文字裡,或直接放在畫面上。
寫台詞,並選定聲音
寫成一口氣能讀完。Your hold is ready at the front desk 落得很乾淨。把這句 出聲讀一遍。如果打絆,先刪詞,再生成。
在 OmniArt 的音訊工作台裡生成聲音,整段只用一個預設。 MiniMax Speech 2.8 指南 講了 HD 和 Turbo 的成片,以及標點。從測試句到最終 那句,都用同一個預設,包括兩端的短暫停頓。
用一句短台詞跑同步測試
用任何外部工具之前,先為 Mara 做一條短的圖生影片測試,帶一個小點頭或一次眨眼。 這條測試檢查光線、肩膀,以及這張臉是不是還是 Mara。它並不聲稱嘴 對上了詞。接受圖像的影片模型可以讓靜止畫面動起來。那種運動並不是 把影格綁到你的聲音檔案上的控件。
把通過的聲音放進 OmniArt 之外的對口型編輯器,只同步這一句。 打開聲音,用正常速度播放。嘴應該在第一個詞張開,並在 這句話結束時穩住,下巴仍然連在臉上。
如果測試失敗,只改一個輸入。用更清楚的正面靜止畫面、更慢的朗讀,或 更乾淨的音訊檔案。例如,如果一張下巴內收的四分之三自拍擋住了 下唇,就否掉它:同步工具可能得去發明缺失的嘴沿。這是一條否決標準, 不是我們做過的某次測試的結果。
讓臉在各條成片之間保持不動
Mara 在靜止畫面、運動測試和 同步後的匯出裡,需要同一雙眼睛、同一條髮縫和敞開的領口。重複使用已通過的圖像。 角色指南 在這裡也適用,哪怕表演只有一句話。
已通過的靜止畫面是平視,圖書館窗戶在她左肩後面,沒有東西 擋住嘴。墨鏡、手托下巴、嚴重模糊和很陡的側臉,會藏住 對口型編輯器必須讀到的形狀。
按最終取景複查片段
按你要發布的裁切複查匯出檔案。9:16 的圖書館貼文,把字幕 放在下巴下面,免得穿過嘴。檢查裁切之後眼睛是否仍然看向鏡頭, 聲音裡沒有房間底噪,以及畫面上的字是否和口播的那句一致。
看一遍意思,再看一遍嘴。暫停時看起來很清晰的一個影格, 句子一開始仍可能覺得晚了。音樂要壓在聲音下面。如果裁切切到 領口,就回到已通過的靜止畫面。
在 OmniArt 上開始
在圖像工作台裡把 Mara 做成原創的正面肖像,兩隻眼睛和 嘴都不要被擋住。在音訊工作台裡生成那一句聲音,並儲存這一條。 影片模型只用來給靜止畫面做短的運動測試。在外部 編輯器裡完成對口型,然後在字幕就位後,看一遍最終取景,再發布。
準備好開始創作了嗎?
用 AI 生成精彩內容