Tutorial教學與操作指南閱讀時間 11 分鐘

在 OmniArt 上開始做 AI 影片生成

在 OmniArt 上做出你的第一支 AI 影片:怎麼選模型、提示詞怎麼寫、參考素材流程、點數估算、檢查方法和下一步。

OmniArt 團隊
在 OmniArt 上開始做 AI 影片生成

第一個專案越小,AI 影片生成就越容易上手。你不需要一支完整的廣告、一份完美的腳本,也不需要最貴的模型。你需要的是一顆清楚的鏡頭、一個吃得下正確輸入的模型,以及一套判斷這個結果值不值得再跑一次的方法。

OmniArt 把文字生成影片、圖片生成影片、以參考素材引導的生成、轉場、原生音訊模型和多個模型家族,都放進同一個創作工作台。這份新手指南會帶你從空白的提示詞走到檢查完的第一支片,而且不會把影響成本和品質的選擇藏起來。

先做一顆鏡頭,不是一整部片

從一個五到八秒、只有一個主體和一個主要動作的瞬間開始。適合當第一個專案的例子有:

  • 一件產品在乾淨檯面上緩慢旋轉;
  • 一個角色走過一個場景;
  • 一張靜態圖片獲得細微的鏡頭運動;
  • 一張起始影格轉場到一張指定的結束影格;
  • 一顆帶單一聲音提示的短氛圍鏡頭。

像「做一支完整的上市影片,五個場景、對白、字幕,還要有標誌現身」這種要求,裡面包了好幾個各自獨立的製作問題。把它拆成鏡頭。你會得到更清楚的提示詞、更受控的成本,也更有機會把做對的部分留下來。

挑對輸入模式

輸入決定了你手上有哪些控制方式。

起點什麼時候用主要風險
只有文字場景可以完全從描述裡長出來身分和構圖可能會跑掉
起始圖片第一格畫面或產品外觀必須被錨定動起來時細節可能變形
首尾影格鏡頭必須在兩個已知構圖之間移動轉場可能顯得生硬
多張參考素材人物、物件、服裝或風格必須維持一致互相衝突的參考會削弱控制

用能守住需求的最小一組參考素材。多加圖片只有在每一張都補上一塊明確資訊時才有幫助。

用最難的那一段來挑模型

OmniArt 開放好幾個影片模型家族,因為沒有一個引擎能贏下每一顆鏡頭。從你需要模型解決的問題開始:

  • PixVerse V6: 實用的免費起點,畫面比例齊全,支援圖片輸入,音訊選配。
  • PixVerse C1: 受控的短動作,有轉場和參考模式。
  • Seedance 2.0: 多參考素材與有調度的多鏡頭工作,有 Standard、Fast 和 Mini 三種。
  • Gemini Omni: 任意輸入的短影片生成,帶原生音訊。
  • Happy Horse 1.0: 較長的片段,帶原生音訊,並有 1080p 選項。
  • Kling: 物理動作、參考控制,可選 Standard 或 Pro。
  • Grok Imagine: 以圖片帶動的社群動態,短時長選擇靈活。
  • Veo 3.1: 較高解析度選項、轉場、延長,以及支援音訊的版本。
  • Sora 2: 在固定時長選項下做出連貫的單鏡頭。

第一次測試,請挑吃得下你所需輸入的最便宜模型。等你講得出想解決的限制是什麼,再往上走。

寫一條模型排得出來的提示詞

一條好用的影片提示詞會描述五件事:

  1. 主體: 畫面上看得到誰或什麼?
  2. 動作: 這段片子裡有什麼在改變?
  3. 環境: 動作發生在哪裡?
  4. 鏡頭: 這個瞬間怎麼取景,鏡頭怎麼動?
  5. 視聽質感: 哪些光線、質地、節奏、對白、環境音或音效很重要?

範例:

A matte coral travel bottle stands on a warm stone counter in a bright kitchen. A hand enters from the right, lifts the bottle, turns the label toward camera, and sets it beside a glass. Slow waist-level push-in, natural morning window light, realistic product photography, quiet room ambience, preserve the bottle shape and label colors.

這條提示詞給了模型一個排得出來的順序。它避開了剪輯指示、畫面上的文案,以及那些屬於流程後段的額外場景。

小技巧

把確切的字幕、價格、法律文案和標誌留在生成的畫面之外。 等視覺鏡頭定案之後,再用可控的方式加上去。

設定時長、畫質、比例和音訊

可用的控制項會隨著選定的模型而變。在細修提示詞之前先看一遍:

  • 時長: 更長不等於更好。挑一個剛好夠一個看得懂的動作的長度。
  • 畫質: 早期測試用適合打樣的解析度,等方向定了再拉高畫質。
  • 畫面比例: 先決定要交付到哪裡。直式動態消息用 9:16,橫式影片用 16:9,真的需要正方形素材的版位才用 1:1。
  • 音訊: 原生音訊有助於對齊,但另外做人聲或音樂的流程能給你更多編輯上的掌控。
  • 數量: 一次多做幾個可以比較不同詮釋,但點數估算也會跟著翻倍。

OmniArt 在送出前就會顯示預估點數。這個估算會隨模型、時長、畫質、音訊、模式和輸出數量變動。請把它當成創作決策的一部分,而不是結帳時才發現的意外。

做出你的第一支片

  1. 打開 OmniArt 的影片工作台
  2. 選一個支援你輸入模式的模型。
  3. 上傳你真正需要的起始、結束或參考素材。
  4. 貼上提示詞,選好時長、畫質、比例和音訊。
  5. 看一下預估點數。
  6. 送出生成,跟著有文字說明的進度走。
  7. 從作品紀錄裡打開完成的檔案,和一開始的需求比對。

新帳號會收到新手贈送的 10 點數。一次低成本的 V6 打樣塞得進這筆額度,而高階模型或更長、更高解析度的片段,可能需要付費方案或另外購買點數。

分輪次檢查結果

不要看一眼就決定「好」或「不好」。照這個順序檢查:

第一輪:構圖

主體看得清楚嗎?重要的產品或角色有沒有留在畫面裡?鏡頭有沒有往預期的方向動?

第二輪:動態

盯著手、接觸點、布料、反射、物體的重量,以及每個動作的起點和終點。細節看起來怪怪的時候,把片子放慢。

第三輪:身分與產品準確度

把臉、服裝、輪廓、標籤位置、顏色和參考細節,拿去和已定案的原始素材比對。

第四輪:音訊

檢查對白時機、嘴型、環境音、音量突然變化,以及生成的聲音是在支撐這顆鏡頭,還是在干擾它。

第五輪:交付

用真正的尺寸和比例預覽一次。確認還留得下字幕、行動呼籲或平台介面元素的空間。

一次修一個問題

第一次結果沒中的時候,先找出最大的那個失敗:

  • 如果構圖跑掉了,就強化起始圖片或鏡頭描述。
  • 如果動態很含糊,就把形容詞換成一個看得見的動作和它的時間點。
  • 如果身分變了,就減少互相衝突的參考素材,並重複那些穩定的視覺錨點。
  • 如果產品變形了,就把動作縮短,並改用更近的已定案參考圖。
  • 如果音訊很弱,就把聲音需求簡化,或另外做一軌。
  • 如果畫面太擠,就拿掉一個主體,或把這個想法拆成兩支片。

一次改一到兩個變數,不要整份需求重寫。這樣重跑才會變成一個受控的改善過程。

做出下一個版本

第一顆鏡頭成立之後,把提示詞、模型、參數和已定案的參考素材存下來。下一顆鏡頭圍著同一組錨點去做,再到 OmniArt 的音訊工作台加上人聲、音效或音樂。

當你需要更強的鏡頭和光線控制時,接著看電影感 AI 影片提示詞指南。要挑模型的話,用 2026 AI 影片生成器比較。目標不是一次幸運的輸出,而是一條從需求走到定案素材、而且可以重複的路。

準備好開始創作了嗎?

用 AI 生成精彩內容

免費開始