在 OmniArt 上開始做 AI 影片生成
在 OmniArt 上做出你的第一支 AI 影片:怎麼選模型、提示詞怎麼寫、參考素材流程、點數估算、檢查方法和下一步。

第一個專案越小,AI 影片生成就越容易上手。你不需要一支完整的廣告、一份完美的腳本,也不需要最貴的模型。你需要的是一顆清楚的鏡頭、一個吃得下正確輸入的模型,以及一套判斷這個結果值不值得再跑一次的方法。
OmniArt 把文字生成影片、圖片生成影片、以參考素材引導的生成、轉場、原生音訊模型和多個模型家族,都放進同一個創作工作台。這份新手指南會帶你從空白的提示詞走到檢查完的第一支片,而且不會把影響成本和品質的選擇藏起來。
先做一顆鏡頭,不是一整部片
從一個五到八秒、只有一個主體和一個主要動作的瞬間開始。適合當第一個專案的例子有:
- 一件產品在乾淨檯面上緩慢旋轉;
- 一個角色走過一個場景;
- 一張靜態圖片獲得細微的鏡頭運動;
- 一張起始影格轉場到一張指定的結束影格;
- 一顆帶單一聲音提示的短氛圍鏡頭。
像「做一支完整的上市影片,五個場景、對白、字幕,還要有標誌現身」這種要求,裡面包了好幾個各自獨立的製作問題。把它拆成鏡頭。你會得到更清楚的提示詞、更受控的成本,也更有機會把做對的部分留下來。
挑對輸入模式
輸入決定了你手上有哪些控制方式。
| 起點 | 什麼時候用 | 主要風險 |
|---|---|---|
| 只有文字 | 場景可以完全從描述裡長出來 | 身分和構圖可能會跑掉 |
| 起始圖片 | 第一格畫面或產品外觀必須被錨定 | 動起來時細節可能變形 |
| 首尾影格 | 鏡頭必須在兩個已知構圖之間移動 | 轉場可能顯得生硬 |
| 多張參考素材 | 人物、物件、服裝或風格必須維持一致 | 互相衝突的參考會削弱控制 |
用能守住需求的最小一組參考素材。多加圖片只有在每一張都補上一塊明確資訊時才有幫助。
用最難的那一段來挑模型
OmniArt 開放好幾個影片模型家族,因為沒有一個引擎能贏下每一顆鏡頭。從你需要模型解決的問題開始:
- PixVerse V6: 實用的免費起點,畫面比例齊全,支援圖片輸入,音訊選配。
- PixVerse C1: 受控的短動作,有轉場和參考模式。
- Seedance 2.0: 多參考素材與有調度的多鏡頭工作,有 Standard、Fast 和 Mini 三種。
- Gemini Omni: 任意輸入的短影片生成,帶原生音訊。
- Happy Horse 1.0: 較長的片段,帶原生音訊,並有 1080p 選項。
- Kling: 物理動作、參考控制,可選 Standard 或 Pro。
- Grok Imagine: 以圖片帶動的社群動態,短時長選擇靈活。
- Veo 3.1: 較高解析度選項、轉場、延長,以及支援音訊的版本。
- Sora 2: 在固定時長選項下做出連貫的單鏡頭。
第一次測試,請挑吃得下你所需輸入的最便宜模型。等你講得出想解決的限制是什麼,再往上走。
寫一條模型排得出來的提示詞
一條好用的影片提示詞會描述五件事:
- 主體: 畫面上看得到誰或什麼?
- 動作: 這段片子裡有什麼在改變?
- 環境: 動作發生在哪裡?
- 鏡頭: 這個瞬間怎麼取景,鏡頭怎麼動?
- 視聽質感: 哪些光線、質地、節奏、對白、環境音或音效很重要?
範例:
A matte coral travel bottle stands on a warm stone counter in a bright kitchen. A hand enters from the right, lifts the bottle, turns the label toward camera, and sets it beside a glass. Slow waist-level push-in, natural morning window light, realistic product photography, quiet room ambience, preserve the bottle shape and label colors.
這條提示詞給了模型一個排得出來的順序。它避開了剪輯指示、畫面上的文案,以及那些屬於流程後段的額外場景。
小技巧
把確切的字幕、價格、法律文案和標誌留在生成的畫面之外。 等視覺鏡頭定案之後,再用可控的方式加上去。
設定時長、畫質、比例和音訊
可用的控制項會隨著選定的模型而變。在細修提示詞之前先看一遍:
- 時長: 更長不等於更好。挑一個剛好夠一個看得懂的動作的長度。
- 畫質: 早期測試用適合打樣的解析度,等方向定了再拉高畫質。
- 畫面比例: 先決定要交付到哪裡。直式動態消息用 9:16,橫式影片用 16:9,真的需要正方形素材的版位才用 1:1。
- 音訊: 原生音訊有助於對齊,但另外做人聲或音樂的流程能給你更多編輯上的掌控。
- 數量: 一次多做幾個可以比較不同詮釋,但點數估算也會跟著翻倍。
OmniArt 在送出前就會顯示預估點數。這個估算會隨模型、時長、畫質、音訊、模式和輸出數量變動。請把它當成創作決策的一部分,而不是結帳時才發現的意外。
做出你的第一支片
- 打開 OmniArt 的影片工作台。
- 選一個支援你輸入模式的模型。
- 上傳你真正需要的起始、結束或參考素材。
- 貼上提示詞,選好時長、畫質、比例和音訊。
- 看一下預估點數。
- 送出生成,跟著有文字說明的進度走。
- 從作品紀錄裡打開完成的檔案,和一開始的需求比對。
新帳號會收到新手贈送的 10 點數。一次低成本的 V6 打樣塞得進這筆額度,而高階模型或更長、更高解析度的片段,可能需要付費方案或另外購買點數。
分輪次檢查結果
不要看一眼就決定「好」或「不好」。照這個順序檢查:
第一輪:構圖
主體看得清楚嗎?重要的產品或角色有沒有留在畫面裡?鏡頭有沒有往預期的方向動?
第二輪:動態
盯著手、接觸點、布料、反射、物體的重量,以及每個動作的起點和終點。細節看起來怪怪的時候,把片子放慢。
第三輪:身分與產品準確度
把臉、服裝、輪廓、標籤位置、顏色和參考細節,拿去和已定案的原始素材比對。
第四輪:音訊
檢查對白時機、嘴型、環境音、音量突然變化,以及生成的聲音是在支撐這顆鏡頭,還是在干擾它。
第五輪:交付
用真正的尺寸和比例預覽一次。確認還留得下字幕、行動呼籲或平台介面元素的空間。
一次修一個問題
第一次結果沒中的時候,先找出最大的那個失敗:
- 如果構圖跑掉了,就強化起始圖片或鏡頭描述。
- 如果動態很含糊,就把形容詞換成一個看得見的動作和它的時間點。
- 如果身分變了,就減少互相衝突的參考素材,並重複那些穩定的視覺錨點。
- 如果產品變形了,就把動作縮短,並改用更近的已定案參考圖。
- 如果音訊很弱,就把聲音需求簡化,或另外做一軌。
- 如果畫面太擠,就拿掉一個主體,或把這個想法拆成兩支片。
一次改一到兩個變數,不要整份需求重寫。這樣重跑才會變成一個受控的改善過程。
做出下一個版本
第一顆鏡頭成立之後,把提示詞、模型、參數和已定案的參考素材存下來。下一顆鏡頭圍著同一組錨點去做,再到 OmniArt 的音訊工作台加上人聲、音效或音樂。
當你需要更強的鏡頭和光線控制時,接著看電影感 AI 影片提示詞指南。要挑模型的話,用 2026 AI 影片生成器比較。目標不是一次幸運的輸出,而是一條從需求走到定案素材、而且可以重複的路。
準備好開始創作了嗎?
用 AI 生成精彩內容