怎麼用 AI 把影片畫面往外擴:一套真的能跑的流程
怎麼用 AI 把影片畫面往外擴:用 OmniArt 的圖片模型加上圖片生成影片重建,把影片換到新的畫面比例,一套實際可跑的流程。

你拍的是直式,客戶要 16:9。或者一段 4:3 的舊素材必須填滿一個寬螢幕的主視覺欄位。又或者一支 1:1 的產品循環影片得改成 9:16 限動,而且不能把產品切一半。直覺反應是裁切,而裁切正是好素材去送死的地方——你要嘛失去構圖的邊緣,要嘛接受上下黑邊和一個變小的主體。
乾淨的解法是把畫面往外擴,而不是往裡切:保住每一個原始畫素,在空出來的邊緣生成新的畫面資訊。專門做影片外擴繪圖的工具正是一格一格這樣做。OmniArt 沒有——今天工作台裡沒有一鍵擴展影片畫面這個功能。
OmniArt 有的,是一條複合流程的兩半,走到最後結果一樣:能把一張靜態圖擴到新畫面比例、而且可以控制區域和錨點的圖片模型,加上一整排能把擴好的靜態圖變回動態的影片模型。這份指南把五個階段從頭走到尾,也會老實說出代價——你是在重建這顆鏡頭,不是在延展原本的素材。在一段緩慢、靜態、以背景為主的片段上,重建出來的東西常常跟真的分不出來;在一段穿過人群的手持推軌上,就不是這樣了。
「擴展影片畫面」到底是什麼意思
有四種完全不同的操作被叫成同一個名字,而挑錯那一種,就是這件事上大部分被浪費掉的時間。
| 做法 | 你的畫素會怎樣 | 你要付出的代價 |
|---|---|---|
| 裁切/平移縮放 | 原始畫素保留,邊緣丟掉 | 構圖和主體大小 |
| 上下黑邊/模糊側邊 | 全部保留,邊緣用色塊或模糊複本填滿 | 螢幕面積;看起來像轉發 |
| 影片外擴繪圖 | 全部保留,邊緣逐格生成 | 需要專門的外擴繪圖模型 |
| 複合式重建(本指南) | 原始素材變成參考素材,重新生成一段更寬的片段 | 對原始素材的逐格一致性 |
複合式重建落在外擴繪圖和重拍之間:把一張有代表性的靜態圖擴到目標比例,讓它動起來,再把新片段的運動和色調對回原始素材,讓兩者能待在同一條時間軸上。
注意
把這件事看清楚。OmniArt 沒有原生的影片外擴繪圖——這套流程是從一張擴好的靜態圖重新生成整顆鏡頭,而不是把你現有的畫面加寬。它不會逐畫素保住你的原始素材,也撐不過快速鏡頭運動或需要對嘴的對白。如果這段片段是必須保持拍攝原貌的主素材,請改用專門的影片外擴繪圖工具,或直接用更寬的比例重拍。
這條路什麼時候有用、什麼時候會失敗
花任何一點點數之前,先判斷這顆鏡頭。決定一切的變數是:更寬的畫面需要多少新資訊。
有用的情況:
- 鎖死或接近靜止的鏡頭。 腳架上的產品桌面、靜物、緩慢的環境背景——原始畫面外面幾乎沒有東西需要獨立運動。
- 邊緣是環境和紋理。 攝影棚背景、天空、牆面、水面、樹葉、散景。圖片模型延伸連續紋理的說服力很好。
- 緩慢的單向鏡頭運動。 一次輕輕的推鏡或飄移,你可以用提示詞重新描述出來。
- 短片段。 3~6 秒。片段越短,相對於原始素材累積的偏移就越少。
- 主體置中。 只要主體從不走進新生成的邊緣,需要做對的東西就少很多。
會失敗的情況,而且通常很難看:
- 快速或複雜的鏡頭運動。 手持、甩鏡、吊臂——新的邊緣需要幾何正確的視差,而模型沒有依據可以憑空造出來。
- 複雜的遮擋。 主體從前景物件後面經過、人群橫越畫面、肢體在邊緣進進出出。
- 需要對嘴的講話畫面。 你沒辦法重新生成一段表演又讓對白對得上。別試。
- 邊緣有認得出來的人或有授權的產品。 模型在邊緣造出來的東西就是造出來的——那是法律問題,不只是美感問題。
- 長鏡頭。 超過大約 8 秒,重建出來的片段和原始素材的偏離,不是任何調色蓋得住的。
如果你的鏡頭落在第二份清單裡,就停在這裡。老老實實加黑邊,或裁得有品味一點,都好過一段明顯在晃的重建。
階段 1:輸出一格有代表性的畫面
把原始片段拖著看一遍,抓出單獨一格,用 PNG 以原始解析度輸出。「有代表性」這四個字是真的有份量——後面每一步都會繼承這一格的構圖、光線和主體位置。
- 挑主體處在最典型位置的那一格,不是最極端的那一格。
- 避開有動態模糊的畫面。模糊會被烤進擴展結果裡,然後又被影片模型再模糊一次。
- 如果鏡頭有運動,優先挑運動中段的畫面,這樣重建出來的運動前後都有一樣的空間。
- 用無損格式輸出。畫面邊緣的一個 JPEG 壓縮瑕疵,到了擴展圖上就是一道接縫。
現在就把原始比例、解析度和長度記下來——階段 4 三個都會用到。
階段 2:把靜態圖擴到目標畫面比例
打開 OmniArt 的圖片工作台,挑一個能把你的靜態圖當參考素材、又能把目標畫面比例當參數的模型。Seedream 5.0 Pro 在這裡是實務上的首選,因為它支援區域和錨點編輯,還有多圖融合——你可以把原圖釘成參考,同時告訴模型新內容只屬於某一塊邊緣。
上傳輸出好的那一格,把輸出畫面比例設成你的目標(16:9、9:16、4:5,看版位需要什麼),然後對著邊緣下提示詞,而不是對著整張圖。
把 9:16 的產品鏡頭擴成 16:9:
"Use the reference image as the exact center of the frame. Keep every element of the reference unchanged in content, scale, position, color, and lighting. Extend the scene outward to the left and right only, continuing the same walnut tabletop, the same seamless warm-gray backdrop, and the same soft key light from the upper left. Match the existing depth of field and grain. Add no new objects, no people, no text, no props."
把 4:3 的外景擴成 16:9:
"Use the reference image as the anchor region and preserve it exactly. Continue the scene left and right: the same overcast sky gradient, the same treeline density, the same wet asphalt reflections. Keep the horizon at an identical height across the full width. Photographic, no stylization, no added vehicles or figures."
乾淨的擴展和一眼就看穿的擴展,差在三個習慣:
- 先講要保住什麼,再講要加什麼。 除非你明確把原始區域釘住,模型就會在那裡走鐘。
- 講清楚方向。 「只往左右」會阻止模型偷偷把整個構圖重新平衡一遍。
- 講清楚連續性的錨點。 地平線高度、主光方向、表面材質、景深、顆粒——眼睛在接縫處檢查的就是這些。
生成三到四個變體,然後在 100% 檢視下比對接縫,不要縮小看。有明顯色階跳動、地平線彎掉,或紋理在同一個表面中途變性的,一律退掉。如果某個變體只有一邊邊緣不對,其他都好,那就只針對那一塊再跑一次區域編輯,不要整張重來。
階段 3:把擴好的靜態圖帶回動態
把定案的寬幅靜態圖帶進影片工作台,用它生成一段圖片生成影片的片段。擴好的靜態圖成為第一格,所以模型是在一格本來就已經是正確畫面比例的畫面上做動畫——加寬這個問題在運動進場之前就解決了。
你的提示詞只有一個任務:重現原始片段的運動。把原片多看幾次,照著順序描述鏡頭和主體實際上在做什麼。
"Animate the reference image. Camera pushes in very slowly over 5 seconds, no shake, no tilt. The subject stays centered and static. Steam drifts upward and to the right. Background remains still. Lighting unchanged throughout. Locked framing, no cuts, no zoom snap."
模型跟著鏡頭走。Seedance 2.0 讓你把擴好的靜態圖釘成帶標籤的參考素材,在運動中守住識別。片段必須擺在原生 4K 素材旁邊時,選 Veo 3.1。要一次重建很多顆鏡頭,Kling 3.0 是划算的選項;而 PixVerse 出片快,適合偏社群的片段和便宜的迭代。它們全都在同一個工作台裡,所以測兩個只是換一下下拉選單——更完整的比較可以看 2026 年最好的圖片生成影片 AI 模型。
長度對齊原始片段,生成兩三個 Seed。評判每一個時,特別盯新生成的邊緣,因為不穩的模型最先在那裡露餡。
階段 4:把運動、時間和色調對回原始素材
這個階段決定重建過不過得了關。把新片段放到時間軸上原始片段的正上方,兩相比較。
| 要檢查什麼 | 怎麼檢查 | 怎麼修 |
|---|---|---|
| 運動速度 | 在同一個播放頭位置切換兩段片段 | 替生成片段變速;小幅度的速度變化看不出來 |
| 運動方向 | 比較兩段的第一格和最後一格 | 用明確方向重下提示詞,不要在剪接裡硬修 |
| 長度 | 對齊影格數,不是四捨五入的秒數 | 用修剪,不要拉伸超過大約 10% |
| 色彩與顆粒 | 兩段都上示波器,再在 100% 下比對一塊平面 | 往原始素材的方向調色,並加上對得上的顆粒;生成出來的畫面通常太乾淨 |
| 主體大小 | 用 50% 不透明度疊在一起 | 縮放片段;如果差超過幾個百分點,回階段 2 重擴 |
小技巧
先把生成片段調色調到跟原始素材一致,再對兩段一起加一層淡淡的顆粒。共用的顆粒層藏起雜訊結構上的小差異,比任何單獨調色都有效。
階段 5:把它剪在一起
生成的片段現在是一份可用的寬幅素材,但最強的剪法通常不會只靠它。
- 直接替換。 如果重建撐得住,就拿它當這顆鏡頭。最簡單,也是靜態背景的正確答案。
- 把原片疊在重建之上。 把原始片段以原尺寸放在生成的寬幅片段上方,主體位置對齊。你真正的素材在中央播放,生成的邊緣填滿兩側——這是這套流程最接近真正外擴繪圖的版本,也是當畫面中央必須保持真實時要用的做法。
- 繞著它剪。 用寬幅片段當建立鏡頭,較近的段落切回裁切過的原片。鏡頭之間的運動會蓋掉差異。
用目標比例輸出,然後除了螢幕之外,也用手機看一次結果。在筆電上讀起來「有點軟」的接縫,在明亮的小螢幕上會讀成「明顯是假的」。
值得直說的限制
- 這不是外擴繪圖。 生成出來的片段是一次全新的生成。對原始素材的逐格一致性照定義就沒有了,任何提示詞都救不回來。
- 聲音撐不過重建。 綁定畫面動作的聲音必須重新對點,對白基本上對不了。
- 成本隨迭代成長,不隨長度。 大部分花費都進了擴展變體和 Seed 比較。
- 長片段會偏移。 超過大約 8 秒,就分段重建,中間用剪接接起來。
- 有時候,換個工具才是正解。 要加寬的鏡頭很多、素材無法取代,或客戶會一格一格比對——這三種情況都指向專門的外擴繪圖工具,或用更寬的比例重拍。知道什麼時候不要用這套流程,也是把它用好的一部分。
常見問題
OmniArt 可以一步擴展影片畫面嗎?
不行。工作台裡沒有原生的影片外擴繪圖。上面這套流程是用圖片模型擴展一張靜態圖、再用圖片生成影片模型重建動態,走到類似的結果。
結果會跟原始片段一模一樣嗎?
不會,也不該這樣宣稱。在靜態、紋理為主的鏡頭上,剪在一起時差異通常察覺不到;只要有真正的鏡頭運動,就看得出來。
我可以讓原始素材留在畫面中央嗎?
可以——那就是階段 5 的疊合選項。把原始片段以原尺寸疊在生成的寬幅片段上。你真正的畫素在中央播放,生成內容只填滿邊緣。
在 OmniArt 上開始
挑一段靜態片段和一個目標比例。輸出一格有代表性的畫面,在圖片工作台用 Seedream 5.0 Pro 把它擴到新的畫面比例,用圖片生成影片模型讓結果動起來,再把色調對齊、剪在一起。二十分鐘就能告訴你重建這條路對這顆鏡頭行不行得通——在你把一整批素材押上去之前。
兩半都在同一個地方,所以整個迴圈只有一個工作台和一份餘額,不是兩份訂閱。從「創作」工作台開始,用一格畫面和一片單純的背景就好。
準備好開始創作了嗎?
用 AI 生成精彩內容