Tutorial教學與操作指南閱讀時間 16 分鐘

從產品照片到影片:一套 OmniArt AI 工作流程

用 OmniArt 現在就有的模型,把一張產品照片變成讓人停下手指的影片——正是 Google 剛為 Gemini 預覽的那套圖生影片流程。

OmniArt 團隊
從產品照片到影片:一套 OmniArt AI 工作流程

6 月 30 日,Google 秀了一組 Gemini 內部的新搭配:Nano Banana 2 Lite 負責快速修圖,Gemini Omni Flash 負責短影片生成,兩者透過 Interactions API 串在一起。旗艦示範 Omni Product Studio 拿一張靜態產品照,先修成乾淨的電商圖,再把那張圖動起來變成短片——全部在同一條流程裡。Google 又用同樣的形狀示範了兩次:「Anywhere」(把照片丟到一個新場景,再讓它動起來)和「Space Lift」(把室內設計的靜態圖變成電影感的漫遊)。三個示範的共同模式是:先修圖,再交給影片模型。

你不需要 Google 那條特定的流程也能跑這套工作流程。OmniArt 早就有關鍵的兩塊——一個為這種修圖而生的圖片模型,加上一整排能把靜態圖變成動態的影片模型。以下是同一套「照片到影片」的完整形狀:準備、修圖、動起來、匯出,用的都是今天在 OmniArt 上確認可用的模型,每一步都附提示詞範例。

OmniArt 今天實際有哪些可以用

Gemini Omni Flash 和 Nano Banana 2 Lite——Google 為此打造的修圖到影片組合——現在在 OmniArt 上都能用於一般的圖片和影片生成。這篇教學仍然用 Nano Banana 2 和 Seedance 2.0,因為它的參考素材系統很適合產品流程,但你可以在同樣的交接點換成 Nano Banana 2 LiteGemini Omni Flash

小技巧

Google 的 Omni Product Studio 組合——Nano Banana 2 Lite 負責修圖、Gemini Omni Flash 負責動態,透過 Interactions API 串接——是下面這套工作流程的專用版本。兩個模型現在都能在 OmniArt 做一般生成,但 OmniArt 並沒有把那條保留工作階段的 Interactions API 串接開成介面上的控制項。背景可以看 Gemini Omni Flash 的開發者 API:I/O 之後有什麼新東西Nano Banana 2 Lite、2 與 Pro 比較:該用哪個 Gemini 模型

你會需要什麼

  • 一張產品照片——你自己拍的,或一張乾淨的型錄圖
  • 一個能用圖片和影片工作台的 OmniArt 帳號
  • 修圖步驟用 Nano Banana 2
  • 動態步驟用一個影片模型——這份指南用 Seedance 2.0,因為它的參考素材系統很能在動態中守住產品的形狀和顏色
  • 選填:匯出前用 OmniArt 的音訊模型做一輪聲音
步驟工作台模型任務
1拍一張或找一張乾淨的產品照片
2圖片Nano Banana 2清背景、佈景、生活情境變體
3影片Seedance 2.0把修好的照片變成一段短片
4影片Seedance 2.0在不同 Seed 變體之間鎖住一致性
5音訊+匯出聲音處理與各平台匯出

步驟 1:拍一張或找一張乾淨的產品照片

修圖和動態這兩步只能用第一格畫面裡已經有的東西,所以在這裡花的幾分鐘,後面會賺回兩次。

  • 素色、打光均勻的背景。 白色、灰色或無縫背景紙——底子單純,Nano Banana 2 修起來比雜亂的乾淨得多。
  • 柔和的光。 硬陰影和過曝的反光,正是產品一動起來影片模型最容易扭曲的地方。
  • 讓產品佔滿畫面。 產品要是最主要的主體;影片模型會跟著第一格畫面裡視覺份量最重的東西走。
  • 拍你最正、最有代表性的角度。 它會變成第一格畫面,之後每一格都會拿來跟它比。
  • 用你手上最高的解析度。 標籤和細節能參考的來源像素越多,撐過兩個步驟的機會越大。

不是重拍,而是從既有的型錄照片開始?規則一樣——在步驟 2 之前先把重陰影壓平、把雜物裁掉,因為 Nano Banana 2 修的是已經在那裡的東西,不會憑空造一個新產品出來。

步驟 2:用 Nano Banana 2 修圖並佈景

在 OmniArt 的圖片工作台打開 Nano Banana 2,把你的來源照片當成參考圖上傳——你在修它,不是從零描述一個新場景。這正是 Google 那個示範裡最值得直接借用的部分:圖片這一步是一次有目標的修改。Nano Banana 2 的調校方向是快速、平衡的修圖,而不是慢而極致的完整生成,剛好適合每個產品生幾個佈景變體,而不是只求一張主視覺。

有兩組提示詞值得跑:

乾淨的攝影棚背景:

"Edit this reference photo. Replace the background with a seamless soft lilac-gray studio backdrop. Keep the product's shape, proportions, color, and label text exactly as shown in the reference. Add soft, diffused studio lighting from the upper left and a subtle reflection on the surface below. Do not change the product itself."

生活情境變體:

"Edit this reference photo. Place the product on a light oak counter near a window with soft morning light. Keep the product's size, color, and label unchanged from the reference. Add a shallow depth of field with a softly blurred background. Natural, editorial product-photography style, no added text."

每一組生兩三個變體——兩種你之後都會想要,因為攝影棚那版會變成「正式」的圖,生活情境那版則給你第二支可以測試的短片。挑那個在比例和顏色上最貼近原圖的變體;這一格畫面裡已經跑掉的東西,步驟 3 會照樣讓它動起來。

想多了解 Nano Banana 2 跟其他圖片選項的差別,可以看 GPT Image 2 與 Nano Banana 2 比較:2026 年該用哪個 AI 圖片模型?。提示詞的寫法技巧,可以看怎麼為 AI 生成寫出更好的提示詞

步驟 3:用 Seedance 2.0 讓畫面動起來

把 Nano Banana 2 的成果帶進 OmniArt 的影片工作台,打開 Seedance 2.0。先把修好的照片當成起始格上傳,接著——因為 Seedance 2.0 最多接受九張帶標籤的參考圖——在提示詞裡再以 @image1 的形式上傳一次。這樣模型同時拿到第一格畫面的錨點,和一個要在生成動態時守住的身分參考。描述鏡頭和環境,不要描述產品——產品已經被參考素材鎖住了,你寫的每一句關於它的話,都可能讓模型「好心」把它改掉。

主視覺推鏡:

"@image1 is the product reference. Keep the product's shape, color, and label exactly as shown in @image1 throughout. Camera slowly pushes in on the product over 5 seconds. Soft light shifts gently across the surface. Static background, no camera shake, shallow depth of field."

轉檯:

"@image1 is the product reference. The product rotates smoothly 360 degrees in place on a seamless studio backdrop, camera locked in position. Lighting stays consistent through the rotation. No added props, no background elements, no text overlays."

先用 Fast 模式便宜地看動態,等你滿意提示詞和 Seed 之後,再用 Standard 重跑你要留的那一版——Standard 每支片比較貴,只花在你真的要匯出的版本上。第一輪把片子留短;4 到 5 秒比一開始就跳到 15 秒更能守住產品的還原度。

想看產品鏡頭之外更多 Seedance 2.0 的提示詞模式,可以看 Seedance 2.0:AI 影片的提示詞模式與六種用法

步驟 4:讓產品從照片到影片都保持一致

這套流程最危險的一刻,是圖片交棒給影片的那一下——顏色、比例和構圖最容易在這裡跑掉。

可能跑掉的東西為什麼會這樣怎麼鎖住
顏色影片模型每一格都在重新詮釋光線在提示詞裡指名確切的顏色("keep the label's navy blue unchanged"),並釘住 @image1
比例旋轉和運鏡會露出 Nano Banana 2 從來沒生成過的角度第一輪把運鏡幅度壓小;先測 15 到 20 度的轉動,再做完整的 360 度
構圖圖片和影片兩步之間的畫面比例變了,產品被裁得不一樣在生成之前就設好匯出的畫面比例,不要事後才調
標籤/文字的可讀性動態模糊和壓縮最先傷到小字在點數允許的範圍內用最高解析度生成,並讓有文字的那一面對著鏡頭久一點

生兩三個 Seed 變體並排比較,不要接受第一個結果——一支能用的片和一支扭掉的片,差別常常只是你留下哪個 Seed。判斷每個變體時,看產品離起始角度最遠的那一格,因為跑掉的地方會最先在那裡出現。

步驟 5:修飾、加聲音、匯出

一支沒有聲音的產品短片,看起來就是沒做完。OmniArt 把圖片、影片和音訊放在同一個工作台裡,所以匯出前直接補一輪聲音,不用繞到另一個工具:運鏡上一聲柔和的呼嘯、一點空間環境音,再從音訊模型拿一段短音樂。依照投放位置裁長度:付費社群的主視覺短片 5 到 8 秒,只有多出來的秒數真的有新東西時才拉長。依頻道匯出——動態消息用正方形或 4:5,Reels、TikTok 和 Shorts 用 9:16,產品頁或 YouTube 用 16:9。

把步驟 2 修好的攝影棚照片存進你的參考素材庫——它會變成這個產品未來每一支影片的起始格,下次改款或季節性變體就從一個鎖定好的樣子開始,而不是從一張白紙。

換一個影片模型

這裡選 Seedance 2.0,是因為它的參考素材標籤系統,是把產品身分守過動態最直接的辦法,但它不是唯一合理的選擇——依任務挑替代模型,看下面的常見問題。它們都住在同一個影片工作台裡,所以換模型只是換一個下拉選單,不是重蓋一次流程。

想完整逛一遍整排模型,可以看所有 AI 影片模型集中在一個工作台:OmniArt 陣容。等你有了一支滿意的短片,想要更多廣告格式的點子,可以看用 OmniArt 把產品照片變成影片廣告

常見問題

我今天能在 OmniArt 上用 Nano Banana 2 Lite 或 Gemini Omni Flash 嗎?

可以。Nano Banana 2 LiteGemini Omni Flash 都能做一般生成。這篇教學用 Nano Banana 2 加 Seedance 2.0 當成一組適合量產的搭配;Lite 專屬的提示詞模式,可以看我們的 Nano Banana 2 Lite 提示詞指南。Google 那條保留狀態的 Interactions API 串接,目前沒有開在 OmniArt 的介面上。

為什麼要先修圖再讓它動,而不是直接讓原始照片動起來?

因為修圖這一步控制的,正是動態一旦加進來就最難修的變數:背景、光線、佈景。先用 Nano Banana 2 在靜態圖裡把這些處理好,影片模型就只需要加動態,不必一邊守住產品一邊搶救一個雜亂的背景。

來源照片需要專業攝影器材嗎?

不用。素色、打光均勻的背景加一張手機照片就可以了——要求的是一致性,不是器材。把一張還可以的手機照片變成攝影棚質感靜態圖的,是 Nano Banana 2 的修圖步驟。

最終的產品影片應該多長?

付費社群和動態消息的版位,5 到 8 秒是好用的區間——長到看得出動態,短到還抓得住注意力。產品頁和 YouTube 可以更長,前提是多出來的秒數真的有新東西。

如果不用 Seedance 2.0,該用哪個影片模型?

看任務:Veo 3.1 適合原生 4K 的廣電級輸出,Kling 3.0 適合跨很多品項時的成本效率,PixVerse 適合快速、偏生活感的社群短片。它們都跟 Seedance 2.0 在同一個 OmniArt 影片工作台裡。

我可以在 OmniArt 上幫最終影片加音樂或音效嗎?

可以。OmniArt 的音訊模型就在圖片和影片工作台旁邊,所以你不用離開平台,就能幫匯出的短片加上一段音樂、音效或旁白。

在 OmniArt 上開始

挑一個產品、一張乾淨的照片,給自己十五分鐘。在圖片工作台用 Nano Banana 2 修它,在影片工作台用 Seedance 2.0 讓成果動起來,匯出前再加一段短音樂。這就是 Google 為 Gemini 預覽的那套「照片到影片」形狀,今天就跑在 OmniArt 裡已經有的模型上。

準備好開始創作了嗎?

用 AI 生成精彩內容

免費開始