Gemini Omni 1.1 Flash:這次為影片控制上線了什麼
Google 的 Gemini Omni 1.1 Flash 是一次面向製作的影片更新:延長場景、指定首尾影格、用 360p 打草稿,再生成 1080p 或 4K 輸出。

2026 年 8 月 27 日,Google 推出了 Gemini Omni 1.1 Flash——這是 I/O 首發的 Omni Flash 影片模型迎來的第一次面向製作的更新。官方公告和 Google 的 X 串文把它定性為一次控制向的發布,而不是改名:延長一個場景,鎖定起始影格和結束影格,附上短影片參考,用 360p 低成本打草稿,再為你要留下的那幾條生成 1080p 或 4K。
這和我們在 Gemini Omni Flash:真正上線的部分,以及 Google 留了什麼沒放裡寫過的 5 月 19 日消費端首發,不是同一份工作。最初的 Flash 賣點是對話式編輯和任意對任意輸入,硬上限是 10 秒片段,6 月 30 日的開發者 API 裡也沒有場景延長。1.1 這一輪,是想把這些片段做夠長、做夠清楚、做夠受控,好進製作產線。
這篇文章是能力清單:1.1 實際加了什麼,哪些限制還在,以及其中哪些任務你今天就能在 OmniArt 上跑。
Gemini Omni 1.1 Flash 實際上線了什麼
Google 的 API id 是 gemini-omni-1.1-flash(在 Gemini Enterprise Agent Platform 上的預覽版是 gemini-omni-1.1-flash-preview)。預設輸出仍是 720p 橫式;16:9 和 9:16 仍是僅有的兩種畫面比例。SynthID 浮水印仍然強制加上。
| 能力 | 原版 Omni Flash | Omni 1.1 Flash |
|---|---|---|
| 片段時長 | 每次生成 10 秒 | 每次生成 10 秒,可按 10 秒步進延長,累計最長 40 秒 |
| 場景延長 | 不在 6 月 30 日 API 裡 | 會分析最多 10 秒 的前置畫面(不只是最後一秒) |
| 首尾影格 | 不是正式獨立的 API 模式 | 在兩張關鍵影格之間插值出連續運動 |
| 影片參考 | 一段;超過 3 秒的片段不會被完整處理 | 最多 三段,每段 3 秒 |
| 草稿解析度 | 預設 720p,沒有更便宜的預覽檔 | 360p 草稿,Google 稱最高可快 60%,成本大約是 720p 的三分之一 |
| 成片解析度 | I/O 時未公布;OmniArt 提供 720p | 1080p 或 4K 輸出,文件寫明是從 720p 生成後再輸出 |
| 可用介面 | Gemini App、Flow、YouTube,接著是 6 月 30 日 API | Google AI Studio、Gemini API、Gemini Enterprise Agent Platform、Google Flow;場景延長也出現在面向 Google AI Plus、Pro 和 Ultra 的 Gemini App 裡 |
I/O 時被保留的那份清單沒有移動。Google 目前的文件仍然寫著:不支援語音編輯,不支援上傳音訊參考,虛擬人模式也從未進入這次發布。1.1 加的是方向和長度。它沒有補上那些因安全而保留的功能。
場景延長:10 秒的上下文,最長 40 秒
場景延長是頭條。你從既有片段的尾端繼續往下走,而不是指望一次新的 10 秒生成能對上它。
Google 自己的數字:模型現在會讀取最多 10 秒的前置畫面——「相對先前只參考最後一秒的模型,這是一次躍升」——然後追加 3–10 秒。按 10 秒步進重複,直到累計片段達到 40 秒。來源最後幾格會被改寫,這樣接縫就不是硬切。你不能往前補,也不能延長片段中間。
延長用的提示詞可以短到 "Continue the scene.",也可以具體到一次新的運鏡。Google 文件寫得很明確:帶時間戳的延長提示詞裡,0 秒指的是新片段的起點,不是原片的起點。需要配樂變化時,把音訊寫進提示詞;否則模型會盡量讓它連貫。
在你圍繞這件事規劃一條 40 秒成片之前,有兩條約束很要緊:
- 用於延長的上傳來源片段必須是 10 秒或更短,除非你延長的是同一多輪工作階段裡模型已經生成過的片段。
- 延長上傳片段在 歐洲經濟區、瑞士和英國不可用。延長模型生成的片段,在 API 本身可用的所有地區都能用。
在 OmniArt 上,Seedance 2.5 已經覆蓋了一類相近的任務:把任意不超過 30 秒的結果反覆延長,累計最長 60 秒,或一次長影片生成跑出 30–180 秒。那是今天工作台裡做長段可控影片的路徑。1.1 這條 40 秒的 Omni 原生延長鏈,是同一想法在 Google 介面上的版本。
首尾影格
指定一張起始圖和一張結束圖;Omni 1.1 會生成兩者之間的連續運動。Google 把這一定位給環繞運鏡、變焦轉場和循環片段——最後一種做法是把同一張圖同時用作首影格和尾影格。
提示詞標籤用來綁定角色。Google 文件寫了簡單的 FIRST_FRAME 和 LAST_FRAME 標籤,直接放進提示詞;更複雜的提示詞可以明確宣告來源:
[# Sources <FIRST_FRAME>@Image1 <LAST_FRAME>@Image2]
標籤照原樣留在提示詞裡。周圍的指令才是你描述運動的地方:一條連續鏡頭,不要跳切,兩張靜態圖之間攝影機做什麼。
在 OmniArt 上,PixVerse V6 已經提供了在確認過的起始影格和結束影格之間做轉場的工作流程。如果需求是「從這一格走到那一格」,你不必等 Omni 1.1 作為獨立模型 id 落地。如果需求是「在 Omni Flash 的對話串裡做這件事」,那目前仍在 Google 的 Interactions API 上。
影片參考,每段最長三秒
1.1 允許你把短參考影片丟進同一條多模態提示詞,和文字、圖片放在一起。Google 的公開示範把三段舞者影片對應到三張角色靜態圖上,並要求一條連續鏡頭。
文件裡的上限比行銷口徑更嚴。影片參考最適合做外型相似;參考片段裡的音訊會被忽略;你最多能用 三段、每段最長 3 秒。Google 還說,跨多段影片做參照或推理,並不支援當成敘事對照——把每段影片當作主體或動作參考,而不是當作第二路要去剪的素材。
相對 6 月 30 日預覽,這是一次真實的擴充:當時只接受一段影片參考,而且超過 3 秒的片段不會被完整處理。它仍然不是任意對任意設想裡音訊輸入的那一半。聲音仍然要寫進提示詞裡。
OmniArt 目前的 Gemini Omni 入口接受一段參考影片(MP4 或 MOV,1–10 秒),並可混入最多五張參考圖,計費依來源片段時長計算。今天要用單段動作參考,就走這條路徑。更大的參考包,Seedance 2.5 仍是工作台裡專門做這件事的模型。
360p 草稿與 1080p / 4K 輸出
解析度階梯是另一項製作向變化。預設生成是 720p。你現在可以請求:
- 360p——Google 的低價草稿檔。宣稱最高可快 60%,成本大約是 720p 的三分之一。Flow 允許你用 360p 打草稿,再把留下的那條下載成 720p。
- 1080p 或 4K——文件寫明是從 720p 生成後再輸出,面向社群、數位或廣播級成片。
有用的工作流程就是最直觀的那條:用 360p 探索運鏡、表演和剪點,再把 1080p 或 4K 生成花在你真正要出片的那一條上。這和在 OmniArt 上先用快速模型打草稿、再用更高成本模型收尾是同一套紀律——只是現在變成了同一款 Omni 模型上的解析度切換。
說明
Google 隨 1.1 公告發布了一張依解析度列出的 API 價格表。把 360p「約為 720p 的三分之一」這條口徑,當成 Google 自己的對比,而不是 OmniArt 的點數計算。OmniArt 的 Gemini Omni 入口目前依 720p、3–10 秒的介面計費。
原生 4K 生成在這條產品線裡仍然是 Veo 3.1 的任務。1.1 的 4K 路徑是給 Omni 片段做的收尾步驟,並不是在說 Omni 已經取代 Veo 去做大螢幕交付。
目前在哪些地方可用,OmniArt 今天開放了什麼
Google 於 8 月 27 日在自家技術棧上鋪開 1.1:
- Google AI Studio 和 Gemini API(
gemini-omni-1.1-flash) - Gemini Enterprise Agent Platform(
gemini-omni-1.1-flash-preview) - Google Flow,包括起始/結束影格、360p 草稿,以及 1080p / 4K 匯出
- Gemini App 裡的場景延長,面向 Google AI Plus、Pro 和 Ultra 訂閱使用者
標準 Gemini Omni 生成已經在 OmniArt 上:720p,3–10 秒,原生音訊,最多五張參考圖和一段參考影片,Starter 方案及以上可用。OmniArt 目前沒有單獨開放 gemini-omni-1.1-flash 這個模型 id,也沒有 40 秒延長鏈、首尾影格任務,或 360p / 1080p / 4K 解析度階梯。保留工作階段的對話式編輯仍然需要 Google 的 Interactions API,這一點在我們報導 6 月 30 日開發者 API 時就是如此。
注意
不要拿 OmniArt 目前的 Gemini Omni 選擇器去規劃 40 秒的 Omni 1.1 交付。工作台上線的模型仍是 720p、10 秒的 Omni Flash 介面。1.1 特有的控制請先用 Google 的 API 或 Flow,直到這裡上線獨立的模型入口。
怎麼對照 Veo 3.1 和 Seedance 2.5 來選
1.1 並沒有讓 Google 產品線的其餘部分退役,也沒有讓 Omni 成為 OmniArt 裡唯一的可控影片選項。按鏡頭選:
| 這顆鏡頭需要 | 去用 |
|---|---|
| 在同一條 Omni 對話串裡做聊天式修改 | Google 的 API / Flow 上的 Gemini Omni 1.1 |
| 原生 4K、空間音訊、廣播級成片 | OmniArt 上的 Veo 3.1 |
| 30 秒單一鏡次、60 秒延長,或 180 秒長影片 | OmniArt 上的 Seedance 2.5 |
| 今天就在工作台裡做首尾影格插值 | PixVerse V6 轉場,或 Seedance 2.5 的 First and Last Frames |
| 帶單段影片參考的快速 720p Omni 生成 | OmniArt 上的 Gemini Omni |
| 大規模多模態參考包 | Seedance 2.5 |
模式和 I/O 時一樣:新的 Omni 發布是加法。已經能覆蓋需求的模型你繼續留著,當任務明確是 Omni 的對話式控制,外加更長、更清楚的成片時,再把 1.1 加進來。
對前 10 秒這一拍仍然適用的提示詞習慣——一個清楚動作、聲音寫進提示詞、沒有反向提示詞欄位——見 Omni Flash 提示詞指南。工作台裡已經能做延長的那款模型,延長用語見 Seedance 2.5 編輯與延長指南。
這週在 OmniArt 上該做什麼
如果你想試 Omni 本身,打開影片工作台裡的 Gemini Omni,跑目前這條 10 秒、720p 的介面:文字、參考圖,或一段短影片參考。把它和 Veo 3.1、Seedance 2.5、PixVerse V6、Kling 以及陣容裡的其餘模型並排比較——一份餘額,一套提示詞語法。
如果需求正好是 1.1 的新控制——40 秒的 Omni 原生延長、在 Omni 內部做首尾影格插值,或 360p 再出 4K 的循環——這週請用 Google AI Studio、Flow 或 Gemini API,並把 OmniArt 當作你已經在生成專案其餘部分的地方。
這種拆分是暫時的,和當初 Flash API 的缺口一樣。等 1.1 的控制作為可選擇的 OmniArt 模型落地,它們會變成一個已經在持續產出的工作台裡的又一個選項,而不是一個讓你等待的理由。
常見問題
Gemini Omni 1.1 Flash 是什麼?
Gemini Omni 1.1 Flash 是 Google 於 2026 年 8 月 27 日對 Omni Flash 的更新,Omni Flash 是一款多模態影片生成和編輯模型。它在原有的對話式編輯和文字/圖片/影片輸入之上,加入了場景延長、首尾影格插值、短影片參考、360p 草稿,以及 1080p / 4K 輸出。
Gemini Omni 1.1 Flash 能在 OmniArt 上用嗎?
不能作為獨立的模型 id。OmniArt 目前提供標準 Gemini Omni 生成,720p、3–10 秒。1.1 特有的控制——40 秒延長、首尾影格、360p 草稿,以及 1080p / 4K 輸出——正在 Google AI Studio、Flow、Gemini API 和 Gemini Enterprise Agent Platform 上鋪開。
Omni 1.1 Flash 的影片能有多長?
單次生成仍是 10 秒片段。場景延長每次追加 3–10 秒,使用最多 10 秒的前置畫面作為上下文,累計最長 40 秒。用於延長的上傳來源片段必須是 10 秒或更短。
Omni 1.1 Flash 能原生生成 4K 嗎?
Google 文件把 1080p 和 4K 寫成從預設 720p 生成後再輸出,而不是一條原生 4K 拍攝路徑。要在 OmniArt 上做原生 4K 影片,Veo 3.1 仍是 Google 產品線裡為這種成片準備的模型。
1.1 有沒有加入音訊參考上傳或語音編輯?
沒有。Google 目前的 Omni 文件仍然把音訊參考上傳和語音編輯列為不支援。影片參考裡的音訊會被忽略。聲音仍然靠提示詞來引導,這和我們在任意對任意輸入那篇文章裡記錄的一致。
準備好開始創作了嗎?
用 AI 生成精彩內容