Update模型與觀察閱讀時間 17 分鐘

MiniMax H3 Max:fal 更快的影片模型改了什麼

MiniMax H3 Max 把 fal 的後訓練和快速 768p 生成配在一起。這篇說明它的速度、榜單結果、定價和限制,對創作者代表什麼。

OmniArt 團隊

MiniMax H3 Max 是 fal Research 對 MiniMax H3 做後訓練得到的版本,走的是另一條製作路徑:快速生成 480p 或 768p,而不是基礎模型的 2K 與重度參考素材流程。fal 在 2026 年 8 月 26 日發布這款模型,頭條結果是一段 5 秒的 768p 影片在 3 秒內生成完成。

這個速度說法值得注意,但要放回脈絡來看。H3 Max 不是全新的 MiniMax 基礎模型,也不能取代每一個標準 H3 端點。它把針對提示詞貼合度和美學的後訓練,跟圍繞改動後模型設計的推論路徑綁在一起。本指南把已上線的能力和對外宣稱的能力分開,說明目前的榜單證據,並指出 H3 Max 相對標準 MiniMax H3 的位置。

MiniMax H3 Max 是什麼?

MiniMax H3 Max 是託管在 fal 上、經過後訓練的 MiniMax H3 變體,用於文生影片和圖生影片。它產出 5–15 秒、480p 或 768p、帶同步音訊的片段。核心取捨很直接:創作者放棄標準 H3 的 2K 輸出和更廣的參考/剪輯端點,換更低延遲和更低的 768p 成本。

fal 表示,其 Research 團隊用自研強化學習框架、真實生成負載和人類偏好,把模型調到更強的提示詞貼合度、視聽品質和美學表現。推論團隊在這次後訓練的同時最佳化了服務堆疊。這個區分很重要:H3 Max 是模型和推論服務的組合包,不是單純讓基礎 H3 跑在更快的硬體上。

主要來源是 fal 的 H3 Max 發布頁文生影片端點圖生影片端點發布公告

MiniMax H3 Max 規格速覽

面向上線時的 H3 Max 能力實務含義
模型譜系MiniMax H3,由 fal Research 後訓練調過的 H3 變體,不是新的 MiniMax 基礎模型
端點文生影片和圖生影片圖生影片還可選結尾影格
解析度480p 或 768p;預設 768p768p 的 16:9 為 1344×768
時長5–15 秒適合單一鏡頭和短社群片段
影格率24 FPS15 秒成片包含 360 個影格
音訊原生同步的音訊和影片提示詞應同時指揮聲音和畫面
文生影片畫面比例21:9、16:9、4:3、1:1、3:4 和 9:16涵蓋電影感、橫式、方形和直式交付
圖生影片構圖跟隨輸入圖按目標交付比例準備來源圖
公布延遲5 秒的 768p 片段不到 3 秒這是後端推論,不是保證的端到端等待時間

上線時,H3 Max 與標準 H3 並沒有完整功能對等。fal 8 月 25 日的發布頁寫過,參考生影片會在當週稍晚跟上。在該端點明確上線並有說明之前,把文生影片、圖生影片,以及選填的首尾影格控制,視為 H3 Max 目前可用的能力面。

H3 Max 實務上有多快?

說法的乾淨版本是:fal 回報,一段 5 秒的 768p H3 Max 片段大約需要 2.5 秒後端推論,並在 3 秒內回傳。這比生成片段本身的時長還短。fal 也說,15 秒生成大約要 15 秒,因此最長時長更接近即時,而不像 5 秒那條頭條那麼誇張。

後端推論不等於創作者的完整等待。佇列、來源圖上傳、提示詞擴充、安全檢查、回應傳輸和本機播放準備,都會拉長實際經過時間。fal 在回應裡暴露 timings.inference 值,因此可以把模型執行和其他請求開銷分開。

提示詞擴充又加了一層變數。fal 建議用它的均衡設定,由系統決定一次請求需要改寫多少。據稱快速擴充路徑大約 1 秒回傳,而畫質路徑在影片推論開始前最多可能花 30 秒改寫。公平的延遲測試因此應同時記錄 timings.inference 和完整的送出到出結果時間,並把擴充設定維持不變。

為什麼比成片更短的生成時間重要?它改變的是迭代迴圈,而不是最終匯出。創意團隊可以在需求還熱著的時候,多次試鏡頭方向、動作時機或產品揭示。製作指標仍應是每一支被採用成片的耗時,而不是每次請求的耗時:一個很快、卻要很多次重試的模型,優勢會被吃掉。

「第一」排名能說明什麼、不能說明什麼

H3 Max 上線時帶著寬泛的「#1」說法。最有力的公開證據其實更窄、也更有用:它在特定圖生影片榜單上,依盲測使用者偏好領先。那是這些測試條件下輸出品質有競爭力的證據,不是它在每一項影片任務上都是最好模型的證明。

評測公開結果說了什麼證據邊界
Artificial Analysis 含音訊的圖生影片2026 年 8 月 27 日核對時,以 1,204 Elo、±10、5,123 次出場排第一測的是含音訊圖生影片賽道上的盲測偏好;票數進來後排名會變
Design Arena 圖生影片fal 回報其 8 月 25 日快照中 H3 Max 為 1,341 Elo,基礎 H3 為 1,333另一項圖生影片偏好測試;不能確立文生影片或工作流程可靠度
fal 人類偏好研究fal 稱 H3 Max 在整體品質、提示詞理解和美學上對 12 個領先影片模型排第一官方評測;發布頁沒有公布完整可重現協議

獨立的 Artificial Analysis 結果有分量,因為投票時模型名稱是隱藏的,樣本數現在以數千次出場計。它的信賴區間仍然重要:接近的分數可能重疊,排序也可能移動。這項測試獎勵的,是人們在那個場域裡更喜歡的輸出,未必符合團隊對產品外形、精確結尾影格、對白、字體或可編輯性的要求。

用榜單決定 H3 Max 值不值得做一次受控測試。不要用它來跳過測試。製作決策應保留每一次嘗試,鎖定來源圖和提示詞,並針對最傷專案的失敗打分。

說明

「在含音訊的圖生影片榜單上第一」是精確的。「最好的 AI 影片模型」不是。文生影片、參考控制、2K 細節、延遲、成本和 可重現性,是分開的問題。

H3 Max 對標準 MiniMax H3

H3 Max 和標準 H3 共享模型譜系和原生視聽生成,但各自為不同工作最佳化。H3 Max 是 768p 上的速度與產出路線。標準 H3 仍是更廣的製作路線:當解析度或參考控制更重要時走它。

能力MiniMax H3 Max標準 MiniMax H3
服務商路徑由 fal 後訓練並託管MiniMax 基礎模型,經其標準端點
輸出解析度480p 或 768p最高 2K
時長5–15 秒依目前的 fal 說明為 5–15 秒
上線端點文生影片;圖生影片,可選結尾影格文生影片、首尾影格、參考生影片,以及剪輯路徑
原生音訊
主要優勢快速迭代和更低的 768p 成本更高解析度和更廣的輸入/控制面
最合適草稿、社群鏡頭、快速 A/B 探索、高產出生成2K 成片、混合參考導演,以及剪輯工作流程

這不是一條「Max」包含標準產品全部能力的畫質模式階梯。切到 H3 Max,可能拿掉一份需求所依賴的能力。如果專案需要在同一脈絡裡放入多份圖片、影片和音訊參考,或需要 2K 結果,標準 H3 是更穩妥的起點。如果需求只需要一則提示詞或一張來源圖,並在 768p 上快速迭代,H3 Max 才是更相關的測試對象。

MiniMax H3 Max 定價與上線折扣

fal 的線上端點頁列出臨時上線價:480p 每生成秒 $0.025768p 每秒 $0.04,截至 2026 年 9 月 1 日。列出的促銷後價格分別為每秒 $0.05 和 $0.08。

依目前 768p 端點費率,基礎生成成本是:

輸出時長目前 768p 上線價列出的促銷後 768p 價
5 秒$0.20$0.40
10 秒$0.40$0.80
15 秒$0.60$1.20

有一處官方來源不一致,值得標出來。fal 專門的 H3 Max 發布頁報的是另一組數字——14 天促銷期內每秒 $0.03,之後每秒 $0.06——而線上的文生影片和圖生影片端點頁顯示的是上面的費率與 9 月 1 日截止日。在 fal 把這些頁面對齊之前,送出時應把端點顯示的預估視為準則。

不要只比較一次生成的價格。追蹤被採用的輸出、重試次數、提示詞擴充延遲,以及任何收尾工作。對一段要試 4 次的 5 秒 768p 片段,上線價生成花費在剪輯前是 $0.80。一個更慢、但第一次就成功的模型,仍可能做出更便宜的可用鏡頭。

誰該先測 H3 Max?

當生成時間卡住創意探索時,H3 Max 最有意思。社群團隊試幾種開場鉤子、分鏡師試鏡頭選擇、產品團隊驗證動態方向、開發者跑大批量變體,都會受惠於短片段以秒而不是分鐘到達。

如果一份需求的成敗取決於 2K 細節、一大包混合參考素材,或有說明記載的剪輯端點,它就不那麼對口。那些是標準 H3 的強項。原生音訊也值得單獨過一輪:檢查對白可懂度、唇形時機、前景效果、環境聲、音樂平衡和權利歸屬,而不是把「含音訊」當成「混音已完成」。

在選定任一路線前,先跑一輪小規模對照測試:

  1. 使用同一張合格來源圖、同一則提示詞、同一時長、同一畫面比例和同一音訊指示。
  2. 每個模型至少生成五次,並保留每一次結果。
  3. 記錄每次嘗試的後端推論時間、完整實際經過時間和價格。
  4. 給提示詞貼合度、主體或產品保真度、動態連續性、音訊可用性和可進剪輯的秒數打分。
  5. 比較每一支被採用成片的成本和耗時,而不是最強的展示影格。

這輪測試把上線說法變成符合你自己工作的證據。它也會暴露:提示詞擴充帶來的採用提升,是否足以抵銷額外延遲。

OmniArt 上用得到 H3 Max 嗎?

H3 Max 目前未列入 OmniArt 的模型清單。本文解釋的是 fal 的外部發布,不是 OmniArt 的可用公告。標準 MiniMax H3 已可在 OmniArt 影片工作台使用,適合需要其目前 OmniArt 模式、並與其他圖片、影片、音訊和音樂模型共用工作台的創作者。

若要立刻做比較,準備一份可帶走的提示詞和來源素材包,把標準 H3 和另一款可用影片模型一起跑,並保留設定與失敗樣本。MiniMax H3 評測與比較計畫 提供可重現的評分方法,MiniMax H3 提示詞指南 則說明如何替每一項輸入分派清楚角色。

MiniMax H3 Max 常見問題

H3 Max 和 MiniMax H3 是同一個模型嗎?

不是。H3 Max 是 fal Research 後訓練的 MiniMax H3 變體,並與 fal 的推論堆疊共同最佳化。它聚焦快速的 480p 和 768p 生成。標準 MiniMax H3 保留 2K 輸出,以及更廣的參考和剪輯路徑。

H3 Max 能生成 2K 影片嗎?

不能。目前的 H3 Max 端點提供 480p 和 768p。當 2K 輸出是硬性要求時,使用標準 MiniMax H3。

H3 Max 真的能在三秒內生成五秒影片嗎?

fal 回報,一段 5 秒的 768p 片段大約 2.5 秒後端推論,並在 3 秒內回傳。端到端時間可能更長,因為還有佇列、上傳、提示詞擴充、安全檢查和傳輸。據稱 15 秒生成大約要 15 秒。

H3 Max 是排名第一的 AI 影片模型嗎?

2026 年 8 月 27 日核對時,它在 Artificial Analysis 含音訊的圖生影片榜單上排第一,fal 也回報了 Design Arena 的第一名結果。那些是具體、會變動的偏好榜單。它們並不能確立 H3 Max 在文生影片、2K 輸出、參考控制或每一份製作需求上都領先。

H3 Max 要多少錢?

fal 線上端點頁列出的上線價是 480p 每秒 $0.025、768p 每秒 $0.04,截至 9 月 1 日,隨後為每秒 $0.05 和 $0.08。fal 單獨的發布頁目前顯示不同費率,因此生成前確認端點顯示的預估。

我能在 OmniArt 上用 H3 Max 嗎?

截至發布時不能。OmniArt 目前列出的是標準 MiniMax H3,不是 H3 Max 變體。當需求需要今天工作台裡已經可用的那款模型時,打開 OmniArt 上的 MiniMax H3

準備好開始創作了嗎?

用 AI 生成精彩內容

免費開始