Updateモデルとインサイト21分で読めます

MiniMax H3 Max:falの高速動画モデルが変えること

MiniMax H3 Maxは、falの事後学習と高速な768p生成を組み合わせます。速度、ベンチマーク結果、料金、制約が、いまのクリエイターに何を意味するかを整理します。

OmniArt チーム

MiniMax H3 Max は、fal Research が MiniMax H3 に事後学習を施した版で、別の制作経路向けに作られています。対象は基礎モデルの 2K や参照素材の多いワークフローではなく、480p または 768p の高速生成です。fal は 2026年8月26日にこのモデルを発表し、見出しの結果として5秒の 768p 動画を3秒未満で生成したと示しました。

この速度の主張は注目に値しますが、文脈が必要です。H3 Max は新しい MiniMax の基盤モデルではなく、すべての標準 H3 エンドポイントを置き換えるものでもありません。プロンプト追従と美学のための事後学習と、改変後のモデルを前提に設計された推論経路を組み合わせています。本ガイドでは、公開中の内容と主張を切り分け、現時点のリーダーボード根拠を説明し、標準 MiniMax H3 の横で H3 Max がどこに収まるかを示します。

MiniMax H3 Max とは?

MiniMax H3 Max は、fal がホストする、テキストから動画および画像から動画向けの、事後学習済み MiniMax H3 派生です。同期音声付きで、5〜15秒、480p または 768p のクリップを生成します。主なトレードオフは明快です。クリエイターは標準 H3 の 2K 出力と、より広い参照/編集エンドポイントを手放す代わりに、低いレイテンシと低い 768p コストを得ます。

fal によれば、Research チームは社内の強化学習フレームワーク、実際の生成ワークロード、人間の選好を使い、プロンプト追従、視聴覚品質、美学を強める方向にモデルを調整しました。推論チームは、その事後学習と並行してサービングスタックを最適化しています。この区別は重要です。H3 Max はモデルとサービングのパッケージであり、基礎 H3 を単により速いハードウェアで動かしているだけではありません。

一次情報は、fal の H3 Max ローンチページテキストから動画エンドポイント画像から動画エンドポイント、および 発表投稿 です。

MiniMax H3 Max の仕様一覧

項目ローンチ時の H3 Max の能力実務上の意味
モデル系統MiniMax H3 を fal Research が事後学習調整済みの H3 派生であり、新しい MiniMax 基盤モデルではない
エンドポイントテキストから動画と画像から動画画像から動画は任意の終了フレームも受け付ける
解像度480p または 768p。既定は 768p768p の 16:9 は 1344×768
5〜15秒個別ショットや短いソーシャルクリップに向く
フレームレート24 FPS15秒の結果は360フレームを含む
音声ネイティブに同期した音声と動画プロンプトは絵だけでなく音も指示するべきです
テキストから動画のアスペクト比21:9、16:9、4:3、1:1、3:4、9:16シネマ、横、正方形、縦の納品をカバーします
画像から動画の構図入力画像に従う意図した納品比でソースを用意する
公表レイテンシ5秒の 768p クリップで3秒未満バックエンド推論であり、エンドツーエンド待ち時間の保証ではありません

ローンチ時点では、H3 Max は標準 H3 と機能が完全には揃っていません。fal の8月25日のローンチページでは、参照から動画は週の後半に続くとされていました。そのエンドポイントが目に見える形で公開され、文書化されるまでは、テキストから動画、画像から動画、任意の開始・終了フレーム制御を、利用可能な H3 Max の範囲として扱ってください。

実務で H3 Max はどのくらい速いのか

主張の整理された形は次のとおりです。fal は、5秒の 768p H3 Max クリップに約2.5秒のバックエンド推論がかかり、3秒未満で返ると報告しています。これは生成クリップの尺より短い時間です。fal は15秒の生成には約15秒かかると述べており、最長尺は5秒の見出しよりリアルタイムに近いです。

バックエンド推論は、クリエイター側の待ち時間全体と同じではありません。キュー、ソース画像のアップロード、プロンプト拡張、安全チェック、応答の転送、ローカル再生の準備は、いずれも実時間を伸ばします。fal は応答に timings.inference を出すため、モデル実行とリクエストの残りを切り分けられます。

プロンプト拡張は別の変数です。fal は、リクエストに必要な書き換え量を判断するバランス設定を推奨しています。高速拡張経路は約1秒で戻るとされ、品質経路は動画推論が始まる前に最大30秒かけて書き換えることがあります。公平なレイテンシ試験では、拡張設定を固定したうえで、timings.inference と送信から結果までの全体時間の両方を記録するべきです。

生成尺より短い時間での生成が重要なのはなぜでしょうか。最終書き出しより、反復のループが変わります。制作チームは、案件の熱が残っているうちに、カメラ方向、動きのタイミング、製品の見せ方を何度も試せます。制作指標は、リクエストあたりの時間ではなく、採用クリップ1本あたりの時間であるべきです。速いモデルでも再試行が多ければ、優位は失われます。

1位という評価が意味すること、意味しないこと

H3 Max は幅広い「#1」主張とともにローンチされました。最も強い公開根拠は、より狭く、より有用です。ブラインドのユーザー選好に基づく特定の画像から動画リーダーボードで先頭に立っています。それは、それらの試験条件における出力品質の競争力の根拠であり、あらゆる動画タスクで最良のモデルであることの証明ではありません。

評価公開結果が示すこと根拠の境界
Artificial Analysis の音声付き画像から動画2026年8月27日確認時点で 1,204 Elo、±10、5,123回の出現で1位音声付き画像から動画の区分でのブラインド選好を測ります。票が入るにつれ順位は変わります
Design Arena の画像から動画fal は8月25日のスナップショットで H3 Max が 1,341 Elo、基礎 H3 が 1,333 と報告別の画像から動画の選好試験です。テキストから動画やワークフローの信頼性は示しません
fal の人間選好調査fal は、全体品質、プロンプト理解、美学で12の主要動画モデルに対し H3 Max が1位だったと述べています公式評価です。ローンチページは再現可能な完全なプロトコルを公開していません

独立した Artificial Analysis の結果に意味があるのは、投票中にモデル名が隠されており、標本がいま数千回の出現で測られているからです。信頼区間は依然として重要です。近いスコアは重なり得ますし、順序は動き得ます。この試験が報いるのは、その場で人々が好む出力であり、製品形状、正確な終了フレーム、台詞、タイポグラフィ、編集しやすさといったチームの条件と一致するとは限りません。

リーダーボードは、H3 Max を管理された試験に値するかどうかの判断に使ってください。試験そのものを飛ばす理由にはしないでください。制作上の判断では、すべての試行を残し、ソース画像とプロンプトを固定し、案件にもっとも高くつく失敗を採点するべきです。

メモ

「音声付きの画像から動画リーダーボードで首位」は正確です。「最良の AI 動画モデル」は正確ではありません。テキストから動画、参照制御、2K の細部、レイテンシ、コスト、 再現性は、それぞれ別の問いです。

H3 Max と標準 MiniMax H3 の比較

H3 Max と標準 H3 はモデル系統とネイティブの視聴覚生成を共有しますが、最適化されている仕事は異なります。H3 Max は 768p での速度とスループットの経路です。解像度や参照制御のほうが重要なときは、標準 H3 がより広い制作経路のままです。

能力MiniMax H3 Max標準 MiniMax H3
プロバイダー経路fal が事後学習しホスト標準エンドポイント経由の MiniMax 基盤モデル
出力解像度480p または 768p最大 2K
5〜15秒現行の fal 文書では 5〜15秒
ローンチ時エンドポイントテキストから動画。画像から動画は任意の終了フレーム付きテキストから動画、開始/終了フレーム、参照から動画、編集経路
ネイティブ音声ありあり
主な利点速い反復と低い 768p コストより高い解像度とより広い入力/制御面
向いている用途下書き、ソーシャルショット、速い A/B 探索、高スループット生成2K の最終納品、混合参照による演出、編集ワークフロー

これは、「Max」が標準製品のすべてを含む品質モードのはしごではありません。H3 Max に切り替えると、案件が依拠する能力が外れることがあります。1つの文脈に複数の画像、動画、音声参照が必要なら、あるいは 2K の結果が必要なら、標準 H3 のほうが安全な出発点です。1つのプロンプトまたは1枚のソース画像と、768p での速い反復が案件の中心なら、H3 Max のほうが試す価値があります。

MiniMax H3 Max の料金とローンチ割引

fal の公開エンドポイントページは、2026年9月1日までの一時的なローンチ料金として、480p は生成秒あたり $0.025768p は秒あたり $0.04 を掲載しています。掲載されているプロモーション後の料金は、それぞれ秒あたり $0.05 と $0.08 です。

現行の 768p エンドポイント料金では、基礎の生成コストは次のとおりです。

出力尺現行 768p ローンチ料金掲載のプロモーション後 768p 料金
5秒$0.20$0.40
10秒$0.40$0.80
15秒$0.60$1.20

公式ソースの食い違いは、明示しておく価値があります。fal 専用の H3 Max ローンチページは別の組、つまり14日間のプロモーション中は秒あたり $0.03、その後は $0.06 を引用しています。一方、公開中のテキストから動画および画像から動画のエンドポイントページは、上記の料金と9月1日の期限を示しています。fal がこれらのページを揃えるまでは、送信時にエンドポイントが表示する見積もりを正式な数値として扱ってください。

1回の生成価格だけを比べないでください。採用された出力、再試行回数、プロンプト拡張のレイテンシ、仕上げ作業を追跡してください。4回試した5秒の 768p クリップでは、ローンチ料金の生成費は編集前で $0.80 です。初回で成功する遅いモデルのほうが、使えるショットとしては安くなることもあります。

まず H3 Max を試すべき人

生成時間が創意の探索を止めているとき、H3 Max はもっとも興味深いです。複数のフックを試すソーシャルチーム、カメラ選択を探る絵コンテ担当、動きの方向を検証する製品チーム、大量のバリエーションを回す開発者は、短いクリップが分ではなく秒で届くときに恩恵を受けます。

成功が 2K の細部、大きな混合参照パック、文書化された編集エンドポイントに依存する案件には、向きははっきりしません。それらは標準 H3 の強みです。ネイティブ音声も、独自の確認工程が必要です。「音声付き」を「ミックス完了」と扱わず、台詞の明瞭さ、口のタイミング、前景効果、アンビエンス、音楽のバランス、権利を確認してください。

どちらの経路を選ぶ前に、小さな対照試験を走らせてください。

  1. 同じ適格なソース画像、プロンプト、尺、アスペクト比、音声指示を使う。
  2. モデルごとに少なくとも5回生成し、結果をすべて残す。
  3. 各試行のバックエンド推論時間、全体の実時間、価格を記録する。
  4. プロンプト追従、被写体または製品の忠実度、動きの連続性、音声の有用性、編集可能な秒数を採点する。
  5. いちばん強い見せ場フレームではなく、採用クリップ1本あたりのコストと時間を比べる。

その試験は、ローンチ時の主張を、自分の仕事に合う根拠に変えます。プロンプト拡張が採用率を十分上げて、追加レイテンシに見合うかも見えます。

OmniArt で H3 Max は使えますか?

H3 Max は現在、OmniArt のモデル登録に載っていません。本記事は fal の外部リリースを説明するのであり、OmniArt の提供開始告知ではありません。標準の MiniMax H3 は OmniArt の動画ワークスペースで利用できます。現行の OmniArt モードと、他の画像、動画、音声、音楽モデルと共有するワークスペースが必要なクリエイター向けです。

すぐ比較するなら、持ち運び可能なプロンプトとソース一式を用意し、標準 H3 を別の利用可能な動画モデルと並べて実行し、設定と失敗を残してください。MiniMax H3 レビューと比較計画 は再現可能な採点方法を示し、MiniMax H3 プロンプトガイド は各入力に明確な役割を割り当てる方法を説明します。

MiniMax H3 Max FAQ

H3 Max は MiniMax H3 と同じですか?

いいえ。H3 Max は fal Research が事後学習した MiniMax H3 派生で、fal の推論スタックと合わせて最適化されています。焦点は 480p と 768p の高速生成です。標準 MiniMax H3 は 2K 出力と、より広い参照および編集経路を保っています。

H3 Max は 2K 動画を生成しますか?

いいえ。現行の H3 Max エンドポイントは 480p と 768p です。2K 出力が必須なら、標準 MiniMax H3 を使ってください。

H3 Max は本当に5秒の動画を3秒未満で生成できますか?

fal は、5秒の 768p クリップに約2.5秒のバックエンド推論がかかり、3秒未満で応答すると報告しています。キューイング、アップロード、プロンプト拡張、安全チェック、転送があるため、エンドツーエンド時間は長くなり得ます。15秒の生成は約15秒かかるとされています。

H3 Max は1位の AI 動画モデルですか?

2026年8月27日確認時点で、Artificial Analysis の音声付き画像から動画リーダーボードで1位でした。fal は Design Arena の1位結果も報告しています。これらは特定の、変動する選好リーダーボードです。H3 Max がテキストから動画、2K 出力、参照制御、あらゆる制作案件で先頭であることは示しません。

H3 Max の料金はいくらですか?

公開中の fal エンドポイントページは、9月1日まで 480p が秒あたり $0.025、768p が秒あたり $0.04、その後は秒あたり $0.05 と $0.08 と掲載しています。fal の別のローンチページは現在異なる料金を示しているため、生成前にエンドポイントが表示する見積もりを確認してください。

OmniArt で H3 Max は使えますか?

公開時点では使えません。OmniArt が現在掲載しているのは標準 MiniMax H3 であり、H3 Max 派生ではありません。いまワークスペースで使えるモデルが案件に必要なら、OmniArt の MiniMax H3 を開いてください。

制作を始めますか?

AIで魅力的なコンテンツを生成しましょう

無料で始める