MiniMax H3 Max:fal 加速版视频模型带来什么变化
MiniMax H3 Max 把 fal 的后训练和快速 768p 生成绑在一起。本文说明它的速度、榜单结果、定价和限制,对创作者意味着什么。
MiniMax H3 Max 是 fal Research 对 MiniMax H3 做后训练得到的版本,面向另一条制作路径:快速生成 480p 或 768p,而不是基础模型的 2K 与重度依赖参考素材的工作流。fal 于 2026 年 8 月 26 日发布该模型,头条结果是一段 5 秒的 768p 视频在 3 秒内生成完成。
这个速度说法值得关注,但需要放到上下文里看。H3 Max 不是全新的 MiniMax 基础模型,也不能替代每一个标准 H3 端点。它把针对提示词遵循度和美学的后训练,与围绕改动后模型设计的推理路径结合在一起。本指南把已上线的能力和对外宣称的能力分开,说明当前榜单证据,并指出 H3 Max 相对标准 MiniMax H3 的位置。
MiniMax H3 Max 是什么?
MiniMax H3 Max 是托管在 fal 上、经过后训练的 MiniMax H3 变体,用于文生视频和图生视频。它生成 5–15 秒、480p 或 768p、带同步音频的片段。核心取舍很直接:创作者放弃标准 H3 的 2K 输出和更广的参考、剪辑端点,换取更低延迟和更低的 768p 成本。
fal 表示,其 Research 团队用自研强化学习框架、真实生成负载和人类偏好,把模型调到更强的提示词遵循度、视听质量和美学表现。推理团队在这次后训练的同时优化了服务栈。这个区分很重要:H3 Max 是模型和推理服务的组合包,不是简单地让基础 H3 跑在更快的硬件上。
主要来源是 fal 的 H3 Max 发布页、文生视频端点、图生视频端点 和 发布公告。
MiniMax H3 Max 规格速览
| 面向 | 上线时的 H3 Max 能力 | 实际含义 |
|---|---|---|
| 模型谱系 | MiniMax H3,由 fal Research 后训练 | 调优过的 H3 变体,不是新的 MiniMax 基础模型 |
| 端点 | 文生视频和图生视频 | 图生视频还可选尾帧 |
| 分辨率 | 480p 或 768p;默认 768p | 768p 的 16:9 为 1344×768 |
| 时长 | 5–15 秒 | 适合单镜头和短社交片段 |
| 帧率 | 24 FPS | 15 秒成片包含 360 帧 |
| 音频 | 原生同步的音频和视频 | 提示词应同时指挥声音和画面 |
| 文生视频画面比例 | 21:9、16:9、4:3、1:1、3:4 和 9:16 | 覆盖电影感、横屏、方形和竖屏交付 |
| 图生视频构图 | 跟随输入图 | 按目标交付比例准备源图 |
| 公布延迟 | 5 秒的 768p 片段不到 3 秒 | 这是后端推理,不是保证的端到端等待时间 |
上线时,H3 Max 与标准 H3 并不具备完整功能对等。fal 8 月 25 日的发布页写过,参考生视频会在当周晚些时候跟上。在该端点明确上线并有文档之前,把文生视频、图生视频,以及可选的首尾帧控制,视为 H3 Max 当前可用的能力面。
H3 Max 实际有多快?
说法的干净版本是:fal 报告,一段 5 秒的 768p H3 Max 片段大约需要 2.5 秒后端推理,并在 3 秒内返回。这比生成片段本身的时长还短。fal 还说,15 秒生成大约要 15 秒,因此最长时长更接近实时,而不像 5 秒那条头条那么夸张。
后端推理不等于创作者的完整等待。排队、源图上传、提示词扩展、安全检查、响应传输和本地回放准备,都会拉长实际经过时间。fal 在响应里暴露 timings.inference 值,因而可以把模型执行和其他请求开销分开。
提示词扩展又加了一层变量。fal 建议用它的均衡设置,由系统决定一次请求需要改写多少。据称快速扩展路径大约 1 秒返回,而画质路径在视频推理开始前最多可能花 30 秒改写。公平的延迟测试因此应同时记录 timings.inference 和完整的提交到出结果时间,并把扩展设置保持不变。
为什么比成片更短的生成时间重要?它改变的是迭代循环,而不是最终导出。创意团队可以在需求还热着的时候,多次试镜头方向、动作时机或产品揭示。制作指标仍应是每条被采纳成片的耗时,而不是每次请求的耗时:一个很快、却要很多次重试的模型,优势会被吃掉。
“第一”排名能说明什么、不能说明什么
H3 Max 上线时带着宽泛的“#1”说法。最强的公开证据其实更窄、也更有用:它在特定图生视频榜单上,按盲测用户偏好领先。那是这些测试条件下输出质量有竞争力的证据,不是它在每一项视频任务上都是最好模型的证明。
| 评测 | 公开结果说了什么 | 证据边界 |
|---|---|---|
| Artificial Analysis 带音频的图生视频 | 2026 年 8 月 27 日核对时,以 1,204 Elo、±10、5,123 次出场排第一 | 测的是带音频图生视频赛道上的盲测偏好;票数进来后排名会变 |
| Design Arena 图生视频 | fal 报告其 8 月 25 日快照中 H3 Max 为 1,341 Elo,基础 H3 为 1,333 | 另一项图生视频偏好测试;不能确立文生视频或工作流可靠性 |
| fal 人类偏好研究 | fal 称 H3 Max 在整体质量、提示词理解和美学上对 12 个领先视频模型排第一 | 官方评测;发布页没有公布完整可复现协议 |
独立的 Artificial Analysis 结果有分量,因为投票时模型名是隐藏的,样本量现在以数千次出场计。它的置信区间仍然重要:接近的分数可能重叠,排序也可能移动。这项测试奖励的,是人们在那个赛场里更喜欢的输出,未必匹配团队对产品外形、精确尾帧、对白、字体或可编辑性的要求。
用榜单决定 H3 Max 值不值得做一次受控测试。不要用它来跳过测试。制作决策应保留每一次尝试,锁定源图和提示词,并给对项目代价最大的失败打分。
说明
“在带音频的图生视频榜单上第一”是精确的。“最好的 AI 视频模型”不是。文生视频、参考控制、2K 细节、延迟、成本和 可复现性,是分开的问题。
H3 Max 与标准 MiniMax H3
H3 Max 和标准 H3 共享模型谱系和原生视听生成,但各自为不同工作优化。H3 Max 是 768p 上的速度与吞吐路线。标准 H3 仍是更广的制作路线:当分辨率或参考控制更重要时走它。
| 能力 | MiniMax H3 Max | 标准 MiniMax H3 |
|---|---|---|
| 服务商路径 | 由 fal 后训练并托管 | MiniMax 基础模型,经其标准端点 |
| 输出分辨率 | 480p 或 768p | 最高 2K |
| 时长 | 5–15 秒 | 按当前 fal 文档为 5–15 秒 |
| 上线端点 | 文生视频;图生视频,可选尾帧 | 文生视频、首尾帧、参考生视频,以及剪辑路径 |
| 原生音频 | 有 | 有 |
| 主要优势 | 快速迭代和更低的 768p 成本 | 更高分辨率和更广的输入、控制面 |
| 最适合 | 草稿、社交镜头、快速 A/B 探索、高吞吐生成 | 2K 成片、混合参考导演,以及剪辑工作流 |
这不是一条“Max”包含标准产品全部能力的画质模式阶梯。切到 H3 Max,可能拿掉一份需求所依赖的能力。如果项目需要在同一上下文里放入多份图片、视频和音频参考,或需要 2K 结果,标准 H3 是更稳妥的起点。如果需求只需要一条提示词或一张源图,并在 768p 上快速迭代,H3 Max 才是更相关的测试对象。
MiniMax H3 Max 定价与上线折扣
fal 的在线端点页列出临时上线价:480p 每生成秒 $0.025,768p 每秒 $0.04,截至 2026 年 9 月 1 日。列出的促销后价格分别为每秒 $0.05 和 $0.08。
按当前 768p 端点费率,基础生成成本是:
| 输出时长 | 当前 768p 上线价 | 列出的促销后 768p 价 |
|---|---|---|
| 5 秒 | $0.20 | $0.40 |
| 10 秒 | $0.40 | $0.80 |
| 15 秒 | $0.60 | $1.20 |
有一处官方来源不一致,值得标出来。fal 专门的 H3 Max 发布页报的是另一组数字——14 天促销期内每秒 $0.03,之后每秒 $0.06——而在线的文生视频和图生视频端点页显示的是上面的费率与 9 月 1 日截止日。在 fal 把这些页面核对一致之前,提交时应把端点显示的预估视为权威。
不要只比较一次生成的价格。跟踪被采纳的输出、重试次数、提示词扩展延迟,以及任何收尾工作。对一段要试 4 次的 5 秒 768p 片段,上线价生成花费在剪辑前是 $0.80。一个更慢、但第一次就成功的模型,仍可能做出更便宜的可用镜头。
谁该先测 H3 Max?
当生成时间卡住创意探索时,H3 Max 最有意思。社交团队试几种开场钩子、分镜师试镜头选择、产品团队验证运动方向、开发者跑大批量变体,都会受益于短片段以秒而不是分钟到达。
如果一份需求的成败取决于 2K 细节、一大包混合参考素材,或有文档的剪辑端点,它就不那么对口。那些是标准 H3 的强项。原生音频也值得单独过一遍:检查对白可懂度、口型时机、前景效果、环境声、音乐平衡和版权,而不是把“含音频”当成“混音已完成”。
在选定任一路线前,先跑一轮小规模对照测试:
- 使用同一张合格源图、同一条提示词、同一时长、同一画面比例和同一音频指示。
- 每个模型至少生成五次,并保留每一次结果。
- 记录每次尝试的后端推理时间、完整实际经过时间和价格。
- 给提示词遵循度、主体或产品保真度、运动连续性、音频可用性和可进入剪辑的秒数打分。
- 比较每条被采纳成片的成本和耗时,而不是最强的展示帧。
这轮测试把上线说法变成匹配你自己工作的证据。它也会暴露:提示词扩展带来的采纳提升,是否足以抵消额外延迟。
OmniArt 上能用 H3 Max 吗?
H3 Max 目前未列入 OmniArt 的模型注册表。本文解释的是 fal 的外部发布,不是 OmniArt 的可用性公告。标准 MiniMax H3 已可在 OmniArt 视频工作台使用,适合需要其当前 OmniArt 模式、并与其他图片、视频、音频和音乐模型共用工作台的创作者。
若要立刻做对比,准备一份可带走的提示词和源素材包,把标准 H3 和另一款可用视频模型一起跑,并保留设置与失败样本。MiniMax H3 评测与对比方案 提供可复现的评分方法,MiniMax H3 提示词指南 则说明如何给每项输入分配清晰角色。
MiniMax H3 Max 常见问题
H3 Max 和 MiniMax H3 是同一个模型吗?
不是。H3 Max 是 fal Research 后训练的 MiniMax H3 变体,并与 fal 的推理栈共同优化。它聚焦快速的 480p 和 768p 生成。标准 MiniMax H3 保留 2K 输出,以及更广的参考和剪辑路径。
H3 Max 能生成 2K 视频吗?
不能。当前 H3 Max 端点提供 480p 和 768p。当 2K 输出是硬性要求时,使用标准 MiniMax H3。
H3 Max 真的能在三秒内生成五秒视频吗?
fal 报告,一段 5 秒的 768p 片段大约 2.5 秒后端推理,并在 3 秒内返回。端到端时间可能更长,因为还有排队、上传、提示词扩展、安全检查和传输。据称 15 秒生成大约要 15 秒。
H3 Max 是排名第一的 AI 视频模型吗?
2026 年 8 月 27 日核对时,它在 Artificial Analysis 带音频的图生视频榜单上排第一,fal 也报告了 Design Arena 的第一名结果。那些是具体、会变动的偏好榜单。它们并不能确立 H3 Max 在文生视频、2K 输出、参考控制或每一份制作需求上都领先。
H3 Max 多少钱?
fal 在线端点页列出的上线价是 480p 每秒 $0.025、768p 每秒 $0.04,截至 9 月 1 日,随后为每秒 $0.05 和 $0.08。fal 单独的发布页目前显示不同费率,因此生成前确认端点显示的预估。
我能在 OmniArt 上用 H3 Max 吗?
截至发布时不能。OmniArt 目前列出的是标准 MiniMax H3,不是 H3 Max 变体。当需求需要今天工作台里已经可用的那款模型时,打开 OmniArt 上的 MiniMax H3。
准备好创作了吗?
开始用 AI 生成精彩内容