MiniMax H3:排第一,而且权重能下载的那个模型
MiniMax H3 在 Arena AI 的图生视频盲测榜上排第一,压过 Gemini Omni 和 Wan 3.0——而且它跟几乎每一个它赢过的模型不同:权重可以下载。这让它成为唯一一个「干脆自己跑」是真选项而不是口号的前沿视频模型。这一页讲清 H3 与 H3 Max 的分野、每一档已公布的价格、开源版实际包含什么,以及两条会绊住商业用户的许可条件。
MiniMax H3 是什么
MiniMax H3 是 2026 年取代海螺(Hailuo)产品线的视频生成模型,接替 Hailuo 2.3。它现在是 MiniMax 自家消费端应用里的模型,同时在公司按量付费的 API 上以两个标识出售:MiniMax-H3 和 MiniMax-H3-Max,后者与 fal.ai 联合开发。
命名需要用一段话理清,因为两套系统在同时运行:
- MiniMax 是公司名,也是面向开发者的模型名。API 标识符为
MiniMax-H3和MiniMax-H3-Max。 - 海螺(Hailuo) 是消费端产品名——也就是那个 App——同时也是上一代模型 Hailuo 2.3 的名字,MiniMax 现在把它归在 Legacy Models 下。
所以「海螺 H3」作为「通过海螺 App 用 H3」的简称没问题,但模型叫 MiniMax H3;而搜旧名字,你搜到的是已经被替代的那一代。
让这个模型值得单独写一页的,是一个目前没有对手同时具备的组合:它在一个主流盲测榜上排第一,同时它的权重是可以下载的。 Gemini Omni、Seedance、可灵都是闭源的,H3 不是。
H3 与 H3 Max——以及为什么便宜的那个不一定更便宜
H3 Max 是通过额外训练从 H3 派生出的速度优化版本,目标是生成更快、提示词遵循更好。已公布的差异比名字暗示的要小,而且其中一项还朝着反方向走。
| 项目 | MiniMax-H3 | MiniMax-H3-Max |
|---|---|---|
| 定位 | 基准模型 | 速度优化,由 H3 经额外训练派生,与 fal.ai 联合发布 |
| 分辨率 | 768p 与 2K | 480p 与 768p,没有 2K |
| 费率 | 768p 每秒 $0.08 · 2K 每秒 $0.13 | 480p 每秒 $0.05 · 768p 每秒 $0.08 |
| 片段时长 | — | 5–15 秒,整数时长 |
| 图片输入 | 前 5 张免费,之后每张 $0.04 | 前 2 张免费,之后每张 $0.074 |
| 音频参考 | 免费 | 免费 |
| 开源权重 | 有(H3-Base,768p) | 没有 |
把分辨率和费率两行放在一起读,卖点就清楚了:H3 Max 给你一个便宜的 480p 档,而在 768p 收和 H3 一样的钱。它不是「原有模型的折扣」,而是在下面加了一层新地板。
真正会绊住人的是图片输入那一行。H3 Max 每多一张图几乎贵一倍,免费额度还少三张。 MiniMax 自己举的例子正好把直觉反过来:一个 15 秒 768p、带四张参考图和一段六秒参考视频的请求,在 H3 Max 上约 2.21 美元,在 H3 上约 1.68 美元。「更便宜」的模型贵了三分之一,因为这个请求输入很重。如果你的工作流是靠参考图驱动的,那么在他们共同支持的所有分辨率上,H3 都更便宜。
要花多少钱
MiniMax 在按量付费 API 上按成片每秒计费。这一层没有积分体系要换算,所以它是比较好做预算的模型之一。
| 路径 | 速率 | 十秒片段 |
|---|---|---|
| H3 Max 480p | $0.05 / 秒 | $0.50 |
| H3 768p | $0.08 / 秒 | $0.80 |
| H3 Max 768p | $0.08 / 秒 | $0.80 |
| H3 2K | $0.13 / 秒 | $1.30 |
| 768p 重生成到 2K | 每个输出秒 $0.05 | $0.50 |
输入单独计费,意外也都藏在这里。参考视频按输入时长、以输出分辨率对应的费率收费——480p 输出每秒 0.0553 美元,768p 每秒 0.143 美元——所以一段六秒参考视频是真实的一笔钱,不是零头。两个模型的音频参考都免费。
作为参照,上一代产品仍在售,而且对短片来说性价比并不明显更差:Hailuo 2.3 六秒 768p 为 0.28 美元、1080p 为 0.49 美元,Hailuo 2.3 Fast 只做图生视频。MiniMax 把它们移到了 Legacy Models 下,因此新工作流应当优先评估 H3 与 H3 Max。
谁在 H3 上做了东西——以及为什么它能比 H3 官方还便宜
H3 不只由 MiniMax 出售。2026 年 9 月底,Pruna AI 发布了 P-Video-2-Pro,在自己的发布帖里称它「基于 MiniMax H3」——这是一个衍生物,而不是套壳,针对生成速度做了调优,并通过合作平台而非 MiniMax 分发。
它与众不同的地方很窄、很具体:
- 输入:文本或首帧图片,可选尾帧条件——和 H3 一样的帧控逻辑,也符合这个模型家族最擅长的方向。
- 速度:Pruna 声称其 Speed 模式下生成一条 5 秒 480p 片段约需 2.0 秒,768p 约 4.3 秒。快于实时,这正是这个模型的卖点。
- 输出:24fps,含生成音频。值得注意的是不开放音频输入——所以 MiniMax 在 H3 上免费提供的音频参考,在这里没有对应能力。
- 时长:5 到 15 秒,480p 或 768p,没有 2K 档。按成片计费,未指定模式时按 Speed 计。
然后是价格,这部分值得多看两眼。Pruna 公布了三套生成配方——成本、速度和质量——与 MiniMax 自己的费率对比如下:
| 768p 路径 | 每秒费率 | 十秒片段 |
|---|---|---|
| MiniMax 官方 H3 | $0.08 | $0.80 |
| P-Video-2-Pro 质量模式 | $0.075 | $0.75 |
| P-Video-2-Pro 速度模式 | $0.035 | $0.35 |
| P-Video-2-Pro 成本模式 | $0.025 | $0.25 |
在 768p,这个衍生物在所有档位上都比原版便宜,最便宜的模式约为 MiniMax 官方费率的三分之一。在 480p 差距更大:P-Video-2-Pro 成本模式从每秒 0.01 美元起,而同分辨率下 H3 Max 是 0.05 美元。
由此有两个结论值得在选择生成平台前知道。「MiniMax H3 的价格」如今是平台价格,不是模型价格——这意味着任何只报一个数字的 H3 对比表,报的都是某一家平台的意见。而且 H3 家族的竞争力越来越体现在「谁来跑更便宜」,而不是「谁画得更好」:MiniMax 自己的开源权重、一个经速度调优的商业衍生物、九家合作方同时在场,问题已经从「模型好不好」变成「谁跑得最便宜」。
开源权重——你实际拿到的是什么
MiniMax 在 Hugging Face 上以 MiniMax H3 社区许可发布了 H3 的权重。这是把 H3 与它所有竞争对手区分开的地方,也是细节最常被省略的地方。
| 项目 | 细节 |
|---|---|
| 开源的部分 | H3-Base,输出 768p |
| 没开源的部分 | 2K 重生成环节,以及稀疏注意力——那项能降低长片段算力成本的优化 |
| 模型体量 | 330 亿参数主 Transformer,另需完整运行 Qwen3-VL-32B 来理解提示词与图像 |
| 硬盘 | 单个 checkpoint 的 Transformer 文件约 66 GB |
| 硬件 | MiniMax 自己的部署示例用了四块 GPU |
| 许可 | MiniMax H3 社区许可 |
两条许可条件很容易被忽略,而且都有牙齿:
- 年收入超过 2000 万美元的商业产品,需要 MiniMax 书面许可。 这一条本身就让开源版本不适合大公司——除非先去谈一趟。
- 商业产品必须在界面上显示「MiniMax H3」。 不是写在文档里,而是写在产品里。这是用户可见的署名要求,需要在设计阶段就留位置,而不是事后贴上去。
如果你改用托管 API,这两条都不适用——这就是取舍:API 按秒收钱,但不带署名要求和收入门槛。
排名说明了什么
Arena AI 用真人盲测两两对比,并以 Elo 体系给模型评分。MiniMax H3 在三个榜上的位置格外有信息量,因为它并不一致。
| 榜单 | 名次 | 分数 |
|---|---|---|
| 图生视频 | 第一 | 1495,超过 5711 次投票 |
| 视频编辑 | 第三 | 1392 |
| 文生视频 | 约第八 | 1460 |
图生视频第一、编辑第三、文生视频第八,这不是噪声,而是一张画像:这个模型在「有图可依」时最强——让静图动起来、维持一个被给定了的角色、在一次编辑中保持场景一致。被要求凭一句话凭空造场景时,它相对较弱。这个模型的其他一切也都与这一点自洽,包括 MiniMax 自己的定价页把大量细节花在图片和参考视频怎么计费上。
如果你在 H3 和 Gemini Omni 之间选,这个区别就是决定性的。Gemini Omni 的优势是对话式编辑和以提示词为先的工作流上的文字渲染;H3 的优势是在你已经知道第一帧长什么样时的还原度。按你输入从哪来选模型。
海螺还免费吗?大部分不免费
这个问题值得直接回答,因为旧的假设已经失效。截至 2026 年 9 月,海螺免费套餐不再包含每月积分。 它提供的是针对 MiniMax 自家模型的一次性试用积分——评估额度,而不是可续期额度。你可以用它测试,但没法用它干活。
期间有过赠送大额积分的促销,包括为安装其他 MiniMax 应用而送,但那些是促销,不该写进计划里。真正免费的两条路径是:开源权重(下载不要钱,但要四块 GPU),以及个别第三方宿主按自己的条款给出的免费额度——那不是 MiniMax 的价格,也可能随时变化。
怎么卡出一条能用的视频
-
按输入选模型,而不是按预算选。
参考重的活用 H3 更便宜,因为每多一张图是 0.04 而不是 0.074 美元,而且前五张免费。如果你的请求带音频参考或参考视频,先把账算一遍——输入重的任务在 H3 Max 上可能贵三分之一,尽管标题费率更低。
-
只有在 480p 就能交片时,才用 480p 搭草稿。
H3 Max 的 0.05 档是进入这个家族最便宜的入口,但从 480p 到 2K 没有路径——Max 上根本没有这一档。如果成片必须是 2K,你就在 H3 上,480p 的省钱跟你无关。先定分辨率,再看费率。
-
把它写成镜头,而不是概念。
点明主体、动作、地点、运镜和光线。「浓缩咖啡慢动作注入玻璃杯,清晨窗光,浅景深」比「咖啡视频」给模型的信息多得多——而这个模型文生视频相对偏弱,恰恰说明提示词的纪律更重要,而不是更不重要。
-
用帧来引导,不要用文字。
H3 Max 接受首帧、尾帧或两者。既然图生视频是它排第一的榜单,给帧就是打在强项上;用散文描述那一帧,就是打在它最弱的榜上。
-
把时长控制在你要付费的范围内。
按输出秒计费,所以生成过长的片段不只是慢,而是直接更贵。生成前就定好时长,不要事后裁剪,因为没有东西可退。
-
在权重上做东西之前先看许可。
如果你打算基于开源版本做商业产品,有两件事要早点处理:超过 2000 万美元年收入需要书面许可;界面必须带「MiniMax H3」署名。这两件都是设计决策,不是走流程。
常见问题
MiniMax H3 是什么?
2026 年取代海螺产品线的视频模型,接替 Hailuo 2.3。它在 MiniMax 按量付费 API 上以每秒 0.08 美元(768p 输出)和 0.13 美元(2K)出售,也是极少数公布了可下载权重的前沿视频模型之一。在 Arena AI 的图生视频盲测榜上,它以 1495 的 Elo、在 5711 次投票中排名第一。
MiniMax H3 和 H3 Max 有什么区别?
H3 Max 是通过额外训练从 H3 派生的速度优化版本,与 fal.ai 联合发布。它增加了一个每秒 0.05 美元的廉价 480p 档,但没有 2K 选项,且在 768p 与 H3 同价而非更便宜。它的图片输入也更贵——前两张免费、之后每张 0.074 美元,而 H3 是前五张免费、之后每张 0.04 美元——所以输入重的请求在 H3 Max 上可能比 H3 更贵。
MiniMax H3 多少钱?
H3 在 768p 为每秒 0.08 美元、2K 为 0.13 美元;H3 Max 在 480p 为 0.05 美元、768p 为 0.08 美元。因此一条十秒片段按路径不同为 0.50、0.80 或 1.30 美元。输入单独计费——参考视频按输入时长计价,480p 输出每秒 0.0553 美元、768p 每秒 0.143 美元——而两个模型的音频参考都免费。
能本地部署吗?
可以,但有限制。权重发布在 Hugging Face 上,采用 MiniMax H3 社区许可。主 Transformer 为 330 亿参数,整条流水线还需完整运行 Qwen3-VL-32B 来读提示词和图像,每个 checkpoint 约 66 GB,MiniMax 自己的部署示例用了四块 GPU。开源版本只有 768p 的 H3-Base——2K 重生成环节和稀疏注意力优化没有开源。
开源权重的许可条件是什么?
两条重要条件:年收入超过 2000 万美元的商业产品需要 MiniMax 书面许可;商业产品必须在界面显示「MiniMax H3」。第一条把大公司挡在门外(除非先去谈),第二条是需要提前设计的用户可见署名。使用托管 API 时两条都不适用。
海螺 AI 免费吗?
大部分不免费。截至 2026 年 9 月,免费套餐不再包含每月积分——只有针对 MiniMax 自家模型的一次性试用积分,属于评估额度而非可续期额度。曾有促销为安装其他 MiniMax 应用赠送大额积分,但那不是套餐设计。真正免费的路径是开源权重(需要认真配置的硬件),以及个别第三方宿主自己给出的试用额度。
MiniMax H3 的排名如何?
在 Arena AI 图生视频榜第一(Elo 1495,5711 次投票),视频编辑第三(1392),文生视频约第八(1460)。这个分布才是有用的部分:它拿到一张图作为起点时最强,被要求凭提示凭空造场景时相对较弱。
支持哪些分辨率和时长?
H3 Max 输出 5 到 15 秒整数时长的片段,分辨率 480p 或 768p,画幅覆盖 21:9、16:9、4:3、1:1、3:4 和 9:16,可用首帧、尾帧或两者控制。H3 额外提供 2K 档。注意至少有一家转售商称 H3 Max 不支持参考图片、参考视频或参考音频条件控制,这与 MiniMax 自己的图片输入计费相矛盾——请在你实际购买的平台上核实。
MiniMax H3 现在还叫海螺吗?
两个名字都在用,但描述的是不同层面。MiniMax 是公司名,也是面向开发者的模型名,API 标识符为 MiniMax-H3 和 MiniMax-H3-Max。海螺是消费端产品名,也是上一代模型 Hailuo 2.3 的名字,后者现在归在 Legacy Models 下。「海螺 H3」作为简称说得通,但模型本身叫 MiniMax H3。
我该用 MiniMax H3 还是托管聚合平台?
MiniMax 自家 API 提供按秒计费、完整分辨率范围和官方能力清单,但剪辑、配音和字幕要你自己搭。像 Higgsfield 这样的聚合平台把多家厂商收在一个订阅、一个积分余额后面——对比方便,但价格和免费额度由宿主自己定,不是 MiniMax 的价格,而且积分不是「视频的计量单位」。对有 GPU 资源的团队来说,开源权重是第三条路。
有没有比 MiniMax 官方价更便宜的用法?
有——这是本页最有用的信息。2026 年 9 月底 Pruna AI 发布了 P-Video-2-Pro,声称基于 MiniMax H3。在 768p,它三档都比 MiniMax 官方的 0.08 美元便宜:质量模式每秒 0.075、速度 0.035、成本 0.025。在 480p,成本模式从每秒 0.01 美元起,而 H3 Max 为 0.05 美元。但注意事项很重要:它是另一个经速度调优的模型,而不是同一个;发布时基准结果尚未公布,所以质量说法来自厂商;它还通过九家各家自定价的推理合作方分发。结论是:MiniMax H3 的价格如今是平台价格,不是模型价格。
站内其他内容
- Seedance 2.5——字节的闭源视频模型,以及没有任何工程来源证实的四项规格。与 H3 的开源发布正好对照。
- 可灵 4.0——承诺 30 秒单次生成的竞争对手。快手实际交付了什么、哪些只是官宣。
- Gemini Omni——H3 在图生视频上赢过、在文生视频上落后于它的那个模型。Google 的 any-to-any 视频模型、免费额度和真实每秒成本。
- Hotel Lobby AI——大家用这些模型生成得最多的玩法格式,含步骤、提示词和授权规则。