MiniMax H3
- 上下文
- —
- 输入价
- —
- 输出价
- —
- 许可
- 开源
概览
MiniMax 于 2026 年 7 月 31 日发布的通用全模态生成模型,也是海螺 Hailuo 视频产品线的当前一代(社区常称 Hailuo 3.0)。它把文本、图像、视频、音频读成同一个上下文:可以同时给一段参考视频定运镜、一张图定角色、一条音轨定声音,再用自然语言描述三者关系。开放权重版由三部分组成:预处理多模态输入的 H3-Context-IR、生成 768p 音画的 H3-Base,以及负责升到 2K 的 H3-Regenerate-2K,稳定支持 11 种语言,并提供 FL2VA(文生视频,可选首尾帧)与 Ref2VA(多模态参考生成)两个专用检查点。官方称 2K 档的每秒成本不到主流模型的三分之一,768p 不到主流模型 720p 的一半。2026 年 8 月 3 日 MiniMax 开源了 H3 基础权重。
- 模态
- 视频
- 参数量
- 33B(H3-Base 开放权重)
- 许可说明
- 开源 · MiniMax H3 Community License Agreement
能力
- 全模态统一上下文:文本、图像、视频、音频一起理解
- 4–15 秒、最高 2K 分辨率视频,原生立体声同步音频,覆盖 21:9 至 9:16 六种画幅
- 用参考视频控制运镜、参考图像锁定角色、参考音频驱动配音
- 指令跟随与画面文字渲染表现突出,支持运动迁移
- 开放权重:2026 年 8 月 3 日在 Hugging Face 与 ModelScope 放出基础权重
版本历史
2026-08(开源)
- 在 Hugging Face 与 ModelScope 放出 H3-Base 基础权重,采用 MiniMax H3 Community License
2026-07
- 首次发布,全模态生成,2K/15 秒视频带原生立体声
- 上线 MiniMax 平台 API 与海螺 AI 应用







