@ABBY_FLOWAI · 上手清单

MiniMax H3:一个模型,
把生成 / 配音 / 改画面合成一件事

2026-08-09 整理 · 全部规格来自官方页面,二手传闻一律不收

H3 于 2026 年 8 月 3 日开源,这份清单只讲能落地的部分
H3 于 2026 年 8 月 3 日开源,这份清单只讲能落地的部分

01它到底是什么

过去做一条 AI 短片,你大概要开四个站:一个生成画面、一个配音、一个对口型、一个改画面。 每换一次工具,风格就飘一次,音画还得自己再对。

H3 的做法是:在预训练阶段就把这些任务一起建模,不再拆成一个个独立的专家模型。 官方原话是「打破任务之间的边界」——用自然语言表达要做什么,而不是先选一个任务模式。

一句话

它是一个全模态生成模型:能同时读文字、图片、视频、音频, 直接吐出带原生立体声的音视频

02它能接的三种活

任务你给它什么典型用法
T2VA
文生音视频
一段文字 从零起一个镜头,连声音一起出
FL2VA
首 / 尾帧生成
第一帧,或最后一帧 已有一张定好的画面,让它补出这段动态
Ref2VA
多模态参考
图 / 视频 / 音频当例子 要它像某个风格、某个动作、某个声音
以前 生成画面 配音 对口型 改画面 H3 文字 图 / 视频 H3 画面 +立体声
四个工具串联 → 一个模型一次出片(示意)
同一个模型接管文生视频、首尾帧、多模态参考三种任务
同一个模型接管文生视频、首尾帧、多模态参考三种任务

03官方规格清单

项目官方数值
发布 / 开源2026 年 8 月 3 日
模型规模33B 稠密模型(H3-Omni-Transformer),其中约 13B 在 AdaLN 相关分支
权重BF16,HuggingFace MiniMaxAI/MiniMax-H3、ModelScope
时长4–15 秒
帧率24 FPS
分辨率默认 768p,最高 2K(走 H3-Regenerate-2K 模块)
声音32kHz 原生立体声,与画面联合生成
对白语言稳定支持 11 种:中、英、日、韩、法、德、意、西、葡、俄、阿
画面比例21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16
部署示例官方文档给的是 SGLang + 4 张 GPU
协议MiniMax H3 Community License Agreement

※ 关于价格:官方 blog 只写了相对说法——「2K 每秒价格不到主流模型的三分之一, 768p 不到主流模型 720p 的一半」。网上流传的具体每秒单价,在官方定价文档里查不到 (该页明确写着视频资源包暂不支持 MiniMax H3),所以这里不写死数字,以你下单时页面为准。

32kHz 立体声与画面一起生成,不是后期配上去的
32kHz 立体声与画面一起生成,不是后期配上去的

04参考素材怎么喂

Ref2VA 这一支是最实用的部分。它一次能接:

建议这样给

一类参考只解决一个问题:人物用 2-3 张不同角度的图, 风格用 1-2 张成片截图,动作用 1 段短视频。混在一起给九张同类图,它反而抓不到重点。

别这样给

把九张风格迥异的图一起丢进去,然后写「参考这些」。 参考之间打架的时候,出来的东西通常哪个都不像。

参考版本一次能吃 9 张图、3 段视频、3 段音频
参考版本一次能吃 9 张图、3 段视频、3 段音频

05商用之前,先读协议

这是最多人忽略的一条。「开源」不等于「随便商用」。

06四个容易踩的坑

坑 1 · 以为默认就是 2K

默认出的是 768p。2K 要再走一个重绘模块,成本和时间都不一样。

坑 2 · 拿它做长片

单条 4–15 秒。它是拿来做镜头的,不是拿来做整片的。 长片得靠你自己分镜、生成、再剪。

坑 3 · 家用单卡硬上

33B 稠密模型,官方给的部署示例是 SGLang 四张卡。 一张消费级显卡先别折腾,走 API 更快见效。

坑 4 · 声音当成后期

它的声音是跟画面一起生成的。 意思是——声音的描述要写进同一段 prompt 里,而不是等出片了再想配什么。

下手前先看清协议、分辨率和时长这三件事
下手前先看清协议、分辨率和时长这三件事

07什么情况下先别用它

08官方来源

开源公告:minimax.io/news/minimax-h3-open-source
技术说明:minimax.io/blog/minimax-h3
模型权重:huggingface.co/MiniMaxAI/MiniMax-H3
部署文档:github.com/MiniMax-AI/MiniMax-H3

把 AI 真正接进你的日常工作

这份清单只是选型。如果你想要的是一整套能跑起来的工作流—— 选题、生成、排版、发布、私信自动化,一步步照着做—— 我把自己在用的那套整理成了《AI 进阶实战包》。

去看看实战包 →