MiniMax: MiniMax H3
hailuo-h3- 价格
- 起 $0.08
- 模态
- 视频
MiniMax H3 简介
MiniMax H3,也叫 Hailuo H3,是 MiniMax 的通用多模态视频模型,也是 Hailuo 2.3 的后继者。它可以根据文字、一张静态图、一对首尾帧,或一组参考图片、视频和音频片段生成视频。它提供 768p 和 2K 两档分辨率,是 H3 系列中较高的范围,这使它区别于偏重速度的 H3-Max。
擅长的任务
- 首尾帧生成固定了镜头的开始和结束方式,把分镜变成动态时很有帮助。
- 参考生成接受图片、短视频片段和音频片段,作为主体、动作和声音的引导。
- 分辨率可选 768p 和 2K,其中 2K 高于最高只到 768p 的 H3-Max。
- 支持文生视频和图生视频,所以一个模型既能做纯提示词的工作,也能做基于静态图的工作。
- 片段时长为 6 秒或 10 秒,足够拍一个有头有尾的镜头。
什么情况换别的模型
- 参考模式和首尾帧模式不能在同一次请求里组合,所以每次生成需要二选一。
- 需要在较低分辨率下快速迭代时,MiniMax 把 H3-Max 定位为更快的变体。
- 宽高比只限 16:9 和自适应,其他固定比例无法选择。
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
图生视频参考图生视频首尾帧视频文生视频TokenLab 端点POST/v1/videos/generationscurl -X POST "https://api.tokenlab.sh/v1/videos/generations" \ -H "Authorization: Bearer sk-xxx" \ -H "Content-Type: application/json" \ -d '{ "aspect_ratio": "16:9", "duration": 6, "operation": "text-to-video", "resolution": "768p", "model": "hailuo-h3", "prompt": "Cinematic sunrise over a calm lake with gentle camera motion." }'
价格
TokenLab 价格用于 Verified,多数模型更便宜;官方价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。
- 图生视频Official
- 参考图生视频Official
- 首尾帧视频Official
- 文生视频Verified, Official
文生视频 · 768p
每秒- 官方价格
- $0.08
- TokenLab 价格
- $0.08
- 折扣
- —
图生视频 / 首尾帧视频 / 参考图生视频 · 768p
每秒- 官方价格
- $0.08
- TokenLab 价格
- —
- 折扣
- —
文生视频 · 2k
每秒- 官方价格
- $0.13
- TokenLab 价格
- $0.13
- 折扣
- —
图生视频 / 首尾帧视频 / 参考图生视频 · 2k
每秒- 官方价格
- $0.13
- TokenLab 价格
- —
- 折扣
- —
参考图生视频 · 图片输入 · 前 5 张图片免费
每秒- 官方价格
- $0.04/张图片
- TokenLab 价格
- —
- 折扣
- —
| 官方价格每秒 | TokenLab 价格每秒 | 折扣 | |
|---|---|---|---|
| 文生视频 · 768p | $0.08 | $0.08 | — |
| 图生视频 / 首尾帧视频 / 参考图生视频 · 768p | $0.08 | — | — |
| 文生视频 · 2k | $0.13 | $0.13 | — |
| 图生视频 / 首尾帧视频 / 参考图生视频 · 2k | $0.13 | — | — |
| 参考图生视频 · 图片输入 · 前 5 张图片免费 | $0.04/张图片 | — | — |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时- 请求
- 成功率
- P95 延迟
- 总 token 数
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
MiniMax H3 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 hailuo-h3 完成一次 text-to-video,接口是 /v1/videos/generations。返回结果、状态和费用。
使用场景
适用场景- 多模态
- 文生视频
从分镜到镜头
给出首帧、尾帧和一条描述两者之间运动的提示词,得到一个落在预定最终构图上的动态测试。
角色一致的片段
提供角色或产品的参考图,把它们放进多个片段中的新场景里。
感知声音的场景
加入一段音频作为参考,引导生成镜头的节奏或氛围。
高分辨率主视觉镜头
以 2K 渲染一个关键镜头,用于网站头图或影片样片。
提示词示例
从关着的门开始,到敞开的门结束,光线涌入;缓慢向前推轨,积满灰尘的走廊。
用这张红色运动鞋的参考照片,展示它在摄影棚灯光下,在混凝土底座上旋转。
夜晚的纸灯笼节,镜头从人群上方升起,温暖的光倒映在河面上。
FAQ
MiniMax H3 和 Hailuo 2.3 有什么不同?
H3 是较新的多模态一代。除了文字和单张图片输入,它还接受首尾帧,以及参考图片、视频和音频,并且可达 2K。Hailuo 2.3 只接受一条提示词和一张图片。
我可以同时设置首帧和尾帧吗?
可以。提供一张起始图和一张结束图,模型会在两者之间生成动画。MiniMax 的文档把这当作与参考生成不同的另一种模式。
H3 能使用哪些参考素材?
根据 MiniMax 文档,最多九张图片、三段视频和三段音频,视频和音频的片段总时长各以十五秒为上限。
它提供哪些分辨率?
据 MiniMax 文档是 768p 和 2K。H3-Max 变体用最高分辨率换速度,提供的是 480p 和 768p,没有更大的尺寸。
片段有多长?
6 秒或 10 秒。单个动作或产品亮相选 6 秒;镜头需要运镜或场景内有变化时选 10 秒。更长的段落可以分几段生成,再在剪辑软件里拼接。
MiniMax H3 的费用是多少?
在 TokenLab 上,MiniMax H3 的价格为 $0.08-$0.13 每秒。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
MiniMax H3 应该使用哪个端点?
MiniMax H3 使用 https://api.tokenlab.sh/v1/videos/generations。代码写法见下方的请求示例。
MiniMax H3 支持哪些操作?
MiniMax H3 支持 图生视频, 参考图生视频, 首尾帧视频, 文生视频。选了操作,上面会显示对应的端点和请求示例。
MiniMax H3 对比
资料来源
审阅于 2026年10月2日