返回模型列表
Veo 3.1 对比 MiniMax H3
Veo 3.1 和 MiniMax H3:价格、上下文、最大输出和支持的操作。
怎么选
导演式场景需要让对白、环境声和音效与画面出现在同一个片段里,或者要通过续写已完成的片段来加长序列,选 Veo 3.1。由首尾帧或图像、视频、音频混合参考构建的分镜驱动镜头,以及想要最高的输出分辨率,选 MiniMax H3(Hailuo H3)。两者都支持文本、图像和首尾帧输入。
价格对比
| Veo 3.1 | MiniMax H3 | |
|---|---|---|
| 模型厂商 | MiniMax | |
| 可用状态 | 可用 | 可用 |
| 上下文窗口 | - | - |
| 最大输出 | - | - |
| 官方价格 | $0.40-$0.60每秒 | $0.08-$0.13每秒 |
| TokenLab 价格 | $0.28-$0.42每秒 | $0.08-$0.13每秒 |
| 模型表现 | 正在收集数据 | 正在收集数据 |
| 能力 | 图生视频参考图生视频首尾帧生视频文生视频视频续写 | 图生视频多模态参考图生视频首尾帧生视频文生视频 |
什么时候选 Veo 3.1
- 你想让对白和音效与画面一起生成,而不是事后添加
- 你打算把一个好的片段接着做成更长的序列
- 你需要用同一个模型输出竖屏和横屏
什么时候选 MiniMax H3
- 你手里有分镜脚本,想固定每个镜头的开头和结尾
- 你用多张参考图、视频片段或音频片段来引导镜头
- 你以最高分辨率档位交付,更看重清晰度而不是片段长度
差异在哪
| 方面 | Veo 3.1 | MiniMax H3 |
|---|---|---|
| 声音 | Google 介绍 Veo 3.1 能同时生成音频和视频,包括语音和环境声。 | MiniMax 文档里的音频片段是用来引导镜头的参考,而不是模型替你生成的声轨。 |
| 接续镜头 | 视频续写可以让一个已完成的片段在第二次生成中继续。 | 未列出续写步骤;更长的内容要靠规划帧相衔接的多个独立镜头。 |
| 帧控制 | 首尾帧可以固定,参考图能让主体保持稳定。 | 首尾帧和参考素材是独立的模式,每次请求只能选一种。 |
| 参考输入 | 参考图可以在镜头之间保持角色、产品或场景一致。 | 参考可以是图像、短视频和音频片段,引导动作和声音的方式更多。 |
| 输出格式 | 提供竖屏和横屏画面。 | 提供宽屏,或根据输入自适应比例。 |
摘要
- Veo 3.1: $0.28-$0.42 每秒; MiniMax H3: $0.08-$0.13 每秒. 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
FAQ
做带对白的广告,Veo 3.1 和 Hailuo H3 哪个更好?
Veo 3.1。Google 把台词、环境声和音效都放进了生成里,所以带人物说话的场景后期步骤更少。Hailuo H3 可以把音频作为参考,但它的文档没有说明它能自己生成对白。
能不改提示词把 Hailuo H3 换成 Veo 3.1 吗?
不能直接换。Hailuo H3 的提示词依赖首尾帧和参考文件,而 Veo 3.1 的提示词还可以描述声音。预计要重写镜头描述,并重新检查画幅选项。
做分镜工作哪个更合适?
Hailuo H3。固定镜头的首尾帧适合分镜,Veo 3.1 的首尾帧输入也同样适合;还需要混合参考或最高分辨率档位时,选 Hailuo H3。
Veo 3.1 和 MiniMax H3 哪个更便宜?
Veo 3.1: $0.28-$0.42 每秒; MiniMax H3: $0.08-$0.13 每秒. 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
Veo 3.1 和 MiniMax H3 的主要区别是什么?
Veo 3.1:视频续写. MiniMax H3:多模态
资料来源
审阅于 2026年10月2日