每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

返回模型列表

Veo 3.1 对比 MiniMax H3

Veo 3.1 和 MiniMax H3:价格、上下文、最大输出和支持的操作。

怎么选

导演式场景需要让对白、环境声和音效与画面出现在同一个片段里,或者要通过续写已完成的片段来加长序列,选 Veo 3.1。由首尾帧或图像、视频、音频混合参考构建的分镜驱动镜头,以及想要最高的输出分辨率,选 MiniMax H3(Hailuo H3)。两者都支持文本、图像和首尾帧输入。

价格对比

Veo 3.1MiniMax H3
模型厂商GoogleMiniMax
可用状态可用可用
上下文窗口--
最大输出--
官方价格
$0.40-$0.60每秒
$0.08-$0.13每秒
TokenLab 价格
$0.28-$0.42每秒
$0.08-$0.13每秒
模型表现正在收集数据正在收集数据
能力
图生视频参考图生视频首尾帧生视频文生视频视频续写
图生视频多模态参考图生视频首尾帧生视频文生视频

什么时候选 Veo 3.1

  • 你想让对白和音效与画面一起生成,而不是事后添加
  • 你打算把一个好的片段接着做成更长的序列
  • 你需要用同一个模型输出竖屏和横屏

什么时候选 MiniMax H3

  • 你手里有分镜脚本,想固定每个镜头的开头和结尾
  • 你用多张参考图、视频片段或音频片段来引导镜头
  • 你以最高分辨率档位交付,更看重清晰度而不是片段长度

差异在哪

方面Veo 3.1MiniMax H3
声音Google 介绍 Veo 3.1 能同时生成音频和视频,包括语音和环境声。MiniMax 文档里的音频片段是用来引导镜头的参考,而不是模型替你生成的声轨。
接续镜头视频续写可以让一个已完成的片段在第二次生成中继续。未列出续写步骤;更长的内容要靠规划帧相衔接的多个独立镜头。
帧控制首尾帧可以固定,参考图能让主体保持稳定。首尾帧和参考素材是独立的模式,每次请求只能选一种。
参考输入参考图可以在镜头之间保持角色、产品或场景一致。参考可以是图像、短视频和音频片段,引导动作和声音的方式更多。
输出格式提供竖屏和横屏画面。提供宽屏,或根据输入自适应比例。

摘要

  • Veo 3.1: $0.28-$0.42 每秒; MiniMax H3: $0.08-$0.13 每秒. 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
Veo 3.1
Veo 3
查看详情
MiniMax H3
Hailuo
查看详情

FAQ

做带对白的广告,Veo 3.1 和 Hailuo H3 哪个更好?

Veo 3.1。Google 把台词、环境声和音效都放进了生成里,所以带人物说话的场景后期步骤更少。Hailuo H3 可以把音频作为参考,但它的文档没有说明它能自己生成对白。

能不改提示词把 Hailuo H3 换成 Veo 3.1 吗?

不能直接换。Hailuo H3 的提示词依赖首尾帧和参考文件,而 Veo 3.1 的提示词还可以描述声音。预计要重写镜头描述,并重新检查画幅选项。

做分镜工作哪个更合适?

Hailuo H3。固定镜头的首尾帧适合分镜,Veo 3.1 的首尾帧输入也同样适合;还需要混合参考或最高分辨率档位时,选 Hailuo H3。

Veo 3.1 和 MiniMax H3 哪个更便宜?

Veo 3.1: $0.28-$0.42 每秒; MiniMax H3: $0.08-$0.13 每秒. 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

Veo 3.1 和 MiniMax H3 的主要区别是什么?

Veo 3.1:视频续写. MiniMax H3:多模态

资料来源

审阅于 2026年10月2日