每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

MiniMax: MiniMax H3

Hailuo H3 可根据文字、静态图片或视觉参考生成视频,首尾帧有助于明确镜头走向,适合把分镜概念转为短动态片段。
对比模型
hailuo-h3
可用MiniMax视频异步
价格
起 $0.08
模态
视频

MiniMax H3 简介

MiniMax H3,也叫 Hailuo H3,是 MiniMax 的通用多模态视频模型,也是 Hailuo 2.3 的后继者。它可以根据文字、一张静态图、一对首尾帧,或一组参考图片、视频和音频片段生成视频。它提供 768p 和 2K 两档分辨率,是 H3 系列中较高的范围,这使它区别于偏重速度的 H3-Max。

擅长的任务

  • 首尾帧生成固定了镜头的开始和结束方式,把分镜变成动态时很有帮助。
  • 参考生成接受图片、短视频片段和音频片段,作为主体、动作和声音的引导。
  • 分辨率可选 768p 和 2K,其中 2K 高于最高只到 768p 的 H3-Max。
  • 支持文生视频和图生视频,所以一个模型既能做纯提示词的工作,也能做基于静态图的工作。
  • 片段时长为 6 秒或 10 秒,足够拍一个有头有尾的镜头。

什么情况换别的模型

  • 参考模式和首尾帧模式不能在同一次请求里组合,所以每次生成需要二选一。
  • 需要在较低分辨率下快速迭代时,MiniMax 把 H3-Max 定位为更快的变体。
  • 宽高比只限 16:9 和自适应,其他固定比例无法选择。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    图生视频参考图生视频首尾帧视频文生视频TokenLab 端点
    POST/v1/videos/generations
    curl -X POST "https://api.tokenlab.sh/v1/videos/generations" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "aspect_ratio": "16:9",
      "duration": 6,
      "operation": "text-to-video",
      "resolution": "768p",
      "model": "hailuo-h3",
      "prompt": "Cinematic sunrise over a calm lake with gentle camera motion."
    }'

价格

TokenLab 价格用于 Verified,多数模型更便宜;官方价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。

  • 图生视频Official
  • 参考图生视频Official
  • 首尾帧视频Official
  • 文生视频Verified, Official

文生视频 · 768p

每秒
官方价格
$0.08
TokenLab 价格
$0.08
折扣
—

图生视频 / 首尾帧视频 / 参考图生视频 · 768p

每秒
官方价格
$0.08
TokenLab 价格
—
折扣
—

文生视频 · 2k

每秒
官方价格
$0.13
TokenLab 价格
$0.13
折扣
—

图生视频 / 首尾帧视频 / 参考图生视频 · 2k

每秒
官方价格
$0.13
TokenLab 价格
—
折扣
—

参考图生视频 · 图片输入 · 前 5 张图片免费

每秒
官方价格
$0.04/张图片
TokenLab 价格
—
折扣
—

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

MiniMax H3 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 hailuo-h3 完成一次 text-to-video,接口是 /v1/videos/generations。返回结果、状态和费用。

使用场景

适用场景
  • 多模态
  • 文生视频
  • 从分镜到镜头

    给出首帧、尾帧和一条描述两者之间运动的提示词,得到一个落在预定最终构图上的动态测试。

  • 角色一致的片段

    提供角色或产品的参考图,把它们放进多个片段中的新场景里。

  • 感知声音的场景

    加入一段音频作为参考,引导生成镜头的节奏或氛围。

  • 高分辨率主视觉镜头

    以 2K 渲染一个关键镜头,用于网站头图或影片样片。

提示词示例

从关着的门开始,到敞开的门结束,光线涌入;缓慢向前推轨,积满灰尘的走廊。

用这张红色运动鞋的参考照片,展示它在摄影棚灯光下,在混凝土底座上旋转。

夜晚的纸灯笼节,镜头从人群上方升起,温暖的光倒映在河面上。

FAQ

MiniMax H3 和 Hailuo 2.3 有什么不同?

H3 是较新的多模态一代。除了文字和单张图片输入,它还接受首尾帧,以及参考图片、视频和音频,并且可达 2K。Hailuo 2.3 只接受一条提示词和一张图片。

我可以同时设置首帧和尾帧吗?

可以。提供一张起始图和一张结束图,模型会在两者之间生成动画。MiniMax 的文档把这当作与参考生成不同的另一种模式。

H3 能使用哪些参考素材?

根据 MiniMax 文档,最多九张图片、三段视频和三段音频,视频和音频的片段总时长各以十五秒为上限。

它提供哪些分辨率?

据 MiniMax 文档是 768p 和 2K。H3-Max 变体用最高分辨率换速度,提供的是 480p 和 768p,没有更大的尺寸。

片段有多长?

6 秒或 10 秒。单个动作或产品亮相选 6 秒;镜头需要运镜或场景内有变化时选 10 秒。更长的段落可以分几段生成,再在剪辑软件里拼接。

MiniMax H3 的费用是多少?

在 TokenLab 上,MiniMax H3 的价格为 $0.08-$0.13 每秒。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

MiniMax H3 应该使用哪个端点?

MiniMax H3 使用 https://api.tokenlab.sh/v1/videos/generations。代码写法见下方的请求示例。

MiniMax H3 支持哪些操作?

MiniMax H3 支持 图生视频, 参考图生视频, 首尾帧视频, 文生视频。选了操作,上面会显示对应的端点和请求示例。

MiniMax H3 对比

资料来源

审阅于 2026年10月2日

更多 Hailuo 模型

相关模型