每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

xAI: Grok Imagine Video 1.5

视频模型,面向图生视频、视频编辑与视频延长工作流
对比模型
grok-imagine-video-1.5
可用xAI视频异步新发布
价格
起 $0.08
发布日期
2026年6月16日
模态
视频

Grok Imagine Video 1.5 简介

Grok Imagine Video 1.5 是 xAI 较新的 Imagine 视频模型,用于图生视频。它把你提供的静态图片变成最长 15 秒的片段,分辨率 480p 或 720p,可选多种宽高比。这张静态图决定开场画面的外观。已经有关键帧、需要让它动起来时用它。

擅长的任务

  • 让现有图片动起来,以你已经审核通过的构图作为起始帧。
  • 时长 1 到 15 秒,可适配短循环或较长的镜头。
  • 七种宽高比涵盖方形、横屏和竖屏发布。
  • 据 xAI 文档,是比原版 Imagine 视频模型更新的一代。
  • 提供 480p 和 720p,可以在更高分辨率渲染之前低成本测试。

什么情况换别的模型

  • 它只能从起始图片出发;要从纯文字开始或编辑素材,请用 grok-imagine-video。
  • 最高分辨率为 720p,大屏交付可能偏低。
  • 快速或复杂的运动可能使细节变形,请先用有代表性的图片测试。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    图生视频TokenLab 端点
    POST/v1/videos/generations
    curl -X POST "https://api.tokenlab.sh/v1/videos/generations" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "aspect_ratio": "16:9",
      "duration": 5,
      "operation": "image-to-video",
      "resolution": "720p",
      "model": "grok-imagine-video-1.5",
      "prompt": "Cinematic sunrise over a calm lake with gentle camera motion.",
      "image_url": "https://example.com/image.jpg"
    }'

价格

官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。

价格

每秒
Official
计价方式
官方价格
计价方式

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Grok Imagine Video 1.5 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 grok-imagine-video-1.5 完成一次 image-to-video,接口是 /v1/videos/generations。返回结果、状态和费用。

使用场景

  • 让主视觉动起来

    取一张海报、插画或产品渲染图,加上镜头运动或主体动作,做成短的社交媒体片段。

  • 从分镜到动态

    把审核通过的分镜画面变成动态预览,在正式投入制作前判断节奏。

  • 竖版广告

    用静态创意生成 9:16 的竖版片段,适配快拍和短视频信息流。

提示词示例

镜头缓缓推近灯笼,火星向上飘散,纸面闪烁,八秒。

模特转头看向窗户并微笑,光线在她脸上移动。

轻柔的视差效果:云在山脉上方移动,前景的草随风摆动。

FAQ

Grok Imagine Video 1.5 能做什么?

它接受一张起始图片加一条文字提示词,据此生成短视频。你可以选择最长 15 秒的时长、480p 或 720p,以及宽高比。

它和预览版有区别吗?

预览版是同一个 1.5 系列较早的测试版本,这个模型是正式版。两者都是让输入图片动起来,所以生产工作用这个,只有想对比时才用预览版。

可以只从文字开始吗?

1.5 模型从起始图片出发。需要从文字、参考图或现有素材开始时,grok-imagine-video 涵盖这些模式。这类起点请用那个模型。

有哪些宽高比?

方形、3:2、2:3、4:3、3:4、16:9 和 9:16。竖屏信息流选 9:16,横屏播放器选 16:9。方形适合许多社交媒体网格,按片段的展示位置来选。

一个片段最长多久?

1 到 15 秒。较短的片段更容易保持一致,所以很多用户会生成几个简短的镜头再剪到一起。之后再剪辑成更长的序列。

Grok Imagine Video 1.5 的费用是多少?

在 TokenLab 上,Grok Imagine Video 1.5 的价格为 计价方式 。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

Grok Imagine Video 1.5 应该使用哪个端点?

Grok Imagine Video 1.5 使用 https://api.tokenlab.sh/v1/videos/generations。代码写法见下方的请求示例。

Grok Imagine Video 1.5 支持哪些操作?

Grok Imagine Video 1.5 支持 图生视频。选了操作,上面会显示对应的端点和请求示例。

Grok Imagine Video 1.5 对比

用到 Grok Imagine Video 1.5 的指南

资料来源

审阅于 2026年10月2日

更多 Grok Imagine 模型

相关模型