每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

xAI: Grok Imagine Video

Grok Imagine Video 支持短视频生成、编辑和续写,可从文字、参考图片或已有视频出发,在多个制作步骤中持续完善动态创意。
对比模型
grok-imagine-video
可用xAI视频异步
价格
起 $0.025
模态
视频

Grok Imagine Video 简介

Grok Imagine Video 是 xAI 原版的 Imagine 视频模型,用于创建、编辑和延长短视频。它接受文字、起始图片、参考图或现有素材,所以一个创意可以经过多个制作步骤。与以图片为输入的 1.5 版本相比,这个模型涵盖文字、参考、编辑和延长的全部任务。

擅长的任务

  • 支持文生视频、图生视频和参考图生视频,起始材料可以是文字、静态图或风格参考。
  • 可以通过视频到视频,用文字指令编辑现有素材。
  • 视频延长从片段结束的地方继续,让你分步骤做出更长的序列。
  • 片段 1 到 15 秒,分辨率 480p 或 720p。
  • 七种宽高比涵盖方形、横屏和竖屏交付。

什么情况换别的模型

  • 分辨率最高 720p,最终的广播级作品需要放大或使用其他模型。
  • 片段较短,较长的作品需要延长步骤和细心的连贯性处理。
  • 长片段里动作和物理细节可能漂移,短镜头最能保持一致。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    图生视频参考图生视频文生视频视频续写视频转视频TokenLab 端点
    POST/v1/videos/generations
    curl -X POST "https://api.tokenlab.sh/v1/videos/generations" \
      -H "Authorization: Bearer sk-xxx" \
      -H "Content-Type: application/json" \
      -d '{
      "aspect_ratio": "16:9",
      "duration": 5,
      "operation": "text-to-video",
      "resolution": "720p",
      "model": "grok-imagine-video",
      "prompt": "Cinematic sunrise over a calm lake with gentle camera motion."
    }'

价格

官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。

  • 图生视频TokenLab Verified, Official
  • 参考图生视频Official
  • 文生视频TokenLab Verified, Official
  • 视频续写TokenLab Verified
  • 视频转视频Official

价格

每秒
TokenLab 价格
计价方式
官方价格
计价方式

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Grok Imagine Video 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 grok-imagine-video 完成一次 text-to-video,接口是 /v1/videos/generations。返回结果、状态和费用。

使用场景

适用场景
  • 文生视频
  • 产品预告

    把产品主图做成一段短循环,社交媒体帖子可选竖版或方形构图。

  • 参考图引导的场景

    提供角色或风格图片和一条提示词,生成一个参照这些参考、又不锁定第一帧的片段。

  • 编辑并延长素材

    用文字指令改变片段的风格或内容,再把最后一刻延长成更长的镜头。

提示词示例

一只纸船顺着积满雨水的水沟漂流,镜头低位跟随,柔和的灰色光线,六秒。

根据附上的角色图片,展示她走过夜市,手持镜头,霓虹灯倒影。

把这个片段延长五秒:无人机继续上升,露出整段海岸线。

FAQ

Grok Imagine Video 能做什么?

它可以根据文字、一张图片或参考图创建短片,用文字指令编辑现有视频,并把片段延长到最后一帧之后。时长 1 到 15 秒。

有哪些分辨率和宽高比?

输出可以是 480p 或 720p,宽高比有方形、3:2、2:3、4:3、3:4、16:9 或 9:16。选与投放位置相符的比例,例如竖屏信息流选 9:16。

它和 grok-imagine-video-1.5 有什么区别?

这个模型涵盖文字、参考、编辑和延长任务。1.5 模型接受一张起始图片并让它动起来。从文字、参考图或现有素材开始时,用这一个。

它能延长我已有的视频吗?

能。延长从片段的最后一刻继续,所以你可以串联多个步骤,做出更长的镜头。每一步之间要检查连贯性,因为动作和细节可能会漂移。

需要输入图片吗?

不需要。只用文字就可以开始。只有想固定开场画面的外观时,才需要再加图片或参考图。想让创意保持开放时,可以都不加。

Grok Imagine Video 的费用是多少?

在 TokenLab 上,Grok Imagine Video 的价格为 计价方式 。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

Grok Imagine Video 应该使用哪个端点?

Grok Imagine Video 使用 https://api.tokenlab.sh/v1/videos/generations。代码写法见下方的请求示例。

Grok Imagine Video 支持哪些操作?

Grok Imagine Video 支持 图生视频, 参考图生视频, 文生视频, 视频续写, 视频转视频。选了操作,上面会显示对应的端点和请求示例。

Grok Imagine Video 对比

用到 Grok Imagine Video 的指南

资料来源

审阅于 2026年10月2日

更多 Grok Imagine 模型

相关模型