每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

xAI: Grok 4.5

xAI 的 Grok 模型,面向对话、编程、智能体工具调用,幻觉风险更低
对比模型
grok-4.5
可用xAI聊天缓存输入便宜 75%
输入 / 输出-50%
$2.00 / $6.00$1.00 / $3.00
上下文
500K
发布日期
2026年7月8日
最大输出
128K
模态
视觉聊天
能力
工具调用提示词缓存推理

Grok 4.5 简介

Grok 4.5 是 xAI 面向智能体式软件、工程和工作流任务的模型,训练时侧重科学、数学和工程材料。它接受文本和图像,输出文本,推理强度有四档可调,默认 high。它的位置在 Grok 4.3 与之后的 4.6、4.7 之间,上下文窗口比 4.3 小。

擅长的任务

  • 训练侧重科学、数学和工程数据,处理技术推理问题是合理的选择。
  • 四档推理强度,从 low 到 xhigh,每次请求都可以在深度和延迟之间调节。
  • 函数调用和结构化输出支持修改代码或驱动内部工具的智能体。
  • 可以连同文字一起读取截图和图表,有助于处理界面缺陷和技术图示。
  • 提示词缓存适合反复发送同一份仓库上下文的编程会话。

什么情况换别的模型

  • 上下文窗口比 Grok 4.3 和 4.20 系列小,非常大的语料可能放不下。
  • Grok 4.6 和 4.7 是之后的版本;4.7 是 xAI 当前推荐的编程模型。
  • 只输出文本,不生成图像、音频或视频。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    文本生成Responses API
    POST/v1/responses
    API 格式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "grok-4.5",
        "input": "Hello!"
      }'

价格

官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。

默认规格

每 1M token
官方价格
输入 $2.00 / 输出 $6.00 / 缓存读取 $0.50
TokenLab 价格
输入 $1.00 / 输出 $3.00 / 缓存读取 $0.25
折扣
-50%
提示词缓存价格

缓存读取

官方价格
$0.50
TokenLab 价格
$0.25
折扣
-50%

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Grok 4.5 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 grok-4.5 发一条简短消息,接口是 /v1/responses。返回回复,附上延迟和费用。

使用场景

适用场景
  • 推理
  • 视觉
  • 编程智能体

    规划一次改动,通过工具调用编辑文件、运行检查并修订;棘手的重构调高推理强度,日常修复调低。

  • 技术问题求解

    解决中间步骤很重要、答案需要可验证的物理、数学或工程问题。

  • 工作流自动化

    在内部系统之间串联工具调用,例如读取工单、查询数据库、起草回复,步骤之间用结构化输出衔接。

提示词示例

阅读堆栈跟踪和下面两个文件。找出根本原因,修好它,并说明哪个测试本来可以发现这个问题。

推导阻尼振子振幅降到 5% 以下所需时间的闭式解,并写出每一步。

根据这张工单,先调用 lookup_account,再起草回复。如果数据与客户的说法冲突,回复前先指出来。

此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。

FAQ

Grok 4.5 最擅长什么?

xAI 把它定位于智能体式软件、工程和工作流任务,并称训练时侧重科学、数学和工程数据。它更适合编程智能体和技术推理,而不是闲聊。

Grok 4.5 提供哪些推理档位?

有四档:low、medium、high 和 xhigh,默认 high。档位越高,模型回答前思考的空间越大,代价是回复更长、token 更多。

Grok 4.5 接受图像输入吗?

接受。输入可以是文本和图像,返回文本,所以提问时可以附上报错截图或示意图。

该用 Grok 4.5 还是 Grok 4.7?

Grok 4.7 是之后的版本,也是 xAI 推荐的能力最强的模型。如果你的提示词已经针对 4.5 调好、质量够用,就选 4.5,并用自己的任务样本比较两者。

它支持函数调用吗?

支持,同时支持结构化输出。你在请求里定义函数或 JSON schema,模型就可以调用这些函数,或按该结构返回数据。

Grok 4.5 的费用是多少?

在 TokenLab 上,Grok 4.5 的价格为 输入 $1.00 / 输出 $3.00 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

Grok 4.5 的上下文窗口和输出上限是多少?

Grok 4.5 最多接收 500,000 token 的上下文,单次最多返回 131,072 token。

Grok 4.5 应该使用哪个端点?

Grok 4.5 使用 https://api.tokenlab.sh/v1/responses。代码写法见下方的请求示例。

Grok 4.5 支持哪些操作?

Grok 4.5 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。

Grok 4.5 对比

资料来源

审阅于 2026年10月2日

更多 Grok 4 模型

相关模型