- 输入 / 输出-50%
- $2.00 / $6.00$1.00 / $3.00
- 上下文
- 500K
- 发布日期
- 2026年7月8日
- 最大输出
- 128K
- 模态
- 视觉聊天
- 能力
- 工具调用提示词缓存推理
Grok 4.5 简介
Grok 4.5 是 xAI 面向智能体式软件、工程和工作流任务的模型,训练时侧重科学、数学和工程材料。它接受文本和图像,输出文本,推理强度有四档可调,默认 high。它的位置在 Grok 4.3 与之后的 4.6、4.7 之间,上下文窗口比 4.3 小。
擅长的任务
- 训练侧重科学、数学和工程数据,处理技术推理问题是合理的选择。
- 四档推理强度,从 low 到 xhigh,每次请求都可以在深度和延迟之间调节。
- 函数调用和结构化输出支持修改代码或驱动内部工具的智能体。
- 可以连同文字一起读取截图和图表,有助于处理界面缺陷和技术图示。
- 提示词缓存适合反复发送同一份仓库上下文的编程会话。
什么情况换别的模型
- 上下文窗口比 Grok 4.3 和 4.20 系列小,非常大的语料可能放不下。
- Grok 4.6 和 4.7 是之后的版本;4.7 是 xAI 当前推荐的编程模型。
- 只输出文本,不生成图像、音频或视频。
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
文本生成Responses APIPOST/v1/responsesAPI 格式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "grok-4.5", "input": "Hello!" }'
价格
官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。
默认规格
每 1M token- 官方价格
- 输入 $2.00 / 输出 $6.00 / 缓存读取 $0.50
- TokenLab 价格
- 输入 $1.00 / 输出 $3.00 / 缓存读取 $0.25
- 折扣
- -50%
缓存读取
- 官方价格
- $0.50
- TokenLab 价格
- $0.25
- 折扣
- -50%
| 官方价格每 1M token | TokenLab 价格每 1M token | 折扣 | |
|---|---|---|---|
| 默认规格 | 输入 $2.00 / 输出 $6.00 / 缓存读取 $0.50 | 输入 $1.00 / 输出 $3.00 / 缓存读取 $0.25 | -50% |
| 提示词缓存价格 | |||
| 缓存读取 | $0.50 | $0.25 | -50% |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时- 请求
- 成功率
- P95 延迟
- 总 token 数
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
Grok 4.5 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 grok-4.5 发一条简短消息,接口是 /v1/responses。返回回复,附上延迟和费用。
使用场景
适用场景- 推理
- 视觉
编程智能体
规划一次改动,通过工具调用编辑文件、运行检查并修订;棘手的重构调高推理强度,日常修复调低。
技术问题求解
解决中间步骤很重要、答案需要可验证的物理、数学或工程问题。
工作流自动化
在内部系统之间串联工具调用,例如读取工单、查询数据库、起草回复,步骤之间用结构化输出衔接。
提示词示例
阅读堆栈跟踪和下面两个文件。找出根本原因,修好它,并说明哪个测试本来可以发现这个问题。
推导阻尼振子振幅降到 5% 以下所需时间的闭式解,并写出每一步。
根据这张工单,先调用 lookup_account,再起草回复。如果数据与客户的说法冲突,回复前先指出来。
此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。
FAQ
Grok 4.5 最擅长什么?
xAI 把它定位于智能体式软件、工程和工作流任务,并称训练时侧重科学、数学和工程数据。它更适合编程智能体和技术推理,而不是闲聊。
Grok 4.5 提供哪些推理档位?
有四档:low、medium、high 和 xhigh,默认 high。档位越高,模型回答前思考的空间越大,代价是回复更长、token 更多。
Grok 4.5 接受图像输入吗?
接受。输入可以是文本和图像,返回文本,所以提问时可以附上报错截图或示意图。
该用 Grok 4.5 还是 Grok 4.7?
Grok 4.7 是之后的版本,也是 xAI 推荐的能力最强的模型。如果你的提示词已经针对 4.5 调好、质量够用,就选 4.5,并用自己的任务样本比较两者。
它支持函数调用吗?
支持,同时支持结构化输出。你在请求里定义函数或 JSON schema,模型就可以调用这些函数,或按该结构返回数据。
Grok 4.5 的费用是多少?
在 TokenLab 上,Grok 4.5 的价格为 输入 $1.00 / 输出 $3.00 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
Grok 4.5 的上下文窗口和输出上限是多少?
Grok 4.5 最多接收 500,000 token 的上下文,单次最多返回 131,072 token。
Grok 4.5 应该使用哪个端点?
Grok 4.5 使用 https://api.tokenlab.sh/v1/responses。代码写法见下方的请求示例。
Grok 4.5 支持哪些操作?
Grok 4.5 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。
Grok 4.5 对比
资料来源
审阅于 2026年10月2日