xAI: Grok 4.6
grok-4.6- 输入 / 输出-50%
- $2.00 / $6.00$1.00 / $3.00
- 上下文
- 500K
- 发布日期
- 2026年8月12日
- 最大输出
- 128K
- 模态
- 视觉聊天
- 能力
- 工具调用提示词缓存
Grok 4.6 简介
Grok 4.6 是 xAI 面向编程、智能体工作和知识密集型任务的模型,发布于 Grok 4.5 与 4.7 之间。它读取文本和图像,输出文本,推理强度从 low 到 xhigh,默认 high。团队用它把参考文档和截图放进同一个工作对话,用于分析、写作或软件方面的帮助。
擅长的任务
- 在同一个对话里处理文档和截图,带图片的缺陷报告不需要另做预处理。
- 推理强度有四档,从 low 到 xhigh,默认 high,适合较难的问题。
- 函数调用和结构化输出使它可以作为使用工具的助手的引擎。
- 既面向知识工作也面向代码,适合分析和长篇写作任务。
- 整个会话里反复使用大量参考资料时,提示词缓存有帮助。
什么情况换别的模型
- Grok 4.7 随后成为 xAI 的旗舰,所以 4.6 主要适合已在其上验证过的提示词。
- 它输出文本;生成图像或音频需要其他模型。
- 高推理设置会拉长响应,对延迟敏感的聊天用较低强度或不推理的模型可能更好。
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
文本生成Responses APIPOST/v1/responsesAPI 格式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "grok-4.6", "input": "Hello!" }'
价格
官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。
输入 token <= 200K
每 1M token- 官方价格
- 输入 $2.00 / 输出 $6.00 / 缓存读取 $0.50
- TokenLab 价格
- 输入 $1.00 / 输出 $3.00 / 缓存读取 $0.25
- 折扣
- -50%
输入 token 200K-500K
每 1M token- 官方价格
- 输入 $4.00 / 输出 $12.00 / 缓存读取 $1.00
- TokenLab 价格
- 输入 $2.00 / 输出 $6.00 / 缓存读取 $0.50
- 折扣
- -50%
缓存读取
- 官方价格
- $0.50
- TokenLab 价格
- $0.25
- 折扣
- -50%
| 官方价格每 1M token | TokenLab 价格每 1M token | 折扣 | |
|---|---|---|---|
| 输入 token <= 200K | 输入 $2.00 / 输出 $6.00 / 缓存读取 $0.50 | 输入 $1.00 / 输出 $3.00 / 缓存读取 $0.25 | -50% |
| 输入 token 200K-500K | 输入 $4.00 / 输出 $12.00 / 缓存读取 $1.00 | 输入 $2.00 / 输出 $6.00 / 缓存读取 $0.50 | -50% |
| 提示词缓存价格 | |||
| 缓存读取 | $0.50 | $0.25 | -50% |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时- 请求
- 成功率
- P95 延迟
- 总 token 数
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
Grok 4.6 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 grok-4.6 发一条简短消息,接口是 /v1/responses。返回回复,附上延迟和费用。
使用场景
适用场景- 视觉
带图表的文档分析
把报告连同其中的图表图像一起上传,询问正文叙述与图中数字之间有哪些不一致。
软件辅助
根据日志和报错截图诊断失败的构建,提出补丁,并用通俗的话解释改动。
知识工作起草
把一堆会议记录和参考资料整理成结构化的简报,让每个论断都有所提供的来源可依。
提示词示例
下面是季度报告正文和营收图表。告诉我文字中的说法哪里与图表不符。
这份 CI 日志和截图显示的是同一个失败。解释可能的原因,并给出最小的补丁。
把附上的笔记整理成给新员工的一页简报。凡是只有一条笔记支持的说法,都做上标记。
此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。
FAQ
Grok 4.6 用来做什么?
xAI 为编程、智能体任务和知识工作打造了它。它接受文本和图像,能调用工具、返回结构化输出,推理强度可调。典型用途是代码辅助,以及分析带图表的文档。
Grok 4.6 有哪些推理设置?
推理强度可以是 low、medium、high 或 xhigh,默认 high。快速回合选较低档,需要准确性的调试、规划或分析选较高档。
Grok 4.6 接受图像输入吗?
接受。输入可以是文本和图像,回复是文本。这样一次请求里就能同时放下文档和你所问对象的截图。
Grok 4.6 和 Grok 4.7 有什么区别?
两者输入类型、工具支持和强度档位相同。Grok 4.7 是之后的版本,也是 xAI 推荐的前沿模型。如果你已经调好提示词并验证过结果,可以继续用 4.6。
能从 Grok 4.6 得到 JSON 吗?
能。它支持结构化输出,可以传入 schema 并得到与之匹配的响应。在基于工具的工作流中,这可以和函数调用配合使用。
Grok 4.6 的费用是多少?
在 TokenLab 上,Grok 4.6 的价格为 输入 $1.00 / 输出 $3.00 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
Grok 4.6 的上下文窗口和输出上限是多少?
Grok 4.6 最多接收 500,000 token 的上下文,单次最多返回 131,072 token。
Grok 4.6 应该使用哪个端点?
Grok 4.6 使用 https://api.tokenlab.sh/v1/responses。代码写法见下方的请求示例。
Grok 4.6 支持哪些操作?
Grok 4.6 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。
Grok 4.6 对比
资料来源
审阅于 2026年10月2日