每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

xAI: Grok 4.6

Grok 4.6 可处理文字和图片,支持工具调用及长上下文,适合把参考文档、截图放在同一对话中完成分析、写作或软件辅助任务。
对比模型
grok-4.6
可用xAI聊天缓存输入便宜 75%
输入 / 输出-50%
$2.00 / $6.00$1.00 / $3.00
上下文
500K
发布日期
2026年8月12日
最大输出
128K
模态
视觉聊天
能力
工具调用提示词缓存

Grok 4.6 简介

Grok 4.6 是 xAI 面向编程、智能体工作和知识密集型任务的模型,发布于 Grok 4.5 与 4.7 之间。它读取文本和图像,输出文本,推理强度从 low 到 xhigh,默认 high。团队用它把参考文档和截图放进同一个工作对话,用于分析、写作或软件方面的帮助。

擅长的任务

  • 在同一个对话里处理文档和截图,带图片的缺陷报告不需要另做预处理。
  • 推理强度有四档,从 low 到 xhigh,默认 high,适合较难的问题。
  • 函数调用和结构化输出使它可以作为使用工具的助手的引擎。
  • 既面向知识工作也面向代码,适合分析和长篇写作任务。
  • 整个会话里反复使用大量参考资料时,提示词缓存有帮助。

什么情况换别的模型

  • Grok 4.7 随后成为 xAI 的旗舰,所以 4.6 主要适合已在其上验证过的提示词。
  • 它输出文本;生成图像或音频需要其他模型。
  • 高推理设置会拉长响应,对延迟敏感的聊天用较低强度或不推理的模型可能更好。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    文本生成Responses API
    POST/v1/responses
    API 格式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "grok-4.6",
        "input": "Hello!"
      }'

价格

官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。

输入 token <= 200K

每 1M token
官方价格
输入 $2.00 / 输出 $6.00 / 缓存读取 $0.50
TokenLab 价格
输入 $1.00 / 输出 $3.00 / 缓存读取 $0.25
折扣
-50%

输入 token 200K-500K

每 1M token
官方价格
输入 $4.00 / 输出 $12.00 / 缓存读取 $1.00
TokenLab 价格
输入 $2.00 / 输出 $6.00 / 缓存读取 $0.50
折扣
-50%
提示词缓存价格

缓存读取

官方价格
$0.50
TokenLab 价格
$0.25
折扣
-50%

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Grok 4.6 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 grok-4.6 发一条简短消息,接口是 /v1/responses。返回回复,附上延迟和费用。

使用场景

适用场景
  • 视觉
  • 带图表的文档分析

    把报告连同其中的图表图像一起上传,询问正文叙述与图中数字之间有哪些不一致。

  • 软件辅助

    根据日志和报错截图诊断失败的构建,提出补丁,并用通俗的话解释改动。

  • 知识工作起草

    把一堆会议记录和参考资料整理成结构化的简报,让每个论断都有所提供的来源可依。

提示词示例

下面是季度报告正文和营收图表。告诉我文字中的说法哪里与图表不符。

这份 CI 日志和截图显示的是同一个失败。解释可能的原因,并给出最小的补丁。

把附上的笔记整理成给新员工的一页简报。凡是只有一条笔记支持的说法,都做上标记。

此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。

FAQ

Grok 4.6 用来做什么?

xAI 为编程、智能体任务和知识工作打造了它。它接受文本和图像,能调用工具、返回结构化输出,推理强度可调。典型用途是代码辅助,以及分析带图表的文档。

Grok 4.6 有哪些推理设置?

推理强度可以是 low、medium、high 或 xhigh,默认 high。快速回合选较低档,需要准确性的调试、规划或分析选较高档。

Grok 4.6 接受图像输入吗?

接受。输入可以是文本和图像,回复是文本。这样一次请求里就能同时放下文档和你所问对象的截图。

Grok 4.6 和 Grok 4.7 有什么区别?

两者输入类型、工具支持和强度档位相同。Grok 4.7 是之后的版本,也是 xAI 推荐的前沿模型。如果你已经调好提示词并验证过结果,可以继续用 4.6。

能从 Grok 4.6 得到 JSON 吗?

能。它支持结构化输出,可以传入 schema 并得到与之匹配的响应。在基于工具的工作流中,这可以和函数调用配合使用。

Grok 4.6 的费用是多少?

在 TokenLab 上,Grok 4.6 的价格为 输入 $1.00 / 输出 $3.00 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

Grok 4.6 的上下文窗口和输出上限是多少?

Grok 4.6 最多接收 500,000 token 的上下文,单次最多返回 131,072 token。

Grok 4.6 应该使用哪个端点?

Grok 4.6 使用 https://api.tokenlab.sh/v1/responses。代码写法见下方的请求示例。

Grok 4.6 支持哪些操作?

Grok 4.6 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。

Grok 4.6 对比

资料来源

审阅于 2026年10月2日

更多 Grok 4 模型

相关模型