每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

xAI: Grok 4.20 Non-Reasoning

Grok 4.20 Non-Reasoning 是 4.20 系列的直接回答版本,适合信息抽取、文稿起草和工具辅助对话等不以长时间推理为重点的任务。
对比模型
grok-4.20-non-reasoning
可用xAI聊天缓存输入便宜 84%
输入 / 输出-50%
$1.25 / $2.50$0.625 / $1.25
上下文
1M
最大输出
128K
模态
视觉聊天
能力
工具调用提示词缓存

Grok 4.20 Non-Reasoning 简介

Grok 4.20 Non-Reasoning 是 xAI 4.20 模型的直接回答版本。它跳过了延长的思考阶段,所以对文本和图像提示回复很快,适合起草、信息抽取和工具辅助的聊天。xAI 称它兼顾严格的提示词遵循和较低的幻觉率。问题需要深思熟虑的分析时,请选推理版或多智能体版。

擅长的任务

  • 不经过单独的思考阶段直接回复,交互式聊天和大批量任务的延迟都较低。
  • xAI 强调该模型严格遵循提示词、幻觉率低,输出必须符合模板时很有用。
  • 支持函数调用和结构化 JSON 输出,适合信息抽取流水线和工具驱动的助手。
  • 接受图像和文本,能一步读取收据或截图并作答。
  • 许多请求复用同一段长指令或参考文本时,提示词缓存会有帮助。

什么情况换别的模型

  • 没有推理步骤,在多阶段逻辑或数学上比 grok-4.20 或 grok-4.7 弱。
  • 它不会把工作拆给多个智能体;开放式研究更适合多智能体变体。
  • 只输出文本,不生成图像、音频或视频。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    文本生成Responses API
    POST/v1/responses
    API 格式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "grok-4.20-non-reasoning",
        "input": "Hello!"
      }'

价格

官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。

默认规格

每 1M token
官方价格
输入 $1.25 / 输出 $2.50 / 缓存读取 $0.20
TokenLab 价格
输入 $0.625 / 输出 $1.25 / 缓存读取 $0.10
折扣
-50%
提示词缓存价格

缓存读取

官方价格
$0.20
TokenLab 价格
$0.10
折扣
-50%

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Grok 4.20 Non-Reasoning 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 grok-4.20-non-reasoning 发一条简短消息,接口是 /v1/responses。返回回复,附上延迟和费用。

使用场景

适用场景
  • 视觉
  • 面向客户的聊天

    用一致的语气回答产品和账户问题,必要时调用查询函数,不让客户等很长的思考阶段。

  • 批量文档信息抽取

    把成千上万份合同、表单或邮件按固定的 JSON schema 处理,靠严格遵循指令保持字段一致。

  • 起草与改写

    按要求的格式写出邮件、摘要和发布说明的初稿,再用简短的后续指令润色。

提示词示例

用三个要点和一条建议回复总结这个客服对话。回复不超过 80 个字,不要承诺退款。

把这份合同里的当事方名称、生效日期和终止通知期,按下面的 JSON schema 抽取出来。缺失的内容返回 null。

把这份更新日志改写给非技术客户看。保留标题,去掉内部工单号,用平实的句子。

此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。

FAQ

Grok 4.20 Non-Reasoning 是什么?

它是 xAI Grok 4.20 的版本,直接回答而不先思考。它读取文本和图像,输出文本,支持函数调用和结构化输出。面向快速、指令密集的工作,例如信息抽取、起草和工具辅助的聊天。

什么时候用 non-reasoning,而不是 grok-4.20?

任务清晰、答案主要靠回忆、改写或排版时用它。它比带推理的 ID 响应更快。答案需要几步分析时,例如调试或规划,就换成 grok-4.20。

Grok 4.20 Non-Reasoning 遵循 JSON schema 吗?

遵循。它支持结构化输出,你可以提供 schema,得到符合它的响应。再加上 xAI 强调的严格提示词遵循,它是信息抽取和分类任务一个合理的默认选择。

它能接受图像输入吗?

能,图像可以和文本一起发送,例如拍下来的表单或界面截图。回复是文本。该模型不能创建或编辑图像。

它能配合现有的 OpenAI 风格客户端使用吗?

能。现有的 OpenAI 风格客户端代码只需改模型名即可,工具定义和 JSON schema 照常放在原来的字段里。

Grok 4.20 Non-Reasoning 的费用是多少?

在 TokenLab 上,Grok 4.20 Non-Reasoning 的价格为 输入 $0.625 / 输出 $1.25 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

Grok 4.20 Non-Reasoning 的上下文窗口和输出上限是多少?

Grok 4.20 Non-Reasoning 最多接收 1,000,000 token 的上下文,单次最多返回 131,072 token。

Grok 4.20 Non-Reasoning 应该使用哪个端点?

Grok 4.20 Non-Reasoning 使用 https://api.tokenlab.sh/v1/responses。代码写法见下方的请求示例。

Grok 4.20 Non-Reasoning 支持哪些操作?

Grok 4.20 Non-Reasoning 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。

Grok 4.20 Non-Reasoning 对比

资料来源

审阅于 2026年10月2日

更多 Grok 4 模型

相关模型