xAI: Grok 4.20 Non-Reasoning
grok-4.20-non-reasoning- 输入 / 输出-50%
- $1.25 / $2.50$0.625 / $1.25
- 上下文
- 1M
- 最大输出
- 128K
- 模态
- 视觉聊天
- 能力
- 工具调用提示词缓存
Grok 4.20 Non-Reasoning 简介
Grok 4.20 Non-Reasoning 是 xAI 4.20 模型的直接回答版本。它跳过了延长的思考阶段,所以对文本和图像提示回复很快,适合起草、信息抽取和工具辅助的聊天。xAI 称它兼顾严格的提示词遵循和较低的幻觉率。问题需要深思熟虑的分析时,请选推理版或多智能体版。
擅长的任务
- 不经过单独的思考阶段直接回复,交互式聊天和大批量任务的延迟都较低。
- xAI 强调该模型严格遵循提示词、幻觉率低,输出必须符合模板时很有用。
- 支持函数调用和结构化 JSON 输出,适合信息抽取流水线和工具驱动的助手。
- 接受图像和文本,能一步读取收据或截图并作答。
- 许多请求复用同一段长指令或参考文本时,提示词缓存会有帮助。
什么情况换别的模型
- 没有推理步骤,在多阶段逻辑或数学上比 grok-4.20 或 grok-4.7 弱。
- 它不会把工作拆给多个智能体;开放式研究更适合多智能体变体。
- 只输出文本,不生成图像、音频或视频。
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
文本生成Responses APIPOST/v1/responsesAPI 格式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "grok-4.20-non-reasoning", "input": "Hello!" }'
价格
官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。
默认规格
每 1M token- 官方价格
- 输入 $1.25 / 输出 $2.50 / 缓存读取 $0.20
- TokenLab 价格
- 输入 $0.625 / 输出 $1.25 / 缓存读取 $0.10
- 折扣
- -50%
缓存读取
- 官方价格
- $0.20
- TokenLab 价格
- $0.10
- 折扣
- -50%
| 官方价格每 1M token | TokenLab 价格每 1M token | 折扣 | |
|---|---|---|---|
| 默认规格 | 输入 $1.25 / 输出 $2.50 / 缓存读取 $0.20 | 输入 $0.625 / 输出 $1.25 / 缓存读取 $0.10 | -50% |
| 提示词缓存价格 | |||
| 缓存读取 | $0.20 | $0.10 | -50% |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时- 请求
- 成功率
- P95 延迟
- 总 token 数
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
Grok 4.20 Non-Reasoning 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 grok-4.20-non-reasoning 发一条简短消息,接口是 /v1/responses。返回回复,附上延迟和费用。
使用场景
适用场景- 视觉
面向客户的聊天
用一致的语气回答产品和账户问题,必要时调用查询函数,不让客户等很长的思考阶段。
批量文档信息抽取
把成千上万份合同、表单或邮件按固定的 JSON schema 处理,靠严格遵循指令保持字段一致。
起草与改写
按要求的格式写出邮件、摘要和发布说明的初稿,再用简短的后续指令润色。
提示词示例
用三个要点和一条建议回复总结这个客服对话。回复不超过 80 个字,不要承诺退款。
把这份合同里的当事方名称、生效日期和终止通知期,按下面的 JSON schema 抽取出来。缺失的内容返回 null。
把这份更新日志改写给非技术客户看。保留标题,去掉内部工单号,用平实的句子。
此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。
FAQ
Grok 4.20 Non-Reasoning 是什么?
它是 xAI Grok 4.20 的版本,直接回答而不先思考。它读取文本和图像,输出文本,支持函数调用和结构化输出。面向快速、指令密集的工作,例如信息抽取、起草和工具辅助的聊天。
什么时候用 non-reasoning,而不是 grok-4.20?
任务清晰、答案主要靠回忆、改写或排版时用它。它比带推理的 ID 响应更快。答案需要几步分析时,例如调试或规划,就换成 grok-4.20。
Grok 4.20 Non-Reasoning 遵循 JSON schema 吗?
遵循。它支持结构化输出,你可以提供 schema,得到符合它的响应。再加上 xAI 强调的严格提示词遵循,它是信息抽取和分类任务一个合理的默认选择。
它能接受图像输入吗?
能,图像可以和文本一起发送,例如拍下来的表单或界面截图。回复是文本。该模型不能创建或编辑图像。
它能配合现有的 OpenAI 风格客户端使用吗?
能。现有的 OpenAI 风格客户端代码只需改模型名即可,工具定义和 JSON schema 照常放在原来的字段里。
Grok 4.20 Non-Reasoning 的费用是多少?
在 TokenLab 上,Grok 4.20 Non-Reasoning 的价格为 输入 $0.625 / 输出 $1.25 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
Grok 4.20 Non-Reasoning 的上下文窗口和输出上限是多少?
Grok 4.20 Non-Reasoning 最多接收 1,000,000 token 的上下文,单次最多返回 131,072 token。
Grok 4.20 Non-Reasoning 应该使用哪个端点?
Grok 4.20 Non-Reasoning 使用 https://api.tokenlab.sh/v1/responses。代码写法见下方的请求示例。
Grok 4.20 Non-Reasoning 支持哪些操作?
Grok 4.20 Non-Reasoning 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。
Grok 4.20 Non-Reasoning 对比
资料来源
审阅于 2026年10月2日