- 输入 / 输出-50%
- $1.25 / $2.50$0.625 / $1.25
- 上下文
- 1M
- 最大输出
- 128K
- 模态
- 视觉聊天
- 能力
- 工具调用提示词缓存推理
Grok 4.3 简介
Grok 4.3 是 xAI 的聊天模型,xAI 称它快速可靠,工具调用和指令遵循能力强。它读取文本和图像,输出文本,保持与 4.20 系列相同的百万 token 级上下文。推理强度可从 none 调到 xhigh,所以同一个模型 ID 既能快速回复,也能应对更难的问题。
擅长的任务
- 推理强度从 none 到 xhigh,可以按请求在速度和深度之间取舍,不必换模型。
- xAI 把它定位在可靠的工具调用和指令遵循上,适合必须遵守固定流程的智能体。
- 支持函数调用和结构化输出,适合需要机器可读回复的集成。
- 接受图像和文本,一次请求就能同时包含截图和文字问题。
- 反复使用很长的系统提示词或文档时,提示词缓存可以降低重复成本。
什么情况换别的模型
- Grok 4.5 到 4.7 是更新的版本,面向编程和智能体式软件工作;这个是较老的通用选择。
- 低强度下思考很少,难题需要更高的设置,或换更强的模型。
- 输出仅限文本;生成图像和音频需要另外的模型。
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
文本生成Responses APIPOST/v1/responsesAPI 格式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "grok-4.3", "input": "Hello!" }'
价格
官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。
默认规格
每 1M token- 官方价格
- 输入 $1.25 / 输出 $2.50 / 缓存读取 $0.20
- TokenLab 价格
- 输入 $0.625 / 输出 $1.25 / 缓存读取 $0.10
- 折扣
- -50%
缓存读取
- 官方价格
- $0.20
- TokenLab 价格
- $0.10
- 折扣
- -50%
| 官方价格每 1M token | TokenLab 价格每 1M token | 折扣 | |
|---|---|---|---|
| 默认规格 | 输入 $1.25 / 输出 $2.50 / 缓存读取 $0.20 | 输入 $0.625 / 输出 $1.25 / 缓存读取 $0.10 | -50% |
| 提示词缓存价格 | |||
| 缓存读取 | $0.20 | $0.10 | -50% |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时- 请求
- 成功率
- P95 延迟
- 总 token 数
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
Grok 4.3 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 grok-4.3 发一条简短消息,接口是 /v1/responses。返回回复,附上延迟和费用。
使用场景
适用场景- 推理
- 视觉
通用助手
用一个模型支撑聊天功能:简单问题快速回答,较难的问题可以加大推理强度。
受指令约束的智能体
运行有固定流程和多个工具的工作流,例如工单分流,模型必须严格按步骤执行并调用正确的函数。
长文档问答
把大批手册或报告装进提示词,跨文档提问,用缓存的前缀降低重复查询的成本。
提示词示例
严格遵守这五条分流规则。对下面每张工单,调用 set_priority 和 assign_team,再用一句话给出理由。
根据附上的手册,说明故障后怎么重置控制器,并引用你用到的章节。
把这条评价归类为缺陷、功能需求或表扬。以 JSON 回复,包含 label 和 0 到 1 之间的 confidence。
此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。
FAQ
Grok 4.3 是为什么设计的?
xAI 称它是快速可靠的模型,工具调用和指令遵循能力强。适合必须遵守流程、调用函数并返回结构化答案的助手和智能体,输入可以是文本和图像。
Grok 4.3 支持推理吗?
支持,推理强度可调,档位有 none、low、medium、high 和 xhigh。xAI 的默认是 low。问题较难时调高,想要最快回复时设为 none。
Grok 4.3 和 Grok 4.20 比起来怎么样?
两者都有很长的上下文,输入类型相近。Grok 4.3 在一个 ID 里提供更细的推理强度控制,而 4.20 拆成了推理、不推理和多智能体三个模型。请用自己的提示词分别测试。
Grok 4.3 能处理图像吗?
能。它接受图像和文本,如图表和截图,以文本回答。它不生成图像。这对关于截图或拍下来的页面的提问很方便,答案以普通文本返回。
Grok 4.3 适合写代码吗?
日常的代码问题和工具驱动的修改都能应付。对要求较高的软件工程和长时间的智能体运行,xAI 较新的 Grok 4.5、4.6 和 4.7 更直接地面向编程和智能体任务。
Grok 4.3 的费用是多少?
在 TokenLab 上,Grok 4.3 的价格为 输入 $0.625 / 输出 $1.25 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
Grok 4.3 的上下文窗口和输出上限是多少?
Grok 4.3 最多接收 1,000,000 token 的上下文,单次最多返回 131,072 token。
Grok 4.3 应该使用哪个端点?
Grok 4.3 使用 https://api.tokenlab.sh/v1/responses。代码写法见下方的请求示例。
Grok 4.3 支持哪些操作?
Grok 4.3 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。
Grok 4.3 对比
资料来源
审阅于 2026年10月2日