每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

xAI: Grok 4.3

xAI 的 Grok,面向对话、编程、智能体工具调用,幻觉风险更低
对比模型
grok-4.3
可用xAI聊天缓存输入便宜 84%
输入 / 输出-50%
$1.25 / $2.50$0.625 / $1.25
上下文
1M
最大输出
128K
模态
视觉聊天
能力
工具调用提示词缓存推理

Grok 4.3 简介

Grok 4.3 是 xAI 的聊天模型,xAI 称它快速可靠,工具调用和指令遵循能力强。它读取文本和图像,输出文本,保持与 4.20 系列相同的百万 token 级上下文。推理强度可从 none 调到 xhigh,所以同一个模型 ID 既能快速回复,也能应对更难的问题。

擅长的任务

  • 推理强度从 none 到 xhigh,可以按请求在速度和深度之间取舍,不必换模型。
  • xAI 把它定位在可靠的工具调用和指令遵循上,适合必须遵守固定流程的智能体。
  • 支持函数调用和结构化输出,适合需要机器可读回复的集成。
  • 接受图像和文本,一次请求就能同时包含截图和文字问题。
  • 反复使用很长的系统提示词或文档时,提示词缓存可以降低重复成本。

什么情况换别的模型

  • Grok 4.5 到 4.7 是更新的版本,面向编程和智能体式软件工作;这个是较老的通用选择。
  • 低强度下思考很少,难题需要更高的设置,或换更强的模型。
  • 输出仅限文本;生成图像和音频需要另外的模型。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    文本生成Responses API
    POST/v1/responses
    API 格式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "grok-4.3",
        "input": "Hello!"
      }'

价格

官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。

默认规格

每 1M token
官方价格
输入 $1.25 / 输出 $2.50 / 缓存读取 $0.20
TokenLab 价格
输入 $0.625 / 输出 $1.25 / 缓存读取 $0.10
折扣
-50%
提示词缓存价格

缓存读取

官方价格
$0.20
TokenLab 价格
$0.10
折扣
-50%

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Grok 4.3 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 grok-4.3 发一条简短消息,接口是 /v1/responses。返回回复,附上延迟和费用。

使用场景

适用场景
  • 推理
  • 视觉
  • 通用助手

    用一个模型支撑聊天功能:简单问题快速回答,较难的问题可以加大推理强度。

  • 受指令约束的智能体

    运行有固定流程和多个工具的工作流,例如工单分流,模型必须严格按步骤执行并调用正确的函数。

  • 长文档问答

    把大批手册或报告装进提示词,跨文档提问,用缓存的前缀降低重复查询的成本。

提示词示例

严格遵守这五条分流规则。对下面每张工单,调用 set_priority 和 assign_team,再用一句话给出理由。

根据附上的手册,说明故障后怎么重置控制器,并引用你用到的章节。

把这条评价归类为缺陷、功能需求或表扬。以 JSON 回复,包含 label 和 0 到 1 之间的 confidence。

此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。

FAQ

Grok 4.3 是为什么设计的?

xAI 称它是快速可靠的模型,工具调用和指令遵循能力强。适合必须遵守流程、调用函数并返回结构化答案的助手和智能体,输入可以是文本和图像。

Grok 4.3 支持推理吗?

支持,推理强度可调,档位有 none、low、medium、high 和 xhigh。xAI 的默认是 low。问题较难时调高,想要最快回复时设为 none。

Grok 4.3 和 Grok 4.20 比起来怎么样?

两者都有很长的上下文,输入类型相近。Grok 4.3 在一个 ID 里提供更细的推理强度控制,而 4.20 拆成了推理、不推理和多智能体三个模型。请用自己的提示词分别测试。

Grok 4.3 能处理图像吗?

能。它接受图像和文本,如图表和截图,以文本回答。它不生成图像。这对关于截图或拍下来的页面的提问很方便,答案以普通文本返回。

Grok 4.3 适合写代码吗?

日常的代码问题和工具驱动的修改都能应付。对要求较高的软件工程和长时间的智能体运行,xAI 较新的 Grok 4.5、4.6 和 4.7 更直接地面向编程和智能体任务。

Grok 4.3 的费用是多少?

在 TokenLab 上,Grok 4.3 的价格为 输入 $0.625 / 输出 $1.25 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

Grok 4.3 的上下文窗口和输出上限是多少?

Grok 4.3 最多接收 1,000,000 token 的上下文,单次最多返回 131,072 token。

Grok 4.3 应该使用哪个端点?

Grok 4.3 使用 https://api.tokenlab.sh/v1/responses。代码写法见下方的请求示例。

Grok 4.3 支持哪些操作?

Grok 4.3 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。

Grok 4.3 对比

资料来源

审阅于 2026年10月2日

更多 Grok 4 模型

相关模型