每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

xAI: Grok 4.20 Multi-Agent

Grok 4.20 Multi-Agent 是 Grok 4.20 的协作推理版本,面向需要从多条分析路径展开、再汇总形成答案的复杂问题。
对比模型
grok-4.20-multi-agent
可用xAI聊天
输入 / 输出
$1.25 / $2.50
上下文
1M
最大输出
128K
模态
视觉聊天
能力
工具调用提示词缓存推理

Grok 4.20 Multi-Agent 简介

Grok 4.20 Multi-Agent 是 xAI 的 Grok 4.20 变体,用并行运行多个智能体的方式回答难题。每个智能体研究不同的角度,由一个领导智能体把它们的发现合并成一份带证据的回复。与单次推理和不推理的 4.20 模型不同,它适合广度比速度更重要的研究类问题。

擅长的任务

  • 把问题分给多个智能体,同时从不同角度探索,再把结果合并成一个答案。
  • 由领导智能体写最终回复,你拿到的是一份连贯的回答,而不是一堆零散的结果。
  • xAI 文档说明,快速研究大约用四个智能体,深入分析用十六个,对应不同的强度档位。
  • 适合需要收集资料并交叉验证的问题,而不是一步回忆就能答的问题。
  • 问题里带截图或图表时,也能读取图像和文本。

什么情况换别的模型

  • 运行多个智能体比单次处理耗时更长、消耗更多 token;简单查询用普通的 4.20 模型更合适。
  • 只能看到领导智能体的最终答案,无法检查每个子智能体得出了什么。
  • 它是偏研究的变体;需要常规的编程或工具调用智能体时,grok-4.7 是更直接的选择。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    文本生成Responses API
    POST/v1/responses
    API 格式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "grok-4.20-multi-agent",
        "input": "Hello!"
      }'

价格

官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。

默认规格

每 1M token
官方价格
输入 $1.25 / 输出 $2.50 / 缓存读取 $0.20
Official
输入 $1.25 / 输出 $2.50 / 缓存读取 $0.20
折扣
—
提示词缓存价格

缓存读取

官方价格
$0.20
Official
$0.20
折扣
—

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Grok 4.20 Multi-Agent 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 grok-4.20-multi-agent 发一条简短消息,接口是 /v1/responses。返回回复,附上延迟和费用。

使用场景

适用场景
  • 推理
  • 视觉
  • 市场与竞品研究

    要求给出一个产品类别的带来源概览,每个智能体负责不同的厂商或角度,最后得到一份综合简报。

  • 文献与政策综述

    提出一个横跨多篇论文或法规的问题,让并行的智能体收集相关要点,再由领导智能体协调分歧。

  • 开放式难题分析

    交给它一个没有明显单一方法的问题,比如某个指标为什么变动,得到由多条分析线索汇总出的整体判断。

提示词示例

比较面向一千万篇文档语料的向量搜索索引的主要方案,涵盖准确率、内存占用和运维复杂度,并推荐一种。

用授权图片训练模型,目前有哪些悬而未决的法律问题?给出各方观点及各自的证据。

我们上个月的注册量下降了 18%。提出五个相互独立的解释,并说明需要什么数据来证实或排除每一个。

此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。

FAQ

Grok 4.20 的多智能体版本是做什么的?

它启动多个智能体并行处理一个问题,从不同角度收集和分析信息,再由领导智能体把讨论合并为最终答案。你发送的是普通提示词,收到的是一份回复。

grok-4.20-multi-agent 用多少个智能体?

xAI 描述了两种配置:四个智能体用于快速、聚焦的研究,十六个用于深入、复杂的分析。数量取决于你请求的推理强度,低强度对应小团队,高强度对应大团队。

grok-4.20-multi-agent 比 grok-4.20 慢吗?

通常是的。领导智能体写回复之前,多个智能体要先探索问题,所以延迟和 token 用量会随智能体数量上升。短问题或聊天场景,标准的或不推理的 4.20 模型响应更快。

能看到每个智能体得出了什么结论吗?

不能。xAI 只公开领导智能体的输出,不返回子智能体的工作状态。想核实结论是怎么得出的,可以要求模型在最终答案里引用证据。

它接受图像吗?

接受。和其他 4.20 模型一样,它接受图像和文本,所以研究问题里可以附带图表或截图。回复以文本形式返回。

Grok 4.20 Multi-Agent 的费用是多少?

在 TokenLab 上,Grok 4.20 Multi-Agent 的价格为 输入 $1.25 / 输出 $2.50 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

Grok 4.20 Multi-Agent 的上下文窗口和输出上限是多少?

Grok 4.20 Multi-Agent 最多接收 1,000,000 token 的上下文,单次最多返回 131,072 token。

Grok 4.20 Multi-Agent 应该使用哪个端点?

Grok 4.20 Multi-Agent 使用 https://api.tokenlab.sh/v1/responses。代码写法见下方的请求示例。

Grok 4.20 Multi-Agent 支持哪些操作?

Grok 4.20 Multi-Agent 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。

Grok 4.20 Multi-Agent 对比

资料来源

审阅于 2026年10月2日

更多 Grok 4 模型

相关模型