為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

xAI: Grok 4.20

Grok 4.20 在長上下文對話中結合了推理、視覺輸入與工具使用功能。它適用於需要整合大量文字、圖像與中間結果,最後得出答案的調查工作。
比較模型
grok-4.20
可用xAI對話輸入快取節省 84%
輸入 / 輸出-50%
$1.25 / $2.50$0.625 / $1.25
上下文
1M
最大輸出長度
128K
模態
視覺辨識對話
能力
工具使用提示詞快取推理

關於 Grok 4.20

Grok 4.20 是 xAI 4.20 系列中具備推理能力的模型,專為處理超長輸入的工具調用工作流程而構建。它能讀取文字與圖像並輸出文字,且在回答前會進行思考,這使其區別於同系列中非推理及多代理(multi-agent)的兄弟模型。當答案取決於整合多份文件、截圖及中間工具執行結果時,請選擇此模型。

適用場景

  • 在回覆前會先針對問題進行推理,因此對於多步驟問題,它會提供經過運算的答案,而非僅是初步猜測。
  • 支援文字與圖像同時輸入,讓單一對話能混合使用截圖、圖表與書面資料。
  • 能調用工具並返回結構化的 JSON,因此可嵌入代理迴圈(agent loop)或提取管線中。
  • 能處理極長的對話歷史,對於需要在多次對話中累積證據的調查工作非常有用。
  • 提示詞快取(Prompt caching)功能可降低在多次請求中重複發送大型共享前綴的成本。

其他選擇建議

  • 思考步驟會增加延遲;當任務僅為簡單的草擬或提取時,非推理的 4.20 變體回答速度更快。
  • 較新的 Grok 版本(如 4.7)更直接針對程式編寫與代理任務,在處理困難的軟體任務時表現可能更佳。
  • 輸出僅限文字,因此無法生成圖像、音訊或影片。

入門指南

  1. 建立 API 金鑰

    請至 Console 建立金鑰,即可在平台上使用各類模型。

  2. 發送您的第一個請求

    複製您所選語言的範例,並針對端點執行它。

    文字轉文字Responses API
    POST/v1/responses
    API 格式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "grok-4.20",
        "input": "Hello!"
      }'

定價

Official 價格為模型開發商的公開基準價。TokenLab 價格則為您在 TokenLab 使用該模型的實際費用。

輸入 權杖 <= 200K

每 1M Token
Official 定價
輸入 $1.25 / 輸出 $2.50 / 快取讀取 $0.20
TokenLab 價格
輸入 $0.625 / 輸出 $1.25 / 快取讀取 $0.10
折扣
-50%

輸入 權杖 > 200K

每 1M Token
Official 定價
輸入 $2.50 / 輸出 $5.00 / 快取讀取 $0.40
TokenLab 價格
輸入 $1.25 / 輸出 $2.50 / 快取讀取 $0.20
折扣
-50%
Prompt 快取價格

快取讀取

Official 定價
$0.20
TokenLab 價格
$0.10
折扣
-50%

使用量與活動

成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。

用量與可用性

過去 24 小時
請求數
成功率
P95 延遲
總 Token 用量
模型效能
當達到隱私權與資料量的門檻後,指標才會顯示。

資料基於彙總的使用者請求,不包含狀態檢查。

直接在 Console 裡試

在 Console 中開啟 Grok 4.20,並準備好編輯或發送提示詞。

協助我使用 grok-4.20 透過 /v1/responses 進行對話,並顯示回覆、延遲與成本。

應用情境

適合場景
  • 推理
  • 視覺辨識
  • 基於證據的調查

    輸入在事件或審計期間收集的報告、匯出資料與截圖,並要求其提供具備推理的時間軸以及剩餘的待解問題。

  • 具備工具的代理迴圈

    賦予其搜尋、資料庫或票務功能,讓它自行決定調用時機、讀取結果,並持續執行直到問題獲得解答。

  • 從雜亂輸入中進行結構化提取

    將掃描的表單、發票或聊天記錄轉換為固定的 JSON 架構,推理步驟有助於處理模糊的條目。

提示詞範例

以下是三份日誌匯出檔與一份儀表板截圖。請建立故障時間軸,並標記出任何與日誌內容矛盾之處。

請從這張發票圖像中提取供應商、日期、明細項目與稅額,並轉換為符合下方架構的 JSON。請標記出任何你不確定的欄位。

你可以調用 search_orders 與 get_customer。客戶表示訂單 8812 遺漏了兩項商品。請規劃檢查內容與順序。

此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。

FAQ

什麼是 Grok 4.20?

Grok 4.20 是 xAI 推出的聊天模型,支援文字與圖像輸入並以文字回答。這是該系列中的推理版本:它會在回覆前先處理問題。xAI 同時提供非推理與多代理形式的相同生成模型。

grok-4.20 與 grok-4.20-non-reasoning 有何不同?

基礎 ID 在回答前會花時間推理,而非推理 ID 則直接回覆。針對需要多步驟分析的問題請使用基礎 ID;若為草擬、提取及對話等重視速度勝過深度的任務,則使用非推理版本。

Grok 4.20 能讀取圖像嗎?

可以。你可以在對話中同時發送文字與圖像(例如截圖、圖表或拍攝的文件),並針對這些內容提問。回覆皆為文字;模型不會生成或編輯圖像。

Grok 4.20 支援工具調用與 JSON 輸出嗎?

支援。它支援函數調用與結構化 JSON 回應,因此你可以將其連接至自訂函數,或強制要求輸出符合特定架構。這使其適用於提取任務以及在外部系統上執行操作的代理。

我可以使用現有的 OpenAI 風格客戶端搭配 Grok 4.20 嗎?

可以。只需更改模型名稱,現有的 OpenAI 風格客戶端程式碼即可運作,且工具定義與 JSON 架構使用的欄位與你目前發送的完全相同。

Grok 4.20 的費用是多少?

在 TokenLab 上,Grok 4.20 價格為 輸入 $0.625 / 輸出 $1.25 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。

Grok 4.20 的上下文長度與輸出限制為何?

Grok 4.20 支援最高 1,000,000 tokens 的上下文,單次回應上限為 131,072 tokens。

Grok 4.20 應該使用哪一個端點?

請使用 https://api.tokenlab.sh/v1/responses 進行 Grok 4.20 的呼叫。下方的請求範例展示了對應的程式碼格式。

Grok 4.20 支援哪些操作?

Grok 4.20 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。

比較 Grok 4.20

來源

更新於 2026年10月2日

更多來自 Grok 4 的模型

相關模型