xAI: Grok 4.20
grok-4.20- 輸入 / 輸出-50%
- $1.25 / $2.50$0.625 / $1.25
- 上下文
- 1M
- 最大輸出長度
- 128K
- 模態
- 視覺辨識對話
- 能力
- 工具使用提示詞快取推理
關於 Grok 4.20
Grok 4.20 是 xAI 4.20 系列中具備推理能力的模型,專為處理超長輸入的工具調用工作流程而構建。它能讀取文字與圖像並輸出文字,且在回答前會進行思考,這使其區別於同系列中非推理及多代理(multi-agent)的兄弟模型。當答案取決於整合多份文件、截圖及中間工具執行結果時,請選擇此模型。
適用場景
- 在回覆前會先針對問題進行推理,因此對於多步驟問題,它會提供經過運算的答案,而非僅是初步猜測。
- 支援文字與圖像同時輸入,讓單一對話能混合使用截圖、圖表與書面資料。
- 能調用工具並返回結構化的 JSON,因此可嵌入代理迴圈(agent loop)或提取管線中。
- 能處理極長的對話歷史,對於需要在多次對話中累積證據的調查工作非常有用。
- 提示詞快取(Prompt caching)功能可降低在多次請求中重複發送大型共享前綴的成本。
其他選擇建議
- 思考步驟會增加延遲;當任務僅為簡單的草擬或提取時,非推理的 4.20 變體回答速度更快。
- 較新的 Grok 版本(如 4.7)更直接針對程式編寫與代理任務,在處理困難的軟體任務時表現可能更佳。
- 輸出僅限文字,因此無法生成圖像、音訊或影片。
入門指南
建立 API 金鑰
請至 Console 建立金鑰,即可在平台上使用各類模型。
發送您的第一個請求
複製您所選語言的範例,並針對端點執行它。
文字轉文字Responses APIPOST/v1/responsesAPI 格式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "grok-4.20", "input": "Hello!" }'
定價
Official 價格為模型開發商的公開基準價。TokenLab 價格則為您在 TokenLab 使用該模型的實際費用。
輸入 權杖 <= 200K
每 1M Token- Official 定價
- 輸入 $1.25 / 輸出 $2.50 / 快取讀取 $0.20
- TokenLab 價格
- 輸入 $0.625 / 輸出 $1.25 / 快取讀取 $0.10
- 折扣
- -50%
輸入 權杖 > 200K
每 1M Token- Official 定價
- 輸入 $2.50 / 輸出 $5.00 / 快取讀取 $0.40
- TokenLab 價格
- 輸入 $1.25 / 輸出 $2.50 / 快取讀取 $0.20
- 折扣
- -50%
快取讀取
- Official 定價
- $0.20
- TokenLab 價格
- $0.10
- 折扣
- -50%
| Official 定價每 1M Token | TokenLab 價格每 1M Token | 折扣 | |
|---|---|---|---|
| 輸入 權杖 <= 200K | 輸入 $1.25 / 輸出 $2.50 / 快取讀取 $0.20 | 輸入 $0.625 / 輸出 $1.25 / 快取讀取 $0.10 | -50% |
| 輸入 權杖 > 200K | 輸入 $2.50 / 輸出 $5.00 / 快取讀取 $0.40 | 輸入 $1.25 / 輸出 $2.50 / 快取讀取 $0.20 | -50% |
| Prompt 快取價格 | |||
| 快取讀取 | $0.20 | $0.10 | -50% |
使用量與活動
成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。
用量與可用性
過去 24 小時- 請求數
- 成功率
- P95 延遲
- 總 Token 用量
資料基於彙總的使用者請求,不包含狀態檢查。
直接在 Console 裡試
在 Console 中開啟 Grok 4.20,並準備好編輯或發送提示詞。
協助我使用 grok-4.20 透過 /v1/responses 進行對話,並顯示回覆、延遲與成本。
應用情境
適合場景- 推理
- 視覺辨識
基於證據的調查
輸入在事件或審計期間收集的報告、匯出資料與截圖,並要求其提供具備推理的時間軸以及剩餘的待解問題。
具備工具的代理迴圈
賦予其搜尋、資料庫或票務功能,讓它自行決定調用時機、讀取結果,並持續執行直到問題獲得解答。
從雜亂輸入中進行結構化提取
將掃描的表單、發票或聊天記錄轉換為固定的 JSON 架構,推理步驟有助於處理模糊的條目。
提示詞範例
以下是三份日誌匯出檔與一份儀表板截圖。請建立故障時間軸,並標記出任何與日誌內容矛盾之處。
請從這張發票圖像中提取供應商、日期、明細項目與稅額,並轉換為符合下方架構的 JSON。請標記出任何你不確定的欄位。
你可以調用 search_orders 與 get_customer。客戶表示訂單 8812 遺漏了兩項商品。請規劃檢查內容與順序。
此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。
FAQ
什麼是 Grok 4.20?
Grok 4.20 是 xAI 推出的聊天模型,支援文字與圖像輸入並以文字回答。這是該系列中的推理版本:它會在回覆前先處理問題。xAI 同時提供非推理與多代理形式的相同生成模型。
grok-4.20 與 grok-4.20-non-reasoning 有何不同?
基礎 ID 在回答前會花時間推理,而非推理 ID 則直接回覆。針對需要多步驟分析的問題請使用基礎 ID;若為草擬、提取及對話等重視速度勝過深度的任務,則使用非推理版本。
Grok 4.20 能讀取圖像嗎?
可以。你可以在對話中同時發送文字與圖像(例如截圖、圖表或拍攝的文件),並針對這些內容提問。回覆皆為文字;模型不會生成或編輯圖像。
Grok 4.20 支援工具調用與 JSON 輸出嗎?
支援。它支援函數調用與結構化 JSON 回應,因此你可以將其連接至自訂函數,或強制要求輸出符合特定架構。這使其適用於提取任務以及在外部系統上執行操作的代理。
我可以使用現有的 OpenAI 風格客戶端搭配 Grok 4.20 嗎?
可以。只需更改模型名稱,現有的 OpenAI 風格客戶端程式碼即可運作,且工具定義與 JSON 架構使用的欄位與你目前發送的完全相同。
Grok 4.20 的費用是多少?
在 TokenLab 上,Grok 4.20 價格為 輸入 $0.625 / 輸出 $1.25 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。
Grok 4.20 的上下文長度與輸出限制為何?
Grok 4.20 支援最高 1,000,000 tokens 的上下文,單次回應上限為 131,072 tokens。
Grok 4.20 應該使用哪一個端點?
請使用 https://api.tokenlab.sh/v1/responses 進行 Grok 4.20 的呼叫。下方的請求範例展示了對應的程式碼格式。
Grok 4.20 支援哪些操作?
Grok 4.20 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。
比較 Grok 4.20
來源
更新於 2026年10月2日