xAI: Grok 4.20 Non-Reasoning
grok-4.20-non-reasoning- 輸入 / 輸出-50%
- $1.25 / $2.50$0.625 / $1.25
- 上下文
- 1M
- 最大輸出長度
- 128K
- 模態
- 視覺辨識對話
- 能力
- 工具使用提示詞快取
關於 Grok 4.20 Non-Reasoning
Grok 4.20 Non-Reasoning 是 xAI 4.20 模型的直接回答版本。它跳過了延伸思考階段,因此能快速回覆文字與圖像提示,適合草擬、提取與工具輔助聊天。xAI 將其描述為結合了嚴格的提示詞遵循與低幻覺率。當問題需要審慎分析時,請選擇推理或多代理程式變體。
適用場景
- 回覆時不經過獨立的思考階段,這能降低互動式聊天與高流量作業的延遲。
- xAI 強調此模型具有嚴格的提示詞遵循與低幻覺率,當輸出必須遵循特定模板時非常有用。
- 支援函式呼叫與結構化 JSON 輸出,適用於提取管線與工具驅動的助理。
- 接受圖像與文字,因此可以一次讀取收據或截圖並進行回答。
- 當許多請求重複使用相同的長指令或參考文字時,提示詞快取(Prompt caching)很有幫助。
其他選擇建議
- 由於沒有推理步驟,其在多階段邏輯或數學方面的能力弱於 grok-4.20 或 grok-4.7。
- 它不會將工作拆分給多個代理程式;開放式研究建議使用多代理程式變體。
- 輸出僅限文字,不具備圖像、音訊或影片生成功能。
入門指南
建立 API 金鑰
請至 Console 建立金鑰,即可在平台上使用各類模型。
發送您的第一個請求
複製您所選語言的範例,並針對端點執行它。
文字轉文字Responses APIPOST/v1/responsesAPI 格式:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "grok-4.20-non-reasoning", "input": "Hello!" }'
定價
Official 價格為模型開發商的公開基準價。TokenLab 價格則為您在 TokenLab 使用該模型的實際費用。
預設規格
每 1M Token- Official 定價
- 輸入 $1.25 / 輸出 $2.50 / 快取讀取 $0.20
- TokenLab 價格
- 輸入 $0.625 / 輸出 $1.25 / 快取讀取 $0.10
- 折扣
- -50%
快取讀取
- Official 定價
- $0.20
- TokenLab 價格
- $0.10
- 折扣
- -50%
| Official 定價每 1M Token | TokenLab 價格每 1M Token | 折扣 | |
|---|---|---|---|
| 預設規格 | 輸入 $1.25 / 輸出 $2.50 / 快取讀取 $0.20 | 輸入 $0.625 / 輸出 $1.25 / 快取讀取 $0.10 | -50% |
| Prompt 快取價格 | |||
| 快取讀取 | $0.20 | $0.10 | -50% |
使用量與活動
成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。
用量與可用性
過去 24 小時- 請求數
- 成功率
- P95 延遲
- 總 Token 用量
資料基於彙總的使用者請求,不包含狀態檢查。
直接在 Console 裡試
在 Console 中開啟 Grok 4.20 Non-Reasoning,並準備好編輯或發送提示詞。
協助我使用 grok-4.20-non-reasoning 透過 /v1/responses 進行對話,並顯示回覆、延遲與成本。
應用情境
適合場景- 視覺辨識
客戶服務聊天
以一致的語氣回答產品與帳戶問題,並在需要時呼叫查詢函式,無需讓客戶等待漫長的思考階段。
大量文件提取
透過固定的 JSON 架構處理數千份合約、表格或電子郵件,依賴嚴格的指令遵循來保持欄位一致性。
草擬與改寫
以要求的格式產出電子郵件、摘要與發布說明的初稿,然後透過簡短的後續指令進行潤飾。
提示詞範例
請將此支援對話串總結為三個要點與一個建議回覆。回覆長度請控制在 80 字以內,且不要承諾退款。
從此合約中提取當事方名稱、生效日期與終止通知期,並填入下方的 JSON 架構中。若有缺失項目,請回傳 null。
為非技術客戶改寫此變更日誌。保留標題,刪除內部工單編號,並使用淺顯易懂的句子。
此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。
FAQ
什麼是 Grok 4.20 Non-Reasoning?
這是 xAI Grok 4.20 模型中直接回答而非先進行思考的版本。它能讀取文字與圖像、撰寫文字,並支援函式呼叫與結構化輸出。它旨在處理快速、指令繁重的任務,例如提取、草擬與工具輔助聊天。
我應該何時使用 Non-Reasoning 而非 grok-4.20?
當任務明確且答案主要涉及檢索、改寫或格式化時使用。它的回應速度比推理 ID 快。當答案需要多步驟分析(例如除錯或規劃)時,請切換至 grok-4.20。
Grok 4.20 Non-Reasoning 是否遵循 JSON 架構?
是的。它支援結構化輸出,因此您可以提供架構並接收符合該架構的回應。結合 xAI 對嚴格提示詞遵循的強調,這使其成為提取與分類作業的合理預設選擇。
它能接受圖像輸入嗎?
是的,圖像可以與文字一起發送,例如拍攝的表格或 UI 截圖。回覆為文字。該模型無法建立或編輯圖像。
它能與現有的 OpenAI 風格客戶端搭配使用嗎?
是的。現有的 OpenAI 風格客戶端程式碼只需更改模型名稱即可運作,工具定義與 JSON 架構仍如往常般在對應欄位中發送。
Grok 4.20 Non-Reasoning 的費用是多少?
在 TokenLab 上,Grok 4.20 Non-Reasoning 價格為 輸入 $0.625 / 輸出 $1.25 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。
Grok 4.20 Non-Reasoning 的上下文長度與輸出限制為何?
Grok 4.20 Non-Reasoning 支援最高 1,000,000 tokens 的上下文,單次回應上限為 131,072 tokens。
Grok 4.20 Non-Reasoning 應該使用哪一個端點?
請使用 https://api.tokenlab.sh/v1/responses 進行 Grok 4.20 Non-Reasoning 的呼叫。下方的請求範例展示了對應的程式碼格式。
Grok 4.20 Non-Reasoning 支援哪些操作?
Grok 4.20 Non-Reasoning 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。
比較 Grok 4.20 Non-Reasoning
來源
更新於 2026年10月2日