為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

xAI: Grok 4.20 Non-Reasoning

Grok 4.20 Non-Reasoning 提供 4.20 系列的直接回應變體。它適用於提取、草擬與工具輔助對話,且無需額外的擴展推理階段。
比較模型
grok-4.20-non-reasoning
可用xAI對話輸入快取節省 84%
輸入 / 輸出-50%
$1.25 / $2.50$0.625 / $1.25
上下文
1M
最大輸出長度
128K
模態
視覺辨識對話
能力
工具使用提示詞快取

關於 Grok 4.20 Non-Reasoning

Grok 4.20 Non-Reasoning 是 xAI 4.20 模型的直接回答版本。它跳過了延伸思考階段,因此能快速回覆文字與圖像提示,適合草擬、提取與工具輔助聊天。xAI 將其描述為結合了嚴格的提示詞遵循與低幻覺率。當問題需要審慎分析時,請選擇推理或多代理程式變體。

適用場景

  • 回覆時不經過獨立的思考階段,這能降低互動式聊天與高流量作業的延遲。
  • xAI 強調此模型具有嚴格的提示詞遵循與低幻覺率,當輸出必須遵循特定模板時非常有用。
  • 支援函式呼叫與結構化 JSON 輸出,適用於提取管線與工具驅動的助理。
  • 接受圖像與文字,因此可以一次讀取收據或截圖並進行回答。
  • 當許多請求重複使用相同的長指令或參考文字時,提示詞快取(Prompt caching)很有幫助。

其他選擇建議

  • 由於沒有推理步驟,其在多階段邏輯或數學方面的能力弱於 grok-4.20 或 grok-4.7。
  • 它不會將工作拆分給多個代理程式;開放式研究建議使用多代理程式變體。
  • 輸出僅限文字,不具備圖像、音訊或影片生成功能。

入門指南

  1. 建立 API 金鑰

    請至 Console 建立金鑰,即可在平台上使用各類模型。

  2. 發送您的第一個請求

    複製您所選語言的範例,並針對端點執行它。

    文字轉文字Responses API
    POST/v1/responses
    API 格式:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "grok-4.20-non-reasoning",
        "input": "Hello!"
      }'

定價

Official 價格為模型開發商的公開基準價。TokenLab 價格則為您在 TokenLab 使用該模型的實際費用。

預設規格

每 1M Token
Official 定價
輸入 $1.25 / 輸出 $2.50 / 快取讀取 $0.20
TokenLab 價格
輸入 $0.625 / 輸出 $1.25 / 快取讀取 $0.10
折扣
-50%
Prompt 快取價格

快取讀取

Official 定價
$0.20
TokenLab 價格
$0.10
折扣
-50%

使用量與活動

成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。

用量與可用性

過去 24 小時
請求數
成功率
P95 延遲
總 Token 用量
模型效能
當達到隱私權與資料量的門檻後,指標才會顯示。

資料基於彙總的使用者請求,不包含狀態檢查。

直接在 Console 裡試

在 Console 中開啟 Grok 4.20 Non-Reasoning,並準備好編輯或發送提示詞。

協助我使用 grok-4.20-non-reasoning 透過 /v1/responses 進行對話,並顯示回覆、延遲與成本。

應用情境

適合場景
  • 視覺辨識
  • 客戶服務聊天

    以一致的語氣回答產品與帳戶問題,並在需要時呼叫查詢函式,無需讓客戶等待漫長的思考階段。

  • 大量文件提取

    透過固定的 JSON 架構處理數千份合約、表格或電子郵件,依賴嚴格的指令遵循來保持欄位一致性。

  • 草擬與改寫

    以要求的格式產出電子郵件、摘要與發布說明的初稿,然後透過簡短的後續指令進行潤飾。

提示詞範例

請將此支援對話串總結為三個要點與一個建議回覆。回覆長度請控制在 80 字以內,且不要承諾退款。

從此合約中提取當事方名稱、生效日期與終止通知期,並填入下方的 JSON 架構中。若有缺失項目,請回傳 null。

為非技術客戶改寫此變更日誌。保留標題,刪除內部工單編號,並使用淺顯易懂的句子。

此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。

FAQ

什麼是 Grok 4.20 Non-Reasoning?

這是 xAI Grok 4.20 模型中直接回答而非先進行思考的版本。它能讀取文字與圖像、撰寫文字,並支援函式呼叫與結構化輸出。它旨在處理快速、指令繁重的任務,例如提取、草擬與工具輔助聊天。

我應該何時使用 Non-Reasoning 而非 grok-4.20?

當任務明確且答案主要涉及檢索、改寫或格式化時使用。它的回應速度比推理 ID 快。當答案需要多步驟分析(例如除錯或規劃)時,請切換至 grok-4.20。

Grok 4.20 Non-Reasoning 是否遵循 JSON 架構?

是的。它支援結構化輸出,因此您可以提供架構並接收符合該架構的回應。結合 xAI 對嚴格提示詞遵循的強調,這使其成為提取與分類作業的合理預設選擇。

它能接受圖像輸入嗎?

是的,圖像可以與文字一起發送,例如拍攝的表格或 UI 截圖。回覆為文字。該模型無法建立或編輯圖像。

它能與現有的 OpenAI 風格客戶端搭配使用嗎?

是的。現有的 OpenAI 風格客戶端程式碼只需更改模型名稱即可運作,工具定義與 JSON 架構仍如往常般在對應欄位中發送。

Grok 4.20 Non-Reasoning 的費用是多少?

在 TokenLab 上,Grok 4.20 Non-Reasoning 價格為 輸入 $0.625 / 輸出 $1.25 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。

Grok 4.20 Non-Reasoning 的上下文長度與輸出限制為何?

Grok 4.20 Non-Reasoning 支援最高 1,000,000 tokens 的上下文,單次回應上限為 131,072 tokens。

Grok 4.20 Non-Reasoning 應該使用哪一個端點?

請使用 https://api.tokenlab.sh/v1/responses 進行 Grok 4.20 Non-Reasoning 的呼叫。下方的請求範例展示了對應的程式碼格式。

Grok 4.20 Non-Reasoning 支援哪些操作?

Grok 4.20 Non-Reasoning 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。

比較 Grok 4.20 Non-Reasoning

來源

更新於 2026年10月2日

更多來自 Grok 4 的模型

相關模型