Google: Gemma 4 31B
gemma-4-31b- 輸入 / 輸出
- $0.102 / $0.297
- 模態
- 對話
關於 Gemma 4 31B
Gemma 4 31B 是 Google 開放權重 Gemma 4 系列中最大的稠密模型,該系列於 2026 年 3 月推出,尺寸從 E2B 到 31B 不等。Google 將此系列描述為專為推理、代理工作流、編碼和多模態理解而構建。與專有的 Gemini 模型不同,其權重是公開的,因此相同的模型也可以在您自己的硬體上運行。
適用場景
- 開放權重讓您可以在託管環境和自建環境之間遷移相同的模型。
- 稠密 31B 尺寸旨在實現較小 Gemma 4 尺寸所放棄的推理和編碼品質。
- Google 的模型卡報告顯示,該模型在 MMLU Pro 和 LiveCodeBench v6 等推理與編碼基準測試中表現強勁。
- 支援超過 140 種語言的多語言覆蓋。
其他選擇建議
- 它僅支援文字處理且不具備工具呼叫功能,因此代理工作流更適合使用 Gemini 模型。
- 在長期的自主任務上,它的能力不如 Gemini 3.x Pro 和 Flash 模型。
入門指南
建立 API 金鑰
請至 Console 建立金鑰,即可在平台上使用各類模型。
發送您的第一個請求
複製您所選語言的範例,並針對端點執行它。
文字轉文字Chat Completions APIPOST/v1/chat/completionscurl https://api.tokenlab.sh/v1/chat/completions \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "gemma-4-31b", "messages": [ {"role": "user", "content": "Hello!"} ] }'
定價
Official 價格為模型開發商的公開基準價。TokenLab 價格則為您在 TokenLab 使用該模型的實際費用。
預設規格
每 1M Token- Official 定價
- 輸入 $0.102 / 輸出 $0.297 / 快取讀取 $0.012
- Official
- 輸入 $0.102 / 輸出 $0.297 / 快取讀取 $0.012
- 折扣
- —
快取讀取
- Official 定價
- $0.012
- Official
- $0.012
- 折扣
- —
| Official 定價每 1M Token | Official每 1M Token | 折扣 | |
|---|---|---|---|
| 預設規格 | 輸入 $0.102 / 輸出 $0.297 / 快取讀取 $0.012 | 輸入 $0.102 / 輸出 $0.297 / 快取讀取 $0.012 | — |
| Prompt 快取價格 | |||
| 快取讀取 | $0.012 | $0.012 | — |
使用量與活動
成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。
用量與可用性
過去 24 小時- 請求數
- 成功率
- P95 延遲
- 總 Token 用量
資料基於彙總的使用者請求,不包含狀態檢查。
直接在 Console 裡試
在 Console 中開啟 Gemma 4 31B,並準備好編輯或發送提示詞。
協助我使用 gemma-4-31b 透過 /v1/chat/completions 進行對話,並顯示回覆、延遲與成本。
應用情境
可自託管的助理
先針對託管模型進行原型設計,若資料規範有要求,再遷移至您自己的 GPU 上。
多語言聊天
透過單一模型以多種語言回答使用者,這比運行獨立的翻譯工具更能簡化支援架構。
程式碼解釋
在因政策或託管原因必須使用開放權重模型的環境中,審閱程式碼片段並編寫函式。
微調基礎
在將開放權重適配到您的領域之前,先與託管基準進行比較。
提示詞範例
將此段落翻譯成西班牙語、德語和日語,並註明您必須改寫的任何慣用語。
解釋此 SQL 查詢的作用,然後重寫它以避免使用相關子查詢。
寫一封簡短且禮貌的回信,拒絕此會議請求並提議改在下週進行。
此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。
FAQ
Gemma 4 31B 是開源的嗎?
Google 根據 Gemma 條款發布權重,這使其成為開放權重模型。在商業使用前請閱讀模型卡上的授權條款,因為它是 Gemma 專屬的授權。
Gemma 與 Gemini 有何不同?
Gemini 模型是 Google 的託管專有產品線。Gemma 模型是基於相關研究構建的較小開放權重模型,您可以下載、微調並自行運行。
它支援工具呼叫嗎?
不支援。託管模型僅處理文字聊天,支援文字輸入與輸出,但不具備工具呼叫功能。若需要呼叫函式的代理,請改用 Gemini 模型。
該模型的大小是多少?
約 310 億參數,稠密模型,是五種 Gemma 4 尺寸(E2B、E4B、12B、26B A4B 和 31B)中最大的一款。較小的尺寸針對手機和筆記型電腦進行了優化。
Gemma 4 31B 的費用是多少?
在 TokenLab 上,Gemma 4 31B 價格為 輸入 $0.102 / 輸出 $0.297 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。
Gemma 4 31B 應該使用哪一個端點?
請使用 https://api.tokenlab.sh/v1/chat/completions 進行 Gemma 4 31B 的呼叫。下方的請求範例展示了對應的程式碼格式。
Gemma 4 31B 支援哪些操作?
Gemma 4 31B 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。
比較 Gemma 4 31B
來源
更新於 2026年10月2日