為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

Google: Gemma 4 31B

Gemma 4 31B 是 Google 推出的密集型開放權重模型,專為文字對話、程式編寫及多語言任務而設計。此 TokenLab 模型公開了經過驗證的文字聊天完成(Chat Completions)合約。
比較模型
gemma-4-31b
可用Google對話
輸入 / 輸出
$0.102 / $0.297
模態
對話

關於 Gemma 4 31B

Gemma 4 31B 是 Google 開放權重 Gemma 4 系列中最大的稠密模型,該系列於 2026 年 3 月推出,尺寸從 E2B 到 31B 不等。Google 將此系列描述為專為推理、代理工作流、編碼和多模態理解而構建。與專有的 Gemini 模型不同,其權重是公開的,因此相同的模型也可以在您自己的硬體上運行。

適用場景

  • 開放權重讓您可以在託管環境和自建環境之間遷移相同的模型。
  • 稠密 31B 尺寸旨在實現較小 Gemma 4 尺寸所放棄的推理和編碼品質。
  • Google 的模型卡報告顯示,該模型在 MMLU Pro 和 LiveCodeBench v6 等推理與編碼基準測試中表現強勁。
  • 支援超過 140 種語言的多語言覆蓋。

其他選擇建議

  • 它僅支援文字處理且不具備工具呼叫功能,因此代理工作流更適合使用 Gemini 模型。
  • 在長期的自主任務上,它的能力不如 Gemini 3.x Pro 和 Flash 模型。

入門指南

  1. 建立 API 金鑰

    請至 Console 建立金鑰,即可在平台上使用各類模型。

  2. 發送您的第一個請求

    複製您所選語言的範例,並針對端點執行它。

    文字轉文字Chat Completions API
    POST/v1/chat/completions
    curl https://api.tokenlab.sh/v1/chat/completions \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "gemma-4-31b",
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

定價

Official 價格為模型開發商的公開基準價。TokenLab 價格則為您在 TokenLab 使用該模型的實際費用。

預設規格

每 1M Token
Official 定價
輸入 $0.102 / 輸出 $0.297 / 快取讀取 $0.012
Official
輸入 $0.102 / 輸出 $0.297 / 快取讀取 $0.012
折扣
—
Prompt 快取價格

快取讀取

Official 定價
$0.012
Official
$0.012
折扣
—

使用量與活動

成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。

用量與可用性

過去 24 小時
請求數
成功率
P95 延遲
總 Token 用量
模型效能
當達到隱私權與資料量的門檻後,指標才會顯示。

資料基於彙總的使用者請求,不包含狀態檢查。

直接在 Console 裡試

在 Console 中開啟 Gemma 4 31B,並準備好編輯或發送提示詞。

協助我使用 gemma-4-31b 透過 /v1/chat/completions 進行對話,並顯示回覆、延遲與成本。

應用情境

  • 可自託管的助理

    先針對託管模型進行原型設計,若資料規範有要求,再遷移至您自己的 GPU 上。

  • 多語言聊天

    透過單一模型以多種語言回答使用者,這比運行獨立的翻譯工具更能簡化支援架構。

  • 程式碼解釋

    在因政策或託管原因必須使用開放權重模型的環境中,審閱程式碼片段並編寫函式。

  • 微調基礎

    在將開放權重適配到您的領域之前,先與託管基準進行比較。

提示詞範例

將此段落翻譯成西班牙語、德語和日語,並註明您必須改寫的任何慣用語。

解釋此 SQL 查詢的作用,然後重寫它以避免使用相關子查詢。

寫一封簡短且禮貌的回信,拒絕此會議請求並提議改在下週進行。

此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。

FAQ

Gemma 4 31B 是開源的嗎?

Google 根據 Gemma 條款發布權重,這使其成為開放權重模型。在商業使用前請閱讀模型卡上的授權條款,因為它是 Gemma 專屬的授權。

Gemma 與 Gemini 有何不同?

Gemini 模型是 Google 的託管專有產品線。Gemma 模型是基於相關研究構建的較小開放權重模型,您可以下載、微調並自行運行。

它支援工具呼叫嗎?

不支援。託管模型僅處理文字聊天,支援文字輸入與輸出,但不具備工具呼叫功能。若需要呼叫函式的代理,請改用 Gemini 模型。

該模型的大小是多少?

約 310 億參數,稠密模型,是五種 Gemma 4 尺寸(E2B、E4B、12B、26B A4B 和 31B)中最大的一款。較小的尺寸針對手機和筆記型電腦進行了優化。

Gemma 4 31B 的費用是多少?

在 TokenLab 上,Gemma 4 31B 價格為 輸入 $0.102 / 輸出 $0.297 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。

Gemma 4 31B 應該使用哪一個端點?

請使用 https://api.tokenlab.sh/v1/chat/completions 進行 Gemma 4 31B 的呼叫。下方的請求範例展示了對應的程式碼格式。

Gemma 4 31B 支援哪些操作?

Gemma 4 31B 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。

比較 Gemma 4 31B

來源

更新於 2026年10月2日

相關模型