各リクエストに対して Auto、TokenLab Verified、または Official を選択でき、価格は事前に表示されます。新機能を見る

Google: Gemma 4 31B

Gemma 4 31Bは、テキスト会話、コーディング、多言語タスクに対応したGoogleのデンス型オープンウェイトモデルです。このTokenLabモデルは、検証済みのテキストChat Completionsコントラクトを公開しています。
モデルを比較
gemma-4-31b
利用可能Googleチャット
入力 / 出力
$0.102 / $0.297
モダリティ
チャット

Gemma 4 31B について

Gemma 4 31Bは、2026年3月にE2Bから31Bまでのサイズでリリースされた、Googleのオープンウェイトモデル「Gemma 4」ファミリーの中で最大のデンスモデルです。Googleは、このファミリーが推論、エージェントワークフロー、コーディング、マルチモーダル理解のために構築されたと説明しています。プロプライエタリなGeminiモデルとは異なり、重みが公開されているため、同じモデルを自身のハードウェアで実行することも可能です。

得意なこと

  • オープンウェイトであるため、同じモデルをホスト環境とセルフホスト環境の間で移行できます。
  • デンスな31Bサイズは、より小さなGemma 4サイズでは犠牲にされていた推論能力とコーディング品質をターゲットにしています。
  • Googleのモデルカードでは、MMLU ProやLiveCodeBench v6といった推論およびコーディングのベンチマークにおいて強力な結果が報告されています。
  • 140以上の言語をカバーする多言語対応。

他のモデルを検討すべきケース

  • テキストのみに対応しており、ツール呼び出し機能はないため、エージェントワークフローにはGeminiモデルの方が適しています。
  • 長時間の自律的なタスクにおいては、Gemini 3.x ProやFlashモデルよりも能力が劣ります。

はじめに

  1. 最初のキーを作成

    Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。

  2. 最初のリクエストを送信する

    お使いの言語の例をコピーして、エンドポイントに対して実行してください。

    テキスト・トゥ・テキストChat Completions API
    POST/v1/chat/completions
    curl https://api.tokenlab.sh/v1/chat/completions \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "gemma-4-31b",
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

料金

Official価格はモデル提供者の公開基準です。TokenLab価格はTokenLabでのご利用料金です。

デフォルト仕様

100万トークンあたり
公式価格
入力 $0.102 / 出力 $0.297 / キャッシュ読み取り $0.012
Official
入力 $0.102 / 出力 $0.297 / キャッシュ読み取り $0.012
割引
—
プロンプトキャッシュ料金

キャッシュ読み取り

公式価格
$0.012
Official
$0.012
割引
—

使用状況とアクティビティ

成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。

使用量と可用性

過去24時間
リクエスト数
成功率
P95 レイテンシ
合計トークン数
モデルパフォーマンス
プライバシーおよびデータ量のしきい値に達すると、メトリクスが表示されます。

データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。

Consoleで開く

ConsoleでGemma 4 31Bを開き、プロンプトを編集・送信できます。

gemma-4-31bと/v1/chat/completionsでメッセージをテスト。返答、レイテンシ、コストを表示します。

ユースケース

  • セルフホスト可能なアシスタント

    ホスト型モデルでプロトタイプを作成し、データ規制上の要件がある場合は自身のGPU環境へ移行できます。

  • 多言語チャット

    単一のモデルで多くの言語のユーザーに応答できるため、個別の翻訳ツールを運用するよりもサポート体制を簡素化できます。

  • コード解説

    ポリシーやホスティング上の理由でオープンウェイトモデルの使用が必須となる環境において、コードスニペットのレビューや関数の作成を行います。

  • ファインチューニングのベース

    オープンウェイトを特定のドメインに適応させる前に、ホスト型のベースラインと比較できます。

プロンプト例

この段落をスペイン語、ドイツ語、日本語に翻訳し、言い換えが必要だった慣用句があれば注記してください。

このSQLクエリの動作を説明し、相関サブクエリを回避するように書き直してください。

この会議の招待を丁重に断り、来週を提案する短い返信メールを作成してください。

このモデルは条件付き料金です。月間トークン総量だけでは確実な見積もりができません。リクエスト仕様・キャッシュ・該当時間帯に応じた詳細料金をご利用ください。

FAQ

Gemma 4 31Bはオープンソースですか?

GoogleはGemmaの利用規約に基づいて重みを公開しており、これはオープンウェイトモデルとなります。商用利用の前にモデルカードのライセンスを確認してください。これはGemma独自のライセンスであるためです。

GemmaとGeminiの違いは何ですか?

GeminiモデルはGoogleのホスト型プロプライエタリ製品ラインです。Gemmaモデルは、関連する研究から構築されたより小型のオープンウェイトモデルであり、ダウンロード、ファインチューニング、および自身での実行が可能です。

ツール呼び出しをサポートしていますか?

いいえ。ホスト型モデルはテキストチャットのみに対応しており、テキストの入出力のみでツール呼び出し機能はありません。関数を呼び出すエージェントには、代わりにGeminiモデルを使用してください。

モデルのサイズはどれくらいですか?

約310億パラメータのデンスモデルで、E2B、E4B、12B、26B、A4B、31Bという5つのGemma 4サイズの中で最大です。より小さなサイズはスマートフォンやノートPC向けです。

Gemma 4 31B の料金はいくらですか?

TokenLab では Gemma 4 31B は 入力 $0.102 / 出力 $0.297 100万トークンあたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。

Gemma 4 31B はどのエンドポイントを使うべきですか?

Gemma 4 31B のデフォルトは https://api.tokenlab.sh/v1/chat/completions です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。

Gemma 4 31B はどの操作に対応していますか?

Gemma 4 31B は テキスト・トゥ・テキスト に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。

Gemma 4 31B を比較する

ソース

2026/10/02 時点での評価

関連モデル