Google: Gemma 4 31B
gemma-4-31b- 入力 / 出力
- $0.102 / $0.297
- モダリティ
- チャット
Gemma 4 31B について
Gemma 4 31Bは、2026年3月にE2Bから31Bまでのサイズでリリースされた、Googleのオープンウェイトモデル「Gemma 4」ファミリーの中で最大のデンスモデルです。Googleは、このファミリーが推論、エージェントワークフロー、コーディング、マルチモーダル理解のために構築されたと説明しています。プロプライエタリなGeminiモデルとは異なり、重みが公開されているため、同じモデルを自身のハードウェアで実行することも可能です。
得意なこと
- オープンウェイトであるため、同じモデルをホスト環境とセルフホスト環境の間で移行できます。
- デンスな31Bサイズは、より小さなGemma 4サイズでは犠牲にされていた推論能力とコーディング品質をターゲットにしています。
- Googleのモデルカードでは、MMLU ProやLiveCodeBench v6といった推論およびコーディングのベンチマークにおいて強力な結果が報告されています。
- 140以上の言語をカバーする多言語対応。
他のモデルを検討すべきケース
- テキストのみに対応しており、ツール呼び出し機能はないため、エージェントワークフローにはGeminiモデルの方が適しています。
- 長時間の自律的なタスクにおいては、Gemini 3.x ProやFlashモデルよりも能力が劣ります。
はじめに
最初のキーを作成
Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。
最初のリクエストを送信する
お使いの言語の例をコピーして、エンドポイントに対して実行してください。
テキスト・トゥ・テキストChat Completions APIPOST/v1/chat/completionscurl https://api.tokenlab.sh/v1/chat/completions \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "gemma-4-31b", "messages": [ {"role": "user", "content": "Hello!"} ] }'
料金
Official価格はモデル提供者の公開基準です。TokenLab価格はTokenLabでのご利用料金です。
デフォルト仕様
100万トークンあたり- 公式価格
- 入力 $0.102 / 出力 $0.297 / キャッシュ読み取り $0.012
- Official
- 入力 $0.102 / 出力 $0.297 / キャッシュ読み取り $0.012
- 割引
- —
キャッシュ読み取り
- 公式価格
- $0.012
- Official
- $0.012
- 割引
- —
| 公式価格100万トークンあたり | Official100万トークンあたり | 割引 | |
|---|---|---|---|
| デフォルト仕様 | 入力 $0.102 / 出力 $0.297 / キャッシュ読み取り $0.012 | 入力 $0.102 / 出力 $0.297 / キャッシュ読み取り $0.012 | — |
| プロンプトキャッシュ料金 | |||
| キャッシュ読み取り | $0.012 | $0.012 | — |
使用状況とアクティビティ
成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。
使用量と可用性
過去24時間- リクエスト数
- 成功率
- P95 レイテンシ
- 合計トークン数
データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。
Consoleで開く
ConsoleでGemma 4 31Bを開き、プロンプトを編集・送信できます。
gemma-4-31bと/v1/chat/completionsでメッセージをテスト。返答、レイテンシ、コストを表示します。
ユースケース
セルフホスト可能なアシスタント
ホスト型モデルでプロトタイプを作成し、データ規制上の要件がある場合は自身のGPU環境へ移行できます。
多言語チャット
単一のモデルで多くの言語のユーザーに応答できるため、個別の翻訳ツールを運用するよりもサポート体制を簡素化できます。
コード解説
ポリシーやホスティング上の理由でオープンウェイトモデルの使用が必須となる環境において、コードスニペットのレビューや関数の作成を行います。
ファインチューニングのベース
オープンウェイトを特定のドメインに適応させる前に、ホスト型のベースラインと比較できます。
プロンプト例
この段落をスペイン語、ドイツ語、日本語に翻訳し、言い換えが必要だった慣用句があれば注記してください。
このSQLクエリの動作を説明し、相関サブクエリを回避するように書き直してください。
この会議の招待を丁重に断り、来週を提案する短い返信メールを作成してください。
このモデルは条件付き料金です。月間トークン総量だけでは確実な見積もりができません。リクエスト仕様・キャッシュ・該当時間帯に応じた詳細料金をご利用ください。
FAQ
Gemma 4 31Bはオープンソースですか?
GoogleはGemmaの利用規約に基づいて重みを公開しており、これはオープンウェイトモデルとなります。商用利用の前にモデルカードのライセンスを確認してください。これはGemma独自のライセンスであるためです。
GemmaとGeminiの違いは何ですか?
GeminiモデルはGoogleのホスト型プロプライエタリ製品ラインです。Gemmaモデルは、関連する研究から構築されたより小型のオープンウェイトモデルであり、ダウンロード、ファインチューニング、および自身での実行が可能です。
ツール呼び出しをサポートしていますか?
いいえ。ホスト型モデルはテキストチャットのみに対応しており、テキストの入出力のみでツール呼び出し機能はありません。関数を呼び出すエージェントには、代わりにGeminiモデルを使用してください。
モデルのサイズはどれくらいですか?
約310億パラメータのデンスモデルで、E2B、E4B、12B、26B、A4B、31Bという5つのGemma 4サイズの中で最大です。より小さなサイズはスマートフォンやノートPC向けです。
Gemma 4 31B の料金はいくらですか?
TokenLab では Gemma 4 31B は 入力 $0.102 / 出力 $0.297 100万トークンあたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。
Gemma 4 31B はどのエンドポイントを使うべきですか?
Gemma 4 31B のデフォルトは https://api.tokenlab.sh/v1/chat/completions です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。
Gemma 4 31B はどの操作に対応していますか?
Gemma 4 31B は テキスト・トゥ・テキスト に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。
Gemma 4 31B を比較する
ソース
2026/10/02 時点での評価