各リクエストに対して Auto、TokenLab Verified、または Official を選択でき、価格は事前に表示されます。新機能を見る

Google: Gemini 3.7 Flash

エージェントワークフロー、コーディング、マルチモーダル推論のための高効率なGeminiモデル
モデルを比較
gemini-3.7-flash
利用可能Googleチャット入力キャッシュで90%オフ
入力 / 出力-50%
$0.75 / $3.75$0.375 / $1.88
コンテキスト
1M
リリース日
2026年8月13日
最大出力
64K
モダリティ
ビジョンチャット
機能
ツール利用プロンプトキャッシュ

Gemini 3.7 Flash について

Gemini 3.7 Flashは、2026年8月にリリースされたGoogleの安定版Flashティアモデルであり、複雑なコーディング、エージェントワークフロー、および信頼性の高いマルチステップ実行のために構築されたとGoogleは説明しています。テキストと画像を読み取り、思考(thinking)をサポートし、ツール呼び出しやスキーマ準拠のJSON出力、コンテキストキャッシュが可能です。3.6 Flashの1つ上のモデルであり、3.8 Flashの1つ下のモデルです。

得意なこと

  • 回答の前に推論(Reasoning)を実行できるため、コーディングやマルチステップのタスクに役立ちます。
  • 信頼性の高いマルチステップ実行が設計上の目標として掲げられており、エージェントが作業の進捗を見失ってはならない場合に有用です。
  • ツール呼び出しとスキーマ準拠のJSON出力により、結果を他のシステムへ容易に組み込むことができます。
  • 画像入力は、スクリーンショット、図表、スキャンされたドキュメントに対応しています。

他のモデルを検討すべきケース

  • Gemini 3.8 Flashは、GoogleがFlashティアの中で最も高性能であると提示している新しいモデルです。
  • 思考(Thinking)はレイテンシを増加させるため、単純な検索にはFlash-Liteの方が適しています。

はじめに

  1. 最初のキーを作成

    Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。

  2. 最初のリクエストを送信する

    お使いの言語の例をコピーして、エンドポイントに対して実行してください。

    テキスト・トゥ・テキストGemini API
    POST/v1beta/models/gemini-3.7-flash:generateContent
    API形式:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

料金

Verified 価格は Verified に適用され、多くのモデルでより低コストです。Official 価格はモデルのメーカーが公表する価格で、信頼性の高い Official ルートに適用されます。Auto はリクエストを完了したルートの価格で課金します。

Promotional Standard

100万トークンあたり
Official 価格
入力 $0.75 / 出力 $3.75 / キャッシュ読み取り $0.075
Verified 価格
入力 $0.375 / 出力 $1.88 / キャッシュ読み取り $0.0375
割引
-50%
プロンプトキャッシュ料金

キャッシュ読み取り

Official 価格
$0.075
Verified 価格
$0.0375
割引
-50%
ツール利用料

ツール利用時のみ、呼び出しごとに料金が発生します。

ウェブ検索

Official 価格
$0.014/検索
Verified 価格
$0.007/検索
割引
-50%

使用状況とアクティビティ

成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。

使用量と可用性

過去24時間
リクエスト数
成功率
P95 レイテンシ
合計トークン数
モデルパフォーマンス
30日間の成功率
99.8%
過去7日間の中央値レイテンシ
13.3 sn=278
7日間のP95レイテンシ
52.4 sn=278
30日間のリクエスト数
1K+
最終利用
15 時間前

データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。

Consoleで開く

ConsoleでGemini 3.7 Flashを開き、プロンプトを編集・送信できます。

gemini-3.7-flashと/v1beta/models/gemini-3.7-flash:generateContentでメッセージをテスト。返答、レイテンシ、コストを表示します。

ユースケース

向いている用途
  • ビジョン
  • 機能実装

    エージェントにチケットを読み込ませ、複数のファイルを編集し、テストを実行させます。

  • ワークフローの自動化

    各ステップが前のステップに依存するような、承認、検索、通知の連鎖を行います。

  • コードレビュー

    差分(diff)を読み取り、リスクのある変更を指摘し、人間が迅速に承認判断を下せるよう各発見事項を説明します。

  • データクリーンアップ

    不整合なレコードを推論し、適用前に正規化ルールを提案することで、クリーンアップ作業の監査を可能にします。

プロンプト例

このチケットとリンクされたファイルを読み取り、変更を実装し、実行したテストをリストアップしてください。

この差分をレビューし、並行処理のバグを確認して、深刻度順に結果をランク付けしてください。

これら2つの顧客レコードは重複しているようです。どのフィールドが競合しているか、またどのようなルールで安全に統合できるかを説明してください。

このモデルは条件付き料金です。月間トークン総量だけでは確実な見積もりができません。リクエスト仕様・キャッシュ・該当時間帯に応じた詳細料金をご利用ください。

FAQ

Gemini 3.7 Flashは何のために設計されていますか?

複雑なコーディング、エージェントワークフロー、および最初から最後まで信頼性を維持する必要があるマルチステップ実行です。ツールと画像入力をサポートし、思考が可能なFlashモデルです。

思考(Thinking)をサポートしていますか?

はい。回答前に推論を行うことができ、コードや計画作成の結果を向上させます。短い対話形式のやり取りでは、応答を速く保つためにその負荷を低く抑えてください。

3.6 Flashとはどう違いますか?

3.7 Flashは後のモデルであり、推論機能が追加され、信頼性の高いマルチステップ実行により重点を置いています。3.6 Flashは、思考機能なしでのコーディングループや視覚的推論を中心に構成されています。

3.8 Flashの方が良い選択肢ですか?

長期的なソフトウェアエンジニアリングにおいては、多くの場合そうです。3.7 Flashは、すでにプロンプトの調整が済んでおり、その結果が基準を満たしている場合には、依然として妥当な選択肢です。

Gemini 3.7 Flash の料金はいくらですか?

TokenLab では Gemini 3.7 Flash は 入力 $0.375 / 出力 $1.88 100万トークンあたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。

Gemini 3.7 Flash のコンテキストウィンドウと出力制限は?

Gemini 3.7 Flash は最大 1,048,576 トークンのコンテキストに対応し、1回のレスポンスで最大 65,536 トークンまで出力可能です。

Gemini 3.7 Flash はどのエンドポイントを使うべきですか?

Gemini 3.7 Flash のデフォルトは https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。

Gemini 3.7 Flash はどの操作に対応していますか?

Gemini 3.7 Flash は テキスト・トゥ・テキスト に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。

Gemini 3.7 Flash を比較する

ソース

2026/10/02 時点での評価

Gemini 3 の他のモデル

関連モデル