Google: Gemini 3.5 Flash
gemini-3.5-flash- 入力 / 出力-50%
- $1.50 / $9.00$0.75 / $4.50
- コンテキスト
- 1M
- リリース日
- 2026年5月19日
- 最大出力
- 64K
- モダリティ
- ビジョンチャット
- 機能
- ツール利用プロンプトキャッシュ推論
Gemini 3.5 Flash について
Gemini 3.5 Flashは、Googleによる安定したFlashティアのモデルであり、日常的な高スループットのワークロードにおいて、速度と基礎的なパフォーマンスの基準となるモデルとして位置付けられています。テキストや画像の読み取り、ツールの呼び出し、スキーマに準拠したJSONの出力、およびキャッシュをサポートしています。Flash-Lite 3.5と、その後の3.6、3.7、3.8 Flashリリースの間に位置するモデルです。
得意なこと
- 日常的なチャット、抽出、大量の要約処理に適した、安定した汎用Flashモデルです。
- ツール呼び出し機能により、いくつかのステップを経てタスクを遂行するアシスタントをサポートします。
- 画像入力に対応しており、別のビジョンモデルを介さずにスクリーンショット、スキャンデータ、グラフを処理できます。
- スキーマに準拠したJSON出力とコンテキストキャッシュは、繰り返し行われるパイプライン呼び出しに適しています。
他のモデルを検討すべきケース
- 後の3.6、3.7、3.8 Flashモデルは、コーディングやエージェントタスクにおいてより高い能力を発揮します。
- 専用の思考モードを備えていないため、複雑な多段階の推論が必要な場合は他のモデルの使用が適しています。
はじめに
最初のキーを作成
Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。
最初のリクエストを送信する
お使いの言語の例をコピーして、エンドポイントに対して実行してください。
テキスト・トゥ・テキストGemini APIPOST/v1beta/models/gemini-3.5-flash:generateContentAPI形式:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
料金
Verified 価格は Verified に適用され、多くのモデルでより低コストです。Official 価格はモデルのメーカーが公表する価格で、信頼性の高い Official ルートに適用されます。Auto はリクエストを完了したルートの価格で課金します。
デフォルト仕様
100万トークンあたり- Official 価格
- 入力 $1.50 / 出力 $9.00 / キャッシュ読み取り $0.15
- Verified 価格
- 入力 $0.75 / 出力 $4.50 / キャッシュ読み取り $0.075
- 割引
- -50%
キャッシュ読み取り
- Official 価格
- $0.15
- Verified 価格
- $0.075
- 割引
- -50%
ツール利用時のみ、呼び出しごとに料金が発生します。
ウェブ検索
- Official 価格
- $0.014/検索
- Verified 価格
- $0.007/検索
- 割引
- -50%
| Official 価格100万トークンあたり | Verified 価格100万トークンあたり | 割引 | |
|---|---|---|---|
| デフォルト仕様 | 入力 $1.50 / 出力 $9.00 / キャッシュ読み取り $0.15 | 入力 $0.75 / 出力 $4.50 / キャッシュ読み取り $0.075 | -50% |
| プロンプトキャッシュ料金 | |||
| キャッシュ読み取り | $0.15 | $0.075 | -50% |
| ツール利用料ツール利用時のみ、呼び出しごとに料金が発生します。 | |||
| ウェブ検索 | $0.014/検索 | $0.007/検索 | -50% |
使用状況とアクティビティ
成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。
使用量と可用性
過去24時間- リクエスト数
- 成功率
- P95 レイテンシ
- 合計トークン数
- 30日間の成功率
- 94.8%
- 30日間のリクエスト数
- 1K+
- 最終利用
- 8 分前
データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。
Consoleで開く
ConsoleでGemini 3.5 Flashを開き、プロンプトを編集・送信できます。
gemini-3.5-flashと/v1beta/models/gemini-3.5-flash:generateContentでメッセージをテスト。返答、レイテンシ、コストを表示します。
ユースケース
向いている用途- 推論
- ビジョン
顧客対応チャット
プロンプトの先頭にキャッシュされたナレッジベースを使用して、製品に関する質問に回答します。
バッチ要約
通話の書き起こしやチケットを要約し、項目ごとに固定形式のJSONで出力します。
フォームおよびドキュメントの読み取り
スキャンされたフォームや納品書からフィールドを抽出し、後続のシステムが直接読み込める構造化データに変換します。
エントリーレベルのコーディング支援
コードの解説、小さな関数の作成、および深さが重要ではない単体テストのドラフト作成を行います。
プロンプト例
このサポートの書き起こしを3つの箇条書きで要約し、「解決済み」をtrueまたはfalseで設定してください。
このスキャンされた納品書を読み取り、注文番号、品目、署名状況をJSON形式で返してください。
複雑な文字列からISO形式の日付を解析するPython関数と、5つのテストケースを作成してください。
このモデルは条件付き料金です。月間トークン総量だけでは確実な見積もりができません。リクエスト仕様・キャッシュ・該当時間帯に応じた詳細料金をご利用ください。
FAQ
Gemini 3.5 Flashとは何ですか?
日常的な高スループットタスクを目的とした、安定したFlashティアのGeminiモデルです。テキストと画像を受け取り、ツールを使用し、構造化された出力を生成します。最大限の深さよりも安定した速度を重視しています。
Gemini 3.5 Flash-Liteとどう違いますか?
Flash-LiteはGoogleの3.5モデルの中で最も高速かつ経済的であり、Flashはより丁寧な対応が必要なタスク向けのモデルです。タグ付けや抽出にはLiteを、会話や長文の出力にはFlashを選択してください。
コーディングエージェントに適していますか?
小規模なコーディングタスクは処理できますが、複雑なコーディングや長期的なエージェントには、Googleの後の3.7および3.8 Flashモデルが推奨されます。単純な作業でボリュームが多い場合は3.5 Flashを使用してください。
画像とキャッシュをサポートしていますか?
はい、両方サポートしています。画像はテキストと同じリクエスト内に含めることができ、コンテキストキャッシュは固定の指示セットなど、長い共有プレフィックスを多くのリクエスト間で再利用します。
Gemini 3.5 Flash の料金はいくらですか?
TokenLab では Gemini 3.5 Flash は 入力 $0.75 / 出力 $4.50 100万トークンあたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。
Gemini 3.5 Flash のコンテキストウィンドウと出力制限は?
Gemini 3.5 Flash は最大 1,048,576 トークンのコンテキストに対応し、1回のレスポンスで最大 65,536 トークンまで出力可能です。
Gemini 3.5 Flash はどのエンドポイントを使うべきですか?
Gemini 3.5 Flash のデフォルトは https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash:generateContent です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。
Gemini 3.5 Flash はどの操作に対応していますか?
Gemini 3.5 Flash は テキスト・トゥ・テキスト に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。
Gemini 3.5 Flash を比較する
Gemini 3.5 Flash を活用するガイド
ソース
2026/10/02 時点での評価