各リクエストに対して Auto、TokenLab Verified、または Official を選択でき、価格は事前に表示されます。新機能を見る

Google: Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Liteは、短い応答時間が求められる大量の処理を対象としています。繰り返し実行されるドキュメント処理や抽出、小規模なエージェントタスクなど、テキストや視覚情報の入力を効率的に扱う必要がある場合に適しています。
モデルを比較
gemini-3.5-flash-lite
利用可能Googleチャット入力キャッシュで90%オフ
入力 / 出力-50%
$0.30 / $2.50$0.15 / $1.25
コンテキスト
1M
リリース日
2026年7月21日
最大出力
64K
モダリティ
ビジョンチャット
機能
ツール利用プロンプトキャッシュ

Gemini 3.5 Flash-Lite について

Gemini 3.5 Flash-Liteは、2026年7月にリリースされた、3.5世代におけるGoogleの最も高速で費用対効果の高いモデルです。ドキュメント処理、抽出、小規模な反復エージェントタスクなど、短い応答時間が重要となる大量の作業を対象としています。テキストと画像を読み取り、ツールを呼び出し、スキーマに準拠したJSONを返し、コンテキストをキャッシュします。Googleは現在、新規プロジェクトに対して本モデルを推奨しています。

得意なこと

  • 何千回も繰り返される作業において、短い応答時間を実現するように設計されています。
  • ドキュメントやスクリーンショットの処理のために、テキストと画像を組み合わせて扱います。
  • スキーマに準拠したJSONにより、抽出結果の一貫性を保ちます。
  • 関数呼び出しにより、ルックアップやルーティングといった小規模なエージェントステップを実行できます。

他のモデルを検討すべきケース

  • 長時間のコーディングセッションや複雑なエンタープライズワークフローは、3.8 Flashまたは3.1 Proに適しています。
  • 密度が高かったり曖昧だったりするドキュメントでは、より上位のFlashモデルが捉えられる詳細を見落とす可能性があります。

はじめに

  1. 最初のキーを作成

    Consoleでキーを作成すれば、プラットフォーム内のすべてのモデルで使えます。

  2. 最初のリクエストを送信する

    お使いの言語の例をコピーして、エンドポイントに対して実行してください。

    テキスト・トゥ・テキストGemini API
    POST/v1beta/models/gemini-3.5-flash-lite:generateContent
    API形式:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash-lite:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

料金

VerifiedはTokenLab価格で低コストに、Officialは提供元の価格で高い信頼性を提供します。Autoはリクエストを完了したルートの料金を適用します。

デフォルト仕様

100万トークンあたり
公式価格
入力 $0.30 / 出力 $2.50 / キャッシュ読み取り $0.03
TokenLab 価格
入力 $0.15 / 出力 $1.25 / キャッシュ読み取り $0.015
割引
-50%
プロンプトキャッシュ料金

キャッシュ読み取り

公式価格
$0.03
TokenLab 価格
$0.015
割引
-50%

使用状況とアクティビティ

成功率は完了したリクエストの割合です。レイテンシは完全なレスポンスにかかる時間で、P95 は 95% のリクエストがその時間内に完了したことを意味します。

使用量と可用性

過去24時間
リクエスト数
成功率
P95 レイテンシ
合計トークン数
モデルパフォーマンス
30日間の成功率
99.7%
過去7日間の中央値レイテンシ
1.9 sn=346
7日間のP95レイテンシ
7 sn=346
30日間のリクエスト数
100+
最終利用
19 時間前

データはステータスチェックを除外した、集計済みのユーザーリクエストに基づいています。

Consoleで開く

ConsoleでGemini 3.5 Flash-Liteを開き、プロンプトを編集・送信できます。

gemini-3.5-flash-liteと/v1beta/models/gemini-3.5-flash-lite:generateContentでメッセージをテスト。返答、レイテンシ、コストを表示します。

ユースケース

向いている用途
  • ビジョン
  • ドキュメントパイプライン

    契約書、請求書、レポートを大規模に構造化フィールドへ変換し、入力されるファイルごとに検証済みのJSONレコードを1つ作成します。

  • キューのトリアージ

    人間やより大きなモデルが確認する前に、受信したチケットやメッセージをトピックと緊急度で分類します。

  • 小規模エージェント

    注文の照会やカレンダーの変更など、各ステップが小さく、ループが頻繁に繰り返される限定的なツールループジョブを実行します。

  • 視覚チェック

    アップロードされた写真が、目に見えるラベルや正しい向きなど、単純なルールを満たしているかを確認します。

プロンプト例

この請求書からすべての品目を、説明、数量、単価を含むJSONとして抽出してください。

このチケットの緊急度を低、中、高で評価し、その根拠となる一文を提示してください。

この製品写真にパッケージのラベルがはっきりと写っているか確認してください。はいかいいえで答え、その理由を述べてください。

このモデルは条件付き料金です。月間トークン総量だけでは確実な見積もりができません。リクエスト仕様・キャッシュ・該当時間帯に応じた詳細料金をご利用ください。

FAQ

Gemini 3.5 Flash-Liteは何のためのものですか?

抽出、分類、ルーティング、軽量なマルチモーダルチェックといった、高速で反復的な単純作業用です。3.5ファミリーの中で経済的な位置付けにあり、深さよりも応答時間を重視して構築されています。

Gemini 3.1 Flash-Liteより新しいですか?

はい。後の世代であり、Googleは新規プロジェクト向けの軽量な選択肢として推奨しています。古い3.1 Flash-Liteも既存の統合向けに引き続き利用可能です。

画像を読み取れますか?

はい。リクエストにテキストと画像を添えることができ、回答はプレーンテキストまたは構造化JSONとして返されるため、写真チェックやスキャンされたドキュメントの抽出に適しています。

いつ能力不足になりますか?

持続的な推論、慎重な長文ドキュメント分析、または数時間にわたるコーディング作業が必要な場合です。その場合はGemini 3.8 Flashまたは3.1 Proにステップアップしてください。

Gemini 3.5 Flash-Lite の料金はいくらですか?

TokenLab では Gemini 3.5 Flash-Lite は 入力 $0.15 / 出力 $1.25 100万トークンあたり です。詳細は上の料金表を参照してください。 料金は課金単位・仕様・使用量によって異なります。モデルの詳細な料金で同条件同士を比較してください。単一のレートで総額は決まりません。

Gemini 3.5 Flash-Lite のコンテキストウィンドウと出力制限は?

Gemini 3.5 Flash-Lite は最大 1,048,576 トークンのコンテキストに対応し、1回のレスポンスで最大 65,536 トークンまで出力可能です。

Gemini 3.5 Flash-Lite はどのエンドポイントを使うべきですか?

Gemini 3.5 Flash-Lite のデフォルトは https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash-lite:generateContent です。プロバイダーネイティブ形式に対応している場合は、API workbench にそのエンドポイントも表示されます。

Gemini 3.5 Flash-Lite はどの操作に対応していますか?

Gemini 3.5 Flash-Lite は テキスト・トゥ・テキスト に対応しています。上の API workbench で操作を選ぶと、対応するエンドポイントとコード例が表示されます。

Gemini 3.5 Flash-Lite を比較する

ソース

2026/10/02 時点での評価

Gemini 3 の他のモデル

関連モデル