為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

Google: Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite 針對高流量、短回應時間的工作。適用於文件處理、擷取,以及需要高效處理文字與視覺輸入、且需重複執行的較小型代理程式任務。
比較模型
gemini-3.5-flash-lite
可用Google對話輸入快取節省 90%
輸入 / 輸出-50%
$0.30 / $2.50$0.15 / $1.25
上下文
1M
發布日期
2026年7月21日
最大輸出長度
64K
模態
視覺辨識對話
能力
工具使用提示詞快取

關於 Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite 是 Google 3.5 世代中速度最快且最具成本效益的模型,於 2026 年 7 月發布。它針對需要短回應時間的高流量工作:文件處理、資料擷取及小型重複性代理任務。它能讀取文字與圖像、呼叫工具、回傳符合結構描述的 JSON 並快取上下文,Google 目前建議新專案優先採用此模型。

適用場景

  • 專為需要重複數千次的工作提供短回應時間而設計。
  • 可同時處理文字與圖像,用於文件與截圖處理。
  • 符合結構描述的 JSON 可保持擷取輸出的穩定性。
  • 函式呼叫使其能執行小型代理步驟,例如查詢或路由。

其他選擇建議

  • 長時間的編碼工作階段與複雜的企業工作流程應交由 3.8 Flash 或 3.1 Pro 處理。
  • 在處理密集或模糊的文件時,它可能會遺漏較完整的 Flash 模型所能捕捉到的細節。

入門指南

  1. 建立 API 金鑰

    請至 Console 建立金鑰,即可在平台上使用各類模型。

  2. 發送您的第一個請求

    複製您所選語言的範例,並針對端點執行它。

    文字轉文字Gemini API
    POST/v1beta/models/gemini-3.5-flash-lite:generateContent
    API 格式:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash-lite:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

定價

Verified 享有 TokenLab 優惠價,多數模型更划算。Official 採用原廠定價,提供更穩定的服務。Auto 模式將依據實際完成請求的管道進行計費。

預設規格

每 1M Token
Official 定價
輸入 $0.30 / 輸出 $2.50 / 快取讀取 $0.03
TokenLab 價格
輸入 $0.15 / 輸出 $1.25 / 快取讀取 $0.015
折扣
-50%
Prompt 快取價格

快取讀取

Official 定價
$0.03
TokenLab 價格
$0.015
折扣
-50%

使用量與活動

成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。

用量與可用性

過去 24 小時
請求數
成功率
P95 延遲
總 Token 用量
模型效能
近 30 日成功率
99.7%
近 7 日中位數延遲
1.9 sn=346
近 7 日 P95 延遲
7 sn=346
近 30 日請求數
100+
最後活動時間
23 小時前

資料基於彙總的使用者請求,不包含狀態檢查。

直接在 Console 裡試

在 Console 中開啟 Gemini 3.5 Flash-Lite,並準備好編輯或發送提示詞。

協助我使用 gemini-3.5-flash-lite 透過 /v1beta/models/gemini-3.5-flash-lite:generateContent 進行對話,並顯示回覆、延遲與成本。

應用情境

適合場景
  • 視覺辨識
  • 文件管線

    大規模將合約、發票與報告轉換為結構化欄位,為每個傳入的檔案寫入一筆經過驗證的 JSON 記錄。

  • 佇列分類

    在人工或大型模型處理前,按主題與緊急程度對傳入的工單或訊息進行分類。

  • 小型代理

    執行狹窄的工具循環作業,例如訂單查詢或行事曆變更,其中每個步驟都很小且循環頻繁。

  • 視覺檢查

    確認上傳的照片符合簡單規則,例如是否有可見標籤或方向是否正確。

提示詞範例

從這張發票中擷取每一項明細作為 JSON,包含描述、數量與單位金額。

將此工單的緊急程度評為低、中或高,並提供一句話的理由。

檢查此產品照片是否清楚顯示包裝標籤;回答是或否並說明原因。

此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。

FAQ

Gemini 3.5 Flash-Lite 的用途是什麼?

快速、重複、簡單的工作:擷取、分類、路由與輕量級多模態檢查。它是 3.5 系列中經濟實惠的選擇,專為回應速度而非深度而建。

它比 Gemini 3.1 Flash-Lite 更新嗎?

是的。它是較新的世代,Google 將其列為新專案推薦的輕量級選擇。舊款 3.1 Flash-Lite 仍可供現有整合使用。

它能讀取圖像嗎?

可以,請求中可包含圖像與文字,回答會以純文字或結構化 JSON 形式回傳,這適用於照片檢查與掃描文件擷取。

什麼時候它會顯得能力不足?

當任務需要持續的推理、仔細的長篇文件分析或數小時的編碼工作時。在這些情況下,請升級至 Gemini 3.8 Flash 或 3.1 Pro。

Gemini 3.5 Flash-Lite 的費用是多少?

在 TokenLab 上,Gemini 3.5 Flash-Lite 價格為 輸入 $0.15 / 輸出 $1.25 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。

Gemini 3.5 Flash-Lite 的上下文長度與輸出限制為何?

Gemini 3.5 Flash-Lite 支援最高 1,048,576 tokens 的上下文,單次回應上限為 65,536 tokens。

Gemini 3.5 Flash-Lite 應該使用哪一個端點?

請使用 https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash-lite:generateContent 進行 Gemini 3.5 Flash-Lite 的呼叫。下方的請求範例展示了對應的程式碼格式。

Gemini 3.5 Flash-Lite 支援哪些操作?

Gemini 3.5 Flash-Lite 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。

比較 Gemini 3.5 Flash-Lite

來源

更新於 2026年10月2日

更多來自 Gemini 3 的模型

相關模型