Google: Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite- 輸入 / 輸出-50%
- $0.30 / $2.50$0.15 / $1.25
- 上下文
- 1M
- 發布日期
- 2026年7月21日
- 最大輸出長度
- 64K
- 模態
- 視覺辨識對話
- 能力
- 工具使用提示詞快取
關於 Gemini 3.5 Flash-Lite
Gemini 3.5 Flash-Lite 是 Google 3.5 世代中速度最快且最具成本效益的模型,於 2026 年 7 月發布。它針對需要短回應時間的高流量工作:文件處理、資料擷取及小型重複性代理任務。它能讀取文字與圖像、呼叫工具、回傳符合結構描述的 JSON 並快取上下文,Google 目前建議新專案優先採用此模型。
適用場景
- 專為需要重複數千次的工作提供短回應時間而設計。
- 可同時處理文字與圖像,用於文件與截圖處理。
- 符合結構描述的 JSON 可保持擷取輸出的穩定性。
- 函式呼叫使其能執行小型代理步驟,例如查詢或路由。
其他選擇建議
- 長時間的編碼工作階段與複雜的企業工作流程應交由 3.8 Flash 或 3.1 Pro 處理。
- 在處理密集或模糊的文件時,它可能會遺漏較完整的 Flash 模型所能捕捉到的細節。
入門指南
建立 API 金鑰
請至 Console 建立金鑰,即可在平台上使用各類模型。
發送您的第一個請求
複製您所選語言的範例,並針對端點執行它。
文字轉文字Gemini APIPOST/v1beta/models/gemini-3.5-flash-lite:generateContentAPI 格式:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash-lite:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
定價
Verified 享有 TokenLab 優惠價,多數模型更划算。Official 採用原廠定價,提供更穩定的服務。Auto 模式將依據實際完成請求的管道進行計費。
預設規格
每 1M Token- Official 定價
- 輸入 $0.30 / 輸出 $2.50 / 快取讀取 $0.03
- TokenLab 價格
- 輸入 $0.15 / 輸出 $1.25 / 快取讀取 $0.015
- 折扣
- -50%
快取讀取
- Official 定價
- $0.03
- TokenLab 價格
- $0.015
- 折扣
- -50%
| Official 定價每 1M Token | TokenLab 價格每 1M Token | 折扣 | |
|---|---|---|---|
| 預設規格 | 輸入 $0.30 / 輸出 $2.50 / 快取讀取 $0.03 | 輸入 $0.15 / 輸出 $1.25 / 快取讀取 $0.015 | -50% |
| Prompt 快取價格 | |||
| 快取讀取 | $0.03 | $0.015 | -50% |
使用量與活動
成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。
用量與可用性
過去 24 小時- 請求數
- 成功率
- P95 延遲
- 總 Token 用量
- 近 30 日成功率
- 99.7%
- 近 7 日中位數延遲
- 1.9 sn=346
- 近 7 日 P95 延遲
- 7 sn=346
- 近 30 日請求數
- 100+
- 最後活動時間
- 23 小時前
資料基於彙總的使用者請求,不包含狀態檢查。
直接在 Console 裡試
在 Console 中開啟 Gemini 3.5 Flash-Lite,並準備好編輯或發送提示詞。
協助我使用 gemini-3.5-flash-lite 透過 /v1beta/models/gemini-3.5-flash-lite:generateContent 進行對話,並顯示回覆、延遲與成本。
應用情境
適合場景- 視覺辨識
文件管線
大規模將合約、發票與報告轉換為結構化欄位,為每個傳入的檔案寫入一筆經過驗證的 JSON 記錄。
佇列分類
在人工或大型模型處理前,按主題與緊急程度對傳入的工單或訊息進行分類。
小型代理
執行狹窄的工具循環作業,例如訂單查詢或行事曆變更,其中每個步驟都很小且循環頻繁。
視覺檢查
確認上傳的照片符合簡單規則,例如是否有可見標籤或方向是否正確。
提示詞範例
從這張發票中擷取每一項明細作為 JSON,包含描述、數量與單位金額。
將此工單的緊急程度評為低、中或高,並提供一句話的理由。
檢查此產品照片是否清楚顯示包裝標籤;回答是或否並說明原因。
此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。
FAQ
Gemini 3.5 Flash-Lite 的用途是什麼?
快速、重複、簡單的工作:擷取、分類、路由與輕量級多模態檢查。它是 3.5 系列中經濟實惠的選擇,專為回應速度而非深度而建。
它比 Gemini 3.1 Flash-Lite 更新嗎?
是的。它是較新的世代,Google 將其列為新專案推薦的輕量級選擇。舊款 3.1 Flash-Lite 仍可供現有整合使用。
它能讀取圖像嗎?
可以,請求中可包含圖像與文字,回答會以純文字或結構化 JSON 形式回傳,這適用於照片檢查與掃描文件擷取。
什麼時候它會顯得能力不足?
當任務需要持續的推理、仔細的長篇文件分析或數小時的編碼工作時。在這些情況下,請升級至 Gemini 3.8 Flash 或 3.1 Pro。
Gemini 3.5 Flash-Lite 的費用是多少?
在 TokenLab 上,Gemini 3.5 Flash-Lite 價格為 輸入 $0.15 / 輸出 $1.25 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。
Gemini 3.5 Flash-Lite 的上下文長度與輸出限制為何?
Gemini 3.5 Flash-Lite 支援最高 1,048,576 tokens 的上下文,單次回應上限為 65,536 tokens。
Gemini 3.5 Flash-Lite 應該使用哪一個端點?
請使用 https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash-lite:generateContent 進行 Gemini 3.5 Flash-Lite 的呼叫。下方的請求範例展示了對應的程式碼格式。
Gemini 3.5 Flash-Lite 支援哪些操作?
Gemini 3.5 Flash-Lite 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。
比較 Gemini 3.5 Flash-Lite
來源
更新於 2026年10月2日