為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

返回模型列表

Gemini 3.8 Flash 與 Gemini 3.1 Flash-Lite 比較

Gemini 3.8 Flash 與 Gemini 3.1 Flash-Lite 比較:在 TokenLab 上並排比較定價、上下文窗口、最大輸出與功能。

該選哪一個

若您需要進行長期的編碼、自主代理和複雜工作流程,且模型需要思考並在多個步驟中保持計畫,請選擇 Gemini 3.8 Flash。若您需要進行互動式功能和高吞吐量的多模態工作,且每個調用都必須快速返回且任務簡單,請選擇 Gemini 3.1 Flash-Lite。決定因素在於速度層級:Flash-Lite 在能力上低於 Flash 層級,並以深度換取回應時間。

價格比較

Gemini 3.8 FlashGemini 3.1 Flash-Lite
模型供應商GoogleGoogle
交付可用性可用可用
上下文視窗1M1M
最大輸出長度64K64K
Official 定價
輸入$0.75每 1M Token輸出$3.75每 1M Token
輸入$0.25每 1M Token輸出$1.50每 1M Token
TokenLab 價格
輸入$0.375每 1M Token輸出$1.88每 1M Token
輸入$0.125每 1M Token輸出$0.75每 1M Token
模型效能
近 30 日成功率
93.4%
近 7 日中位數延遲
9.8 sn=931
近 30 日成功率
97.8%
能力
JSON 模式提示詞快取工具使用視覺辨識
JSON 模式提示詞快取工具使用視覺辨識

選擇 Gemini 3.8 Flash 的時機

  • 您運行涉及多次工具調用的代理或編碼任務
  • 您需要思考能力來進行規劃與除錯
  • 任務複雜度高,Lite 模型可能會給出錯誤答案

選擇 Gemini 3.1 Flash-Lite 的時機

  • 每個調用必須在互動式功能中快速返回
  • 您需要大量處理收據、表單和螢幕截圖
  • 任務簡單,深度推理無法帶來額外價值

差異比較

評估項目Gemini 3.8 FlashGemini 3.1 Flash-Lite
層級Google 最聰明的 Flash 模型。低延遲、低成本模型,低於 Flash 層級。
推理支援在行動前進行思考。非推理優先模型;困難的數學或深度規劃任務應交由更強大的模型處理。
長代理運行設計用於在多個步驟中保持執行緒。在長期的多步驟編碼代理任務中表現較弱。
回應時間較重的模型,以回應時間換取能力。短回應時間適合互動式功能。
共享介面文字與圖像、工具調用、模式綁定 JSON 和快取。相同的輸入與輸出,因此在兩者之間切換不會改變請求格式。

摘要

  • Gemini 3.8 Flash: 輸入 $0.375 / 輸出 $1.88 每 1M Token; Gemini 3.1 Flash-Lite: 輸入 $0.125 / 輸出 $0.75 每 1M Token. 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。
Gemini 3.8 Flash
Gemini 3
檢視詳情
Gemini 3.1 Flash-Lite
Gemini 3
檢視詳情

FAQ

Gemini 3.8 Flash 比 Gemini 3.1 Flash-Lite 更好嗎?

對於複雜的編碼和代理工作,是的:它會在行動前思考並在多個步驟中保持計畫。對於簡單、高吞吐量或對延遲敏感的調用,Flash-Lite 是更合適的選擇,因為它專為快速返回而設計。

Flash-Lite 能在不更改提示詞的情況下取代 Gemini 3.8 Flash 嗎?

請求格式相同,但依賴思考或多步驟規劃的提示詞在 Flash-Lite 上會產生較弱的結果。請先測試這些提示詞,如果品質下降,請保留 3.8 Flash 來處理它們。

哪一個更適合從圖像中提取資料?

Flash-Lite 可處理日常收據、表單和螢幕截圖的大量提取,並返回模式綁定 JSON。當文件雜亂、佈局變化大或提取過程需要判斷時,請使用 3.8 Flash。

我可以同時使用兩者嗎?

可以。將高吞吐量的簡單調用發送給 Flash-Lite 以確保使用者獲得快速回覆,並將驗證失敗或需要規劃的請求升級至 Gemini 3.8 Flash。

Gemini 3.8 Flash 和 Gemini 3.1 Flash-Lite,哪一個更便宜?

Gemini 3.8 Flash: 輸入 $0.375 / 輸出 $1.88 每 1M Token; Gemini 3.1 Flash-Lite: 輸入 $0.125 / 輸出 $0.75 每 1M Token. 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。

Gemini 3.8 Flash 和 Gemini 3.1 Flash-Lite 之間的主要區別是什麼?

這兩款模型具有相似的能力。

來源

更新於 2026年10月2日