為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

Google: Gemini 3.5 Flash

Gemini 3.5 Flash 專為持續性編碼與代理程式工作而建。其長文本與工具呼叫功能,適合需要執行多步驟任務,同時需保留文件、程式碼與先前決策的助理。
比較模型
gemini-3.5-flash
可用Google對話輸入快取節省 90%
輸入 / 輸出-50%
$1.50 / $9.00$0.75 / $4.50
上下文
1M
發布日期
2026年5月19日
最大輸出長度
64K
模態
視覺辨識對話
能力
工具使用提示詞快取推理

關於 Gemini 3.5 Flash

Gemini 3.5 Flash 是 Google 推出的穩定 Flash 等級模型,Google 將其描述為針對常規、高吞吐量工作負載在速度與基礎效能方面的基準。它能讀取文字與圖像、呼叫工具、回傳符合架構的 JSON,並支援快取。其定位介於 Flash-Lite 3.5 與後續的 3.6、3.7 及 3.8 Flash 版本之間。

適用場景

  • 一款穩定的通用型 Flash 模型,適用於常規的聊天、擷取與大量摘要任務。
  • 工具呼叫功能支援需要執行數個步驟的助理任務。
  • 圖像輸入功能使其無需額外的視覺模型即可處理螢幕截圖、掃描文件與圖表。
  • 符合架構的 JSON 與上下文快取功能,適合重複性的管線呼叫。

其他選擇建議

  • 後續推出的 3.6、3.7 與 3.8 Flash 模型在程式編寫與代理任務上表現更強。
  • 它沒有專屬的思考模式,因此複雜的多步驟推理任務建議交由其他模型處理。

入門指南

  1. 建立 API 金鑰

    請至 Console 建立金鑰,即可在平台上使用各類模型。

  2. 發送您的第一個請求

    複製您所選語言的範例,並針對端點執行它。

    文字轉文字Gemini API
    POST/v1beta/models/gemini-3.5-flash:generateContent
    API 格式:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

定價

Verified 價格用於 Verified,多數模型更便宜;Official 價格是模型廠商公布的價格,用於更穩定的 Official。Auto 按最終完成請求的線路計價。

預設規格

每 1M Token
Official 價格
輸入 $1.50 / 輸出 $9.00 / 快取讀取 $0.15
Verified 價格
輸入 $0.75 / 輸出 $4.50 / 快取讀取 $0.075
折扣
-50%
Prompt 快取價格

快取讀取

Official 價格
$0.15
Verified 價格
$0.075
折扣
-50%
工具費用

僅在模型呼叫工具時,依使用次數計費。

網路搜尋

Official 價格
$0.014/次搜尋
Verified 價格
$0.007/次搜尋
折扣
-50%

使用量與活動

成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。

用量與可用性

過去 24 小時
請求數
成功率
P95 延遲
總 Token 用量
模型效能
近 30 日成功率
95.0%
近 30 日請求數
1K+
最後活動時間
3 小時前

資料基於彙總的使用者請求,不包含狀態檢查。

直接在 Console 裡試

在 Console 中開啟 Gemini 3.5 Flash,並準備好編輯或發送提示詞。

協助我使用 gemini-3.5-flash 透過 /v1beta/models/gemini-3.5-flash:generateContent 進行對話,並顯示回覆、延遲與成本。

應用情境

適合場景
  • 推理
  • 視覺辨識
  • 面向客戶的聊天服務

    利用提示詞前綴中的快取知識庫來回答產品相關問題。

  • 批次摘要

    摘要通話逐字稿或工單,並為每個項目輸出固定的 JSON 摘要。

  • 表單與文件讀取

    從掃描的表單與送貨單中提取欄位,轉化為下游系統可直接載入的結構化記錄。

  • 入門級程式編寫輔助

    解釋程式碼、編寫小型函式,以及草擬對深度要求不高的單元測試。

提示詞範例

請將此支援逐字稿摘要為三點,並將 'resolved'(已解決)設為 true 或 false。

讀取此掃描的送貨單,並以 JSON 格式回傳訂單編號、項目與簽收狀態。

編寫一個能解析雜亂字串中 ISO 日期的 Python 函式,並提供五個測試案例。

此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。

FAQ

什麼是 Gemini 3.5 Flash?

一款穩定的 Flash 等級 Gemini 模型,旨在處理常規、高吞吐量的任務。它能接收文字與圖像、使用工具並產生結構化輸出,重點在於穩定的速度而非極致的深度。

它與 Gemini 3.5 Flash-Lite 有何不同?

Flash-Lite 是 Google 最快速且最經濟的 3.5 模型;Flash 則是功能更全面的模型,適用於需要更多處理細節的任務。標記與擷取任務請選擇 Lite,對話與較長輸出則選擇 Flash。

它適合用於程式編寫代理嗎?

它可以處理小型程式編寫任務,但 Google 後續推出的 3.7 與 3.8 Flash 模型才是針對複雜程式編寫與長週期代理所設計的。當工作簡單且量大時,請使用 3.5 Flash。

它支援圖像與快取嗎?

兩者皆支援。圖像可在單一請求中與文字一併提供,而上下文快取則可在多次請求中重複使用長共享前綴,例如固定的指令集。

Gemini 3.5 Flash 的費用是多少?

在 TokenLab 上,Gemini 3.5 Flash 價格為 輸入 $0.75 / 輸出 $4.50 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。

Gemini 3.5 Flash 的上下文長度與輸出限制為何?

Gemini 3.5 Flash 支援最高 1,048,576 tokens 的上下文,單次回應上限為 65,536 tokens。

Gemini 3.5 Flash 應該使用哪一個端點?

請使用 https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash:generateContent 進行 Gemini 3.5 Flash 的呼叫。下方的請求範例展示了對應的程式碼格式。

Gemini 3.5 Flash 支援哪些操作?

Gemini 3.5 Flash 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。

比較 Gemini 3.5 Flash

使用 Gemini 3.5 Flash 的指南

來源

更新於 2026年10月2日

更多來自 Gemini 3 的模型

相關模型