Google: Gemini 3.5 Flash
gemini-3.5-flash- 輸入 / 輸出-50%
- $1.50 / $9.00$0.75 / $4.50
- 上下文
- 1M
- 發布日期
- 2026年5月19日
- 最大輸出長度
- 64K
- 模態
- 視覺辨識對話
- 能力
- 工具使用提示詞快取推理
關於 Gemini 3.5 Flash
Gemini 3.5 Flash 是 Google 推出的穩定 Flash 等級模型,Google 將其描述為針對常規、高吞吐量工作負載在速度與基礎效能方面的基準。它能讀取文字與圖像、呼叫工具、回傳符合架構的 JSON,並支援快取。其定位介於 Flash-Lite 3.5 與後續的 3.6、3.7 及 3.8 Flash 版本之間。
適用場景
- 一款穩定的通用型 Flash 模型,適用於常規的聊天、擷取與大量摘要任務。
- 工具呼叫功能支援需要執行數個步驟的助理任務。
- 圖像輸入功能使其無需額外的視覺模型即可處理螢幕截圖、掃描文件與圖表。
- 符合架構的 JSON 與上下文快取功能,適合重複性的管線呼叫。
其他選擇建議
- 後續推出的 3.6、3.7 與 3.8 Flash 模型在程式編寫與代理任務上表現更強。
- 它沒有專屬的思考模式,因此複雜的多步驟推理任務建議交由其他模型處理。
入門指南
建立 API 金鑰
請至 Console 建立金鑰,即可在平台上使用各類模型。
發送您的第一個請求
複製您所選語言的範例,並針對端點執行它。
文字轉文字Gemini APIPOST/v1beta/models/gemini-3.5-flash:generateContentAPI 格式:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
定價
Verified 價格用於 Verified,多數模型更便宜;Official 價格是模型廠商公布的價格,用於更穩定的 Official。Auto 按最終完成請求的線路計價。
預設規格
每 1M Token- Official 價格
- 輸入 $1.50 / 輸出 $9.00 / 快取讀取 $0.15
- Verified 價格
- 輸入 $0.75 / 輸出 $4.50 / 快取讀取 $0.075
- 折扣
- -50%
快取讀取
- Official 價格
- $0.15
- Verified 價格
- $0.075
- 折扣
- -50%
僅在模型呼叫工具時,依使用次數計費。
網路搜尋
- Official 價格
- $0.014/次搜尋
- Verified 價格
- $0.007/次搜尋
- 折扣
- -50%
| Official 價格每 1M Token | Verified 價格每 1M Token | 折扣 | |
|---|---|---|---|
| 預設規格 | 輸入 $1.50 / 輸出 $9.00 / 快取讀取 $0.15 | 輸入 $0.75 / 輸出 $4.50 / 快取讀取 $0.075 | -50% |
| Prompt 快取價格 | |||
| 快取讀取 | $0.15 | $0.075 | -50% |
| 工具費用僅在模型呼叫工具時,依使用次數計費。 | |||
| 網路搜尋 | $0.014/次搜尋 | $0.007/次搜尋 | -50% |
使用量與活動
成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。
用量與可用性
過去 24 小時- 請求數
- 成功率
- P95 延遲
- 總 Token 用量
- 近 30 日成功率
- 95.0%
- 近 30 日請求數
- 1K+
- 最後活動時間
- 3 小時前
資料基於彙總的使用者請求,不包含狀態檢查。
直接在 Console 裡試
在 Console 中開啟 Gemini 3.5 Flash,並準備好編輯或發送提示詞。
協助我使用 gemini-3.5-flash 透過 /v1beta/models/gemini-3.5-flash:generateContent 進行對話,並顯示回覆、延遲與成本。
應用情境
適合場景- 推理
- 視覺辨識
面向客戶的聊天服務
利用提示詞前綴中的快取知識庫來回答產品相關問題。
批次摘要
摘要通話逐字稿或工單,並為每個項目輸出固定的 JSON 摘要。
表單與文件讀取
從掃描的表單與送貨單中提取欄位,轉化為下游系統可直接載入的結構化記錄。
入門級程式編寫輔助
解釋程式碼、編寫小型函式,以及草擬對深度要求不高的單元測試。
提示詞範例
請將此支援逐字稿摘要為三點,並將 'resolved'(已解決)設為 true 或 false。
讀取此掃描的送貨單,並以 JSON 格式回傳訂單編號、項目與簽收狀態。
編寫一個能解析雜亂字串中 ISO 日期的 Python 函式,並提供五個測試案例。
此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。
FAQ
什麼是 Gemini 3.5 Flash?
一款穩定的 Flash 等級 Gemini 模型,旨在處理常規、高吞吐量的任務。它能接收文字與圖像、使用工具並產生結構化輸出,重點在於穩定的速度而非極致的深度。
它與 Gemini 3.5 Flash-Lite 有何不同?
Flash-Lite 是 Google 最快速且最經濟的 3.5 模型;Flash 則是功能更全面的模型,適用於需要更多處理細節的任務。標記與擷取任務請選擇 Lite,對話與較長輸出則選擇 Flash。
它適合用於程式編寫代理嗎?
它可以處理小型程式編寫任務,但 Google 後續推出的 3.7 與 3.8 Flash 模型才是針對複雜程式編寫與長週期代理所設計的。當工作簡單且量大時,請使用 3.5 Flash。
它支援圖像與快取嗎?
兩者皆支援。圖像可在單一請求中與文字一併提供,而上下文快取則可在多次請求中重複使用長共享前綴,例如固定的指令集。
Gemini 3.5 Flash 的費用是多少?
在 TokenLab 上,Gemini 3.5 Flash 價格為 輸入 $0.75 / 輸出 $4.50 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。
Gemini 3.5 Flash 的上下文長度與輸出限制為何?
Gemini 3.5 Flash 支援最高 1,048,576 tokens 的上下文,單次回應上限為 65,536 tokens。
Gemini 3.5 Flash 應該使用哪一個端點?
請使用 https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash:generateContent 進行 Gemini 3.5 Flash 的呼叫。下方的請求範例展示了對應的程式碼格式。
Gemini 3.5 Flash 支援哪些操作?
Gemini 3.5 Flash 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。
比較 Gemini 3.5 Flash
使用 Gemini 3.5 Flash 的指南
來源
更新於 2026年10月2日