為每個請求選擇 Auto、TokenLab Verified 或 Official,並預先顯示價格。查看最新動態

Google: Gemini 3.6 Flash

Gemini 3.6 Flash 專注於高效編碼迴圈、工具編排與視覺推理。適合在大型任務中重複檢查結果、修改程式碼並決定下一步行動的代理程式。
比較模型
gemini-3.6-flash
可用Google對話輸入快取節省 90%
輸入 / 輸出
$0.75 / $3.75
上下文
1M
發布日期
2026年7月21日
最大輸出長度
64K
模態
視覺辨識對話
能力
工具使用提示詞快取

關於 Gemini 3.6 Flash

Gemini 3.6 Flash 是一款穩定的 Flash 等級 Gemini 模型,Google 將其描述為在速度與多模態能力之間取得平衡。它於 2026 年 7 月發布,介於 3.5 Flash 與 3.7 Flash 之間。Google 將其定位於高效的程式編寫迴圈、工具編排與視覺推理,因此適合用於檢查結果、進行修正並決定下一步行動的代理。

適用場景

  • 適用於代理執行程式碼、讀取輸出並進行修正的迴圈。
  • 跨多個呼叫的工具編排是其明確的重點。
  • 針對螢幕截圖與圖表的視覺推理可與文字在同一請求中完成。
  • 符合架構的 JSON 與快取功能支援可重複的生產環境使用。

其他選擇建議

  • 3.7 與 3.8 Flash 是更新的版本,針對更複雜的程式編寫與更長的自主執行任務而設計。
  • 它沒有專屬的思考模式,因此深度審慎的思考建議使用 Pro 模型。

入門指南

  1. 建立 API 金鑰

    請至 Console 建立金鑰,即可在平台上使用各類模型。

  2. 發送您的第一個請求

    複製您所選語言的範例,並針對端點執行它。

    文字轉文字Gemini API
    POST/v1beta/models/gemini-3.6-flash:generateContent
    API 格式:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

定價

Verified 價格用於 Verified,多數模型更便宜;Official 價格是模型廠商公布的價格,用於更穩定的 Official。Auto 按最終完成請求的線路計價。

預設規格

每 1M Token
Official 價格
輸入 $0.75 / 輸出 $3.75 / 快取讀取 $0.075
Verified 價格
輸入 $0.75 / 輸出 $3.75 / 快取讀取 $0.075
折扣
—
Prompt 快取價格

快取讀取

Official 價格
$0.075
Verified 價格
$0.075
折扣
—
工具費用

僅在模型呼叫工具時,依使用次數計費。

網路搜尋

Official 價格
$0.014/次搜尋
Verified 價格
$0.007/次搜尋
折扣
-50%

使用量與活動

成功率是請求完成的比例;延遲是一次完整回應所需的時間,P95 表示 95% 的請求在該時間內完成。

用量與可用性

過去 24 小時
請求數
成功率
P95 延遲
總 Token 用量
模型效能
近 30 日成功率
99.7%
近 30 日請求數
100+
最後活動時間
1 小時前

資料基於彙總的使用者請求,不包含狀態檢查。

直接在 Console 裡試

在 Console 中開啟 Gemini 3.6 Flash,並準備好編輯或發送提示詞。

協助我使用 gemini-3.6-flash 透過 /v1beta/models/gemini-3.6-flash:generateContent 進行對話,並顯示回覆、延遲與成本。

應用情境

適合場景
  • 視覺辨識
  • 程式碼修正迴圈

    讓代理執行測試、讀取失敗訊息、修補檔案,並重複此過程直到測試通過。

  • UI 檢查

    將螢幕截圖與書面規格進行比較,並列出審核人員應修正的每個間距、顏色或佈局不符之處。

  • 工具密集型助理

    在單一對話中協調搜尋、行事曆與 CRM 呼叫,並將每個工具的結果傳遞給下一個決策。

  • 多模態問答

    回答需要同時參考圖表圖像與周邊報告文字的問題。

提示詞範例

執行測試、讀取失敗輸出,並僅修改導致第二個測試失敗的函式。

將此螢幕截圖與設計規格進行比較,並列出每個間距或顏色不符之處。

檢查我的行事曆與 CRM,然後草擬一份建議兩個會議時間的回覆。

此模型按條件計價,僅憑每月 token 總量無法可靠估算;請按請求規格、快取和適用時段查看詳細定價。

FAQ

Gemini 3.6 Flash 最擅長什麼?

迭代式代理工作:程式編寫迴圈、工具編排以及針對圖像的推理。它在速度與多模態能力之間取得了平衡,使其成為不需要最新 Flash 模型時的合理預設選擇。

它與 3.5 Flash 有何不同?

3.6 是較新的版本,其設計圍繞程式編寫迴圈與工具使用,而 3.5 Flash 則是常規高量工作的基準。預期 3.6 能提供更好的代理行為表現。

我應該升級到 3.8 Flash 嗎?

如果您執行的是長軟體任務或複雜的企業流程,3.8 Flash 是 Google 為此定位的模型。對於較簡單的代理,3.6 可能已足夠;建議您使用自己的追蹤資料對兩者進行測試。

它接受圖像嗎?

是的。圖像與文字可以在單一請求中結合,模型會以文字或符合您提供架構的 JSON 格式回答。它本身不會生成圖像。

Gemini 3.6 Flash 的費用是多少?

在 TokenLab 上,Gemini 3.6 Flash 價格為 輸入 $0.75 / 輸出 $3.75 每 1M Token。完整明細見上方價格表。 價格因計費單位、規格和用量而異。請在模型的詳細定價中比較相同條件下的費率;單一費率不代表總價。

Gemini 3.6 Flash 的上下文長度與輸出限制為何?

Gemini 3.6 Flash 支援最高 1,048,576 tokens 的上下文,單次回應上限為 65,536 tokens。

Gemini 3.6 Flash 應該使用哪一個端點?

請使用 https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent 進行 Gemini 3.6 Flash 的呼叫。下方的請求範例展示了對應的程式碼格式。

Gemini 3.6 Flash 支援哪些操作?

Gemini 3.6 Flash 支援 文字轉文字。請在上方選擇一項操作以查看其端點與請求範例。

比較 Gemini 3.6 Flash

來源

更新於 2026年10月2日

更多來自 Gemini 3 的模型

相關模型