每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

Google: Gemini 3.6 Flash

Gemini 3.6 Flash 注重编程迭代、工具协作和视觉推理效率,适合在大型任务中反复检查结果、修改代码并决定下一步操作的智能体。
对比模型
gemini-3.6-flash
可用Google聊天缓存输入便宜 90%
输入 / 输出
$0.75 / $3.75
上下文
1M
发布日期
2026年7月21日
最大输出
64K
模态
视觉聊天
能力
工具调用提示词缓存

Gemini 3.6 Flash 简介

Gemini 3.6 Flash 是稳定版 Flash 档 Gemini 模型,Google 称它在速度和多模态能力之间取得平衡。它于 2026 年 7 月发布,介于 3.5 Flash 和 3.7 Flash 之间。Google 围绕高效的编码循环、工具编排和视觉推理来定位它,适合那种检查结果、修改、再决定下一步动作的智能体。

擅长的任务

  • 适合智能体运行代码、读输出、再修改的循环。
  • 跨多次调用的工具编排是它明确的重点。
  • 对截图和示意图的视觉推理,可以和文本放在同一个请求里完成。
  • 受 schema 约束的 JSON 和缓存,支持可重复的生产使用。

什么情况换别的模型

  • 3.7 和 3.8 Flash 更新,面向更复杂的编码和更长的自主运行。
  • 它没有专门的思考模式,需要深度思考时最好用 Pro 模型。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    文本生成Gemini API
    POST/v1beta/models/gemini-3.6-flash:generateContent
    API 格式:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

价格

Verified 价格用于 Verified,多数模型更便宜;Official 价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。

默认规格

每 1M token
Official 价格
输入 $0.75 / 输出 $3.75 / 缓存读取 $0.075
Verified 价格
输入 $0.75 / 输出 $3.75 / 缓存读取 $0.075
折扣
—
提示词缓存价格

缓存读取

Official 价格
$0.075
Verified 价格
$0.075
折扣
—
工具附加费

按次计费,仅在模型实际使用工具时收取。

网页搜索

Official 价格
$0.014/次搜索
Verified 价格
$0.007/次搜索
折扣
-50%

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
30 天成功率
99.7%
30 天请求数
100+
最后活动时间
1小时前

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Gemini 3.6 Flash 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 gemini-3.6-flash 发一条简短消息,接口是 /v1beta/models/gemini-3.6-flash:generateContent。返回回复,附上延迟和费用。

使用场景

适用场景
  • 视觉
  • 代码修复循环

    让智能体运行测试、读失败信息、修改文件,并重复直到测试通过。

  • 界面检查

    把截图和书面规范对比,列出评审者需要修复的每处间距、颜色或布局不一致。

  • 工具密集的助手

    在一次对话里协调搜索、日历和 CRM 的调用,把每个工具的结果传给下一个决策。

  • 多模态问答

    回答既需要图表图片、又需要周围报告文字的问题。

提示词示例

运行测试,读失败输出,只修改导致第二个测试失败的那个函数。

对比这张截图和设计规范,列出每一处间距或颜色不一致的地方。

查看我的日历和 CRM,然后起草一封回信,提出两个会议时间。

此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。

FAQ

Gemini 3.6 Flash 最擅长什么?

迭代式的智能体工作:编码循环、工具编排和对图片的推理。它在速度和多模态能力之间取得平衡,对不需要最新 Flash 的智能体来说,是合理的默认选择。

它和 3.5 Flash 有什么不同?

3.6 是更晚的版本,围绕编码循环和工具使用来定位,而 3.5 Flash 是日常高并发工作的基准。预期 3.6 的智能体表现更好。

我应该换到 3.8 Flash 吗?

如果你运行长时间的软件任务或复杂的企业流程,Google 为它们定位的是 3.8 Flash。较简单的智能体用 3.6 可能就够了;请在你自己的运行轨迹上比较两者。

它接受图片吗?

接受。图片和文本可以合并在同一个请求里,模型以文本或符合你所给 schema 的 JSON 回答。它自己不生成图片。

Gemini 3.6 Flash 的费用是多少?

在 TokenLab 上,Gemini 3.6 Flash 的价格为 输入 $0.75 / 输出 $3.75 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

Gemini 3.6 Flash 的上下文窗口和输出上限是多少?

Gemini 3.6 Flash 最多接收 1,048,576 token 的上下文,单次最多返回 65,536 token。

Gemini 3.6 Flash 应该使用哪个端点?

Gemini 3.6 Flash 使用 https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent。代码写法见下方的请求示例。

Gemini 3.6 Flash 支持哪些操作?

Gemini 3.6 Flash 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。

Gemini 3.6 Flash 对比

资料来源

审阅于 2026年10月2日

更多 Gemini 3 模型

相关模型