Google: Gemini 3.6 Flash
gemini-3.6-flash- 输入 / 输出
- $0.75 / $3.75
- 上下文
- 1M
- 发布日期
- 2026年7月21日
- 最大输出
- 64K
- 模态
- 视觉聊天
- 能力
- 工具调用提示词缓存
Gemini 3.6 Flash 简介
Gemini 3.6 Flash 是稳定版 Flash 档 Gemini 模型,Google 称它在速度和多模态能力之间取得平衡。它于 2026 年 7 月发布,介于 3.5 Flash 和 3.7 Flash 之间。Google 围绕高效的编码循环、工具编排和视觉推理来定位它,适合那种检查结果、修改、再决定下一步动作的智能体。
擅长的任务
- 适合智能体运行代码、读输出、再修改的循环。
- 跨多次调用的工具编排是它明确的重点。
- 对截图和示意图的视觉推理,可以和文本放在同一个请求里完成。
- 受 schema 约束的 JSON 和缓存,支持可重复的生产使用。
什么情况换别的模型
- 3.7 和 3.8 Flash 更新,面向更复杂的编码和更长的自主运行。
- 它没有专门的思考模式,需要深度思考时最好用 Pro 模型。
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
文本生成Gemini APIPOST/v1beta/models/gemini-3.6-flash:generateContentAPI 格式:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
价格
Verified 价格用于 Verified,多数模型更便宜;Official 价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。
默认规格
每 1M token- Official 价格
- 输入 $0.75 / 输出 $3.75 / 缓存读取 $0.075
- Verified 价格
- 输入 $0.75 / 输出 $3.75 / 缓存读取 $0.075
- 折扣
- —
缓存读取
- Official 价格
- $0.075
- Verified 价格
- $0.075
- 折扣
- —
按次计费,仅在模型实际使用工具时收取。
网页搜索
- Official 价格
- $0.014/次搜索
- Verified 价格
- $0.007/次搜索
- 折扣
- -50%
| Official 价格每 1M token | Verified 价格每 1M token | 折扣 | |
|---|---|---|---|
| 默认规格 | 输入 $0.75 / 输出 $3.75 / 缓存读取 $0.075 | 输入 $0.75 / 输出 $3.75 / 缓存读取 $0.075 | — |
| 提示词缓存价格 | |||
| 缓存读取 | $0.075 | $0.075 | — |
| 工具附加费按次计费,仅在模型实际使用工具时收取。 | |||
| 网页搜索 | $0.014/次搜索 | $0.007/次搜索 | -50% |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时- 请求
- 成功率
- P95 延迟
- 总 token 数
- 30 天成功率
- 99.7%
- 30 天请求数
- 100+
- 最后活动时间
- 1小时前
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
Gemini 3.6 Flash 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 gemini-3.6-flash 发一条简短消息,接口是 /v1beta/models/gemini-3.6-flash:generateContent。返回回复,附上延迟和费用。
使用场景
适用场景- 视觉
代码修复循环
让智能体运行测试、读失败信息、修改文件,并重复直到测试通过。
界面检查
把截图和书面规范对比,列出评审者需要修复的每处间距、颜色或布局不一致。
工具密集的助手
在一次对话里协调搜索、日历和 CRM 的调用,把每个工具的结果传给下一个决策。
多模态问答
回答既需要图表图片、又需要周围报告文字的问题。
提示词示例
运行测试,读失败输出,只修改导致第二个测试失败的那个函数。
对比这张截图和设计规范,列出每一处间距或颜色不一致的地方。
查看我的日历和 CRM,然后起草一封回信,提出两个会议时间。
此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。
FAQ
Gemini 3.6 Flash 最擅长什么?
迭代式的智能体工作:编码循环、工具编排和对图片的推理。它在速度和多模态能力之间取得平衡,对不需要最新 Flash 的智能体来说,是合理的默认选择。
它和 3.5 Flash 有什么不同?
3.6 是更晚的版本,围绕编码循环和工具使用来定位,而 3.5 Flash 是日常高并发工作的基准。预期 3.6 的智能体表现更好。
我应该换到 3.8 Flash 吗?
如果你运行长时间的软件任务或复杂的企业流程,Google 为它们定位的是 3.8 Flash。较简单的智能体用 3.6 可能就够了;请在你自己的运行轨迹上比较两者。
它接受图片吗?
接受。图片和文本可以合并在同一个请求里,模型以文本或符合你所给 schema 的 JSON 回答。它自己不生成图片。
Gemini 3.6 Flash 的费用是多少?
在 TokenLab 上,Gemini 3.6 Flash 的价格为 输入 $0.75 / 输出 $3.75 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
Gemini 3.6 Flash 的上下文窗口和输出上限是多少?
Gemini 3.6 Flash 最多接收 1,048,576 token 的上下文,单次最多返回 65,536 token。
Gemini 3.6 Flash 应该使用哪个端点?
Gemini 3.6 Flash 使用 https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent。代码写法见下方的请求示例。
Gemini 3.6 Flash 支持哪些操作?
Gemini 3.6 Flash 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。
Gemini 3.6 Flash 对比
资料来源
审阅于 2026年10月2日