- 输入 / 输出-50%
- $0.75 / $3.75$0.375 / $1.88
- 上下文
- 1M
- 发布日期
- 2026年8月13日
- 最大输出
- 64K
- 模态
- 视觉聊天
- 能力
- 工具调用提示词缓存
Gemini 3.7 Flash 简介
Gemini 3.7 Flash 是 Google 的稳定版 Flash 档模型,2026 年 8 月发布,Google 称它为复杂编码、智能体工作流和可靠的多步执行而构建。它能读文本和图片,支持思考,调用工具,返回受 schema 约束的 JSON,并缓存上下文。它比 3.6 Flash 高一档,比 3.8 Flash 低一档。
擅长的任务
- 回答前可以先推理,对编码和多步任务有帮助。
- 可靠的多步执行是明确的设计目标,适合智能体不能迷失当前进度的场景。
- 工具调用和受 schema 约束的 JSON,让结果容易接入其他系统。
- 图片输入可处理截图、示意图和扫描文档。
什么情况换别的模型
- Gemini 3.8 Flash 更新,Google 把它作为能力最强的 Flash 档。
- 思考会增加延迟,简单查询更适合用 Flash-Lite。
快速上手
创建 API 密钥
在 Console 生成一把密钥,平台上的模型都能用。
发送第一个请求
复制你所用语言的示例代码,向该端点发起请求。
文本生成Gemini APIPOST/v1beta/models/gemini-3.7-flash:generateContentAPI 格式:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
价格
Verified 价格用于 Verified,多数模型更便宜;Official 价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。
Promotional Standard
每 1M token- Official 价格
- 输入 $0.75 / 输出 $3.75 / 缓存读取 $0.075
- Verified 价格
- 输入 $0.375 / 输出 $1.88 / 缓存读取 $0.0375
- 折扣
- -50%
缓存读取
- Official 价格
- $0.075
- Verified 价格
- $0.0375
- 折扣
- -50%
按次计费,仅在模型实际使用工具时收取。
网页搜索
- Official 价格
- $0.014/次搜索
- Verified 价格
- $0.007/次搜索
- 折扣
- -50%
| Official 价格每 1M token | Verified 价格每 1M token | 折扣 | |
|---|---|---|---|
| Promotional Standard | 输入 $0.75 / 输出 $3.75 / 缓存读取 $0.075 | 输入 $0.375 / 输出 $1.88 / 缓存读取 $0.0375 | -50% |
| 提示词缓存价格 | |||
| 缓存读取 | $0.075 | $0.0375 | -50% |
| 工具附加费按次计费,仅在模型实际使用工具时收取。 | |||
| 网页搜索 | $0.014/次搜索 | $0.007/次搜索 | -50% |
用量与动态
成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。
用量与可用性
最近 24 小时- 请求
- 成功率
- P95 延迟
- 总 token 数
- 30 天成功率
- 99.8%
- 7 天中位延迟
- 13.6 sn=271
- 7 天 P95 延迟
- 53 sn=271
- 30 天请求数
- 1K+
- 最后活动时间
- 19小时前
数据来自汇总的用户请求,不含状态检查。
直接在 Console 里试
Gemini 3.7 Flash 已在 Console 备好,提示词已填好,可以直接修改或发送。
帮我用 gemini-3.7-flash 发一条简短消息,接口是 /v1beta/models/gemini-3.7-flash:generateContent。返回回复,附上延迟和费用。
使用场景
适用场景- 视觉
功能实现
让智能体读工单、修改多个文件并运行测试。
工作流自动化
把审批、查询和通知串起来,每一步都依赖上一步。
代码评审
读 diff,标出有风险的改动,并逐项解释发现的问题,方便人工评审者快速决定采纳哪些。
数据清洗
对不一致的记录先做推理,在应用之前提出规范化规则,让清洗过程可以先被审计。
提示词示例
读这张工单和链接的文件,实现这项改动,并列出你运行了哪些测试。
审查这个 diff 里的并发缺陷,并按严重程度给发现的问题排序。
这两条客户记录看起来是重复的。解释哪些字段冲突,以及用什么规则才能安全地合并它们。
此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。
FAQ
Gemini 3.7 Flash 是为什么设计的?
复杂编码、智能体工作流,以及从第一步到最后一步都要保持可靠的多步执行。它是支持思考的 Flash 模型,同时支持工具和图片。
它支持思考吗?
支持。它可以先推理再回复,提升代码和规划任务的效果。简短的交互轮次把思考强度调低,以保持响应快速。
它和 3.6 Flash 有什么区别?
3.7 Flash 是更晚的模型,加入了推理,更强调可靠的多步运行。3.6 Flash 围绕编码循环和视觉推理来定位,没有思考能力。
3.8 Flash 是更好的选择吗?
对长时程的软件工程,常常是。如果你已经为 3.7 Flash 调好了提示词,并且结果达到你的要求,它依然是稳妥的选择。
Gemini 3.7 Flash 的费用是多少?
在 TokenLab 上,Gemini 3.7 Flash 的价格为 输入 $0.375 / 输出 $1.88 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。
Gemini 3.7 Flash 的上下文窗口和输出上限是多少?
Gemini 3.7 Flash 最多接收 1,048,576 token 的上下文,单次最多返回 65,536 token。
Gemini 3.7 Flash 应该使用哪个端点?
Gemini 3.7 Flash 使用 https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent。代码写法见下方的请求示例。
Gemini 3.7 Flash 支持哪些操作?
Gemini 3.7 Flash 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。
Gemini 3.7 Flash 对比
资料来源
审阅于 2026年10月2日