每次请求可选择 Auto、TokenLab Verified 或 Official,并查看对应价格。查看更新

Google: Gemini 3.7 Flash

高效率的 Gemini 模型,面向智能体工作流、编程与多模态推理
对比模型
gemini-3.7-flash
可用Google聊天缓存输入便宜 90%
输入 / 输出-50%
$0.75 / $3.75$0.375 / $1.88
上下文
1M
发布日期
2026年8月13日
最大输出
64K
模态
视觉聊天
能力
工具调用提示词缓存

Gemini 3.7 Flash 简介

Gemini 3.7 Flash 是 Google 的稳定版 Flash 档模型,2026 年 8 月发布,Google 称它为复杂编码、智能体工作流和可靠的多步执行而构建。它能读文本和图片,支持思考,调用工具,返回受 schema 约束的 JSON,并缓存上下文。它比 3.6 Flash 高一档,比 3.8 Flash 低一档。

擅长的任务

  • 回答前可以先推理,对编码和多步任务有帮助。
  • 可靠的多步执行是明确的设计目标,适合智能体不能迷失当前进度的场景。
  • 工具调用和受 schema 约束的 JSON,让结果容易接入其他系统。
  • 图片输入可处理截图、示意图和扫描文档。

什么情况换别的模型

  • Gemini 3.8 Flash 更新,Google 把它作为能力最强的 Flash 档。
  • 思考会增加延迟,简单查询更适合用 Flash-Lite。

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    文本生成Gemini API
    POST/v1beta/models/gemini-3.7-flash:generateContent
    API 格式:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

价格

Verified 价格用于 Verified,多数模型更便宜;Official 价格是模型厂商公布的价格,用于更稳定的 Official。Auto 按最终完成请求的线路计价。

Promotional Standard

每 1M token
Official 价格
输入 $0.75 / 输出 $3.75 / 缓存读取 $0.075
Verified 价格
输入 $0.375 / 输出 $1.88 / 缓存读取 $0.0375
折扣
-50%
提示词缓存价格

缓存读取

Official 价格
$0.075
Verified 价格
$0.0375
折扣
-50%
工具附加费

按次计费,仅在模型实际使用工具时收取。

网页搜索

Official 价格
$0.014/次搜索
Verified 价格
$0.007/次搜索
折扣
-50%

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时
请求
成功率
P95 延迟
总 token 数
模型表现
30 天成功率
99.8%
7 天中位延迟
13.6 sn=271
7 天 P95 延迟
53 sn=271
30 天请求数
1K+
最后活动时间
19小时前

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

Gemini 3.7 Flash 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 gemini-3.7-flash 发一条简短消息,接口是 /v1beta/models/gemini-3.7-flash:generateContent。返回回复,附上延迟和费用。

使用场景

适用场景
  • 视觉
  • 功能实现

    让智能体读工单、修改多个文件并运行测试。

  • 工作流自动化

    把审批、查询和通知串起来,每一步都依赖上一步。

  • 代码评审

    读 diff,标出有风险的改动,并逐项解释发现的问题,方便人工评审者快速决定采纳哪些。

  • 数据清洗

    对不一致的记录先做推理,在应用之前提出规范化规则,让清洗过程可以先被审计。

提示词示例

读这张工单和链接的文件,实现这项改动,并列出你运行了哪些测试。

审查这个 diff 里的并发缺陷,并按严重程度给发现的问题排序。

这两条客户记录看起来是重复的。解释哪些字段冲突,以及用什么规则才能安全地合并它们。

此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。

FAQ

Gemini 3.7 Flash 是为什么设计的?

复杂编码、智能体工作流,以及从第一步到最后一步都要保持可靠的多步执行。它是支持思考的 Flash 模型,同时支持工具和图片。

它支持思考吗?

支持。它可以先推理再回复,提升代码和规划任务的效果。简短的交互轮次把思考强度调低,以保持响应快速。

它和 3.6 Flash 有什么区别?

3.7 Flash 是更晚的模型,加入了推理,更强调可靠的多步运行。3.6 Flash 围绕编码循环和视觉推理来定位,没有思考能力。

3.8 Flash 是更好的选择吗?

对长时程的软件工程,常常是。如果你已经为 3.7 Flash 调好了提示词,并且结果达到你的要求,它依然是稳妥的选择。

Gemini 3.7 Flash 的费用是多少?

在 TokenLab 上,Gemini 3.7 Flash 的价格为 输入 $0.375 / 输出 $1.88 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

Gemini 3.7 Flash 的上下文窗口和输出上限是多少?

Gemini 3.7 Flash 最多接收 1,048,576 token 的上下文,单次最多返回 65,536 token。

Gemini 3.7 Flash 应该使用哪个端点?

Gemini 3.7 Flash 使用 https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent。代码写法见下方的请求示例。

Gemini 3.7 Flash 支持哪些操作?

Gemini 3.7 Flash 支持 文本生成。选了操作,上面会显示对应的端点和请求示例。

Gemini 3.7 Flash 对比

资料来源

审阅于 2026年10月2日

更多 Gemini 3 模型

相关模型