Google: gemini-3-flash-preview

gemini-3-flash-preview 的价格、表现、能力和可直接使用的请求示例。
对比模型
gemini-3-flash-preview
可用Google聊天缓存输入便宜 90%预览
输入 / 输出-50%
$0.50 / $3.00$0.25 / $1.50
上下文
1M
发布日期
2025年12月17日
最大输出
64K
模态
视觉聊天
能力
工具调用提示词缓存

快速上手

  1. 创建 API 密钥

    在 Console 生成一把密钥,平台上的模型都能用。

  2. 发送第一个请求

    复制你所用语言的示例代码,向该端点发起请求。

    chat_completionGemini 原生 API
    POST/v1beta/models/gemini-3-flash-preview:generateContent
    API 格式:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3-flash-preview:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

价格

官方价格是模型厂商公开的基线价,TokenLab 价格是用这个模型时实际的计费价。

Display Base Rates

每 1M token
官方价格
输入 $0.50 / 输出 $3.00 / 缓存读取 $0.05
TokenLab 价格
输入 $0.25 / 输出 $1.50 / 缓存读取 $0.025
折扣
-50%
提示词缓存价格

缓存读取

官方价格
$0.05
TokenLab 价格
$0.025
折扣
-50%

用量与动态

成功率是请求完成的比例;延迟是拿到一次完整响应要花的时间,P95 表示 95% 的请求都在这个时间内完成。

用量与可用性

最近 24 小时

还没有数据

模型表现
达到隐私和数据量阈值后,指标才会显示。

数据来自汇总的用户请求,不含状态检查。

直接在 Console 里试

gemini-3-flash-preview 已在 Console 备好,提示词已填好,可以直接修改或发送。

帮我用 gemini-3-flash-preview 发一条简短消息,接口是 /v1beta/models/gemini-3-flash-preview:generateContent。返回回复,附上延迟和费用。

使用场景

适用场景

视觉

读取图片、解析文档、回答视觉问题

01

Agent 与工具

处理推理、客服分流、工具调用和多步任务。

02

编程

在常用工具中生成、评审或调试代码。

03

知识助手

搭聊天、搜索和检索功能,价格和能力都清清楚楚。

04

并排对比

并列比较回复质量、延迟和价格。

提示词示例

写一段简洁的客服回复,把背后的假设列出来。

审查这个 API 设计,指出最主要的三个接入风险。

把一份长更新日志整理成非工程师也能读懂的发布说明。

此模型按条件计价,仅凭月度 token 总量无法可靠估算;请按请求规格、缓存和适用时段查看详细定价。

FAQ

gemini-3-flash-preview 的费用是多少?

在 TokenLab 上,gemini-3-flash-preview 的价格为 输入 $0.25 / 输出 $1.50 每 1M token。完整明细见上方价格表。 价格因计费单位、规格和用量而异。请在模型的详细定价中对比相同条件下的费率;单一费率不代表总价。

gemini-3-flash-preview 适合做什么?

gemini-3-flash-preview 支持 JSON 模式, 提示词缓存, 工具调用,可以直接在 Create 中打开。

如何测试 gemini-3-flash-preview?

在 Create 里打开 gemini-3-flash-preview,就能直接用为 /v1beta/models/gemini-3-flash-preview:generateContent 准备的示例。

gemini-3-flash-preview 应该使用哪个端点?

gemini-3-flash-preview 使用 https://api.tokenlab.sh/v1beta/models/gemini-3-flash-preview:generateContent。代码写法见下方的请求示例。

接入前可以先测试 gemini-3-flash-preview 吗?

可以。打开 Console 会为 gemini-3-flash-preview 备好一个现成的草稿,登录后提示词还在,上下文不会丢。

gemini-3-flash-preview 支持哪些操作?

gemini-3-flash-preview 支持 chat_completion。选了操作,上面会显示对应的端点和请求示例。

更多 Gemini 3 模型

相关模型