可用Google聊天缓存 90% 优惠
gemini-3.8-flash新发布

构建基于 gemini-3.8-flash 的下一代应用

API 代码示例

价格

官方价格

输入$0.75
输出$3.75
每 1M Tokens

TokenLab 价格

输入$0.375
输出$1.88
每 1M Tokens
价格详情
每 1M Tokens
定价层级
规格
输入 官方 $0.75/1M tokens · 平台 $0.375/1M tokens 输出 官方 $3.75/1M tokens · 平台 $1.88/1M tokens 缓存读取 官方 $0.075/1M tokens · 平台 $0.0375/1M tokens

一键测试

登录后,Web Agent 会保留这个模型、提示词和请求预设。

在 Web Agent 中使用 /v1beta/models/gemini-3.8-flash:generateContent 测试 gemini-3.8-flash,然后展示请求体、延迟和响应。

API 工作台

生产默认路线。下方代码示例会按你选择的格式使用这个端点。

聊天兼容 OpenAI
POST/v1beta/models/gemini-3.8-flash:generateContent
API 格式:
curl "https://api.tokenlab.sh/v1beta/models/gemini-3.8-flash:generateContent" \
  -H "Content-Type: application/json" \
  -H "x-goog-api-key: sk-xxx" \
  -d '{
    "contents": [
      {"role": "user", "parts": [{"text": "Hello!"}]}
    ]
  }'

应用场景

适合场景

视觉

看图、解析文档与视觉问答

01

智能体与工具

用于推理、客服分流、工具调用和多步任务流程。

02

开发流程

在不动现有架构的前提下,做代码生成、评审或调试。

03

知识助手

上线聊天、搜索与检索流程,成本和行为都可预期。

04

同台对比

比较生产默认模型所需的真实响应质量、延迟和价格。

提示词示例

写一段简洁的客服回复,并列出背后的假设。

审查这个 API 设计,指出前三个接入风险。

把一份长更新日志整理成非工程师也看得懂的发布说明。

此模型采用条件计费。仅凭每月 token 总量无法可靠估算费用;请结合请求规格、缓存及适用时段查看详细价格。

常见问题

gemini-3.8-flash 的费用是多少?

在 TokenLab 上,gemini-3.8-flash 价格为 输入 $0.375 / 输出 $1.88 每 1M Tokens。完整明细见上方价格表。 价格取决于计费单位、规格和实际用量。请按明细中相同条件比较,单个费率不代表总费用。

gemini-3.8-flash 适合做什么?

gemini-3.8-flash 适合 JSON 模式, 提示词缓存, 工具调用。可以通过 TokenLab 用同一个 API key 直接调用。

如何调用 gemini-3.8-flash API?

在 TokenLab 获取 API key 后,向 https://api.tokenlab.sh/v1beta/models/gemini-3.8-flash:generateContent 发请求即可。上方 API 工作台已提供推荐端点和可直接复制的代码示例。

gemini-3.8-flash 应该使用哪个端点?

gemini-3.8-flash 默认使用 https://api.tokenlab.sh/v1beta/models/gemini-3.8-flash:generateContent。如果模型支持原生格式,API 工作台会同时给出原生端点。

接入前可以先测试 gemini-3.8-flash 吗?

可以。「在 Web Agent 中试用」会为 gemini-3.8-flash 打开一个预填好的测试,登录后提示词不会丢,可以接着跑。

相关模型