聊天模型

聊天、问答、推理、写文本都能做的 AI 模型

聊天 · Google

gemini-3-flash-preview
预览可用
JSON 模式提示词缓存工具调用视觉缓存输入便宜 90%
TokenLab 价格-50% 折扣
输入$0.25输出$1.50/1M
官方价格
输入$0.50输出$3.00/1M
gemini-3.1-flash-lite
可用
JSON 模式提示词缓存工具调用视觉缓存输入便宜 90%
TokenLab 价格-50% 折扣
输入$0.125输出$0.75/1M
官方价格
输入$0.25输出$1.50/1M
gemini-2.5-flash
可用
JSON 模式提示词缓存推理工具调用视觉缓存输入便宜 90%
TokenLab 价格-50% 折扣
输入$0.15输出$1.25/1M
官方价格
输入$0.30输出$2.50/1M
gemini-2.5-flash-lite
可用
JSON 模式提示词缓存推理工具调用视觉缓存输入便宜 90%
TokenLab 价格-50% 折扣
输入$0.05输出$0.20/1M
官方价格
输入$0.10输出$0.40/1M
gemini-2.5-pro
已弃用可用
JSON 模式提示词缓存工具调用视觉缓存输入便宜 90%
TokenLab 价格-50% 折扣
输入$0.625输出$5.00/1M
官方价格
输入$1.25输出$10.00/1M
gemini-3.1-pro-preview
可用
JSON 模式提示词缓存工具调用视觉缓存输入便宜 90%
TokenLab 价格-50% 折扣
输入$1.00输出$6.00/1M
官方价格
输入$2.00输出$12.00/1M
gemini-3.5-flash
可用
JSON 模式提示词缓存工具调用视觉缓存输入便宜 90%
TokenLab 价格-50% 折扣
输入$0.75输出$4.50/1M
官方价格
输入$1.50输出$9.00/1M
gemini-3.5-flash-lite
可用
JSON 模式提示词缓存工具调用视觉缓存输入便宜 90%
TokenLab 价格-50% 折扣
输入$0.15输出$1.25/1M
官方价格
输入$0.30输出$2.50/1M
gemini-3.6-flash
可用
JSON 模式提示词缓存工具调用视觉缓存输入便宜 90%
TokenLab 价格-50% 折扣
输入$0.75输出$3.75/1M
官方价格
输入$1.50输出$7.50/1M
gemini-3.7-flash
可用
JSON 模式提示词缓存工具调用视觉缓存输入便宜 90%
TokenLab 价格-50% 折扣
输入$0.375输出$1.88/1M
官方价格
输入$0.75输出$3.75/1M
gemini-3.8-flash
可用
JSON 模式提示词缓存工具调用视觉缓存输入便宜 90%
TokenLab 价格-50% 折扣
输入$0.375输出$1.88/1M
官方价格
输入$0.75输出$3.75/1M

全部模型系列

3 个系列

聊天模型怎么选

真正合适的模型,要同时满足任务、质量、速度和预算。

选择信号

  • 按你实际需要的输入和输出去挑模型。
  • 只有计价单位相同的模型才适合直接比较。
  • 小规模测试能发现目录里看不到的质量和延迟差异。

FAQ

好的聊天模型要看什么?

合适的模型要匹配任务、质量要求、延迟目标和预算。小规模评测能更直观地发现质量和稳定性差异。

之后还能换模型吗?

可以。公开模型 ID 和请求格式保持明确,同组任务对比即可。