Chat Models

AI models for chat, Q&A, reasoning, and text generation

Chat · Google

gemini-3-flash-preview
PreviewAvailable
JSON modePrompt CacheTool useVisionCached input 90% less
TokenLab price-50% Discount
Input$0.25Output$1.50/1M
Official price
Input$0.50Output$3.00/1M
gemini-3.1-flash-lite
Available
JSON modePrompt CacheTool useVisionCached input 90% less
TokenLab price-50% Discount
Input$0.125Output$0.75/1M
Official price
Input$0.25Output$1.50/1M
gemini-2.5-flash
Available
JSON modePrompt CacheReasoningTool useVisionCached input 90% less
TokenLab price-50% Discount
Input$0.15Output$1.25/1M
Official price
Input$0.30Output$2.50/1M
gemini-2.5-flash-lite
Available
JSON modePrompt CacheReasoningTool useVisionCached input 90% less
TokenLab price-50% Discount
Input$0.05Output$0.20/1M
Official price
Input$0.10Output$0.40/1M
gemini-2.5-pro
DeprecatedAvailable
JSON modePrompt CacheTool useVisionCached input 90% less
TokenLab price-50% Discount
Input$0.625Output$5.00/1M
Official price
Input$1.25Output$10.00/1M
gemini-3.1-pro-preview
Available
JSON modePrompt CacheTool useVisionCached input 90% less
TokenLab price-50% Discount
Input$1.00Output$6.00/1M
Official price
Input$2.00Output$12.00/1M
gemini-3.5-flash
Available
JSON modePrompt CacheTool useVisionCached input 90% less
TokenLab price-50% Discount
Input$0.75Output$4.50/1M
Official price
Input$1.50Output$9.00/1M
gemini-3.5-flash-lite
Available
JSON modePrompt CacheTool useVisionCached input 90% less
TokenLab price-50% Discount
Input$0.15Output$1.25/1M
Official price
Input$0.30Output$2.50/1M
gemini-3.6-flash
Available
JSON modePrompt CacheTool useVisionCached input 90% less
TokenLab price-50% Discount
Input$0.75Output$3.75/1M
Official price
Input$1.50Output$7.50/1M
gemini-3.7-flash
Available
JSON modePrompt CacheTool useVisionCached input 90% less
TokenLab price-50% Discount
Input$0.375Output$1.88/1M
Official price
Input$0.75Output$3.75/1M
gemini-3.8-flash
Available
JSON modePrompt CacheTool useVisionCached input 90% less
TokenLab price-50% Discount
Input$0.375Output$1.88/1M
Official price
Input$0.75Output$3.75/1M

All model series

3 series

Choosing the right chat model

The right model balances task fit, output quality, latency, and price.

Selection signals

  • Match the model to the input and output you actually need.
  • Compare models that use the same pricing unit.
  • A small test reveals quality and latency differences that a catalog cannot.

FAQ

What makes a good chat model?

A strong fit matches the task, quality bar, latency target, and budget. A small evaluation set makes quality and reliability differences easier to see.

Can I switch models later?

Yes. Keep the public model ID and request format explicit, and compare alternatives on the same tasks.