Chat Models
AI models for chat, Q&A, reasoning, and text generation
Chat · Google
JSON modePrompt CacheTool useVisionCached input 90% less
- TokenLab price-50% Discount
- Input$0.25Output$1.50/1M
- Official price
- Input$0.50Output$3.00/1M
JSON modePrompt CacheTool useVisionCached input 90% less
- TokenLab price-50% Discount
- Input$0.125Output$0.75/1M
- Official price
- Input$0.25Output$1.50/1M
JSON modePrompt CacheReasoningTool useVisionCached input 90% less
- TokenLab price-50% Discount
- Input$0.15Output$1.25/1M
- Official price
- Input$0.30Output$2.50/1M
JSON modePrompt CacheReasoningTool useVisionCached input 90% less
- TokenLab price-50% Discount
- Input$0.05Output$0.20/1M
- Official price
- Input$0.10Output$0.40/1M
JSON modePrompt CacheTool useVisionCached input 90% less
- TokenLab price-50% Discount
- Input$0.625Output$5.00/1M
- Official price
- Input$1.25Output$10.00/1M
JSON modePrompt CacheTool useVisionCached input 90% less
- TokenLab price-50% Discount
- Input$1.00Output$6.00/1M
- Official price
- Input$2.00Output$12.00/1M
JSON modePrompt CacheTool useVisionCached input 90% less
- TokenLab price-50% Discount
- Input$0.75Output$4.50/1M
- Official price
- Input$1.50Output$9.00/1M
JSON modePrompt CacheTool useVisionCached input 90% less
- TokenLab price-50% Discount
- Input$0.15Output$1.25/1M
- Official price
- Input$0.30Output$2.50/1M
JSON modePrompt CacheTool useVisionCached input 90% less
- TokenLab price-50% Discount
- Input$0.75Output$3.75/1M
- Official price
- Input$1.50Output$7.50/1M
JSON modePrompt CacheTool useVisionCached input 90% less
- TokenLab price-50% Discount
- Input$0.375Output$1.88/1M
- Official price
- Input$0.75Output$3.75/1M
All model series
3 seriesChoosing the right chat model
The right model balances task fit, output quality, latency, and price.
Selection signals
- Match the model to the input and output you actually need.
- Compare models that use the same pricing unit.
- A small test reveals quality and latency differences that a catalog cannot.
FAQ
What makes a good chat model?
A strong fit matches the task, quality bar, latency target, and budget. A small evaluation set makes quality and reliability differences easier to see.
Can I switch models later?
Yes. Keep the public model ID and request format explicit, and compare alternatives on the same tasks.