Choose Auto, TokenLab Verified, or Official for each request, with prices shown up front.See what's new

Chat Models

AI models for chat, Q&A, reasoning, and text generation

Chat

Available
CodePrompt CacheReasoningTool useCached input 95% less
Verified price-70% Discount
Input$0.60/1MOutput$3.00/1M
Official price
Input$2.00/1MOutput$10.00/1M
Available
CodeJSON modePrompt CacheReasoningTool useVisionCached input 90% less
Verified price-70% Discount
Input$0.03/1MOutput$0.15/1M
Official price
Input$0.10/1MOutput$0.50/1M
Available
CodeJSON modePrompt CacheReasoningTool useVisionCached input 90% less
Verified price-70% Discount
Input$0.60/1MOutput$3.00/1M
Official price
Input$2.00/1MOutput$10.00/1M
Available
CodeJSON modePrompt CacheReasoningTool useVisionCached input 90% less
Verified price-70% Discount
Input$0.06/1MOutput$0.36/1M
Official price
Input$0.20/1MOutput$1.20/1M
Available
CodeJSON modePrompt CacheReasoningTool useVisionCached input 90% less
Verified price-70% Discount
Input$1.20/1MOutput$6.00/1M
Official price
Input$4.00/1MOutput$20.00/1M
Available
CodeJSON modePrompt CacheReasoningTool useVisionCached input 90% less
Verified price-70% Discount
Input$0.60/1MOutput$3.60/1M
Official price
Input$2.00/1MOutput$12.00/1M
Available
CodeJSON modePrompt CacheReasoningTool useVisionCached input 90% less
Verified price-70% Discount
Input$1.50/1MOutput$9.00/1M
Official price
Input$5.00/1MOutput$30.00/1M
Available
CodeJSON modePrompt CacheReasoningTool useVisionCached input 90% less
Verified price-70% Discount
Input$3.00/1MOutput$15.00/1M
Official price
Input$10.00/1MOutput$50.00/1M
glm-5.3
Available
CodeJSON modePrompt CacheReasoningTool useSupports prompt caching
Verified price— Discount
—
Official price
Input$1.40/1MOutput$4.40/1M
CodeJSON modePrompt CacheReasoningTool useVisionSupports prompt caching
Verified price— Discount
—
Official price
Input$1.00/1MOutput$2.00/1M
CodeJSON modePrompt CacheReasoningTool useSupports prompt caching
Verified price— Discount
—
Official price
Input$0.4706/1MOutput$2.35/1M
Available
CodeJSON modeReasoningTool useVision
Verified price— Discount
—
Official price
Input$30.00/1MOutput$180.00/1M
ember-1
PreviewAvailable
CodePrompt CacheReasoningTool useSupports prompt caching
Verified price— Discount
—
Official price
Input$3.00/1MOutput$15.00/1M
Available
CodeReasoningTool useSupports prompt caching
Verified price— Discount
—
Official price
Input$0.30/1MOutput$2.50/1M
Available
CodeReasoningTool useSupports prompt caching
Verified price— Discount
—
Official price
Input$1.50/1MOutput$7.50/1M
CodePrompt CacheSupports prompt caching
Verified price— Discount
—
Official price
Input$0.30/1MOutput$1.50/1M
JSON modePrompt CacheReasoningTool useVisionCached input 90% less
Verified price-70% Discount
Input$0.03/1MOutput$0.15/1M
Official price
Input$0.10/1MOutput$0.50/1M
JSON modePrompt CacheReasoningTool useVisionCached input 90% less
Verified price-70% Discount
Input$0.60/1MOutput$3.00/1M
Official price
Input$2.00/1MOutput$10.00/1M
JSON modePrompt CacheReasoningTool useVisionCached input 95% less
Verified price-70% Discount
Input$1.20/1MOutput$6.00/1M
Official price
Input$4.00/1MOutput$20.00/1M
Available
JSON modePrompt CacheReasoningTool useVisionCached input 75% less
Verified price-50% Discount
Input$1.00/1MOutput$3.00/1M
Official price
Input$2.00/1MOutput$6.00/1M
JSON modePrompt CacheReasoningTool useVisionCached input 90% less
Verified price-70% Discount
Input$1.50/1MOutput$7.50/1M
Official price
Input$5.00/1MOutput$25.00/1M
JSON modePrompt CacheReasoningTool useVisionCached input 90% less
Verified price-70% Discount
Input$1.50/1MOutput$7.50/1M
Official price
Input$5.00/1MOutput$25.00/1M
JSON modePrompt CacheTool useVisionCached input 90% less
Verified price-50% Discount
Input$0.375/1MOutput$1.88/1M
Official price
Input$0.75/1MOutput$3.75/1M
JSON modePrompt CacheReasoningTool useVisionCached input 90% less
Verified price-70% Discount
Input$0.90/1MOutput$4.50/1M
Official price
Input$3.00/1MOutput$15.00/1M
1 / 6

All model series

6 series

Choose a chat API for your workload

Start with the conversations your product needs to handle. Compare answer quality, response time, and the cost of complete conversations, including repeated context and tool results.

Selection signals

  • Check the model's supported request format, tools, structured output, and input types before integration.
  • Estimate input, output, and cached tokens separately; context-window size is a limit, not a quality score.
  • Test short questions, long conversations, ambiguous requests, and tool failures with the same evaluation set.