Chat Models

AI models for chat, Q&A, reasoning, and text generation

Chat · Alibaba Cloud

qwen3-coder-flash
Available
CodePrompt CacheCached inputless
TokenLab price— Discount
—
Official price
Input$0.1471Output$0.5882/1M
qwen3.8-2.4t-a95b
Available
JSON modePrompt CacheTool useCached inputless
TokenLab price— Discount
—
Official price
Input$1.76Output$5.29/1M
qwen3.8-27b
Available
JSON modePrompt CacheTool useVisionCached inputless
TokenLab price— Discount
—
Official price
Input$0.4412Output$1.76/1M
qwen3.8-flash
Available
JSON modePrompt CacheTool useVisionCached inputless
TokenLab price— Discount
—
Official price
Input$0.1176Output$0.3971/1M
qwen3.8-max
Available
JSON modePrompt CacheTool useVisionCached inputless
TokenLab price— Discount
—
Official price
Input$1.76Output$5.29/1M
qwen3.6-max-preview
DeprecatedAvailable
Tool use
TokenLab price— Discount
—
Official price
Input$1.43Output$8.60/1M
qwen-flash
Available
Prompt CacheCached inputless
TokenLab price— Discount
—
Official price
Input$0.0221Output$0.2206/1M
qwen-plus
Available
Prompt CacheCached inputless
TokenLab price— Discount
—
Official price
Input$0.1176Output$0.2941/1M
qwen3.5-flash
Available
Prompt CacheCached inputless
TokenLab price— Discount
—
Official price
Input$0.0294Output$0.2941/1M
qwen3.5-plus
Available
Prompt CacheCached inputless
TokenLab price— Discount
—
Official price
Input$0.1176Output$0.7059/1M
qwen3.7-max
Available
Prompt CacheCached inputless
TokenLab price— Discount
—
Official price
Input$1.76Output$5.29/1M
qwen3.7-plus
Available
Prompt CacheCached inputless
TokenLab price— Discount
—
Official price
Input$0.2941Output$1.18/1M
qwen3-vl-plus
Available
Prompt CacheVisionCached inputless
TokenLab price— Discount
—
Official price
Input$0.1471Output$1.47/1M
qwen-doc-turbo
Available
Prompt CacheCached inputless
TokenLab price— Discount
—
Official price
Input$0.0882Output$0.1471/1M
qwen-plus-character
Available
Prompt CacheCached inputless
TokenLab price— Discount
—
Official price
Input$0.1176Output$0.2941/1M
qwen-max
Available
Prompt CacheCached inputless
TokenLab price— Discount
—
Official price
Input$0.3529Output$1.41/1M
qwen-flash-character
Available
Prompt CacheCached inputless
TokenLab price— Discount
—
Official price
Input$0.0368Output$0.2206/1M
qwen-deep-research
Available
TokenLab price— Discount
—
Official price
Input$7.94Output$23.97/1M
qwen3.5-27b
Available
TokenLab price— Discount
—
Official price
Input$0.0882Output$0.7059/1M
qwen3.5-omni-flash
Available
Vision
TokenLab price— Discount
—
Official price
Input$2.65Output$10.59/1M
qwen3.5-omni-plus
Available
Vision
TokenLab price— Discount
—
Official price
Input$7.79Output$31.32/1M
qwen3.6-27b
Available
Tool useVision
TokenLab price— Discount
—
Official price
Input$0.4412Output$2.65/1M
qwen3-omni-flash
Available
Vision
TokenLab price— Discount
—
Official price
Input$0.2647Output$1.01/1M
qwen3.5-ocr
Available
Vision
TokenLab price— Discount
—
Official price
Input$0.0735Output$0.2941/1M
1 / 2

All model series

5 series

Choosing the right chat model

The right model balances task fit, output quality, latency, and price.

Selection signals

  • Match the model to the input and output you actually need.
  • Compare models that use the same pricing unit.
  • A small test reveals quality and latency differences that a catalog cannot.

FAQ

What makes a good chat model?

A strong fit matches the task, quality bar, latency target, and budget. A small evaluation set makes quality and reliability differences easier to see.

Can I switch models later?

Yes. Keep the public model ID and request format explicit, and compare alternatives on the same tasks.