AI 模型排行

比较需求热度、完整文本价格、任务适配和主要图像/视频模型系列。

热门模型

50

当前关注度较高的模型

低成本文本

50

输入和输出价格完整的文本模型

按任务

17

按工作负载分组的候选模型

多媒体

12

主要图像和视频模型系列

热门模型

当前需求较高、可用性明确的模型。

排名模型提供商需求类别
1gpt-5.4OpenAI904.2K聊天 / vision
2GPT-5.6 SolOpenAI339.2K聊天 / vision
3GPT-5.6 LunaOpenAI333.4K聊天 / vision
4deepseek-v3-2DeepSeek164.5K聊天
5gpt-5.4-miniOpenAI125.9K聊天 / vision
6gpt-5.5OpenAI101.7K聊天 / vision
7gemini-3.1-flash-liteGoogle100.3K聊天 / vision
8GPT-5.6 TerraOpenAI99.8K聊天 / vision
9gpt-4o-miniOpenAI63.1K聊天 / vision
10claude-opus-5Anthropic41.9K聊天 / vision
11claude-opus-4-8Anthropic30.9K聊天 / vision
12gemini-3.1-pro-previewGoogle23.4K聊天 / vision
13deepseek-v4-proDeepSeek21.9K聊天
14gpt-image-2OpenAI15.6K图像
15text-embedding-3-smallOpenAI11.8K嵌入
16claude-sonnet-5Anthropic8.9K聊天 / vision
17gemini-3.5-flashGoogle8.1K聊天 / vision
18DeepSeekDeepSeek4.8K聊天
19GLM智谱AI3.6K聊天
20claude-haiku-4-5Anthropic2.4K聊天 / vision
21gpt-4.1-miniOpenAI2.2K聊天 / vision
22gpt-4oOpenAI2.0K聊天 / vision
23claude-sonnet-4-6Anthropic1.5K聊天 / vision
24claude-fable-5Anthropic1.4K聊天 / vision
25seedance-2.0字节跳动1.2K视频
26nano-banana-2Google414图像
27grok-imagine-videoxAI363视频
28grok-4.5xAI305聊天 / vision
29gemini-3.1-flash-imageGoogle300图像 / vision
30claude-opus-4-6Anthropic238聊天 / vision
31whisper-1OpenAI218音频 / 语音转文本
32seedance-2.0-fast字节跳动210视频
33gemini-3.6-flashGoogle135聊天 / vision
34gemini-3.5-flash-liteGoogle126聊天 / vision
35doubao-seed-1.6-flash字节跳动106聊天
36gpt-5.2OpenAI91聊天 / vision
37Qwen-Embedding阿里云82嵌入
38glm-5.3智谱AI78聊天 / 代码
39gpt-5OpenAI78聊天 / vision
40grok-4.20xAI75聊天 / vision
41claude-opus-4-7Anthropic71聊天 / vision
42hy3腾讯68聊天
43nano-banana-proGoogle68图像
44flux-2-klein-4bBlack Forest Labs66图像
45gemini-3-pro-imageGoogle65图像 / vision
46gpt-5-miniOpenAI63聊天 / vision
47qwen3.7-max阿里云61聊天
48minimax-m3MiniMax54聊天
49qwen-flash阿里云53聊天
50gemini-3.1-flash-lite-imageGoogle49图像 / vision

按需求、价格、任务和多媒体系列比较模型

热门文本模型、低成本文本模型、任务候选模型和多媒体系列需要不同的比较标准。

选择信号

  • 需求热度能帮助发现开发者正在测试的模型。
  • 低成本表格只包含 token 价格完整、可横向比较的文本模型。
  • 多媒体模型按系列分组,因为输出单位、延迟和工作流差异很大。

常见问题

这些排行是基准测试吗?

不是。这里结合 TokenLab 模型数据、使用量、类别和价格信息。公开基准测试仍应回到原始来源核对。

应该怎么选择模型?

比较价格单位、上下文长度、延迟需求、请求格式、可靠性,以及你的实际工作负载。