AI 模型排行

比较需求热度、完整文本价格、任务适配和主要图像/视频模型系列。

热门模型

50

当前关注度较高的模型

低成本文本

50

输入和输出价格完整的文本模型

按任务

17

按工作负载分组的候选模型

多媒体

12

主要图像和视频模型系列

热门模型

当前需求较高、可用性明确的模型。

排名模型提供商需求类别
1gpt-5.5OpenAI518.5K聊天 / vision
2gpt-5.4-miniOpenAI469.6K聊天 / vision
3gpt-5.4OpenAI271.1K聊天 / vision
4gpt-4o-miniOpenAI213.3K聊天 / vision
5deepseek-v4-proDeepSeek163.9K聊天
6claude-opus-4-8Anthropic143.8K聊天 / vision
7doubao-1.5-lite-32k字节跳动44.9K聊天
8GPT-5.6 SolOpenAI34.3K聊天 / vision
9DeepSeekDeepSeek33.0K聊天
10GPT-5.6 LunaOpenAI27.8K聊天 / vision
11qwen3.5-flash阿里云19.7K聊天
12gemini-3.1-flash-liteGoogle17.7K聊天 / vision
13claude-opus-4-7Anthropic15.3K聊天 / vision
14GLM智谱AI12.8K聊天
15claude-haiku-4-5Anthropic11.9K聊天 / vision
16claude-sonnet-4-6Anthropic11.3K聊天 / vision
17gpt-image-2OpenAI8.3K图像
18GPT-5.6 TerraOpenAI6.4K聊天 / vision
19claude-opus-4-6Anthropic6.1K聊天 / vision
20gemini-3.5-flashGoogle4.4K聊天 / vision
21claude-sonnet-5Anthropic3.8K聊天 / vision
22claude-fable-5Anthropic2.8K聊天 / vision
23gemini-3.1-pro-previewGoogle2.5K聊天 / vision
24gpt-4oOpenAI1.8K聊天 / vision
25minimax-m2.7-highspeedMiniMax1.0K聊天
26mimo-v2.5小米588聊天 / vision
27gpt-5.3-codexOpenAI453聊天 / vision
28deepseek-v3-2DeepSeek366聊天
29gpt-oss-120bOpenAI356聊天
30nano-banana-2Google351图像
31grok-imagine-videoxAI282视频
32gpt-4o-mini-ttsOpenAI241音频 / 文本转语音
33glm-5.1智谱AI232聊天
34gemini-3.1-flash-imageGoogle189图像 / vision
35seedance-2.0-fast字节跳动188视频
36seedance-2.0字节跳动167视频
37Kimi月之暗面135聊天 / vision
38qwen3.7-max阿里云128聊天
39grok-4-fastxAI119聊天 / vision
40gpt-5.2OpenAI114聊天 / vision
41minimax-m2.7MiniMax90聊天
42grok-imagine-imagexAI85图像
43nano-banana-proGoogle84图像
44mimo-v2.5-pro小米75聊天 / vision
45gemini-3-pro-imageGoogle59图像 / vision
46kimi-k2.6月之暗面51聊天 / vision
47veo3.1-fastGoogle50视频
48gpt-4.1-miniOpenAI39聊天 / vision
49seedream-5.0字节跳动37图像
50kling-3.0-video快手35视频

按需求、价格、任务和多媒体系列比较模型

热门文本模型、低成本文本模型、任务候选模型和多媒体系列需要不同的比较标准。

选择信号

  • 需求热度能帮助发现开发者正在测试的模型。
  • 低成本表格只包含 token 价格完整、可横向比较的文本模型。
  • 多媒体模型按系列分组,因为输出单位、延迟和工作流差异很大。

常见问题

这些排行是基准测试吗?

不是。这里结合 TokenLab 模型数据、使用量、类别和价格信息。公开基准测试仍应回到原始来源核对。

应该怎么选择模型?

比较价格单位、上下文长度、延迟需求、请求格式、可靠性,以及你的实际工作负载。