大模型排行榜

大模型排行榜:按真实调用量排序的中文 AI 大模型榜单

本站统计各大语言模型在真实业务中的 token 调用量,按今日、本周、本月三个时间窗口排出名次,并给出环比变化、厂商份额与应用榜。所有数据每天定时自动更新一次,页面底部标注数据截止日期。

数据截止:2026年9月21日 · 本次更新:2026-09-22 21:22(北京时间) · 统计模型数:505

今日大模型调用量排名(Top 20)

下表按最近一个完整统计日的 token 调用量排序,先看单日热度,再看趋势。

排名模型厂商调用量(tokens)环比占比
1 GLM 5.3 Flash 智谱 AI(GLM) 4.36万亿 +73% 20.9%
2 DeepSeek V4.1 Flash DeepSeek 深度求索 2.43万亿 -2% 11.7%
3 Hy4 preview 腾讯 1.88万亿 -4% 9.04%
4 GPT-5.6 Luna OpenAI 1.32万亿 +9% 6.34%
5 DeepSeek V4 Flash 0731 DeepSeek 深度求索 1.21万亿 +8% 5.79%
6 MiMo-V2.5 小米 9869亿 +12% 4.74%
7 Nemotron 3 Ultra(免费版) 免费版 英伟达 NVIDIA 7439亿 -5% 3.57%
8 DeepSeek V4 Flash 0423 DeepSeek 深度求索 5293亿 +27% 2.54%
9 GLM 5.3 智谱 AI(GLM) 5242亿 +70% 2.52%
10 Hy3 腾讯 5019亿 +3% 2.41%
11 Gemini 3.8 Flash Google 谷歌 3460亿 +36% 1.66%
12 Muse Spark 1.3 Contributor Meta 2954亿 -0% 1.42%
13 Jev 1.13 Typesafe 2879亿 +32% 1.38%
14 Solar Pro 4 Upstage 2708亿 +6% 1.30%
15 GLM 5.2 智谱 AI(GLM) 2575亿 +5% 1.24%
16 GPT-5.6 Sol OpenAI 2383亿 +29% 1.14%
17 Claude Sonnet 5 Anthropic 2312亿 +76% 1.11%
18 MiniMax M3 MiniMax 2192亿 +22% 1.05%
19 Kimi K3 月之暗面 Kimi 2175亿 +25% 1.04%
20 Ling 3.0 Flash Fin(免费版) 免费版 蚂蚁 InclusionAI 1802亿 +7% 0.865%

查看今日榜完整 Top 50 →

本周大模型排行榜(Top 10)

以最近 7 天累计调用量排名,变化列为对比前 7 天,能过滤掉单日波动。

排名模型厂商调用量(tokens)环比占比
1 DeepSeek V4.1 Flash DeepSeek 深度求索 16.9万亿 +172% 13.1%
2 GLM 5.3 Flash 智谱 AI(GLM) 16.9万亿 +45% 13.0%
3 Hy4 preview 腾讯 12.7万亿 -17% 9.79%
4 DeepSeek V4 Flash 0731 DeepSeek 深度求索 8.91万亿 -24% 6.88%
5 GPT-5.6 Luna OpenAI 8.48万亿 -53% 6.54%
6 MiMo-V2.5 小米 6.90万亿 -16% 5.32%
7 Nemotron 3 Ultra(免费版) 免费版 英伟达 NVIDIA 4.78万亿 +39% 3.69%
8 Hy3 腾讯 4.51万亿 +11% 3.48%
9 DeepSeek V4 Flash 0423 DeepSeek 深度求索 3.65万亿 -16% 2.82%
10 GLM 5.3 智谱 AI(GLM) 3.23万亿 +42% 2.49%

查看本周榜完整 Top 50 →

本月大模型排行榜(Top 10)

以最近 30 天累计调用量排名,反映一个月的稳定使用格局。

排名模型厂商调用量(tokens)环比占比
1 GPT-5.6 Luna OpenAI 50.3万亿 +208% 10.3%
2 Hy4 preview 腾讯 49.0万亿 新上榜 10.0%
3 GLM 5.3 Flash 智谱 AI(GLM) 48.9万亿 新上榜 10.0%
4 DeepSeek V4 Flash 0731 DeepSeek 深度求索 48.3万亿 +53% 9.90%
5 MiMo-V2.5 小米 28.7万亿 +0% 5.89%
6 DeepSeek V4.1 Flash DeepSeek 深度求索 23.1万亿 新上榜 4.75%
7 Hy3 腾讯 20.4万亿 -37% 4.19%
8 DeepSeek V4 Flash 0423 DeepSeek 深度求索 19.9万亿 -22% 4.09%
9 Nemotron 3 Ultra(免费版) 英伟达 NVIDIA 18.6万亿 +53% 3.82%
10 GLM 5.3 智谱 AI(GLM) 10.5万亿 +>999% 2.15%

查看本月榜完整 Top 50 →

近半年周度调用量走势

按周汇总的调用量走势,取当前调用量最高的 6 个模型,用于判断谁在持续上升、谁在回落。

04.91万亿9.82万亿14.7万亿19.6万亿tokens / 周3/304/275/256/227/208/179/14GLM 5.3 FlashDeepSeek V4.1 FlashHy4 previewGPT-5.6 LunaDeepSeek V4 Flash 0731MiMo-V2.5

厂商份额(本周)

把本周榜按厂商聚合,看各家的总调用量与份额。

排名厂商上榜模型数调用量(tokens)份额主力模型
1 DeepSeek 深度求索 13 32.4万亿 25.0% DeepSeek V4.1 Flash 13.1%
2 智谱 AI(GLM) 12 22.0万亿 17.0% GLM 5.3 Flash 13.0%
3 腾讯 3 17.2万亿 13.3% Hy4 preview 9.79%
4 OpenAI 30 15.6万亿 12.1% GPT-5.6 Luna 6.54%
5 小米 4 7.19万亿 5.55% MiMo-V2.5 5.32%
6 Google 谷歌 20 6.94万亿 5.36% Gemini 3.8 Flash 1.73%
7 英伟达 NVIDIA 8 5.87万亿 4.53% Nemotron 3 Ultra(免费版) 3.69%
8 Anthropic 12 4.58万亿 3.53% Claude Sonnet 5 1.17%
9 Meta 5 2.49万亿 1.93% Muse Spark 1.3 Contributor 1.72%
10 阿里云通义千问 34 2.44万亿 1.88% Qwen3.8 Flash 0.352%

查看厂商份额榜 →

多模态榜单(本周)

除了文本模型,图像、视频、嵌入、语音与重排也有各自的调用榜,这些榜单按请求数排名,各取前 5 名。点标题看完整榜单。

图像生成榜

排名模型厂商请求数环比
1 Nano Banana 2 (Gemini 3.1 Flash Image) Google 谷歌 122万 次 +2%
2 Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image) Google 谷歌 107万 次 +31%
3 Nano Banana (Gemini 2.5 Flash Image) Google 谷歌 100万 次 -1%
4 GPT Image 2.5 Sunburst OpenAI 49.7万 次 +96%
5 Nano Banana 2 (Gemini 3.1 Flash Image Preview) Google 谷歌 48.3万 次 -4%

视频生成榜

排名模型厂商请求数环比
1 Veo 3.1 Lite Google 谷歌 3.35万 次 -11%
2 Seedance 2.0 Fast bytedance 1.94万 次 +9%
3 Seedance 2.5 bytedance 1.92万 次 +0%
4 Seedance 2.0 Mini bytedance 1.22万 次 -40%
5 Seedance 2.0 bytedance 1.09万 次 +1%

文本嵌入榜

排名模型厂商请求数环比
1 Text Embedding 3 Small OpenAI 1.50亿 次 +22%
2 Qwen3 Embedding 8B 阿里云通义千问 5985万 次 +5%
3 Gemini Embedding 2 Google 谷歌 2665万 次 +26%
4 Bge M3 智源研究院 BAAI 2258万 次 +11%
5 Text Embedding 3 Large OpenAI 1963万 次 -3%

语音合成榜

排名模型厂商请求数环比
1 Gemini 3.1 Flash Tts Preview Google 谷歌 85.8万 次 -6%
2 Kokoro 82M hexgrad 68.7万 次 -29%
3 Grok Voice Tts 1.0 xAI 25.1万 次 -3%
4 Qwen Audio 3.0 Tts Plus 阿里云通义千问 11.1万 次 +773%
5 S2.1 Pro Free(免费版) fish-audio 10.8万 次 +4%

语音转写榜

排名模型厂商请求数环比
1 Whisper Large V3 OpenAI 800万 次 +1%
2 Whisper Large V3 Turbo OpenAI 502万 次 +24%
3 Mai Transcribe 2 微软 222万 次 +95%
4 GPT 4O Mini Transcribe OpenAI 96.0万 次 +3%
5 Parakeet Tdt 0.6b V3 英伟达 NVIDIA 84.9万 次 -2%

文档重排榜

排名模型厂商请求数环比
1 Rerank 2.5 Voyage AI 350万 次 +10%
2 Rerank 2.5 Lite Voyage AI 177万 次 -58%
3 Rerank 4 Fast Cohere 146万 次 -20%
4 Rerank V3.5 Cohere 136万 次 +19%
5 Qwen3 Reranker 8B 阿里云通义千问 55.9万 次 -6%

怎么用这份榜单

  1. 选型阶段先看本周榜的绝对调用量:被大量真实流量验证过的模型,通常意味着更稳的供应与更完整的文档生态。
  2. 关注环比变化:持续增长说明社区在扩大接入,突然下跌往往与涨价、限流或新一代发布有关。
  3. 把榜单与自己的场景对齐:编程任务看代码类模型,长文档看上下文长度与价格,中文场景要额外做本地评测。
  4. 免费版、批处理版单独排名,接入前确认变体的限流与数据使用条款。

常见问题

这个大模型排行榜是怎么统计出来的?

榜单依据模型实际处理的 token 数量(输入 token + 输出 token)排序,统计范围是公开可见的 API 调用流量,每天聚合一次。2026年9月21日当日的数据会在次日进入榜单,因此页面显示的是最近一个完整统计日的结果。

为什么这里的排名和评测跑分榜不一样?

这里衡量的是“被用了多少”,不是“答得多好”。跑分榜回答能力上限,调用量榜回答市场选择:开发者愿意把多少真实流量交给这个模型。两者经常不一致,一个高分模型可能因为价格、速度或合规原因没有被大规模使用。

多久更新一次数据?

每天定时抓取一次,页面底部会显示数据截止日期与本次更新时间。

免费版和批处理版为什么单独排名?

同一个模型的不同变体(免费版、批处理版、思考版等)在计费与使用场景上完全不同,所以分开统计、分别排名,名称后缀即变体说明。

不同厂商的 token 能直接比较吗?

各厂商使用自家分词器,同样一段文字在不同模型里的 token 数并不相同,跨厂商比较适合看量级与趋势,不适合当作精确的等价比对。