大模型排行榜:按真实调用量排序的中文 AI 大模型榜单
本站统计各大语言模型在真实业务中的 token 调用量,按今日、本周、本月三个时间窗口排出名次,并给出环比变化、厂商份额与应用榜。所有数据每天定时自动更新一次,页面底部标注数据截止日期。
今日大模型调用量排名(Top 20)
下表按最近一个完整统计日的 token 调用量排序,先看单日热度,再看趋势。
| 排名 | 模型 | 厂商 | 调用量(tokens) | 环比 | 占比 |
|---|---|---|---|---|---|
| 1 | GLM 5.3 Flash | 智谱 AI(GLM) | 4.36万亿 | +73% | 20.9% |
| 2 | DeepSeek V4.1 Flash | DeepSeek 深度求索 | 2.43万亿 | -2% | 11.7% |
| 3 | Hy4 preview | 腾讯 | 1.88万亿 | -4% | 9.04% |
| 4 | GPT-5.6 Luna | OpenAI | 1.32万亿 | +9% | 6.34% |
| 5 | DeepSeek V4 Flash 0731 | DeepSeek 深度求索 | 1.21万亿 | +8% | 5.79% |
| 6 | MiMo-V2.5 | 小米 | 9869亿 | +12% | 4.74% |
| 7 | Nemotron 3 Ultra(免费版) 免费版 | 英伟达 NVIDIA | 7439亿 | -5% | 3.57% |
| 8 | DeepSeek V4 Flash 0423 | DeepSeek 深度求索 | 5293亿 | +27% | 2.54% |
| 9 | GLM 5.3 | 智谱 AI(GLM) | 5242亿 | +70% | 2.52% |
| 10 | Hy3 | 腾讯 | 5019亿 | +3% | 2.41% |
| 11 | Gemini 3.8 Flash | Google 谷歌 | 3460亿 | +36% | 1.66% |
| 12 | Muse Spark 1.3 Contributor | Meta | 2954亿 | -0% | 1.42% |
| 13 | Jev 1.13 | Typesafe | 2879亿 | +32% | 1.38% |
| 14 | Solar Pro 4 | Upstage | 2708亿 | +6% | 1.30% |
| 15 | GLM 5.2 | 智谱 AI(GLM) | 2575亿 | +5% | 1.24% |
| 16 | GPT-5.6 Sol | OpenAI | 2383亿 | +29% | 1.14% |
| 17 | Claude Sonnet 5 | Anthropic | 2312亿 | +76% | 1.11% |
| 18 | MiniMax M3 | MiniMax | 2192亿 | +22% | 1.05% |
| 19 | Kimi K3 | 月之暗面 Kimi | 2175亿 | +25% | 1.04% |
| 20 | Ling 3.0 Flash Fin(免费版) 免费版 | 蚂蚁 InclusionAI | 1802亿 | +7% | 0.865% |
本周大模型排行榜(Top 10)
以最近 7 天累计调用量排名,变化列为对比前 7 天,能过滤掉单日波动。
| 排名 | 模型 | 厂商 | 调用量(tokens) | 环比 | 占比 |
|---|---|---|---|---|---|
| 1 | DeepSeek V4.1 Flash | DeepSeek 深度求索 | 16.9万亿 | +172% | 13.1% |
| 2 | GLM 5.3 Flash | 智谱 AI(GLM) | 16.9万亿 | +45% | 13.0% |
| 3 | Hy4 preview | 腾讯 | 12.7万亿 | -17% | 9.79% |
| 4 | DeepSeek V4 Flash 0731 | DeepSeek 深度求索 | 8.91万亿 | -24% | 6.88% |
| 5 | GPT-5.6 Luna | OpenAI | 8.48万亿 | -53% | 6.54% |
| 6 | MiMo-V2.5 | 小米 | 6.90万亿 | -16% | 5.32% |
| 7 | Nemotron 3 Ultra(免费版) 免费版 | 英伟达 NVIDIA | 4.78万亿 | +39% | 3.69% |
| 8 | Hy3 | 腾讯 | 4.51万亿 | +11% | 3.48% |
| 9 | DeepSeek V4 Flash 0423 | DeepSeek 深度求索 | 3.65万亿 | -16% | 2.82% |
| 10 | GLM 5.3 | 智谱 AI(GLM) | 3.23万亿 | +42% | 2.49% |
本月大模型排行榜(Top 10)
以最近 30 天累计调用量排名,反映一个月的稳定使用格局。
| 排名 | 模型 | 厂商 | 调用量(tokens) | 环比 | 占比 |
|---|---|---|---|---|---|
| 1 | GPT-5.6 Luna | OpenAI | 50.3万亿 | +208% | 10.3% |
| 2 | Hy4 preview | 腾讯 | 49.0万亿 | 新上榜 | 10.0% |
| 3 | GLM 5.3 Flash | 智谱 AI(GLM) | 48.9万亿 | 新上榜 | 10.0% |
| 4 | DeepSeek V4 Flash 0731 | DeepSeek 深度求索 | 48.3万亿 | +53% | 9.90% |
| 5 | MiMo-V2.5 | 小米 | 28.7万亿 | +0% | 5.89% |
| 6 | DeepSeek V4.1 Flash | DeepSeek 深度求索 | 23.1万亿 | 新上榜 | 4.75% |
| 7 | Hy3 | 腾讯 | 20.4万亿 | -37% | 4.19% |
| 8 | DeepSeek V4 Flash 0423 | DeepSeek 深度求索 | 19.9万亿 | -22% | 4.09% |
| 9 | Nemotron 3 Ultra(免费版) | 英伟达 NVIDIA | 18.6万亿 | +53% | 3.82% |
| 10 | GLM 5.3 | 智谱 AI(GLM) | 10.5万亿 | +>999% | 2.15% |
近半年周度调用量走势
按周汇总的调用量走势,取当前调用量最高的 6 个模型,用于判断谁在持续上升、谁在回落。
厂商份额(本周)
把本周榜按厂商聚合,看各家的总调用量与份额。
| 排名 | 厂商 | 上榜模型数 | 调用量(tokens) | 份额 | 主力模型 |
|---|---|---|---|---|---|
| 1 | DeepSeek 深度求索 | 13 | 32.4万亿 | 25.0% | DeepSeek V4.1 Flash 13.1% |
| 2 | 智谱 AI(GLM) | 12 | 22.0万亿 | 17.0% | GLM 5.3 Flash 13.0% |
| 3 | 腾讯 | 3 | 17.2万亿 | 13.3% | Hy4 preview 9.79% |
| 4 | OpenAI | 30 | 15.6万亿 | 12.1% | GPT-5.6 Luna 6.54% |
| 5 | 小米 | 4 | 7.19万亿 | 5.55% | MiMo-V2.5 5.32% |
| 6 | Google 谷歌 | 20 | 6.94万亿 | 5.36% | Gemini 3.8 Flash 1.73% |
| 7 | 英伟达 NVIDIA | 8 | 5.87万亿 | 4.53% | Nemotron 3 Ultra(免费版) 3.69% |
| 8 | Anthropic | 12 | 4.58万亿 | 3.53% | Claude Sonnet 5 1.17% |
| 9 | Meta | 5 | 2.49万亿 | 1.93% | Muse Spark 1.3 Contributor 1.72% |
| 10 | 阿里云通义千问 | 34 | 2.44万亿 | 1.88% | Qwen3.8 Flash 0.352% |
多模态榜单(本周)
除了文本模型,图像、视频、嵌入、语音与重排也有各自的调用榜,这些榜单按请求数排名,各取前 5 名。点标题看完整榜单。
图像生成榜
| 排名 | 模型 | 厂商 | 请求数 | 环比 |
|---|---|---|---|---|
| 1 | Nano Banana 2 (Gemini 3.1 Flash Image) | Google 谷歌 | 122万 次 | +2% |
| 2 | Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image) | Google 谷歌 | 107万 次 | +31% |
| 3 | Nano Banana (Gemini 2.5 Flash Image) | Google 谷歌 | 100万 次 | -1% |
| 4 | GPT Image 2.5 Sunburst | OpenAI | 49.7万 次 | +96% |
| 5 | Nano Banana 2 (Gemini 3.1 Flash Image Preview) | Google 谷歌 | 48.3万 次 | -4% |
视频生成榜
| 排名 | 模型 | 厂商 | 请求数 | 环比 |
|---|---|---|---|---|
| 1 | Veo 3.1 Lite | Google 谷歌 | 3.35万 次 | -11% |
| 2 | Seedance 2.0 Fast | bytedance | 1.94万 次 | +9% |
| 3 | Seedance 2.5 | bytedance | 1.92万 次 | +0% |
| 4 | Seedance 2.0 Mini | bytedance | 1.22万 次 | -40% |
| 5 | Seedance 2.0 | bytedance | 1.09万 次 | +1% |
文本嵌入榜
| 排名 | 模型 | 厂商 | 请求数 | 环比 |
|---|---|---|---|---|
| 1 | Text Embedding 3 Small | OpenAI | 1.50亿 次 | +22% |
| 2 | Qwen3 Embedding 8B | 阿里云通义千问 | 5985万 次 | +5% |
| 3 | Gemini Embedding 2 | Google 谷歌 | 2665万 次 | +26% |
| 4 | Bge M3 | 智源研究院 BAAI | 2258万 次 | +11% |
| 5 | Text Embedding 3 Large | OpenAI | 1963万 次 | -3% |
语音合成榜
| 排名 | 模型 | 厂商 | 请求数 | 环比 |
|---|---|---|---|---|
| 1 | Gemini 3.1 Flash Tts Preview | Google 谷歌 | 85.8万 次 | -6% |
| 2 | Kokoro 82M | hexgrad | 68.7万 次 | -29% |
| 3 | Grok Voice Tts 1.0 | xAI | 25.1万 次 | -3% |
| 4 | Qwen Audio 3.0 Tts Plus | 阿里云通义千问 | 11.1万 次 | +773% |
| 5 | S2.1 Pro Free(免费版) | fish-audio | 10.8万 次 | +4% |
语音转写榜
| 排名 | 模型 | 厂商 | 请求数 | 环比 |
|---|---|---|---|---|
| 1 | Whisper Large V3 | OpenAI | 800万 次 | +1% |
| 2 | Whisper Large V3 Turbo | OpenAI | 502万 次 | +24% |
| 3 | Mai Transcribe 2 | 微软 | 222万 次 | +95% |
| 4 | GPT 4O Mini Transcribe | OpenAI | 96.0万 次 | +3% |
| 5 | Parakeet Tdt 0.6b V3 | 英伟达 NVIDIA | 84.9万 次 | -2% |
文档重排榜
| 排名 | 模型 | 厂商 | 请求数 | 环比 |
|---|---|---|---|---|
| 1 | Rerank 2.5 | Voyage AI | 350万 次 | +10% |
| 2 | Rerank 2.5 Lite | Voyage AI | 177万 次 | -58% |
| 3 | Rerank 4 Fast | Cohere | 146万 次 | -20% |
| 4 | Rerank V3.5 | Cohere | 136万 次 | +19% |
| 5 | Qwen3 Reranker 8B | 阿里云通义千问 | 55.9万 次 | -6% |
怎么用这份榜单
- 选型阶段先看本周榜的绝对调用量:被大量真实流量验证过的模型,通常意味着更稳的供应与更完整的文档生态。
- 关注环比变化:持续增长说明社区在扩大接入,突然下跌往往与涨价、限流或新一代发布有关。
- 把榜单与自己的场景对齐:编程任务看代码类模型,长文档看上下文长度与价格,中文场景要额外做本地评测。
- 免费版、批处理版单独排名,接入前确认变体的限流与数据使用条款。
常见问题
这个大模型排行榜是怎么统计出来的?
榜单依据模型实际处理的 token 数量(输入 token + 输出 token)排序,统计范围是公开可见的 API 调用流量,每天聚合一次。2026年9月21日当日的数据会在次日进入榜单,因此页面显示的是最近一个完整统计日的结果。
为什么这里的排名和评测跑分榜不一样?
这里衡量的是“被用了多少”,不是“答得多好”。跑分榜回答能力上限,调用量榜回答市场选择:开发者愿意把多少真实流量交给这个模型。两者经常不一致,一个高分模型可能因为价格、速度或合规原因没有被大规模使用。
多久更新一次数据?
每天定时抓取一次,页面底部会显示数据截止日期与本次更新时间。
免费版和批处理版为什么单独排名?
同一个模型的不同变体(免费版、批处理版、思考版等)在计费与使用场景上完全不同,所以分开统计、分别排名,名称后缀即变体说明。
不同厂商的 token 能直接比较吗?
各厂商使用自家分词器,同样一段文字在不同模型里的 token 数并不相同,跨厂商比较适合看量级与趋势,不适合当作精确的等价比对。