大模型排行榜

语音转写模型排行榜(ASR)

按真实请求数统计的语音识别与转写模型排名,适合评估会议记录、字幕生成这类场景的主流选择。

数据截止:2026年9月21日 · 本次更新:2026-09-22 21:22(北京时间) · 统计模型数:21

本周语音转写榜(Top 50)

最近 7 天语音转写模型的请求数排名,变化列为环比。统计窗口内进入榜单的模型共 21 个,合计 2018万 次。

切换窗口: 今日 本周 本月

排名模型厂商请求数环比占比
1 Whisper Large V3 OpenAI 800万 次 +1% 39.7%
2 Whisper Large V3 Turbo OpenAI 502万 次 +24% 24.9%
3 Mai Transcribe 2 微软 222万 次 +95% 11.0%
4 GPT 4O Mini Transcribe OpenAI 96.0万 次 +3% 4.76%
5 Parakeet Tdt 0.6b V3 英伟达 NVIDIA 84.9万 次 -2% 4.21%
6 Whisper 1 OpenAI 54.9万 次 +40% 2.72%
7 Qwen3 Asr 0.6b 阿里云通义千问 48.5万 次 +384% 2.40%
8 GPT Transcribe OpenAI 38.0万 次 +109% 1.88%
9 Qwen3 Asr Flash 2026 02 10 阿里云通义千问 37.1万 次 +24% 1.84%
10 Grok Stt xAI 26.5万 次 +47% 1.32%
11 Voxtral Mini Transcribe 2602 Mistral AI 24.8万 次 -31% 1.23%
12 GPT 4O Transcribe OpenAI 21.7万 次 +76% 1.07%
13 Qwen3 Asr 1.7b 阿里云通义千问 18.3万 次 -12% 0.909%
14 Nova 3 deepgram 17.0万 次 +126% 0.841%
15 Chirp 3 Google 谷歌 9.90万 次 +9% 0.490%
16 Muse Voice Transcribe 1.0 Meta 6.96万 次 +395% 0.345%
17 Nemotron 3.5 Asr Streaming Multilingual 0.6b 英伟达 NVIDIA 2.73万 次 -49% 0.135%
18 Mai Transcribe 1.5 微软 2.54万 次 -29% 0.126%
19 Voxtral Mini 3B 2507 Mistral AI 1.47万 次 +28% 0.073%
20 Transcribe 1 fish-audio 1.34万 次 +35% 0.066%
21 Voxtral Small 24B 2507 Stt Mistral AI 8658 次 -83% 0.043%

本周语音转写榜厂商份额

同一窗口内按厂商聚合的请求量与份额。

排名厂商上榜模型数请求数份额主力模型
1 OpenAI 6 1512万 次 75.0% Whisper Large V3 39.7%
2 微软 2 225万 次 11.1% Mai Transcribe 2 11.0%
3 阿里云通义千问 3 104万 次 5.15% Qwen3 Asr 0.6b 2.40%
4 英伟达 NVIDIA 2 87.7万 次 4.35% Parakeet Tdt 0.6b V3 4.21%
5 Mistral AI 3 27.1万 次 1.34% Voxtral Mini Transcribe 2602 1.23%
6 xAI 1 26.5万 次 1.32% Grok Stt 1.32%
7 deepgram 1 17.0万 次 0.841% Nova 3 0.841%
8 Google 谷歌 1 9.90万 次 0.490% Chirp 3 0.490%
9 Meta 1 6.96万 次 0.345% Muse Voice Transcribe 1.0 0.345%
10 fish-audio 1 1.34万 次 0.066% Transcribe 1 0.066%

近半年请求量走势

按周汇总的请求量走势,取当前请求量最高的 6 个模型,用于判断谁在持续上升、谁在回落。

0226万452万678万904万tokens / 周4/275/186/86/297/208/108/319/21Whisper Large V3Whisper Large V3 TurboParakeet Tdt 0.6b V3Mai Transcribe 2GPT TranscribeGPT 4O Mini Transcribe

这张榜怎么读

常见问题

转写模型按什么排名?

按转写请求数排名;不同模型的计费口径可能是音频时长或字符数,榜单以请求量为统一口径。

中文识别该怎么选?

榜单只能说明通用使用规模,中文识别效果受口音、行业词、噪声影响很大,建议用你的真实录音做一次对比测试。