大模型排行榜

语音转写模型排行榜(ASR)

按真实请求数统计的语音识别与转写模型排名,适合评估会议记录、字幕生成这类场景的主流选择。

数据截止:2026年9月21日 · 本次更新:2026-09-22 21:22(北京时间) · 统计模型数:21

今日语音转写榜(Top 50)

最近一个完整自然日语音转写模型的请求数排名,变化列为环比。统计窗口内进入榜单的模型共 21 个,合计 288万 次。

切换窗口: 今日 本周 本月

排名模型厂商请求数环比占比
1 Whisper Large V3 OpenAI 117万 次 +11% 40.7%
2 Whisper Large V3 Turbo OpenAI 74.5万 次 +69% 25.8%
3 GPT Transcribe OpenAI 20.2万 次 +845% 6.99%
4 Mai Transcribe 2 微软 16.2万 次 -49% 5.64%
5 Parakeet Tdt 0.6b V3 英伟达 NVIDIA 14.5万 次 +409% 5.05%
6 GPT 4O Mini Transcribe OpenAI 13.7万 次 +28% 4.75%
7 Whisper 1 OpenAI 8.12万 次 +32% 2.82%
8 Grok Stt xAI 4.94万 次 +20% 1.71%
9 Qwen3 Asr 0.6b 阿里云通义千问 4.56万 次 -3% 1.58%
10 Qwen3 Asr Flash 2026 02 10 阿里云通义千问 4.11万 次 -25% 1.43%
11 Voxtral Mini Transcribe 2602 Mistral AI 2.60万 次 -7% 0.901%
12 Qwen3 Asr 1.7b 阿里云通义千问 1.93万 次 -4% 0.669%
13 GPT 4O Transcribe OpenAI 1.77万 次 +60% 0.613%
14 Chirp 3 Google 谷歌 1.18万 次 +20% 0.408%
15 Nova 3 deepgram 1.10万 次 +61% 0.381%
16 Mai Transcribe 1.5 微软 4884 次 +86% 0.169%
17 Transcribe 1 fish-audio 2935 次 -21% 0.102%
18 Voxtral Mini 3B 2507 Mistral AI 2839 次 +280% 0.099%
19 Nemotron 3.5 Asr Streaming Multilingual 0.6b 英伟达 NVIDIA 2249 次 +8% 0.078%
20 Muse Voice Transcribe 1.0 Meta 1786 次 -57% 0.062%
21 Voxtral Small 24B 2507 Stt Mistral AI 1187 次 +51% 0.041%

今日语音转写榜厂商份额

同一窗口内按厂商聚合的请求量与份额。

排名厂商上榜模型数请求数份额主力模型
1 OpenAI 6 235万 次 81.7% Whisper Large V3 40.7%
2 微软 2 16.7万 次 5.80% Mai Transcribe 2 5.64%
3 英伟达 NVIDIA 2 14.8万 次 5.13% Parakeet Tdt 0.6b V3 5.05%
4 阿里云通义千问 3 10.6万 次 3.68% Qwen3 Asr 0.6b 1.58%
5 xAI 1 4.94万 次 1.71% Grok Stt 1.71%
6 Mistral AI 3 3.00万 次 1.04% Voxtral Mini Transcribe 2602 0.901%
7 Google 谷歌 1 1.18万 次 0.408% Chirp 3 0.408%
8 deepgram 1 1.10万 次 0.381% Nova 3 0.381%
9 fish-audio 1 2935 次 0.102% Transcribe 1 0.102%
10 Meta 1 1786 次 0.062% Muse Voice Transcribe 1.0 0.062%

近半年请求量走势

按周汇总的请求量走势,取当前请求量最高的 6 个模型,用于判断谁在持续上升、谁在回落。

0226万452万678万904万tokens / 周4/275/186/86/297/208/108/319/21Whisper Large V3Whisper Large V3 TurboParakeet Tdt 0.6b V3Mai Transcribe 2GPT TranscribeGPT 4O Mini Transcribe

这张榜怎么读

常见问题

转写模型按什么排名?

按转写请求数排名;不同模型的计费口径可能是音频时长或字符数,榜单以请求量为统一口径。

中文识别该怎么选?

榜单只能说明通用使用规模,中文识别效果受口音、行业词、噪声影响很大,建议用你的真实录音做一次对比测试。