重排模型排行榜(Rerank)
重排是提升检索精度最划算的一步,请求量反映它在 RAG 流程里的实际使用规模。
本月文档重排榜(Top 50)
最近 30 天文档重排模型的请求数排名,变化列为环比。统计窗口内进入榜单的模型共 7 个,合计 3758万 次。
| 排名 | 模型 | 厂商 | 请求数 | 环比 | 占比 |
|---|---|---|---|---|---|
| 1 | Rerank 2.5 | Voyage AI | 1269万 次 | +87% | 33.8% |
| 2 | Rerank V3.5 | Cohere | 757万 次 | +131% | 20.1% |
| 3 | Rerank 2.5 Lite | Voyage AI | 690万 次 | +624% | 18.4% |
| 4 | Rerank 4 Fast | Cohere | 631万 次 | +282% | 16.8% |
| 5 | Qwen3 Reranker 8B | 阿里云通义千问 | 191万 次 | +589% | 5.09% |
| 6 | Rerank 4 Pro | Cohere | 145万 次 | +11% | 3.85% |
| 7 | Llama Nemotron Rerank VL 1B V2(免费版) 免费版 | 英伟达 NVIDIA | 74.1万 次 | -90% | 1.97% |
本月文档重排榜厂商份额
同一窗口内按厂商聚合的请求量与份额。
| 排名 | 厂商 | 上榜模型数 | 请求数 | 份额 | 主力模型 |
|---|---|---|---|---|---|
| 1 | Voyage AI | 2 | 1960万 次 | 52.1% | Rerank 2.5 33.8% |
| 2 | Cohere | 3 | 1533万 次 | 40.8% | Rerank V3.5 20.1% |
| 3 | 阿里云通义千问 | 1 | 191万 次 | 5.09% | Qwen3 Reranker 8B 5.09% |
| 4 | 英伟达 NVIDIA | 1 | 74.1万 次 | 1.97% | Llama Nemotron Rerank VL 1B V2(免费版) 1.97% |
近半年请求量走势
按周汇总的请求量走势,取当前请求量最高的 6 个模型,用于判断谁在持续上升、谁在回落。
这张榜怎么读
- 主指标是请求数:这类模型按“次”计费与统计,token 数不可比,所以用请求数衡量真实用量。
- 环比显示相对上一个同等长度时间窗口的变化,“新上榜”表示上一周期没有可比数据。
- 占比是该模型在本榜全部上榜模型中的份额,用来判断头部集中度。
- 同一模型的不同变体(免费版、批处理版等)分开统计、分别排名。
常见问题
重排模型按什么排名?
按重排请求数排名,一次请求通常对应一批候选文档。
重排和嵌入模型是什么关系?
嵌入负责召回,重排负责精排;两者组合使用效果最好,因此这两张榜应该一起看。