重排模型排行榜(Rerank)
重排是提升检索精度最划算的一步,请求量反映它在 RAG 流程里的实际使用规模。
本周文档重排榜(Top 50)
最近 7 天文档重排模型的请求数排名,变化列为环比。统计窗口内进入榜单的模型共 7 个,合计 906万 次。
| 排名 | 模型 | 厂商 | 请求数 | 环比 | 占比 |
|---|---|---|---|---|---|
| 1 | Rerank 2.5 | Voyage AI | 350万 次 | +10% | 38.6% |
| 2 | Rerank 2.5 Lite | Voyage AI | 177万 次 | -58% | 19.5% |
| 3 | Rerank 4 Fast | Cohere | 146万 次 | -20% | 16.1% |
| 4 | Rerank V3.5 | Cohere | 136万 次 | +19% | 15.0% |
| 5 | Qwen3 Reranker 8B | 阿里云通义千问 | 55.9万 次 | -6% | 6.17% |
| 6 | Rerank 4 Pro | Cohere | 33.1万 次 | -6% | 3.66% |
| 7 | Llama Nemotron Rerank VL 1B V2(免费版) 免费版 | 英伟达 NVIDIA | 8.67万 次 | -9% | 0.957% |
本周文档重排榜厂商份额
同一窗口内按厂商聚合的请求量与份额。
| 排名 | 厂商 | 上榜模型数 | 请求数 | 份额 | 主力模型 |
|---|---|---|---|---|---|
| 1 | Voyage AI | 2 | 526万 次 | 58.1% | Rerank 2.5 38.6% |
| 2 | Cohere | 3 | 315万 次 | 34.8% | Rerank 4 Fast 16.1% |
| 3 | 阿里云通义千问 | 1 | 55.9万 次 | 6.17% | Qwen3 Reranker 8B 6.17% |
| 4 | 英伟达 NVIDIA | 1 | 8.67万 次 | 0.957% | Llama Nemotron Rerank VL 1B V2(免费版) 0.957% |
近半年请求量走势
按周汇总的请求量走势,取当前请求量最高的 6 个模型,用于判断谁在持续上升、谁在回落。
这张榜怎么读
- 主指标是请求数:这类模型按“次”计费与统计,token 数不可比,所以用请求数衡量真实用量。
- 环比显示相对上一个同等长度时间窗口的变化,“新上榜”表示上一周期没有可比数据。
- 占比是该模型在本榜全部上榜模型中的份额,用来判断头部集中度。
- 同一模型的不同变体(免费版、批处理版等)分开统计、分别排名。
常见问题
重排模型按什么排名?
按重排请求数排名,一次请求通常对应一批候选文档。
重排和嵌入模型是什么关系?
嵌入负责召回,重排负责精排;两者组合使用效果最好,因此这两张榜应该一起看。