哪种RAG范式在规模化中表现最佳?一种检索增强生成范式的规模研究
该研究对检索增强生成(RAG)中的四种范式——词汇检索、密集检索、基于图的索引和代理搜索——进行了严格的语料规模递增测试。通过在从约1000到512000文档的28个嵌套层级中,固定问题和相关文档,评估准确率、查询开销及延迟。结果显示,在受控环境下,传统的BM25在每个规模层面均表现出最佳的性价比和准确率,尤其在中大型规模更优。文件系统代理在小规模时略优,但查询成本高且在大规模时准确率大幅下降。引入基于BM25的检索后,代理性能显著提升。基于图的RAG因构建开销巨大且难以扩展,准确率低于BM25。
这条 研究论文 信号说明,来自 arXiv cs.CL 的信息已经不只是单点新闻,而是值得放进产品、研究和行业判断里的趋势线索。