研究人员推出了一种新颖的密集检索方法CoveR,旨在提高长篇检索增强生成(RAG)系统的覆盖率。CoveR使用基于覆盖率的对比和蒸馏目标进行训练,以更好地捕捉多样化的信息需求。该方法是与SCOPE数据集一同开发的,该数据集包含90K个训练对,源自研究问题,并由LLM生成的子问题可回答性信号进行增强。实验表明,与现有的密集检索基线相比,CoveR将nugget覆盖率提高了10%,同时保持了相关性。 AI
影响 增强了长篇RAG的信息检索能力,可能提高了AI生成内容的全面性。
排序理由 该集群包含一篇详细介绍新信息检索方法和数据集的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
在 arXiv cs.IR (Information Retrieval) 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →