研究人员推出了一种新颖的双编码器REIGN(Refurbished Embeddings with Integrated Guidance Networks),用于高效的密集长文档检索。与传统的二次方扩展的token级编码器不同,REIGN处理来自冻结的Guidance Network的上下文块嵌入,将训练成本显著降低了约四个数量级。这种方法将token处理与文档级推理解耦,并允许缓存,使其在文档到文档的检索任务中更有效。在Wikipedia、LoCo套件和专利检索等各种基准测试中,REIGN的表现均优于大型模型。 AI
影响 这项研究可能显著提高处理和检索非常长文档信息的效率和成本效益,对法律科技、科学研究和知识管理等领域产生影响。
排序理由 该集群包含一篇研究论文,详细介绍了用于密集检索中高效上下文长度扩展的新模型和方法。
- arXiv
- Guidance Network
- Hugging Face
- LoCo
- Transformer++
- Wikipedia
- alphaXiv
- CatalyzeX
- DagsHub
- Gotit.pub
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →