研究人员开发了 ColNanoVDR,一个用于多向量视觉文档检索中文档无关查询蒸馏的新框架。该方法允许较小的学生模型高效地查询大型教师模型,而无需处理或缓存大量的页面数据。该框架利用具有学习权重的最优传输 (OTW) 目标来对齐学生查询令牌与教师嵌入,实现了教师性能的约 95%,同时显著加快了查询编码速度。 AI
影响 通过使小型模型能够更有效地查询大型教师模型,加速了视觉文档检索。
排序理由 该集群描述了一篇详细介绍用于改进视觉文档检索的新颖框架的新研究论文。
在 arXiv cs.IR (Information Retrieval) 阅读 →
- alphaXiv
- arXiv
- CatalyzeX
- ColNanoVDR
- DagsHub
- Hugging Face
- NanoVDR
- nDCG@5
- optimal transport
- Ryenhails
- ViDoRe v1-v3
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →