研究人员推出了一种新颖的AnchorFold框架,旨在提高多向量视觉文档检索的效率。该框架无需训练,通过识别关键的“锚点”标记来压缩视觉块嵌入,然后围绕这些锚点聚合周围标记的信息。与现有的无训练基线相比,AnchorFold表现出优越的性能,在基准数据集上实现了显著压缩率下的近乎无损压缩。 AI
影响 提高了视觉文档检索系统的效率和准确性,可能降低存储和处理成本。
排序理由 该集群包含一篇详细介绍新框架及其在检索任务上性能的学术论文。
- AnchorFold
- arXiv
- CatalyzeX
- DagsHub
- Gotit.pub
- Hugging Face
- nDCG@5
- REAL-MM-RAG
- Recursive Attention Propagation
- ScienceCast
- Visual Document Retrieval
- alphaXiv
- ViDoRe v1/v2
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →