研究人员开发了两种新颖的视觉文档重新排序方法:RenderRank 和 RidgeRank。RenderRank 利用从文档图像中提取的压缩视觉令牌来学习与查询相关的评分,显著减少了输入令牌数量,同时在多个数据集上优于基于文本的重新排序器。RidgeRank 通过融合检索器分数和重新排序器分数并采用浅层线性读出器来提高效率,以一小部分计算成本实现了接近交叉编码器的准确性。这两种方法都旨在提高多模态语言模型在文档检索任务中的重新排序速度和准确性。 AI
影响 这些方法可以显著加快多模态人工智能系统中文档检索和分析的速度。
排序理由 arXiv 上发表了两篇研究论文,详细介绍了视觉文档重新排序的新方法。
在 arXiv cs.IR (Information Retrieval) 阅读 →
- alphaXiv
- arXiv
- BEIR
- CatalyzeX
- Connected Papers
- CORE Recommender
- DagsHub
- Gotit.pub
- Hugging Face
- Litmaps
- NDCG@10
- NDCG@5
- RenderRank
- RidgeRank
- ScienceCast
- scite Smart Citations
- ViDoRe 2
- ViDoRe 3
AI 生成摘要 · Google Gemini · 来自 3 个来源。 我们如何撰写摘要 →