研究人员开发了一种方法,将多页视觉丰富文档理解(MP-VRDU)系统中的失败归因于特定原因:表示、选择和推理。通过分离这些失败模式,他们发现虽然视觉很重要,但它并不能取代文本提取。研究还显示,丢失页面会显著影响准确性,而干扰项的影响很小。此外,推理组件即使在提供所有信息的情况下,也难以整合跨页面的证据。这些发现为在计算约束下构建更有效的MP-VRDU系统提供了指导。 AI
影响 通过识别表示、选择和推理中的关键故障点,为改进多页文档理解系统提供了见解。
排序理由 该集群包含一篇在arXiv上发表的研究论文,详细介绍了一种分析AI系统故障的新方法。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- CatalyzeX
- CORE Recommender
- DagsHub
- Gotit.pub
- Hugging Face
- Influence Flower
- MP-VRDU
- ScienceCast
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →