一个名为 EVICALC 的系统,专为 DocSem 共享任务设计,在 1,730 个任务上实现了 8.61% 的联合准确率。该系统通过选择段落来处理 PDF,使用语言模型生成算术表达式,然后在本地评估这些表达式。一个单独的公开验证运行获得了更高的分数,准确率为 92.17%,证据 F1 为 1.00,尽管由于配置不同,这些指标不能直接比较。分析显示,光学字符识别错误(如合并文本块)等问题可能导致系统从不相关的内容中回答。 AI
影响 凸显了在复杂文档理解任务中集成 OCR 和 LLM 的挑战。
排序理由 该集群包含一篇详细介绍系统在特定任务上的性能和失效分析的研究论文。
在 arXiv cs.IR (Information Retrieval) 阅读 →
- alphaXiv
- CatalyzeX
- Connected Papers
- CORE Recommender
- DagsHub
- DocSem
- EVICALC
- Gotit.pub
- Hugging Face
- Litmaps
- optical character recognition
- ScienceCast
- scite Smart Citations
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →