研究人员开发了AcroMELD,一个旨在从视觉上看起来像表单但缺少必要交互元素的新模型,用于恢复PDF文档中的交互式表单字段。该模型结合了高分辨率视觉Transformer和PDF图元来检测缺失的小部件,解决了重叠视觉线索和密集页面布局带来的困难。AcroMELD在内部测试集上达到了0.9344的微F1分数,在外部保留集上达到了0.8477,超过了之前的参考模型,但在稀有类别和特定评估指标上显示出局限性。 AI
影响 该模型可以提高PDF中嵌入的表单的文档处理和数据输入效率。
排序理由 该集群描述了一篇关于特定计算机视觉任务新模型的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
- AcroMELD
- alphaXiv
- arXiv
- CatalyzeX
- CommonForms-L
- DagsHub
- FFGBT-v8
- Gotit.pub
- Hugging Face
- ScienceCast
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →