研究人员开发了OCR-EDR,一个旨在改进光学字符识别(OCR)系统的新型框架,特别适用于包含公式或结构化文本等复杂文档。该系统超越了聚合指标,提供细粒度的错误诊断,然后进行迭代修复。通过评估OCR预测、其渲染以及源图像之间的一致性,OCR-EDR能够识别和纠正错误,甚至能够处理渲染等效输出。该框架包括用于评估OCR错误的OCRErrBench数据集,以及在公式识别方面表现出高诊断准确性和显著改进的DocEDR模型。 AI
影响 提高了复杂文档的OCR准确性,可能在各个领域改进数据提取和可访问性。
排序理由 学术论文,介绍了一个用于OCR错误诊断和修复的新框架和模型。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →