实体
Diego Belzarena
Diego Belzarena
PulseAugur coverage of Diego Belzarena — every cluster mentioning Diego Belzarena across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
新的统计方法量化历史书籍中的字体相似性
研究人员开发了一种新的统计方法,用于量化历史印刷书籍中的字体相似性,从而加速了文献学分析。该方法使用聚类和对齐的字符图像来定义书籍之间的字体距离,并辅以一个反例统计框架来评估其显著性。该技术应用于17世纪的西班牙剧院小册子,其能力超越了人类专家,从而修正了印刷商的归属,并为大规模数字书目学提供了潜力。
-
视觉语言模型在历史文献OCR中表现出细微的幻觉
一篇新的研究论文分析了视觉语言模型(VLM)在转录历史文献方面的性能。研究发现,尽管它们在字符错误率(CER)和单词错误率(WER)等标准指标上优于传统的OCR系统,但它们表现出细微但关键的故障模式。这些模式包括生成虚假内容和进行语义替换,这些替换在不显著影响CER/WER的情况下改变了含义,尤其影响了命名实体。该研究强调,需要采用评估方法来评估语义可靠性,而不仅仅是字符准确性,以满足档案转录的需求。