研究人员调查了合成数据在训练泰语光学字符识别 (OCR) 模型方面的有效性。他们开发了一种方法来解耦影响合成数据可迁移性的因素,例如领域、上下文、排版和字形变化。利用这些见解,他们将 PaddleOCR-VL-1.6 模型改编为 Wayu-Paxa-OCR-Zero,该模型在打印泰语文档上取得了有竞争力的性能,并显著提高了手写泰语文本的准确性,性能优于 Typhoon OCR v1 7B 模型。 AI
影响 展示了一种可行的仅使用合成数据进行 OCR 训练的方法,有可能减少对真实世界标记数据的依赖。
排序理由 研究论文,详细介绍了合成数据用于 OCR 的新方法。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →