两篇新的研究论文介绍了场景文字图像超分辨率(STISR)的新方法,该任务专注于增强低分辨率文字图像并保持可读性。其中一篇论文提出的DualTSR在一个多模态Transformer骨干网络中统一了连续图像生成和离散文本重建,与以前的方法相比,显著减少了参数数量和推理延迟。第二篇论文介绍了TIGER,一个两阶段框架,它在图像增强之前优先恢复文本结构,确保高保真度和可读性,并且还提出了一个具有极端缩放的中文场景文本新数据集。 AI
影响 场景文字超分辨率的这些进步可以提高OCR准确性以及自动驾驶和文档分析等应用中的图像增强效果。
排序理由 两篇在arXiv上发表的学术论文,介绍了场景文字图像超分辨率的新方法。
- arXiv
- Hugging Face
- Minxing Luo
- TIGER
- alphaXiv
- CatalyzeX
- DagsHub
- DualTSR
- Gotit.pub
- Influence Flower
- ScienceCast
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →