PulseAugur
中
实时 15:21:31
实体 PaddleOCR-VL-1.6

PaddleOCR-VL-1.6

PulseAugur coverage of PaddleOCR-VL-1.6 — every cluster mentioning PaddleOCR-VL-1.6 across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
时间线
  1. 2026-06-02 product_launch Baidu released PaddleOCR-VL-1.6, a new version of its OCR model that achieves state-of-the-art performance on document parsing benchmarks. 来源
  2. 2026-05-27 product_launch PaddlePaddle released the PaddleOCR-VL-1.6 model, achieving state-of-the-art performance in document parsing. 来源
情绪 · 30 天

2 天有情绪数据

最近 · 第 1/1 页 · 共 5 条
  1. TOOL · CL_235442 ·

    合成数据在泰语 OCR 模型训练中展现出潜力

    研究人员调查了合成数据在训练泰语光学字符识别 (OCR) 模型方面的有效性。他们开发了一种方法来解耦影响合成数据可迁移性的因素,例如领域、上下文、排版和字形变化。利用这些见解,他们将 PaddleOCR-VL-1.6 模型改编为 Wayu-Paxa-OCR-Zero,该模型在打印泰语文档上取得了有竞争力的性能,并显著提高了手写泰语文本的准确性,性能优于 Typhoon OCR v1 7B 模型。

  2. TOOL · CL_253053 ·

    合成数据赋能高性能泰语 OCR 模型

    研究人员开发了一款泰语光学字符识别 (OCR) 模型 Wayu-Paxa-OCR-Zero,仅使用合成数据进行训练,就能在真实世界文档上实现高性能。通过仔细解耦字体、布局和手写字形等因素,研究发现字体多样性、二维结构和真实手写字形显著提高了迁移能力。与基础检查点相比,仅使用合成数据训练的模型在字符错误率方面有了大幅降低,并且优于另一个现有的 OCR 模型 Typhoon OCR v1 7B。

  3. SIGNIFICANT · CL_66398 ·

    百度PaddleOCR-VL-1.6刷新文档解析SOTA

    百度文心发布了其开源OCR工具的新版本PaddleOCR-VL-1.6。此次更新在OmniDocBench v1.6基准测试中实现了超过96.33%的准确率,超越了Gemini-3-Pro和GPT-5.2等主流模型。该模型在理解扫描件、弯曲文档和屏幕截图等复杂文档方面表现出显著的改进,使其成为文档数字化的领先解决方案。

  4. RESEARCH · CL_62822 ·

    新基准和模型推动文档解析和表格提取发展

    研究人员推出了新的基准和改进的模型,用于文档解析和表格提取。Dr. DocBench 专注于专家级别的文档解析,包括化学式和音乐符号等复杂结构,突出了当前模型的局限性。DTBench 提供了一个用于文档到表格提取的合成基准,评估 LLM 的推理和冲突解决能力。此外,PaddleOCR-VL-1.6 通过区域感知优化和渐进式后训练得到了增强,在 OmniDocBench v1.6 上取得了最先进的结果。

  5. SIGNIFICANT · CL_57047 ·

    PaddleOCR-VL-1.6 在文档解析领域创下新的SOTA记录

    PaddlePaddle 发布了 PaddleOCR-VL-1.6,这是一款先进的文档解析模型,在包括 OmniDocBench v1.6 在内的多个基准测试中达到了最先进的准确率,得分为 96.33%。新版本采用了一个区域感知数据优化框架和一个渐进式训练后策略,以提高性能,特别是在识别表格、古籍和罕见字符方面。该模型架构与其前身 PaddleOCR-VL-1.5 保持兼容,便于集成。