PulseAugur
实时 05:52:02
English(EN) HPD-Parsing: Hierarchical Parallel Document Parsing

新的HPD-Parsing方法提升了视觉语言模型文档处理速度

研究人员开发了一种名为HPD-Parsing的新方法,用于使用视觉语言模型高效处理文档。该方法用分层并行解码范式取代了传统的逐个标记的顺序生成。HPD-Parsing全局分析文档的整体结构,然后并发解码块级内容,显著提高了吞吐量。实验表明,HPD-Parsing的吞吐量达到每秒4,752个标记,在保持具有竞争力的准确性的同时,性能超过现有模型两倍以上。 AI

影响 这种新的解析方法可以显著加速AI系统的文档处理,从而能够更快地分析大型文档集。

排序理由 该集群描述了在arXiv上的学术论文中提出的一种新方法。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.CL 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

新的HPD-Parsing方法提升了视觉语言模型文档处理速度

报道来源 [1]

  1. arXiv cs.CL TIER_1 English(EN) · Shu Wei, Jingjing Wu, Lingshu Zhang, Qunyi Xie, Hao Zou, Le Xiang, Xu Fan, Yangliu Xu, Manhui Lin, Xiaolong Ma, Cheng Cui, Tengyu Du, YY ·

    HPD-Parsing:分层并行文档解析

    arXiv:2607.18839v1 Announce Type: new Abstract: Efficient teamwork typically combines global coordination with parallel execution, a principle not yet fully reflected in unified Vision-Language Model (VLM)-based document parsers. Existing unified parsers process an entire page jo…