研究人员开发了一种名为HPD-Parsing的新方法,用于使用视觉语言模型高效处理文档。该方法用分层并行解码范式取代了传统的逐个标记的顺序生成。HPD-Parsing全局分析文档的整体结构,然后并发解码块级内容,显著提高了吞吐量。实验表明,HPD-Parsing的吞吐量达到每秒4,752个标记,在保持具有竞争力的准确性的同时,性能超过现有模型两倍以上。 AI
影响 这种新的解析方法可以显著加速AI系统的文档处理,从而能够更快地分析大型文档集。
排序理由 该集群描述了在arXiv上的学术论文中提出的一种新方法。[lever_c_demoted from research: ic=1 ai=1.0]
- arXiv
- Hierarchical Parallel Decoding
- HPD-Parsing
- Hugging Face
- Progressive Multi-Token Prediction
- vision-language model
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →