研究人员推出了两个新框架,以提高大型语言模型理解和回答超长文档问题的能力。DocTrace 专注于创建可追溯的证据图,展示信息在推理过程中是如何组成的,在 MMLongBench-Doc 等基准测试中取得了比现有模型显著的改进。另外,XL-DocBench 提供了一个新的人工验证的超长文档理解基准,其中包含跨越多达 2,303 页的问题,需要进行多文档比较,突显了当前系统在处理此类复杂任务时的困难。 AI
影响 这些进展旨在提高 AI 在处理和推理海量文档方面的能力,这对于合规、金融和工程等领域的应用至关重要。
排序理由 两篇新的学术论文介绍了用于长文档理解的新颖框架和基准。
- XL-DocBench
- DocTrace
- Long Document Visual Question Answering
- LongDocURL
- MMLongBench-Doc
- Multimodal Large Language Models
- Qwen3-VL-8B-Instruct
- SlideVQA
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →