Datalab推出了OmniExtractBench,这是一个旨在解决结构化文档提取任务中偏差和不透明性问题的开放基准。该新基准评估AI系统从PDF文档填充JSON模式的准确性,并使用提供决策解释的确定性评分器。OmniExtractBench旨在提供一种标准化和可审计的评估方法,这与Datalab认为难以比较或验证的供应商创建的排行榜形成对比。该基准包含来自各种来源的620份文档,并采用基于内容的配对方法和匈牙利算法进行准确的表格对齐。 AI
影响 标准化AI文档提取的评估,从而能够更公平地比较模型性能。
排序理由 该项目描述了一个用于评估AI系统的新基准的发布,该项目属于研究类别。[lever_c_demoted from research: ic=1 ai=1.0]
- Apache Software License 2.0
- Azure Content Understanding
- Claude
- Creative Commons Attribution 4.0 International
- ExtractBench
- Gemini
- GitHub
- GPT 5.6-sol
- Hugging Face
- JSON
- LlamaExtract
- LongArray-Extract
- Mistral OCR 4.1
- OmniExtractBench
- Python Package Index
- SciPy
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →