MDPBench
PulseAugur coverage of MDPBench — every cluster mentioning MDPBench across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
开放180B模型Darwin-180B-RSI引领10项Hugging Face基准测试
一个名为Darwin-180B-RSI的开放权重模型在10个Hugging Face官方排行榜上名列前茅,超越了所有其他参与组织。该模型由VIDRAFT基于Alibaba的Qwen3.8-Flash-Next构建,不仅在MMLU-Pro和GPQA等学术基准测试中表现出色,还在文档解析(MDPBench)、结构化数据输出(IFStruct)和PDF字段提取(ExtractBench)等实际的企业级任务中展现出强大性能。该模型的训练方法,…
-
Darwin-180B-RSI 模型领跑 10 个排行榜,可在笔记本电脑上运行
Darwin-180B-RSI 模型在包括 MDPBench、ExtractBench 和 IFStruct 在内的多个基准测试中取得了顶级排名,在 Hugging Face 排行榜上获得了 10 项官方第一名。这个拥有 1800 亿参数的模型,特别是 POCKET-Darwin-180B-GGUF 变体,因其能够在没有专用 GPU 的情况下在笔记本电脑和迷你 PC 等消费级硬件上运行而备受关注,这得益于其稀疏专家混合架构和 4 位量…
-
MonkeyOCRv2: 新型文档AI模型在MDPBench上达到SOTA
研究人员推出MonkeyOCRv2,这是一款专为文档AI任务设计的视觉-文本基础模型。该模型在MonkeyDoc v2上进行了预训练,MonkeyDoc v2是一个包含1.13亿张跨17种语言的文档图像的海量语料库。MonkeyOCRv2采用了一种新颖的预训练策略,结合了图像到文本生成和像素级文档重建,以保留细粒度细节。当用作视觉编码器时,它在MDPBench等基准测试中展现了最先进的性能,并在各种文档分析任务上超越了其他模型。