PulseAugur
实时 21:20:27
实体 SpatialBench

SpatialBench

PulseAugur coverage of SpatialBench — every cluster mentioning SpatialBench across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
  1. RESEARCH · CL_53476 ·

    SpatialBench基准测试揭示了当前空间基础模型的局限性

    引入了一个名为SpatialBench的新基准测试,用于评估空间基础模型在不同领域和任务上的泛化能力。该基准测试包含19个数据集和546个场景,揭示了当前模型在处理多样化场景方面尚未精通。该研究还引入了大规模数据集DA-Next-5M和强大的基线模型DA-Next,以推进空间表示学习。

  2. RESEARCH · CL_15684 ·

    新基准测试挑战多模态大语言模型(MLLMs)的空间和功能推理能力

    研究人员引入了新的基准测试,用于评估多模态大语言模型(MLLMs)的空间和功能推理能力。这些基准测试旨在超越基本的几何感知,评估结构化空间推理和理解物体在特定情境下的效用等更高级的认知能力。实验表明,当前的多模态大语言模型在整合空间记忆、功能推理和外部知识方面存在困难,这凸显了实现具身智能的重大瓶颈。