研究人员开发了 Co-VGGT,一种利用 VGGT 几何基础模型来确定图像对之间共可见性的新方法。VGGT 在其内部表示中隐式编码共可见性,早期层构建场景表示,后期层充当共可见性推理器。Co-VGGT 冻结 VGGT 模型,并仅使用 RGB 输入训练一个小型、轻量级的头部来对共可见性进行分类,将每个 VGGT 层视为专业专家。这种方法显著提高了 Co-VisiON 基准的性能,优于先前的方法甚至人工标注基线。 AI
影响 这项研究推动了几何基础模型的发展,通过实现更准确的共可见性确定,有可能改进 3D 重建和 SLAM 流程。
排序理由 该集群描述了研究论文中提出的一种新方法和基准测试结果。[lever_c_demoted from research: ic=1 ai=1.0]
在 Hugging Face Daily Papers 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →