研究人员开发了 MonoVoc,一个新颖的管道,用于将3D几何重建与语义集成分离,以实现开放词汇3D场景理解。该方法使用单目视频序列高效创建可搜索的对象级语义高斯图。通过解耦这些过程并使用模块化的对象级语义嵌入,而不是密集的每高斯语言特征,MonoVoc 与现有方法相比,内存使用量显著减少了一个数量级,同时保持了强大的渲染保真度和分割精度。 AI
影响 通过自然语言从单目视频实现更高效、更易于访问的3D场景查询和导航。
排序理由 详细介绍3D场景理解新方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →