PulseAugur
实时 08:06:04
English(EN) MonoVoc: Decoupling Geometry and Semantics for Lightweight Monocular Open-Vocabulary 3D Gaussians

MonoVoc 管道解耦3D几何与语义,实现高效开放词汇场景理解

研究人员开发了 MonoVoc,一个新颖的管道,用于将3D几何重建与语义集成分离,以实现开放词汇3D场景理解。该方法使用单目视频序列高效创建可搜索的对象级语义高斯图。通过解耦这些过程并使用模块化的对象级语义嵌入,而不是密集的每高斯语言特征,MonoVoc 与现有方法相比,内存使用量显著减少了一个数量级,同时保持了强大的渲染保真度和分割精度。 AI

影响 通过自然语言从单目视频实现更高效、更易于访问的3D场景查询和导航。

排序理由 详细介绍3D场景理解新方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.CV 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

MonoVoc 管道解耦3D几何与语义,实现高效开放词汇场景理解

报道来源 [1]

  1. arXiv cs.CV TIER_1 English(EN) · Pouya Ardekhani, Zahra Dehghanian, Morteza Abolghasemi, Hamid R. Rabiee ·

    MonoVoc:解耦几何与语义,实现轻量级单目开放词汇3D高斯表示

    arXiv:2607.28300v1 Announce Type: new Abstract: Open vocabulary 3D scene understanding is essential for next-generation interactive systems, empowering users to intuitively query and navigate reconstructed environments using natural language. However, current 3D Gaussian framewor…