PulseAugur
实时 07:23:42
English(EN) MV-GEL: Language-Driven Multi-View Geometric Entity Localization on Meshes

MV-GEL框架增强了语言驱动的网格3D实体定位

研究人员开发了MV-GEL,一个旨在利用语言驱动提示改进3D网格上几何实体定位的新颖框架。该系统通过采用一个名为GELviews的提示条件排序模块来选择信息量最大的视角,从而解决了3D物体外观中的视角敏感性挑战。通过使用视觉-语言模型处理这些选定的视图,并通过几何感知光线投射将预测提升到网格上,MV-GEL在面和边定位方面的准确性相比基线方法有了显著提高。 AI

影响 该框架通过实现更精确的语言驱动3D物体操作,有望推动计算机辅助设计和机器人领域的应用。

排序理由 该集群包含一篇详细介绍用于3D网格几何实体定位的新框架的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.CV 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

MV-GEL框架增强了语言驱动的网格3D实体定位

报道来源 [1]

  1. arXiv cs.CV TIER_1 English(EN) · Kartik Bali, Roland Aydin ·

    MV-GEL:基于语言的网格多视图几何实体定位

    arXiv:2606.31533v2 Announce Type: replace Abstract: Identifying and grounding precise geometric entities, such as edges, planar regions, and curved surfaces within 3D objects, is foundational to computer-aided design (CAD), robotic manipulation, and scientific simulation. Althoug…