研究人员开发了MV-GEL,一个旨在利用语言驱动提示改进3D网格上几何实体定位的新颖框架。该系统通过采用一个名为GELviews的提示条件排序模块来选择信息量最大的视角,从而解决了3D物体外观中的视角敏感性挑战。通过使用视觉-语言模型处理这些选定的视图,并通过几何感知光线投射将预测提升到网格上,MV-GEL在面和边定位方面的准确性相比基线方法有了显著提高。 AI
影响 该框架通过实现更精确的语言驱动3D物体操作,有望推动计算机辅助设计和机器人领域的应用。
排序理由 该集群包含一篇详细介绍用于3D网格几何实体定位的新框架的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- CatalyzeX
- computer-aided design
- DagsHub
- GELviews
- Gotit.pub
- Hugging Face
- MV-GEL
- ScienceCast
- vision-language model
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →