研究人员开发了AffordAny,一个用于开放世界3D可供性识别的新型框架,该框架使用单目RGB图像。该系统构建了大规模文本条件3D部件监督,并通过引导式解码器进行可供性识别,通过伪标签自训练提高了泛化能力。AffordAny创建了一个包含超过5000个对象和10000个部件级样本的基准,与先前的方法相比,显著扩展了类别多样性。该框架展示了有效性和鲁棒性,在未见过对象和类别上取得了强劲的性能。 AI
影响 这项研究推动了从单张图像进行开放世界3D理解,可能改进机器人和AR/VR应用。
排序理由 该集群描述了一篇详细介绍新型3D可供性识别框架的新研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →