PulseAugur
实时 09:46:52
English(EN) Know3D: Prompting 3D Generation with Knowledge from Vision-Language Models

Know3D 框架使用 VLM 来改进可控的 3D 资产生成

研究人员开发了 Know3D,一个通过整合来自视觉语言模型 (VLM) 的知识来增强 3D 资产生成的新框架。该方法使用 VLM 来理解语义指令并指导扩散模型,然后将这些知识转化为 3D 生成过程。Know3D 旨在将 3D 模型中未见区域的生成从随机过程转变为语义可控过程,从而提高与用户意图的对齐度和几何合理性。 AI

影响 该框架可能带来更可控、语义对齐的 3D 资产生成,从而在创意应用中更好地满足用户意图。

排序理由 该集群包含一篇详细介绍新 3D 生成框架的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.CV 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

Know3D 框架使用 VLM 来改进可控的 3D 资产生成

报道来源 [1]

  1. arXiv cs.CV TIER_1 English(EN) · Wenyue Chen, Wenjue Chen, Peng Li, Qinghe Wang, Xu Jia, Heliang Zheng, Rongfei Jia, Yuan Liu, Ronggang Wang ·

    Know3D:利用视觉语言模型的知识提示3D生成

    arXiv:2603.22782v2 Announce Type: replace Abstract: Recent advances in 3D generation have improved the fidelity and geometric details of synthesized 3D assets. However, due to the inherent ambiguity of single-view observations and the lack of robust global structural priors cause…