研究人员开发了 StreetDiff,这是一种新颖的多视图扩散模型,旨在生成一致且结构准确的城市街景。该框架解决了现有模型在跨视图一致性方面,尤其是在复杂环境中,所面临的局限性。StreetDiff 包含一个全景对齐模块 (PAM) 来强制视图之间的对齐,以及一个全景-透视协同设计,用于分离全局布局推理和局部细节合成。该团队还创建了 Street360,一个用于多视图城市全景生成的大规模数据集,并证明了 StreetDiff 在结构一致性和视觉保真度方面具有卓越的性能。 AI
影响 推进了多视图场景生成能力,可能改进虚拟现实、自动驾驶模拟和 3D 内容创作等应用。
排序理由 该集群描述了一篇关于用于计算机视觉任务的新模型和数据集的详细研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- CatalyzeX
- CORE Recommender
- DagsHub
- Gotit.pub
- Hugging Face
- Panorama Alignment Module
- ScienceCast
- Stable Diffusion
- Street360
- StreetDiff
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →