研究人员开发了MOCO,一个新颖的基于扩散的框架,用于从多种同步输入(如语音音频、文本描述和轨迹数据)生成相干的3D化身动作。与以往在对齐的多模态数据方面存在困难且经常产生不匹配运动的先前方法不同,MOCO解耦了运动生成过程。在每个去噪步骤中,它独立生成每种模态的运动,然后根据空间规则将它们组装起来,迭代地优化整体运动以获得自然流畅的结果。在自定义基准上的实验表明,MOCO在多模态运动生成方面优于现有方法。 AI
影响 这项研究可能为游戏、虚拟现实和动画领域带来更逼真、更具交互性的3D化身。
排序理由 该集群包含一篇详细介绍多模态运动生成新方法的论文。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- arXiv
- CatalyzeX
- Connected Papers
- CORE Recommender
- DagsHub
- Gotit.pub
- Hugging Face
- Litmaps
- ScienceCast
- scite Smart Citations
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →