研究人员对视频生成中的运动和遮挡解除控制的设计空间进行了系统性研究。该研究探讨了指定运动的不同方法,例如基于文本与基于跟踪,以及遮挡解除,使用基于文本与基于图像的方法。创建了一个包含合成场景和捕捉场景的新基准来评估这些方法,结果表明基于跟踪的引导提高了运动精度,而基于图像的引导提高了新显露内容的保真度。然而,控制遮挡解除对象的外观和动态,尤其是在它们可见后移动时,仍然是一个开放的挑战。 AI
影响 这项研究可能导致更复杂的视频生成模型,能够更真实地处理复杂的对象运动和显露隐藏内容。
排序理由 该集群包含一篇详细介绍视频生成技术研究的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →