研究人员推出Wonder,这是一种新颖的视频世界模型,专为合成环境的实时交互式探索而设计。该模型可以从图像或条件视频生成可玩的世界,允许用户导航和发现未见的区域。Wonder采用独特的相机条件方法,结合了密集坐标场和高效的基于稀疏注意力机制的内存,以处理长期上下文和精确的内存检索。这种系统级协同设计能够以16 FPS的速度合成具有连贯几何、外观和动态的各种微观尺度视频。 AI
影响 能够对合成环境进行实时交互式探索,可能推动模拟和内容创作领域的应用。
排序理由 该集群描述了一篇详细介绍新型视频世界模型的研究论文。
在 Hugging Face Daily Papers 阅读 →
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →