PulseAugur
实时 23:08:59
Deutsch(DE) Wonder: Video World Model Done Better

Wonder视频世界模型支持实时交互式探索

研究人员推出Wonder,这是一种新颖的视频世界模型,专为合成环境的实时交互式探索而设计。该模型可以从图像或条件视频生成可玩的世界,允许用户导航和发现未见的区域。Wonder采用独特的相机条件方法,结合了密集坐标场和高效的基于稀疏注意力机制的内存,以处理长期上下文和精确的内存检索。这种系统级协同设计能够以16 FPS的速度合成具有连贯几何、外观和动态的各种微观尺度视频。 AI

影响 能够对合成环境进行实时交互式探索,可能推动模拟和内容创作领域的应用。

排序理由 该集群描述了一篇详细介绍新型视频世界模型的研究论文。

在 Hugging Face Daily Papers 阅读 →

AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →

Wonder视频世界模型支持实时交互式探索

报道来源 [2]

  1. Hugging Face Daily Papers TIER_1 Deutsch(DE) ·

    Wonder:视频世界模型做得更好

    We present Wonder, a general-purpose video world model for real-time, camera-controllable world exploration. Given an image or a conditional video, Wonder constructs a playable world where users can navigate interactively by moving the camera, discovering unseen regions, and revi…

  2. arXiv cs.CV TIER_1 Deutsch(DE) · Jiacong Xu, Hanwen Jiang, Zhixin Shu, Kalyan Sunkavalli, Vishal M. Patel, Yiqun Mei ·

    Wonder:视频世界模型做得更好

    arXiv:2607.26037v1 Announce Type: new Abstract: We present Wonder, a general-purpose video world model for real-time, camera-controllable world exploration. Given an image or a conditional video, Wonder constructs a playable world where users can navigate interactively by moving …