PulseAugur
实时 08:06:34
English(EN) PhysOmni: Physics-Grounded Multi-Object Scene Generation from a Single Image with Real-Time Interaction

PhysOmni框架可从单张图像生成可控视频

研究人员推出PhysOmni,一个旨在从单张图像生成物理一致且可控视频的新型框架。该方法通过提高物理一致性和可控性,并解决单图像到3D转换中常见的物体穿插问题,来应对当前生成视频模型的局限性。PhysOmni通过将模拟与渲染分离,实现实时物理交互预览,从而增强了空间连贯性并提高了对多物体交互的控制能力。 AI

影响 增强了AI生成视频的真实感和可控性,可能影响虚拟环境和内容创作等应用。

排序理由 该集群包含一篇详细介绍生成式AI新框架的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.CV 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

PhysOmni框架可从单张图像生成可控视频

报道来源 [1]

  1. arXiv cs.CV TIER_1 English(EN) · Xin Zhang, Yabo Chen, Yijie Fang, Wanying Qu, Haibin Huang, Chi Zhang, Feng Xu, Xuelong Li ·

    PhysOmni:基于物理的单图像多物体场景生成与实时交互

    arXiv:2605.20290v2 Announce Type: replace-cross Abstract: Recent generative video models achieve impressive visual quality but remain constrained by limited physical consistency and controllability. Existing video generation methods provide minimal physical control, and single-im…