一篇新的研究论文调查了视频扩散模型(如 Video Diffusion Transformers (DiTs))是否内化了物理原理,还是仅仅模仿熟悉的运动模式。研究发现,诸如运动学运动和刚体动力学等物理量可以在去噪过程的早期从模型的内部表示中准确解码。这表明模型是主动构建物理信息,而不是仅仅从输入中复制它,信息被定位在对象令牌上,全局计算但局部存储。 AI
影响 调查了人工智能模型理解和应用物理定律的程度,这对于开发更强大、更可靠的人工智能系统至关重要。
排序理由 研究论文发表在 arXiv 上,详细介绍了关于视频扩散模型的发现。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →