清华大学和香港科技大学的研究人员开发了LiveEdit,一个实时流媒体视频编辑框架。该系统以块的形式处理连续视频输入,在每个块上进行4步推理,实现12.66 FPS。LiveEdit通过采用三阶段蒸馏过程和自回归掩码缓存来避免对视频静态部分进行冗余计算,从而保持编辑区域的准确性和未更改区域的一致性。 AI
影响 通过显著加速基于扩散的视频编辑,实现了实时应用,如实时特效和视频会议。
排序理由 该集群描述了一个新的研究框架及其技术细节,已被计算机视觉会议录用。[lever_c_demoted from research: ic=1 ai=1.0]
- AR-oriented mask cache
- Diffusion Transformer
- Ditto-1M
- ECCV 2026
- Hong Kong University of Science and Technology
- LiveEdit
- Tsinghua University
- Wan2.1-T2V-1.3B
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →