研究人员推出Avatar-Forever,一个专为高质量、实时无限交互式虚拟形象设计的新型框架。该系统将生成效率和长时鲁棒性的训练解耦到并行分支中,解决了现有顺序训练管道的局限性。Avatar-Forever采用全参数蒸馏来保证视觉质量,并使用经过面向恢复的滚动训练(RRT)训练的轻量级适配器来提高生成鲁棒性。此外,它还集成了ForeverCache,一种分块特征缓存机制,通过减少冗余计算来优化流式推理。Avatar-Forever基于一个22B的视频基础模型构建,实现了具有一致身份和动作的无界音频驱动虚拟形象生成,在单个H100 GPU上以768x512分辨率达到了27.2 FPS的吞吐量。 AI
影响 该框架有望为交互式应用带来更稳定、更逼真的数字人。
排序理由 该集群包含一篇详细介绍虚拟形象生成新技术框架的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →