PulseAugur
实时 10:25:39
English(EN) OmniMate: Open-Ended Real-Time Streaming Audio-Visual Generation for Interactive Avatars

新框架支持实时、高保真虚拟形象生成

两篇新研究论文介绍了用于实时生成逼真和交互式虚拟形象的先进框架。OmniMate 通过控制生成进度和通过多个参考来维持跨模态身份一致性,专注于开放式、多轮对话。AptAvatar 是一个更大的模型,通过使用蒸馏和历史回放技术来提高效率和长时一致性,而不会牺牲质量,从而实现快速生动的长篇视频生成。 AI

影响 这些进步可能为游戏、虚拟现实和客户服务应用中更具沉浸感和响应性的虚拟互动带来可能。

排序理由 arXiv 上发表了两篇研究论文,详细介绍了虚拟形象生成的新方法。

在 arXiv cs.CV 阅读 →

AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →

新框架支持实时、高保真虚拟形象生成

报道来源 [2]

  1. arXiv cs.CV TIER_1 English(EN) · Quanyue Song, Yishan He, Yanbo Ding, Zhixiang He, Yongxiang Li, Caigui Jiang, Zhi Zhi Guo ·

    OmniMate:面向交互式虚拟形象的开放式实时流音频视觉生成

    arXiv:2607.23023v1 Announce Type: new Abstract: Recent advances in diffusion-based generative models have enabled real-time audio-driven avatar generation and unified audio-visual synthesis, providing a promising foundation for interactive avatar systems. However, extending these…

  2. arXiv cs.CV TIER_1 English(EN) · Hengyuan Zhang, Jingna Sun, Meiguang Jin, Junfeng Ma ·

    AptAvatar:用于生产级虚拟形象的快速生动长篇音频驱动视频生成

    arXiv:2607.24013v1 Announce Type: new Abstract: Production-ready audio-driven avatar generation requires efficient inference without sacrificing fidelity or motion expressiveness. However, existing acceleration methods often compromise quality through restrictive architectural ch…