两篇新的arXiv论文探讨了生成逼真说话头像的进展。第一篇论文全面调研了现有技术,将其分为图像驱动、音频驱动、视频驱动和3D/神经渲染方法,并分析了当前的局限性和未来的挑战。第二篇论文介绍了CHAT框架,该框架可以根据文本提示生成成对的、响应式的视听对话片段,旨在为收集真实世界对话数据提供可扩展的替代方案。 AI
影响 这些论文推动了逼真数字人生成的最先进技术,对虚拟代理和内容创作具有重要意义。
排序理由 两篇在arXiv上发表的学术论文,详细介绍了说话头像生成的新方法和调研。
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →