研究人员开发了一种新的音频驱动数字人生成方法,提高了合成说话头的真实感和准确性。该方法利用面部标志引导和3D高斯溅射技术来改进面部几何和外观建模。该系统包含一个空间增强模块,该模块使用预测的标志来细化表情敏感区域,以及一个全局标志补偿机制,以提供全脸结构信息,从而获得更好的唇部同步和视觉质量。 AI
影响 这项研究可能为虚拟通信和媒体制作带来更真实、更同步的数字人。
排序理由 这是一篇详细介绍AI驱动合成新方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →