研究人员推出WanSong,这是一种新颖的基于扩散的模型,旨在生成长篇、商业级歌曲。该模型直接生成长达五分钟的高保真、多语言歌曲,并在一次运行中输出人声和背景音乐。WanSong的扩散框架还通过步进蒸馏加速推理,并为编辑任务的微调和定制提供了简化的流程。 AI
影响 该模型可以加速AI驱动的音乐创作工具的开发,并提高音频合成的质量和效率。
排序理由 该集群包含一份技术报告,详细介绍了一种新的音频生成模型,属于研究范畴。
AI 生成摘要 · Google Gemini · 来自 3 个来源。 我们如何撰写摘要 →