研究人员开发了 DuoTok,一种新颖的双轨音乐分词方法,旨在同时生成人声和伴奏。该方法使用分阶段解耦来学习语义音频表示,并结合了用于频谱重建、源分离和歌词对齐的自监督预训练和多任务监督。DuoTok 旨在平衡声学保真度和跨轨结构保持,在低比特率下的可预测性和保真度方面优于现有方法。 AI
影响 这项研究可能会推动 AI 在复杂音频生成任务中的能力,并可能影响音乐制作工具和创意 AI 应用。
排序理由 该集群包含一篇详细介绍新音乐生成方法的论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →