研究人员开发了SAME,一种用于立体声音乐和通用音频的新型自动编码器,它在保持重建质量的同时实现了高时间压缩比。该模型结合了Transformer骨干网络、语义正则化、相位感知损失和改进的判别器设计。SAME提供了显著的计算成本优势,并以开放权重形式发布了两个版本:SAME-L和可CPU部署的SAME-S。 AI
影响 新的开放权重音频自动编码器可以降低生成音频任务的计算成本。
排序理由 该集群包含一篇详细介绍新型模型架构及其发布的新学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →