PulseAugur
实时 09:35:20
English(EN) SAME: A Semantically-Aligned Music Autoencoder

新的SAME音频自动编码器提供高压缩率、开放权重

研究人员开发了SAME,一种用于立体声音乐和通用音频的新型自动编码器,它在保持重建质量的同时实现了高时间压缩比。该模型结合了Transformer骨干网络、语义正则化、相位感知损失和改进的判别器设计。SAME提供了显著的计算成本优势,并以开放权重形式发布了两个版本:SAME-L和可CPU部署的SAME-S。 AI

影响 新的开放权重音频自动编码器可以降低生成音频任务的计算成本。

排序理由 该集群包含一篇详细介绍新型模型架构及其发布的新学术论文。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.AI 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

新的SAME音频自动编码器提供高压缩率、开放权重

报道来源 [1]

  1. arXiv cs.AI TIER_1 English(EN) · Jordi Pons ·

    SAME:一种语义对齐的音乐自动编码器

    Latent representations are at the heart of the majority of modern generative models. In the audio domain they are typically produced by a neural-audio-codec autoencoder. In this work we introduce SAME (Semantically-Aligned Music autoEncoder), an autoencoder for stereo music and g…