实体
Audio encoder with selectable L/R or M/S coding
Audio encoder with selectable L/R or M/S coding
PulseAugur coverage of Audio encoder with selectable L/R or M/S coding — every cluster mentioning Audio encoder with selectable L/R or M/S coding across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
FireRedAudio: 统一的音频理解与生成模型
研究人员推出了 FireRedAudio,这是一种新颖的音频语言模型,专为语音的理解和生成而设计。该模型采用独特的、分离的连续输入表示方法进行分析和合成,使其能够处理诸如长篇音频理解(长达一小时)、多语言自动语音识别以及各种形式的语音合成和编辑等任务。FireRedAudio 在这些多样化应用中均取得了具有竞争力的性能,证明了其分离表示策略的有效性。
-
新框架通过可训练的音频提示增强音频语言模型
研究人员为音频语言模型(ALMs)开发了一个新框架,该框架将可训练的提示直接引入音频编码器。这种方法旨在捕获任务特定的声学特征,通过补充现有的文本端提示学习方法来增强少样本适应性。在11个数据集上的实验表明,当与文本提示调优集成时,这种即插即用模块通常可以提高性能,这表明对音频表示空间进行显式调制是有效的。