实体
Descript Audio Codec
Descript Audio Codec
PulseAugur coverage of Descript Audio Codec — every cluster mentioning Descript Audio Codec across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
nineninesix.ai 发布 Diamond 语音恢复模型
nineninesix.ai 发布了一款名为 Diamond 的新型语音恢复模型。这款自回归序列到序列模型采用了双 Transformer 架构,包括一个时间 Transformer 和一个紧凑型深度 Transformer,能够将降质音频重建为高保真 44.1 kHz 语音。Diamond 在与其他开源恢复模型相比时,取得了有竞争力的性能,即使是从头开始训练,参数量和训练时间也相对较少。
-
新研究探索用于语音增强的视听和流匹配技术
两篇新研究论文探索了使用生成模型进行语音增强的高级技术。第一篇论文介绍了视听对比对齐(AVCA),通过强制更强的视听相关性来改进基于扩散的语音增强,在干扰抑制和信号重建方面显示出优势,尤其是在低信噪比下。第二篇论文提出了一种新颖的无跳跃骨干网络用于流匹配语音增强,通过与Descript Audio Codec的潜在表示对齐(LRA)进行指导,旨在保留清晰语音表示并实现高效的几步推理。