PulseAugur
实时 12:21:54
实体 Descript Audio Codec

Descript Audio Codec

PulseAugur coverage of Descript Audio Codec — every cluster mentioning Descript Audio Codec across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_155060 ·

    nineninesix.ai 发布 Diamond 语音恢复模型

    nineninesix.ai 发布了一款名为 Diamond 的新型语音恢复模型。这款自回归序列到序列模型采用了双 Transformer 架构,包括一个时间 Transformer 和一个紧凑型深度 Transformer,能够将降质音频重建为高保真 44.1 kHz 语音。Diamond 在与其他开源恢复模型相比时,取得了有竞争力的性能,即使是从头开始训练,参数量和训练时间也相对较少。

  2. RESEARCH · CL_107740 ·

    新研究探索用于语音增强的视听和流匹配技术

    两篇新研究论文探索了使用生成模型进行语音增强的高级技术。第一篇论文介绍了视听对比对齐(AVCA),通过强制更强的视听相关性来改进基于扩散的语音增强,在干扰抑制和信号重建方面显示出优势,尤其是在低信噪比下。第二篇论文提出了一种新颖的无跳跃骨干网络用于流匹配语音增强,通过与Descript Audio Codec的潜在表示对齐(LRA)进行指导,旨在保留清晰语音表示并实现高效的几步推理。