nineninesix.ai 发布了一款名为 Diamond 的新型语音恢复模型。这款自回归序列到序列模型采用了双 Transformer 架构,包括一个时间 Transformer 和一个紧凑型深度 Transformer,能够将降质音频重建为高保真 44.1 kHz 语音。Diamond 在与其他开源恢复模型相比时,取得了有竞争力的性能,即使是从头开始训练,参数量和训练时间也相对较少。 AI
影响 提供了改进的语音恢复能力,可能影响音频制作和数据集清理。
排序理由 发布了一款具有技术细节和基准测试结果的新模型。[lever_c_demoted from research: ic=1 ai=1.0]
在 Hugging Face Trending Models 阅读 →
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →