实体
XLSR-53
XLSR-53
PulseAugur coverage of XLSR-53 — every cluster mentioning XLSR-53 across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
新基准比较了尼泊尔ASR的多语言模型
一项新研究使用标准化的微调协议,对尼泊尔自动语音识别(ASR)的六个多语言预训练模型进行了基准测试。研究发现,Whisper-Large-v3-Turbo 和 IndicWav2Vec 的表现相当,表明预训练中的语系接近性对于尼泊尔ASR可以与单纯的规模一样有效。研究还强调,与Whisper等自回归模型相比,CTC解码器在相似的准确度水平下提供了显著更快的性能,因此对于有延迟限制的应用来说是更可取的。这项工作为尼泊尔ASR提供了第一个…
-
新框架改进音频深度伪造源追踪
研究人员开发了一种新的双分支门控融合框架,以改进音频深度伪造源的追踪。该系统结合了XLSR-53和一个新颖的66维描述符CORES,后者比以前的方法捕获了更广泛的合成伪影。输入条件门自适应地加权这两个分支,以克服表示不平衡并提高在域外数据集上的性能。