实体
Buckeye
Buckeye
PulseAugur coverage of Buckeye — every cluster mentioning Buckeye across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 2
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
新的基于梯度的语音到文本方法可跨所有ASR模型进行对齐
研究人员开发了一种新颖的基于梯度的语音到文本对齐方法,适用于任何可微分的自动语音识别(ASR)模型。该技术从令牌对数概率的梯度中提取词语时间信息,无需修改模型或进行训练。它提供了一种通用的对齐解决方案,适用于各种ASR家族,包括语音LLM,并直接在输入网格上进行对齐,以获得更高的时间精度。在读取语音和自发语音数据集上的十六个模型进行的评估表明,梯度对齐是可用的,其性能与原生对齐器相当,并为流式模型提供了改进,尽管它需要对每个令牌进行反向传播。
-
新方法改进多语言词级语音对齐
研究人员开发了一种新颖的多语言词级强制对齐方法,集成了Massively Multilingual Speech (MMS) 模型中的表示和一个自监督音素边界检测器。该方法使用学习型动态规划解码器来推断精确的词边界。该系统在TIMIT和Buckeye数据集上与Montreal Forced Aligner (MFA) 等现有方法相比,表现出优越的性能,并在未见过(unseen)的语言上显示出有希望的结果,表明其可扩展性可覆盖MMS支持…