PulseAugur
实时 19:10:56
实体 ASR model

ASR model

PulseAugur coverage of ASR model — every cluster mentioning ASR model across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 1 条
  1. RESEARCH · CL_133172 ·

    新的基于梯度的语音到文本方法可跨所有ASR模型进行对齐

    研究人员开发了一种新颖的基于梯度的语音到文本对齐方法,适用于任何可微分的自动语音识别(ASR)模型。该技术从令牌对数概率的梯度中提取词语时间信息,无需修改模型或进行训练。它提供了一种通用的对齐解决方案,适用于各种ASR家族,包括语音LLM,并直接在输入网格上进行对齐,以获得更高的时间精度。在读取语音和自发语音数据集上的十六个模型进行的评估表明,梯度对齐是可用的,其性能与原生对齐器相当,并为流式模型提供了改进,尽管它需要对每个令牌进行反向传播。