研究人员开发了一种新颖的自动语音识别(ASR)系统前端,可提高语音增强效率。这个名为并行时频混合(PTBM)的新系统利用并行架构来模拟时域和频域,消除了传统循环模型中的顺序依赖。实验表明,与现有方法相比,PTBM在基准数据集上降低了词错误率,同时需要更少的参数和计算能力。 AI
影响 这种新的PTBM架构可能带来更高效、更准确的语音识别系统,从而惠及依赖语音输入的应用程序。
排序理由 该集群包含一篇详细介绍ASR前端新技术方法的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →