PulseAugur
中
实时 13:25:31
实体 speech-to-phoneme (S2P)

speech-to-phoneme (S2P)

PulseAugur coverage of speech-to-phoneme (S2P) — every cluster mentioning speech-to-phoneme (S2P) across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. RESEARCH · CL_286857 ·

    基于音素引导初始化的LLM增强语音识别 · 跟踪2个来源

    研究人员开发了一种新颖的音素引导初始化方法,以提高大型语言模型(LLM)在自动语音识别(ASR)中的性能,尤其是在低资源场景下。该方法在端到端微调之前,先在语音到音素(S2P)任务上预训练音频编码器,在音素到字形(P2G)任务上预训练LLM。在日本、中文、鞑靼语和乌尔都语等多种语言的实验表明,该方法可以媲美或超越现有的级联和端到端ASR模型。此外,在多语言LLM驱动的ASR P2G方面也取得了进展,重点在于处理S2P不确定性和数据不平…