研究人员开发了一种新颖的儿童语音音素识别方法,将年龄感知训练融入轻量级模型。该方法在预测音素序列的同时预测儿童的年龄,使得一个拥有9400万参数的模型能够超越更大的WavLM Large模型,并达到接近更大规模的竞争性集成模型的性能。由此产生的应用程序PhonemeTrainer可以在手机上运行,为儿童提供注重隐私且合规的自动语音识别和发音辅助。 AI
影响 为儿童提供更易于访问和注重隐私的语音识别工具。
排序理由 详细介绍新模型和应用程序的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →