一个名为 Neyshekar 的新的开放式波斯语朗读语音语料库已发布,包含超过 62,000 条录音,总计近 100 小时。该语料库旨在涵盖正式和非正式的波斯语、命名实体和较长的发音,由 190 人贡献。数据使用 'shekar' 库进行处理以进行标准化,并包含详细的特征,如录音负荷和信号质量。评估表明,与现有的波斯语数据集相比,Neyshekar 显著降低了 Whisper 和 XLS-R 等自动语音识别架构的词错误率 (WER) 和字符错误率 (CER)。 AI
影响 为改进波斯语 ASR 系统提供了宝贵的资源,有望带来更好的语音接口和转录服务。
排序理由 该项目是一篇学术论文,详细介绍了一个用于语音识别的新数据集。[lever_c_demoted from research: ic=1 ai=1.0]
- arXiv
- Creative Commons CC0 License
- Neyshekar
- Persian
- Persian Common Voice
- PSRBB
- Shekar
- Whisper
- XLS-R: Self-supervised Cross-lingual Speech Representation Learning at Scale
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →