PulseAugur
实时 08:41:34
English(EN) DONDO: Open w2v-BERT Speech-Recognition Base Models for African Languages

为 27 种非洲语言发布开源自动语音识别模型

研究人员推出了 DONDO,这是一系列专门为非洲语言设计的开源自动语音识别 (ASR) 基础模型。这些模型基于 w2v-BERT 2.0 架构构建,包含 21 个单语模型和 5 个多语种模型,覆盖了多个非洲国家的 27 种语言变体。这些模型使用宗教文本和新颖的两步微调程序进行了微调,达到了具有竞争力的词错误率,并使单个多语种模型能够在多种语言上表现良好。 AI

影响 此次发布为代表性不足的语言的 ASR 研究和开发提供了宝贵的开源工具,有可能加速这些地区的人工智能采用。

排序理由 发布了针对多种语言的开源语音识别模型,并在 arXiv 论文中进行了详细介绍。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.CL 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

为 27 种非洲语言发布开源自动语音识别模型

报道来源 [1]

  1. arXiv cs.CL TIER_1 English(EN) · Paul Azunre ·

    DONDO:开源面向非洲语言的 w2v-BERT 语音识别基础模型

    arXiv:2607.21540v1 Announce Type: new Abstract: We present DONDO, a family of open, permissively licensed automatic speech recognition (ASR) base models for African languages, built on the w2v-BERT 2.0 self-supervised speech encoder. DONDO comprises twenty-one monolingual models …