PulseAugur
实时 15:10:05

新基准数据集面向印度语言的语音技术

研究人员开发了 Indic DiarBench,这是一个旨在改进印度22种官方语言语音技术的新基准数据集。该数据集包含来自各种真实场景的约108小时音频,并附带经过人工校对的、包含说话人归属的转录文本。它旨在解决英语混用和频繁说话人重叠等挑战,并已用于评估现有系统,包括商业API和多模态大型语言模型。 AI

影响 该基准旨在推进针对印度语言的包容性、多语言语音技术研究,有可能为多元化用户群体改进自动语音识别(ASR)和说话人日志系统。

排序理由 该集群描述了在arXiv上发布的新基准数据集和研究论文。[lever_c_demoted from research: ic=1 ai=1.0]

在 arXiv cs.AI 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

新基准数据集面向印度语言的语音技术

报道来源 [1]

  1. arXiv cs.AI TIER_1 English(EN) · Deovrat Mehendale, Aditya Mehndiratta, Dhruv Rathi, Kaushal Bhogale, Mitesh M. Khapra ·

    Indic DiarBench: A Multilingual Joint Diarization and ASR Benchmark for Indian Languages

    arXiv:2607.23808v1 Announce Type: cross Abstract: In this work, we introduce Indic DiarBench, a speaker diarization and ASR benchmark dataset spanning all 22 scheduled languages of India. This corpus comprises approximately 108 hours of natural multi-speaker audio from near-field…