Fernando López
PulseAugur coverage of Fernando López — every cluster mentioning Fernando López across labs, papers, and developer communities, ranked by signal.
2 天有情绪数据
-
ESCUCHA基准发布,用于LALM中的西班牙语语音理解
研究人员推出了ESCUCHA,这是一个旨在专门评估西班牙语大型音频语言模型(LALM)的新基准。该基准解决了在现实的、异构的声学条件下评估LALM的不足之处,并包含了各种西班牙语口音和非标准语音。ESCUCHA包含1000个由人工策划的问题,音频总时长超过160小时,强调跨类别推理能力,并包含多音频问题和口语指令等复杂音频格式。对最先进模型的初步基准测试表明,与人类能力相比存在显著的性能差距。
-
新的西班牙语语音语料库旨在改善神经系统疾病的自动语音识别
研究人员推出了 S-DiverSe,这是一个新的西班牙语语音数据语料库,专门用于改进针对神经系统疾病患者的自动语音识别 (ASR)。该数据集包含 3.2 小时的野外录音,来自 22 名患有肌萎缩侧索硬化症、帕金森病和中风的西班牙语使用者。S-DiverSe 包含 444 个转录的音频片段,并附有说话者特征和病症的元数据,旨在促进针对这一具有挑战性的语音领域的 ASR 开发和评估。初步实验表明,文本后处理方法比微调更能有效地使 ASR …
-
FiLM技术增强了病理性语音的自动语音识别能力
研究人员开发了一种使用特征维度线性调制(FiLM)技术来改进病理性语音自动语音识别(ASR)的新方法。该方法将说话人特定信息注入到冻结的ASR编码器中,使其能够在不改变基础模型权重的情况下适应个体说话人。该方法在西班牙语和英语病理性语音数据集上与现有的适应策略进行了基准测试,显示出具有竞争力的性能,同时保持了回答语音相关问题的能力。