PulseAugur
实时 12:36:39
实体 AVSRBench

AVSRBench

PulseAugur coverage of AVSRBench — every cluster mentioning AVSRBench across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_245695 ·

    新的AVSRBench基准揭示语音识别中的泛化差距

    研究人员开发了AVSRBench,一个旨在评估视听语音识别(AVSR)系统在标准广播语音之外的各种挑战性条件下的新基准。研究发现,当前的AVSR架构在泛化方面存在困难,在涉及过度发音、朗读语音和即兴对话的任务上性能显著下降。视觉理解在侧面视图下也会失效,多模态系统通常严重依赖声学回退。研究强调,说话人的发音比轻微的摄像头移动更关键,基于LLM的架构表现出较差的域外泛化能力。为了促进更好的评估,AVSRBench和统一的数据预处理流程已被引入。