研究人员推出了MRMAD,这是一个旨在评估大型音频语言模型(LALM)理解声学退化能力的新基准。与专注于语义理解的现有基准不同,MRMAD评估LALM在多轮对话中识别、比较和推理音频质量问题的能力。对18种不同LALM的评估显示,当前模型在可靠诊断和比较音频退化方面存在困难,与人类听众相比存在显著差距。 AI
影响 该基准可以推动开发更强大的音频语言模型,使其能够理解现实世界中的声学条件。
排序理由 该集群包含一篇介绍用于评估AI模型的新基准的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →