实体
Speech Foundation Models
Speech Foundation Models
PulseAugur coverage of Speech Foundation Models — every cluster mentioning Speech Foundation Models across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
新的 VQ-Bench 评估揭示语音基础模型中的偏见
一个名为 VQ-Bench 的新评估套件已被开发出来,用于评估语音基础模型(SFMs)如何解读语音中的细微变化,而不仅仅是所说的词语。研究人员发现,一些领先的商业 SFMs 未能通过基本的生物识别检查,而另一些则根据气声或嘎裂声等发声类型,在感知到的主动性、同理心和领导力方面表现出偏见。研究还揭示了性别在薪资和领导力认可方面的不对称性,表明 SFMs 可能会延续或放大现有的社会偏见。
-
SpeechLLMs在翻译基准测试中表现参差不齐,级联系统仍占主导地位
一项新的综合测试套件“Hearing to Translate”已被开发出来,用于评估将语音模态直接集成到大型语言模型(LLMs)中进行语音到文本翻译的有效性。该研究将六个最先进的SpeechLLMs与十六个级联系统进行了基准测试,分析了在16个基准、13种语言对和9种挑战性条件下的性能。研究结果表明,虽然级联系统总体上仍然最可靠,但最近的SpeechLLMs在特定场景下可以与之匹敌甚至超越它们,而独立的Speech Foundati…