PulseAugur
中
实时 00:03:45
实体 speech quality predictors

speech quality predictors

PulseAugur coverage of speech quality predictors — every cluster mentioning speech quality predictors across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_268676 ·

    音频大语言模型现可检测不可靠的转录

    研究人员开发了一种方法,使音频大语言模型(LLM)能够识别它们何时无法可靠地转录用户输入。当前方法,包括语音质量预测器和生成不确定性,效果有限。然而,研究发现,LLM中的音频编码器表示强烈指示了转录的可靠性。一种新的、轻量级的预测器使用这些表示来识别不可靠的查询,从而使模型能够在生成错误响应之前向用户请求澄清。该预测器达到了很高的宏F1分数,并展示了跨不同音频LLM家族的可迁移性。