PulseAugur
实时 12:11:20
English(EN) SPEARBench: A Benchmark for Naturalness Evaluation in Streaming Speech-to-Speech Language Models

新的SPEARBench评估流式语音到语音模型的自然度

研究人员推出了SPEARBench,这是一个旨在评估流式语音到语音语言模型自然度的新基准。与传统基准不同,SPEARBench侧重于对话方面,如时机、轮流和情感适宜性。该基准使用来自Seamless Interaction语料库的提示,并从多个维度评估模型,包括延迟、中断和方言一致性。初步结果表明,尽管当前模型表现出高信号质量和低错误率,但在几个关键领域仍未达到人类对话行为的水平。 AI

影响 该基准有望推动语音到语音AI系统对话自然度的改进。

排序理由 该集群描述了一个用于评估AI模型的新学术基准,发布在arXiv上。

在 arXiv cs.AI 阅读 →

AI 生成摘要 · Google Gemini · 来自 3 个来源。 我们如何撰写摘要 →

新的SPEARBench评估流式语音到语音模型的自然度

报道来源 [3]

  1. arXiv cs.AI TIER_1 English(EN) · Thomas Thebaud, Yuzhe Wang, Hao Zhang, Sathvik Manikantan Napa Ugandhar, Ashish Hallur, Georgi Tinchev, Venkatesh Ravichandran, Laureano Moro-Velazquez ·

    SPEARBench:流式语音到语音语言模型自然度评估基准

    arXiv:2607.05365v1 Announce Type: cross Abstract: Streaming speech-to-speech language models aim to answer spoken queries directly with synthetic speech. However, standard speech and text benchmarks do not capture whether these systems behave naturally in conversations, where tim…

  2. arXiv cs.AI TIER_1 English(EN) · Laureano Moro-Velazquez ·

    SPEARBench:流式语音到语音语言模型自然度评估基准

    Streaming speech-to-speech language models aim to answer spoken queries directly with synthetic speech. However, standard speech and text benchmarks do not capture whether these systems behave naturally in conversations, where timing, turn-taking, prosody, interpersonal stance, l…

  3. Hugging Face Daily Papers TIER_1 English(EN) ·

    SPEARBench:流式语音到语音语言模型自然度评估基准

    Streaming speech-to-speech language models aim to answer spoken queries directly with synthetic speech. However, standard speech and text benchmarks do not capture whether these systems behave naturally in conversations, where timing, turn-taking, prosody, interpersonal stance, l…