实体
Speech Language Model
Speech Language Model
PulseAugur coverage of Speech Language Model — every cluster mentioning Speech Language Model across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
新方法合成伪方言语音以提升SLM性能
研究人员开发了一种新颖的方法,通过合成伪方言语音来提高语音语言模型(SLM)在不同方言上的性能。该方法利用大型语言模型(LLM)生成方言文本,然后使用标准语言的文本到语音(TTS)模型将其转换为语音,从而无需真实的方言语音数据。该方法还在训练期间结合了中间标准文本预测,以规范语义。在日本、德国和中国方言上的评估表明,方言理解能力显著提高,尤其是在语音翻译任务中。
-
新研究探讨语音合成模型中情感引导的几何特性
研究人员提出了一项新研究,探讨了文本到语音(TTS)系统中情感控制的几何特性。该研究将语音语言模型(SLM)和条件流匹配(CFM)模块作为语音合成中引导混合情感的载体。研究结果表明,SLM为情感提供了一个独特、低维度的子空间,具有良好的说话人-情感解耦性,而CFM模块由于说话人和情感表示的纠缠,跨说话人性能较弱。联合引导可以增强情感强度,但可能会降低比例控制和语音质量。