实体
CV3-Eval
CV3-Eval
PulseAugur coverage of CV3-Eval — every cluster mentioning CV3-Eval across labs, papers, and developer communities, ranked by signal.
总计 · 30天
1
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
Confucius4-TTS:新的零样本 TTS 系统可跨 14 种语言克隆声音
研究人员开发了 Confucius4-TTS,一个新颖的多语言零样本文本到语音系统,能够在无需参考音频转录的情况下跨 14 种语言克隆声音。该系统采用两阶段架构,其中文本到语义模块利用可学习的说话人编码器,语义到声学模块用于梅尔频谱生成。Confucius4-TTS 在跨语言基准测试中表现强劲,在 CV3-Eval 上实现了 3.73% 的词错误率,并在人类评估中排名靠前。
-
阿里云Qwen-Audio-3.0-TTS引领全球语音合成基准
阿里云发布了其Qwen-Audio-3.0-TTS,一款在细粒度控制、指令遵循、多语言支持和声学鲁棒性方面取得显著改进的新型语音合成大模型。该模型有两个版本:用于高质量生成的Qwen-Audio-3.0-TTS-Plus和用于实时交互的Fun-Realtime-TTS。Qwen-Audio-3.0-TTS-Plus已在Artificial Analysis全球排行榜上名列前茅,其预览版此前也曾登顶该榜单。