Artificial Analysis TTS leaderboard
PulseAugur coverage of Artificial Analysis TTS leaderboard — every cluster mentioning Artificial Analysis TTS leaderboard across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
Breeze-TTS-2:开源TTS模型声称达到前沿性能
Breeze-TTS-2 是一款专为实时交互设计的新型开源文本转语音模型。它在 Artificial Analysis TTS 排行榜上名列开源TTS模型之首,并据称超越了专有系统。该模型支持自然语言指令进行语音设计,并提供超低延迟流式传输,以实现响应迅速且富有表现力的音频输出。它可供本地使用,约需 7GB 存储空间。
-
阿里巴巴的 Qwen-Audio-3.0-TTS 在 TTS 排行榜上名列前茅
阿里巴巴的 Qwen 团队发布了 Qwen-Audio-3.0-TTS,这是一个新的文本转语音模型,提供实时(Flash)和高质量(Plus)版本。该模型引入了先进的功能,例如用于控制情感和语速的细粒度内联标签、用于风格化生成的自然语言控制、对 16 种语言的支持以及从嘈杂音频生成干净输出的能力。Qwen-Audio-3.0-TTS 还可以在一次运行中生成长达三分钟的长音频,并在 Artificial Analysis TTS 排行榜上名列前茅。
-
Google DeepMind 发布 Gemini 3.1 Flash TTS、Live 和 Lite 模型
Google DeepMind 推出了一系列 Gemini 3.1 Flash 模型,包括用于高级文本到语音的 Flash TTS、用于实时对话的 Flash Live 以及用于成本高效、大批量工作负载的 Flash-Lite。这些模型提供了改进的自然度、表现力和速度,其中 Flash TTS 在语音质量基准测试中获得了高 Elo 分数,Flash Live 在复杂任务完成方面表现强劲。TTS 和 Live 模型生成的所有音频都使用 …