阿里巴巴推出了Qwen-Audio-3.0-TTS,这是一款在控制性、多语言支持和声学鲁棒性方面有显著改进的新型文本到语音模型。该模型有两个版本:Flash版本用于低延迟的实时交互,Plus版本用于高质量生成。Qwen-Audio-3.0-TTS-Plus在Artificial Analysis Speech Arena排行榜上名列前茅,超越了Google和Speechify等竞争对手。 AI
影响 为TTS质量和控制设定了新的基准,可能影响企业采用和富有表现力的语音合成的进一步研究。
排序理由 主要科技公司(阿里巴巴)发布的新模型,并附有性能声明和基准测试结果。
- Alibaba
- Artificial Analysis
- Fun-Realtime-TTS
- Qwen-Audio-3.0-TTS
- Qwen-Audio-3.0-TTS-Plus
- Alibaba Cloud Model Studio
- DashScope
- Tongyi Lab
- Speechify
AI 生成摘要 · Google Gemini · 来自 4 个来源。 我们如何撰写摘要 →