阿里巴巴推出了 Qwen-Audio-3.0-TTS,这是一款在控制、多语言支持和声学鲁棒性方面有显著改进的新型文本转语音模型。该模型有两种版本:用于低延迟实时交互的 Flash 版本和用于高质量生成的 Plus 版本。Qwen-Audio-3.0-TTS-Plus 在人工智能分析语音竞技场排行榜上名列前茅,超越了 Google 和 Speechify 等竞争对手。 AI
影响 为 TTS 质量和控制设定了新的基准,可能影响企业采用和富有表现力的语音合成的进一步研究。
排序理由 主要科技公司(阿里巴巴)发布的新模型,并附有性能声明和基准测试结果。
在 Mastodon — sigmoid.social 阅读 →
- Alibaba
- Artificial Analysis
- Fun-Realtime-TTS
- Qwen-Audio-3.0-TTS
- Qwen-Audio-3.0-TTS-Plus
- Alibaba Cloud Model Studio
- DashScope
- Tongyi Lab
- Speechify
AI 生成摘要 · Google Gemini · 来自 5 个来源。 我们如何撰写摘要 →