阿里云发布了其Qwen-Audio-3.0-TTS,一款在细粒度控制、指令遵循、多语言支持和声学鲁棒性方面取得显著改进的新型语音合成大模型。该模型有两个版本:用于高质量生成的Qwen-Audio-3.0-TTS-Plus和用于实时交互的Fun-Realtime-TTS。Qwen-Audio-3.0-TTS-Plus已在Artificial Analysis全球排行榜上名列前茅,其预览版此前也曾登顶该榜单。 AI
影响 为富有表现力和多语言的语音合成树立了新标杆,可能对配音、游戏和实时通信应用产生影响。
排序理由 主要AI实验室(阿里云)发布新模型,并声称具有基准性能。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
- Alibaba Group
- Artificial Analysis
- CV3-Eval
- Fun-Realtime-TTS
- Qwen-Audio-3.0-TTS
- Qwen-Audio-3.0-TTS-Plus
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →