PulseAugur
实时 03:17:04
中文(ZH) AI语音进入“表演时代”:阿里Qwen-Audio-3.0-TTS登顶全球权威榜单

阿里云Qwen-Audio-3.0-TTS引领全球语音合成基准

阿里云发布了其Qwen-Audio-3.0-TTS,一款在细粒度控制、指令遵循、多语言支持和声学鲁棒性方面取得显著改进的新型语音合成大模型。该模型有两个版本:用于高质量生成的Qwen-Audio-3.0-TTS-Plus和用于实时交互的Fun-Realtime-TTS。Qwen-Audio-3.0-TTS-Plus已在Artificial Analysis全球排行榜上名列前茅,其预览版此前也曾登顶该榜单。 AI

影响 为富有表现力和多语言的语音合成树立了新标杆,可能对配音、游戏和实时通信应用产生影响。

排序理由 主要AI实验室(阿里云)发布新模型,并声称具有基准性能。[lever_c_demoted from frontier_release: ic=1 ai=1.0]

在 量子位 (QbitAI) 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

阿里云Qwen-Audio-3.0-TTS引领全球语音合成基准

报道来源 [1]

  1. 量子位 (QbitAI) TIER_1 中文(ZH) · 梦晨 ·

    AI语音进入“表演时代”:阿里Qwen-Audio-3.0-TTS登顶全球权威榜单

    细粒度标签+ 20 种方言