PulseAugur
实时 15:19:05
English(EN) Introducing the Qwen-Audio-3.0-TTS.

阿里巴巴的 Qwen-Audio-3.0-TTS 在 TTS 排行榜上名列前茅

阿里巴巴的 Qwen 团队发布了 Qwen-Audio-3.0-TTS,这是一个新的文本转语音模型,提供实时(Flash)和高质量(Plus)版本。该模型引入了先进的功能,例如用于控制情感和语速的细粒度内联标签、用于风格化生成的自然语言控制、对 16 种语言的支持以及从嘈杂音频生成干净输出的能力。Qwen-Audio-3.0-TTS 还可以在一次运行中生成长达三分钟的长音频,并在 Artificial Analysis TTS 排行榜上名列前茅。 AI

影响 通过对语音情感和语速的高级控制,增强了游戏叙事和互动故事讲述等创意应用。

排序理由 前沿实验室模型发布,附带系统卡。[lever_c_demoted from frontier_release: ic=1 ai=1.0]

在 X — Qwen (Alibaba) 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

阿里巴巴的 Qwen-Audio-3.0-TTS 在 TTS 排行榜上名列前茅

报道来源 [1]

  1. X — Qwen (Alibaba) TIER_1 English(EN) · Alibaba_Qwen ·

    Introducing the Qwen-Audio-3.0-TTS.

    Introducing the Qwen-Audio-3.0-TTS. Our latest text-to-speech model, in two flavors: • Flash: real-time interaction • Plus: high-quality generation What's new: • Fine-grained inline tags-steer [whisper], [angry], [breaths] & [laughs] • Free-style natural-language https://t.…