Jieyue(Step)发布了其新一代大型语音模型StepAudio 3系列,包含五个独立模型:StepAudio 3 Realtime、StepAudio 3 ASR、StepAudio 3 TTS、StepAudio 3 Gen和StepAudio 3 Music。这些模型涵盖了实时语音交互、语音识别、逼真语音生成和音乐创作等广泛应用。值得注意的是,其中几款模型在Artificial Analysis基准测试中达到了全球顶尖排名,展示了在对话动态和语音推理等领域的先进能力。 AI
影响 为语音AI能力设定了新的基准,可能加速在实时交互和内容创作领域的应用。
排序理由 重要AI实验室发布新模型并声称达到基准。 [lever_c_demoted from frontier_release: ic=1 ai=1.0]
- Artificial Analysis
- Conversational Dynamics
- Speech Reasoning
- StepAudio 3
- StepAudio 3 ASR
- StepAudio 3 Gen
- StepAudio 3 Music
- StepAudio 3 Realtime
- StepAudio 3 TTS
- Zhang Haipeng
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →