Audio8发布了一款新的文本转语音模型Audio8 TTS Preview 0.6B,该模型以其紧凑的尺寸和SOTA级性能而著称。尽管只有0.6亿参数,该模型在基准测试中取得了有竞争力的结果,包括在Seed-TTS基准测试中取得了最佳的英语词错误率(WER)。它支持多语言语音生成和零样本语音克隆,并计划在未来版本中提供更广泛的语言支持。 AI
影响 这款紧凑型TTS模型能够为资源受限环境中的高质量语音生成提供更高效的部署。
排序理由 知名AI实验室(Audio8)发布模型,并附有具体的性能声明。[lever_c_demoted from frontier_release: ic=1 ai=1.0]
在 Hugging Face Trending Models 阅读 →
- Audio8/Audio8-TTS-Preview-0.6b
- Audio8 TTS Preview 0.6B
- AutoArk-AI
- DualAR
- Fish Audio S2 Pro
- Hugging Face
- PyTorch
- safetensors
- soundfile
- torchaudio
- transformers
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →