Supertonic 3
PulseAugur coverage of Supertonic 3 — every cluster mentioning Supertonic 3 across labs, papers, and developer communities, ranked by signal.
- 2026-05-15 product_launch Supertone released Supertonic 3, an on-device text-to-speech model with expanded language support and new expressive features. 来源
- 2026-05-06 product_launch Supertone released Supertonic 3, an on-device text-to-speech model with expanded language support and improved stability. 来源
-
新紧凑型TTS模型Inflect-Micro-v2和Inflect-Nano-v2发布
Owen独立开发并资助了Inflect-Micro-v2和Inflect-Nano-v2,这是两个新的文本到波形语音合成模型。这些模型专为本地、固定语音的英语TTS设计,优先考虑参数少于1000万(Micro)的质量,或参数少于400万(Nano)的更小占用空间。在人类偏好研究和可懂度测试中,这两个模型都表现出具有竞争力的性能,同时还提供快速的CPU推理。
-
纯CPU TTS基准测试:Kokoro 82M在质量上领先,Inflect-Nano-v1在速度上领先
一项在CPU上对三种开源文本转语音(TTS)模型——Kokoro 82M、Supertonic 3和Inflect-Nano-v1——进行的基准测试,揭示了显著的性能和质量差异。Inflect-Nano-v1尽管参数量小且实时因子(RTF)最快达到0.1376,但UTMOS评分发现其被高估,并且存在硬性输出长度限制。Supertonic 3提供了折衷方案,在5步配置下,以0.3164的RTF实现了4.37的MOS评分,而Kokoro …
-
Supertone 发布 Supertonic 3 TTS,支持 31 种语言,内联表达能力
Supertone 推出了 Supertonic 3,这是一个更新的设备端文本转语音模型,现在支持 31 种语言,远超其之前的五种语言。新版本提高了准确性,减少了重复和跳过等错误,并引入了用于内联控制笑声或叹息等情绪的表情标签。尽管功能有所扩展,该模型仍保持紧凑,参数量约为 9900 万,适合在资源受限的设备上部署,无需 GPU。
-
Supertone 发布 Supertonic 3 TTS,支持 31 种语言
Supertone 发布了 Supertonic 3,这是一款设备端文本转语音模型,现支持 31 种语言,较之前支持的 5 种语言有了显著扩展。此更新版本提高了朗读稳定性,减少了重复和跳过等错误,并增强了说话人相似度。Supertonic 3 专为高效的本地推理而设计,可在 CPU 上快速运行,与大型云端系统相比,内存占用更小。