Supertonic 3
PulseAugur coverage of Supertonic 3 — every cluster mentioning Supertonic 3 across labs, papers, and developer communities, ranked by signal.
- 2026-05-15 product_launch Supertone released Supertonic 3, an on-device text-to-speech model with expanded language support and new expressive features. 来源
- 2026-05-06 product_launch Supertone released Supertonic 3, an on-device text-to-speech model with expanded language support and improved stability. 来源
-
独立开发者发布 Inflect-Micro-v2 紧凑型 TTS 模型
独立开发者 Owen 发布了 Inflect-Micro-v2,一个紧凑型文本到波形语音合成模型。该模型拥有不足 1000 万个参数,可在 CPU 或 CUDA 上实现本地、固定语音的英语 TTS 推理。在人类偏好研究和可懂度测试中表现强劲,优于 KittenTTS Nano 和 Piper Low 等其他紧凑型 TTS 基线模型。
-
纯CPU TTS基准测试:Kokoro 82M在质量上领先,Inflect-Nano-v1在速度上领先
一项在CPU上对三种开源文本转语音(TTS)模型——Kokoro 82M、Supertonic 3和Inflect-Nano-v1——进行的基准测试,揭示了显著的性能和质量差异。Inflect-Nano-v1尽管参数量小且实时因子(RTF)最快达到0.1376,但UTMOS评分发现其被高估,并且存在硬性输出长度限制。Supertonic 3提供了折衷方案,在5步配置下,以0.3164的RTF实现了4.37的MOS评分,而Kokoro …
-
Supertone 发布 Supertonic 3 TTS,支持 31 种语言,内联表达能力
Supertone 推出了 Supertonic 3,这是一个更新的设备端文本转语音模型,现在支持 31 种语言,远超其之前的五种语言。新版本提高了准确性,减少了重复和跳过等错误,并引入了用于内联控制笑声或叹息等情绪的表情标签。尽管功能有所扩展,该模型仍保持紧凑,参数量约为 9900 万,适合在资源受限的设备上部署,无需 GPU。
-
Supertone 发布 Supertonic 3 TTS,支持 31 种语言
Supertone 发布了 Supertonic 3,这是一款设备端文本转语音模型,现支持 31 种语言,较之前支持的 5 种语言有了显著扩展。此更新版本提高了朗读稳定性,减少了重复和跳过等错误,并增强了说话人相似度。Supertonic 3 专为高效的本地推理而设计,可在 CPU 上快速运行,与大型云端系统相比,内存占用更小。