Inflect Micro v2
PulseAugur coverage of Inflect Micro v2 — every cluster mentioning Inflect Micro v2 across labs, papers, and developer communities, ranked by signal.
-
audio.cpp 0.5 增加了 DramaBox TTS、Confucius4 语音转换和 AMD GPU 支持
audio.cpp 项目已发布 0.5 版本,对其文本转语音 (TTS) 和语音转换功能进行了重大更新。一个主要亮点是 DramaBox,一个专为提示词驱动的配音设计的新模型,可控制情感和表达。该版本还推出了 Confucius4-TTS 用于跨语言语音转换,并集成了其他几个模型和 ASR 系统。平台支持的增强功能包括对 AMD GPU 的早期 HIP/ROCm 兼容性以及对 Apple Silicon 的性能改进,同时还改进了直播和摄入功能。
-
Inflect-Micro-v2 AI 模型以 9.36M 参数生成语音
一款名为 Inflect-Micro-v2 的新 AI 模型已发布,它能够以 936 万个参数的紧凑规模生成完整的语音。该模型可在 Hugging Face 上找到,其详细信息和讨论也在 Mastodon 和 Hacker News 等平台上分享。
-
Inflect v2:发布用于本地使用的超小型 TTS 模型
一位开发者发布了 Inflect v2,这是一对专为本地执行设计的超小型文本转语音 (TTS) 模型。Inflect-Nano-v2 参数量为 396 万,Inflect-Micro-v2 参数量为 936 万,它们是完整的 TTS 系统,无需外部 vocoder 或独立模型。这些模型比其他 TTS 系统小得多,Nano 比 Fish Audio S2 Pro 小一千多倍。尽管体积小,它们在语音质量和推理速度方面仍取得了有竞争力的性能…
-
新紧凑型TTS模型Inflect-Micro-v2和Inflect-Nano-v2发布
Owen独立开发并资助了Inflect-Micro-v2和Inflect-Nano-v2,这是两个新的文本到波形语音合成模型。这些模型专为本地、固定语音的英语TTS设计,优先考虑参数少于1000万(Micro)的质量,或参数少于400万(Nano)的更小占用空间。在人类偏好研究和可懂度测试中,这两个模型都表现出具有竞争力的性能,同时还提供快速的CPU推理。