实体
TTS Audio Suite
TTS Audio Suite
PulseAugur coverage of TTS Audio Suite — every cluster mentioning TTS Audio Suite across labs, papers, and developer communities, ranked by signal.
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
时间线
最近 · 第 1/1 页 · 共 2 条
-
TTS Audio Suite v5.3 增加 OmniVoice 以实现精确字幕计时
TTS Audio Suite 已更新至 5.3 版本,引入了 OmniVoice,这是一款具有先进原生时长控制功能的文本转语音模型,用于字幕计时。此功能可实现生成音频与 SRT 字幕之间更精确的同步,减少后期调整的需求。此外,还增加了一个新的可视化标签构建器,最初用于帮助 OmniVoice 的指令字段,但已发展成为一个更通用的工具,用于可视化标签和属性的组织,可能有助于图像生成平台的提示。
-
TTS Audio Suite v5 集成 Higgs Audio v3 及运行时隔离
TTS Audio Suite 已更新至 5.0 版本,引入 Higgs Audio v3 作为其主要的文本转语音引擎。该新引擎支持零样本语音克隆和原生内联韵律标签,可增强对语音情感和风格的控制。一项重要的架构变更包括运行时隔离,可防止不同 TTS 引擎之间的依赖冲突,从而允许新模型在保持与旧模型兼容性的同时进行更新。