实体
VCTK
VCTK
PulseAugur coverage of VCTK — every cluster mentioning VCTK across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
-
新攻击揭示微调语音合成模型存在严重隐私风险
研究人员开发了一个新的黑盒成员推理攻击(MIA)框架,专门针对微调的文本到语音(TTS)模型。该框架解决了TTS系统固有的查询生成和表示工程方面的挑战。在三个最先进的TTS模型上进行的评估表明,存在显著的隐私泄露,在困难场景下,说话人级别的AUC得分高达1.0,记录级别的AUC得分在0.80到0.90之间。
-
CPU 语音克隆基准测试:Pocket TTS、Kokoro、Audio8、XTTS v2 对比
一项实际基准测试在 CPU 性能上评估了四种语音克隆模型(Pocket TTS、Kokoro、Audio88 & Yassin 和 XTTS v2)。评估重点关注说话人相似度、自然度、清晰度和延迟,使用了具有不同说话人和口音的 VCTK 数据集。研究发现,虽然 XTTS v2 和 Audio88 & Yassin 是真正的零样本克隆模型,但 Kokoro 在自然度方面表现更好,而 Pocket TTS 和 Kokoro 可作为 CPU…