Resemble AI
PulseAugur coverage of Resemble AI — every cluster mentioning Resemble AI across labs, papers, and developer communities, ranked by signal.
2 天有情绪数据
-
AI voice scams targeting elderly surge, cloning voices from 3 seconds of audio
AI-powered voice cloning scams are rapidly increasing, particularly targeting the elderly. These sophisticated frauds can create realistic voice clones from as little as three seconds of audio, often leading victims to …
-
新的深度伪造音频检测器 DETECT-3B-Omni 被证明对内容和人口统计学不敏感
研究人员开发了 DETECT-3B-Omni,这是一种对内容和说话者人口统计学不敏感的深度伪造音频检测器。一项使用来自美国30个州、不同口音的英语说话者的10,240个音频样本的研究,这些样本由8种不同的AI语音克隆系统生成,结果显示,无论说话内容、说话者性别、年龄或地区如何,该检测器的准确率差异最多为2个百分点。这确保了该检测器能够以同等的准确率识别不同说话者和消息的AI生成音频,通过关注声学伪影而非说话者身份或内容来遵守GDPR合规性。
-
新研究通过新颖的蒸馏和测试方法来提升AI鲁棒性 · 跟踪8个来源
研究人员正在探索增强神经网络对抗鲁棒性的新方法。一种名为AD-CERT的方法结合了对抗蒸馏和区间界传播,在鲁棒性基准测试上取得了最先进的认证性能。另一种技术,激活放大与衰减(A3),使用轻量级插件模块动态重缩放激活,以最小的开销提高鲁棒性。此外,研究还调查了输入维度的作用,发现更高维度通常更容易构建和控制对抗样本。来自Resemble AI的Proteus框架通过系统地应用音频转换来自动化音频深度伪造检测器的对抗鲁棒性测试。
-
Resemble AI 发布 Dramabox 具表现力的 TTS 及语音克隆功能
Resemble AI 发布了 Dramabox,一个基于 Lightricks 的 LTX-2 音频分支构建的具表现力的文本转语音模型。该模型利用提示驱动控制说话人身份、情感和语调,并提供使用 10 秒参考音的语音克隆功能。Dramabox 是 LTX-2.3 3.3B 模型的 IC-LoRA 微调版本,以 Gemma 3 12B 文本嵌入为条件。