研究人员开发了一种名为dots.tts.edit的新语音编辑模型,该模型采用连续自回归方法。该模型通过类似XML的标签界面实现对编辑的精确控制,通过文本指定操作和目标区域。该系统旨在通过提供对词汇内容、情感表达、音高、语速和时间措辞的控制来改进内容创作,同时保持与现有开源系统相当的音频质量。 AI
影响 为内容创作者提供更精细、更可控的音频编辑。
排序理由 详细介绍新模型和评估套件的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →