PulseAugur
实时 15:37:41
实体 Vocal Generation

Vocal Generation

PulseAugur coverage of Vocal Generation — every cluster mentioning Vocal Generation across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 1
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 1 条
  1. TOOL · CL_252667 ·

    StepAudio 3 Gen 统一文本转语音、语音设计、音乐和音效

    研究人员推出 StepAudio 3 Gen,这是一种用于通用音频生成的新型离散自回归模型。该模型在一个框架内统一了文本转语音、语音设计、音效和音乐生成等各种音频任务。与之前的基于扩散 Transformer 的模型不同,StepAudio 3 Gen 在残差向量量化 (RVQ) 标记上运行,使其能够联合量化语义和声学特征。该模型在文本转语音和语音设计方面展示了最先进的性能,同时在其他音频领域保持了强大的能力。