PulseAugur
实时 11:20:34
实体 KVAE-Audio

KVAE-Audio

PulseAugur coverage of KVAE-Audio — every cluster mentioning KVAE-Audio across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 2 条
  1. TOOL · CL_187439 ·

    新的KVAE分词器增强了多模态生成模型

    研究人员推出KVAE,这是一族用于多模态生成模型的分词器,包括专门用于音频、3D视频和2D图像的模型。这些分词器旨在提高文本条件生成任务的学习速度和样本质量。据报道,KVAE模型在各种客观和主观指标上,其性能与现有的开源分词器相当或更优,并且训练细节和代码已公开提供。

  2. TOOL · CL_123983 ·

    kandinskylab发布KVAE-Audio,一款高保真音频自编码器

    kandinskylab发布了KVAE-Audio,一款新的连续全频带音频自编码器。该模型能有效地将原始音频波形压缩成紧凑的潜在表示,并以高保真度重建语音、音乐和通用声音。它被设计用作生成模型的潜在空间,内部测试表明,当KVAE-Audio集成到流程中时,文本到音频生成质量有所提高。