实体
text prompts
text prompts
PulseAugur coverage of text prompts — every cluster mentioning text prompts across labs, papers, and developer communities, ranked by signal.
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 2 条
-
研究人员发布具有细粒度音色控制的文本到合成器音频模型
一位研究人员开发并发布了一个音频模型,该模型能够为音乐制作生成独特的音效样本,并将文本描述转换为可演奏的合成器。该模型名为 Foundation-1,可以对乐器音色进行细粒度控制,从而在同一乐器类型中实现独特的音质。创作者已在 Hugging Face 上分享了该模型,并提供了 GitHub 上的视频教程和推理流程,以指导其他人创建自己的文本到合成器工具。
-
新框架通过可训练的音频提示增强音频语言模型
研究人员为音频语言模型(ALMs)开发了一个新框架,该框架将可训练的提示直接引入音频编码器。这种方法旨在捕获任务特定的声学特征,通过补充现有的文本端提示学习方法来增强少样本适应性。在11个数据集上的实验表明,当与文本提示调优集成时,这种即插即用模块通常可以提高性能,这表明对音频表示空间进行显式调制是有效的。