研究人员开发了一种新颖的实时音乐界面,可将自然语言描述转换为程序化音景。该系统允许表演者通过直接的参数调整来控制生成的音频,从而创建不断演变的、可表演的声音流,而不是一次性生成。该界面支持多种后端,包括检索式方法以及托管或本地语言模型,所有这些都旨在产生音乐上连贯的输出。使用 LAION-CLAP 指标进行的评估表明,检索式配置的性能优于随机有效配置。 AI
影响 实现了新的交互式音频生成和表演形式,可能影响音乐创作和声音设计工具。
排序理由 详细介绍新语言模型应用的学术论文。[lever_c_降级自研究:ic=1 ai=1.0]
- alphaXiv
- arXiv
- CatalyzeX
- Connected Papers
- DagsHub
- Gotit.pub
- Hugging Face
- LAION-CLAP
- Litmaps
- ScienceCast
- SciTE
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →