PulseAugur
实时 20:05:05
English(EN) MiniMax Releases MiniMax-Music3: An Open-Weights Music Model Generating Complete Five-Minute Songs From Lyrics and a Structured Caption

MiniMax发布可生成5分钟歌曲的开放权重音乐模型

MiniMax发布了MiniMax-Music3,这是一个开放权重模型,能够根据文本输入生成长达五分钟的完整歌曲。该模型接受带有章节标签的歌词和详细的音乐描述,生成32 kHz、16位立体声WAV音频。其架构结合了混合语言模型(Hybrid-LM),由一个8B的全局LLM和一个0.6B的局部LLM组成,以及一个利用流匹配(flow matching)和Flow-VAE的连续合成栈。MiniMax已公开提供权重、推理代码和服务路径,允许在特定条件下进行商业使用。 AI

影响 使创作者和企业能够从文本生成完整的歌曲,可能影响音乐制作、游戏开发和广告行业。

排序理由 前沿实验室(MiniMax)发布开放权重模型。[lever_c_降级自frontier_release: ic=1 ai=1.0]

在 MarkTechPost 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

MiniMax发布可生成5分钟歌曲的开放权重音乐模型

报道来源 [1]

  1. MarkTechPost TIER_1 English(EN) · Asif Razzaq ·

    MiniMax发布MiniMax-Music3:一个开放权重音乐模型,可根据歌词和结构化描述生成长达五分钟的完整歌曲

    <p>MiniMax released MiniMax-Music3, an open-weights text-to-music model. Given lyrics with section tags and a structured caption, it generates a complete song of up to five minutes in a single pass, as 32 kHz, 16-bit stereo WAV. Here is the architecture, the three serving paths, …