MiniMax Music 3,一个能够生成长达五分钟完整歌曲的新的开源模型已发布。该模型采用混合方法,结合了从 Qwen3-8B 初始化、用于长程结构的 8B 全局 LLM 和用于细粒度声学细节的 0.6B 局部 LLM。它可以根据歌词和详细的音乐描述进行条件生成,产生 32 kHz、16 位立体声 WAV 音频。该模型可通过 SGLang-Omni 和 diffusers 在本地使用,并通过 Hugging Face 和 audio.cpp 等社区项目提供预览和演示。 AI
影响 能够创作更长、更连贯的音乐作品,并具有细粒度控制,可能对音乐制作和 AI 生成内容产生影响。
排序理由 来自知名 AI 实验室 MiniMaxAI 的模型发布。
在 Mastodon — fosstodon.org 阅读 →
- diffusers
- Flow Matching VAE
- MiniMax-Music3
- Qwen3-8B-LLM
- SGLang-Omni
- Flow Matching
- Flow-VAE
- MiniMaxAI/MiniMax-Music3
- MiniMax Music 3
- Qwen3-8B
- ComfyUI
- Hugging Face
- StableDiffusion
- audio.cpp
- MiniMax H3
AI 生成摘要 · Google Gemini · 来自 8 个来源。 我们如何撰写摘要 →