MiniMax Music3发布 AI歌曲最长5分钟
时间:2026年8月14日
地点:上海
人物:MiniMax
事件详情:AI公司MiniMax今日发布音乐生成模型MiniMax-Music3,可根据歌词和音乐描述生成最长5分钟的完整歌曲。该模型采用分层自回归架构:8B参数的Global LLM基于Qwen3-8B初始化,逐帧预测歌曲长程语义与结构;0.6B参数的Local LLM负责恢复细粒度声学信息。生成歌曲为32kHz、16-bit立体声WAV格式,覆盖前奏、主歌、副歌、桥段、器乐间奏等完整结构。
背景:音乐生成模型此前普遍只能生成30秒至3分钟的片段,完整歌曲生成能力是行业难点。MiniMax通过分层架构首次在长音频中保持音乐主题、节奏、歌声身份和编曲推进的一致性。
影响:MiniMax Music3已在GitHub和HuggingFace开源,ModelScope同步上线,开发者可免费使用。
总结:MiniMax推出Music3音乐模型,通过分层自回归架构实现最长5分钟完整歌曲生成,填补了AI音乐领域长音频生成的短板。
参考来源:
1. https://www.ithome.com/0/989/722.htm
2. https://github.com/MiniMax-AI/MiniMax-Music3
3. https://huggingface.co/MiniMaxAI/MiniMax-Music3
4. https://minimax-ai.github.io/music3-demo/
5. https://modelscope.cn/organization/minimax









