MiniMax 发布 Music3 音乐生成模型,支持生成最长 5 分钟完整歌曲

MiniMax 推出音乐生成模型 MiniMax-Music3,用户输入歌词和音乐描述后,可生成最长 5 分钟的完整歌曲,输出格式为 32kHz、16-bit 立体声 WAV。该模型采用分层自回归架构,由 8B 参数 Global LLM 和 0.6B 参数 Local LLM 协同工作,分别负责长程语义、结构变化及细粒度声学信息建模。官方称,Music3 可保持长音频中的音乐主题、节奏、歌声身份和编曲推进,并覆盖前奏、主歌、副歌、桥段、间奏、尾奏等结构。模型页面和试听示例已在 Hugging Face 上线。

上一篇:

下一篇:

发表回复

登录后才能评论