lithovas.
2026-08-14 · AI 资讯

MiniMax发布Music3模型,支持5分钟长音频生成

MiniMax发布Music3模型,支持5分钟长音频生成
MiniMax发布Music3模型,支持5分钟长音频生成

MiniMax于今日推出最新音乐生成模型Music3,通过输入歌词与描述,用户可生成时长达5分钟的完整音乐,并以32kHz、16-bit的高保真立体声WAV格式输出。

该模型采用了精巧的分层自回归架构:由参数规模8B的全局语言模型负责把控长程语义、结构演进及主要旋律;而参数为0.6B的局部语言模型则专注于细粒度的声学细节填充。这种“骨架+血肉”的架构设计,确保了长音频在保持音乐逻辑与主题一致性方面的稳定性。

在音乐结构处理上,Music3能够清晰界定主歌、副歌、桥段及间奏等复杂组成部分。目前,MiniMax已在Hugging Face平台公开了模型页面并提供音频示例,为音乐创作辅助领域提供了新的技术选择。