短剧《青梅曾驯龙》剧情说明
2026-08-18 3452841
2026-08-18 0
MiniMax 今日正式发布全新音乐生成模型 MiniMax-Music3,用户仅需输入歌词文本与音乐风格描述,即可一键生成时长可达5分钟的完整歌曲,输出格式为32kHz、16-bit 立体声 WAV 文件。
该模型背后采用创新的分层自回归架构,由两个协同工作的语言模型共同驱动:全局语言模型(Global LLM)参数量为8B,专注于逐帧预测首个RVQ码本,核心任务是建模整首歌曲的宏观语义逻辑与结构性演变——其基座源自 Qwen3-8B,在训练初期首先对嵌入层与输出层进行音乐语义词元适配,随后与局部模型联合优化全部RVQ码本;局部语言模型(Local LLM)参数量精简至0.6B,专司每帧中其余声学码本的精细化预测,逐步还原高保真声学细节。一大一小、一主一副,结构骨架与声音血肉分工明确、高效互补。

据官方介绍,MiniMax-Music3 能在长达数分钟的音频生成过程中,精准维持音乐主题一致性、节奏稳定性、人声身份辨识度及编曲演进逻辑,完整覆盖前奏、主歌、预副歌、副歌、桥段、器乐间奏与尾奏等标准音乐段落结构。目前,项目已在 GitHub 开设专属页面,并同步在 Hugging Face 提供模型权重及多个高质量生成样例供公众试听体验。
地址:https://www.php.cn/link/5850f8234db948fb2374d0b150649ffa