MiniMax发布音乐生成模型MiniMax-Music3:AI可创作最长5分钟完整歌曲

2026-08-14 17:14:39   |   棠糖   |   4739

8月14日,AI公司MiniMax今日正式推出音乐生成模型MiniMax-Music3,该模型能够根据用户提供的歌词和音乐描述,生成长达5分钟的完整歌曲,输出格式为32kHz、16-bit立体声WAV文件。

在技术架构上,MiniMax-Music3采用分层自回归架构,由两个核心组件协同工作:

- Global LLM(全局语言模型):参数规模为8B,逐帧预测第一个RVQ码本,负责建模歌曲的长程语义与结构变化,如音乐主题、节奏和编曲推进。该模型基于Qwen3-8B初始化,先适配音乐语义词元的嵌入层和输出层,再与Local LLM联合建模全部RVQ码本。

- Local LLM(局部语言模型):参数规模为0.6B,预测每一帧中其余的声学码本,负责恢复细粒度的声学信息,使音乐听感更加丰富真实。

官方表示,MiniMax-Music3能够在长音频中保持音乐主题、节奏、歌声身份和编曲推进的一致性,覆盖前奏、主歌、预副歌、副歌、桥段、器乐间奏和尾奏等完整歌曲结构,向“由用户定义与协同创作的AI音乐创作伙伴”的目标又迈进一步。

值得注意的是,MiniMax已在2026年7月宣布其AI视频生成服务将在未来几个月内并入MiniMax Lab(由前DeepMind科学家领衔的研究团队),但音乐模型MiniMax-Music3的归属目前尚未明确。业界认为,随着AI音乐生成技术的不断成熟,版权与伦理问题将成为该领域下一步亟待解决的关键挑战。

特别提醒:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字、图片等内容的真实性、完整性、及时性本站不作任何保证或承诺,请自行核实相关内容。本站不承担此类作品侵权行为的直接责任及连带责任。如若本网有任何内容侵犯您的权益,请及时发送相关信息至bireading@163.com,本站将会在48小时内处理完毕。

MiniMax发布音乐生成模型MiniMax-Music3:AI可创作最长5分钟完整歌曲

2026-08-14 17:14:39 浏览量: 4739 作者: 棠糖

8月14日,AI公司MiniMax今日正式推出音乐生成模型MiniMax-Music3,该模型能够根据用户提供的歌词和音乐描述,生成长达5分钟的完整歌曲,输出格式为32kHz、16-bit立体声WAV文件。

在技术架构上,MiniMax-Music3采用分层自回归架构,由两个核心组件协同工作:

- Global LLM(全局语言模型):参数规模为8B,逐帧预测第一个RVQ码本,负责建模歌曲的长程语义与结构变化,如音乐主题、节奏和编曲推进。该模型基于Qwen3-8B初始化,先适配音乐语义词元的嵌入层和输出层,再与Local LLM联合建模全部RVQ码本。

- Local LLM(局部语言模型):参数规模为0.6B,预测每一帧中其余的声学码本,负责恢复细粒度的声学信息,使音乐听感更加丰富真实。

官方表示,MiniMax-Music3能够在长音频中保持音乐主题、节奏、歌声身份和编曲推进的一致性,覆盖前奏、主歌、预副歌、副歌、桥段、器乐间奏和尾奏等完整歌曲结构,向“由用户定义与协同创作的AI音乐创作伙伴”的目标又迈进一步。

值得注意的是,MiniMax已在2026年7月宣布其AI视频生成服务将在未来几个月内并入MiniMax Lab(由前DeepMind科学家领衔的研究团队),但音乐模型MiniMax-Music3的归属目前尚未明确。业界认为,随着AI音乐生成技术的不断成熟,版权与伦理问题将成为该领域下一步亟待解决的关键挑战。

,

Copyright ©2018 铋读网 All Rights Reserved.

京ICP备18051707号

京公网安备 11011302001633号