
AI公司MiniMax于今日推出MiniMax-Music3音乐生成模型。该模型可根据歌词和音乐描述生成最长5分钟的完整歌曲,输出格式为32kHz、16-bit立体声WAV文件,覆盖前奏、主歌、副歌等结构部分。MiniMax-Music3采用分层自回归架构,其中GlobalLLM参数规模为8B,负责长程语义与结构变化;LocalLLM参数规模为0.6B,用于恢复每帧的细粒度声学信息。该模型可在长音频中保持音乐主题、节奏、歌声身份和编曲推进。相关技术细节和使用示例已在其GitHub页面公开。
“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。
Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”