MiniMax-Music3 MiniMaxAI
- 类型
- model
- 任务
- text-to-audio
- 框架
- diffusers
- 下载量
- 5,079
- 点赞
- 771
- 参数量
- 2,431,905,920
- 访问
- public
- 文件
- 88
标签
- 音频生成
- 音视频生成
- 生成式AI
- 语音合成
- diffusers
- 混合专家
- 推理部署
- 文生图
摘要
MiniMax Music 3 是 MiniMax 推出的高性能音乐生成模型,可基于歌词和详细音乐描述生成最长5分钟、32kHz立体声的完整歌曲。模型采用分层自回归架构(8B全局LLM处理长程音乐结构,0.6B局部LLM补充帧级声学细节),并结合Flow Matching与Flow-VAE进行连续隐状态合成。它支持细粒度的音乐控制,包括歌曲段落标签、流派、BPM、人声细节和配器演进等,适合用于AI作曲、歌词配乐、音乐创作辅助等场景。
README
--- library_name: diffusers pipeline_tag: text-to-audio tags: - music-generation - text-to-music - pytorch - sglang-omni --- <div align="center"> <img width="100%" src="figures/Music3.png" alt="MiniMax"> </div> <p align="center"> <a href="https://agent.minimax.io/" target="_blank"><img src="https:/…