MiniMax-Music3 MiniMaxAI

类型
model
任务
text-to-audio
框架
diffusers
下载量
5,079
点赞
771
参数量
2,431,905,920
访问
public
文件
88

标签

  • 音频生成
  • 音视频生成
  • 生成式AI
  • 语音合成
  • diffusers
  • 混合专家
  • 推理部署
  • 文生图

摘要

MiniMax Music 3 是 MiniMax 推出的高性能音乐生成模型,可基于歌词和详细音乐描述生成最长5分钟、32kHz立体声的完整歌曲。模型采用分层自回归架构(8B全局LLM处理长程音乐结构,0.6B局部LLM补充帧级声学细节),并结合Flow Matching与Flow-VAE进行连续隐状态合成。它支持细粒度的音乐控制,包括歌曲段落标签、流派、BPM、人声细节和配器演进等,适合用于AI作曲、歌词配乐、音乐创作辅助等场景。

README

--- library_name: diffusers pipeline_tag: text-to-audio tags: - music-generation - text-to-music - pytorch - sglang-omni --- <div align="center"> <img width="100%" src="figures/Music3.png" alt="MiniMax"> </div> <p align="center"> <a href="https://agent.minimax.io/" target="_blank"><img src="https:/…

查看完整页面 · 查看原文